Text Extractor 使你可以从屏幕上的任意位置(包括图像或视频内部)复制文本。 此代码基于 Joe Finney 的 Text Grab

使用激活快捷方式(默认: ⊞ Win + Shift + T ),屏幕上将显示覆盖区。 单击并按住主鼠标按钮,然后拖动以激活捕获。 文本将保存到剪贴板。

捕获模式在选定区域中的文本被识别并复制到剪贴板后立即停用。 可以随时按 Esc 退出捕获模式。

尝试捕获时调整

通过按住 Shift ,你将从调整捕获区域的大小更改为移动捕获区域。 释放 Shift 时,你将能够再次调整大小。

  • 生成的文本可能并不完美,因此必须快速校对输出进行校对。
  • 此工具使用 OCR (光学字符识别) 来读取屏幕上的文本。
  • 使用的默认语言将基于 系统Windows语言>键盘设置 , (OCR 语言包可用于安装) 。
  • 从“设置”菜单中,可以配置以下选项:

    Text Extractor 只能识别已安装 OCR 语言包的语言。

    可以通过运行以下命令通过 PowerShell 获取列表:

    [Windows.Media.Ocr.OcrEngine, Windows.Foundation, ContentType = WindowsRuntime]
    
    [Windows.Media.Ocr.OcrEngine]::AvailableRecognizerLanguages
    

    如何查询 OCR 语言包

    若要返回支持语言包的列表,请以管理员身份打开 PowerShell (右键单击,然后选择“以管理员身份运行”) ,然后输入以下命令:

    Get-WindowsCapability -Online | Where-Object { $_.Name -Like 'Language.OCR*' }
    

    示例输出:

    Name  : Language.OCR~~~el-GR~0.0.1.0
    State : NotPresent
    Name  : Language.OCR~~~en-GB~0.0.1.0
    State : NotPresent
    Name  : Language.OCR~~~en-US~0.0.1.0
    State : Installed
    Name  : Language.OCR~~~es-ES~0.0.1.0
    State : NotPresent
    Name  : Language.OCR~~~es-MX~0.0.1.0
    State : NotPresent
    

    语言和位置是缩写的,因此“en-US”为“英语-美国”,“en-GB”为“English-Great Britain”。 如果某个语言在输出中不可用,则 OCR 不支持该语言。

    如何安装 OCR 语言包

    以下命令为“en-US”安装 OCR 包:

    $Capability = Get-WindowsCapability -Online | Where-Object { $_.Name -Like 'Language.OCR*en-US*' }
    
    $Capability | Add-WindowsCapability -Online
    

    如何删除 OCR 语言包

    以下命令删除“en-US”的 OCR 包:

    $Capability = Get-WindowsCapability -Online | Where-Object { $_.Name -Like 'Language.OCR*en-US*' }
    
    $Capability | Remove-WindowsCapability -Online
    

    本部分将列出可能的错误和解决方案。

    “未安装任何可能的 OCR 语言。”

    当没有可用于识别的语言时,将显示此消息。

    如果 OCR 包受支持并安装,但仍不可用,并且系统驱动器 X: 不同于“C:”,请将文件夹C:/Windows/OCR复制到 X:/Windows/OCR 以解决此问题。