PowerToys 文本提取器:3 步把屏幕文字变可复制
【免费下载链接】PowerToysMicrosoft PowerToys is a collection of utilities that supercharge productivity and customization on Windows项目地址: https://gitcode.com/GitHub_Trending/po/PowerToys
PowerToys 文本提取器(Text Extractor)解决一个很具体的问题:屏幕上的文字无法复制。它是微软开源的 Windows 效率工具集 PowerToys 里的一个模块,用 OCR 识别你框选的屏幕区域,把识别结果直接放进剪贴板。
文本提取器的选区与提取过程
🧰 能力速览
屏幕任意框选— 图片、视频帧、应用界面里的文字都能选中提取,不限于文本框
多语言识别— 基于 Windows 系统内置 OCR,识别哪些语言取决于你装的语言包
快捷键秒开— 一个组合键弹出选区遮罩,全程不用打开任何窗口
多显示器支持— 每一块屏幕都能弹出选区画布
结果直达剪贴板— 提取完成即可 Ctrl+V 粘贴,中间没有多余步骤
🚀 走一遍
- 安装 PowerToys 并在设置里启用「文本提取器」。从仓库源码安装的话,先克隆再编译:
git clone https://gitcode.com/GitHub_Trending/po/PowerToys- 按默认快捷键Win + Shift + O,屏幕变暗,进入选区模式。
- 用鼠标拖出包含文字的矩形区域,松开后识别结果自动写入剪贴板。
- 切到目标应用,Ctrl+V,文字已经在那里。
💡 小技巧:设置里可以切换识别语言。混合中英文的页面如果识别得不好,先明确指定一种语言再试。
多显示器场景下,每一块屏幕都会弹出选区画布,光标在哪块屏上就在那块屏上框。
框选屏幕区域,识别结果直接进剪贴板
🎯 它最擅长的三个场景
视频字幕:暂停在线课程,框住字幕条,把整段文字变成笔记。暂停截图加第三方 OCR 要三步,这里一步,而且不用离开播放器。
图片和扫描文档:照片、扫描件、图片型 PDF 里的文字本来就不存在"选中"这个概念,文本提取器直接把它们变成可粘贴的文本,省去了上传 OCR 网站的环节。
抄不走的对话框:报错弹窗、终端输出、只读提示框,右键菜单里没有"复制"。框一下,文本就在剪贴板里了。
⚙️ 它是怎么做到的
模块收到激活事件后,在每个显示器上盖一层半透明遮罩,你框出的矩形由CopyFromScreen截成位图,交给 Windows OCR 引擎识别;识别出的文字按行重排后写入剪贴板。整个识别过程不阻塞界面。
模块源码在 src/modules/PowerOCR/,其中PowerOCR.Core/Ocr/WindowsOcrRecognizer.cs是识别入口,PowerOCR.Core/Formatting/OcrTextFormatter.cs负责把识别结果整理成可读文本。
🔧 常用配置
| 配置项 | 默认值 | 什么时候需要改 |
|---|---|---|
| 激活快捷键 | Win + Shift + O | 与其他软件冲突时,在设置里换个组合键 |
| 首选语言 | 空(自动) | 指定语种可提升特定文本的识别率 |
| 模块开关 | 随安装开启 | 不使用时可关掉,快捷键即失效 |
识别结果只会进剪贴板,这是固定行为,没有可配置的输出格式。
🛠️ 解决识别不准和激活失败
快捷键按了没反应→ 组合键被别的工具(输入法、其他效率软件)占用 → 到 PowerToys 设置的文本提取器页改一个不冲突的组合键。
中文识别率低→ 系统缺少对应语言包 → 到 Windows 设置的"时间和语言"里安装相应语言包,OCR 依赖系统语言资源。
选区里没文字或大片空白→ 框到了纯图标、装饰图或分辨率过低的小字 → 把区域框得更大更清楚一些,字越糊识别越差。
更完整的架构说明在官方文档 doc/devdocs/modules/textextractor.md。
文本提取器做的事其实就一件:30 秒内把屏幕上任何位置的可见文字变进你的剪贴板。接下来可以试试把快捷键换成自己的习惯组合,或者打开src/modules/PowerOCR/看看识别结果是怎么重排进剪贴板的。
【免费下载链接】PowerToysMicrosoft PowerToys is a collection of utilities that supercharge productivity and customization on Windows项目地址: https://gitcode.com/GitHub_Trending/po/PowerToys
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考