之前在微信里体验过的功能,图片里的文字可以直接识别、选择、复制。感觉这个交互放到浏览器里应该也挺方便,所以自己做了一个 Chrome 插件 SelectSight 。 使用比较简单: 把鼠标移到网页里的图片上,就会自动开始本地识别 ,识别过程中右上角会有一个 loading 动画。 速度主要取决于图片大小: 小图基本没什么感觉,比较大的图片可能需要稍微等一会儿。 识别完成后,就可以直接选择图片里的文字进行复制。也支持快捷键截图进行识别。 目前主要分成两部分: 本地识别:免费 使用 Paddle OCR 图片不会上传服务器 适合普通文字识别和复制 只输出纯文本,不保留原来的格式 增强识别:收费 适合公式、表格、代码、文档等内容 会尽量保留原始结构和格式 支持 Markdown 、Word 等格式的预览和导出 需要上传图片到服务器处理,图片只用于当次识别,不做保存 确实现在类似的 OCR 插件确实已经很多了,但主要还是想把体验做得更无感一些: 看到图片 → 鼠标移上去 → ...