Skip to content
TopicTracker
来自 HackerNews查看原文
译文语言译文语言

Show HN: 互联网档案馆书籍的原地OCR + 翻译工具

Bookxlate是一款Chrome扩展,利用Google Gemini API对互联网档案馆(Internet Archive)的书籍进行即时OCR识别和翻译。用户无需下载图片、切换窗口或使用第三方软件,只需在浏览器中直接阅读。该扩展解决了档案馆转录不准确且缺乏翻译功能的问题,但需要用户自行提供Gemini API密钥。

背景速读

- Internet Archive 是一个大型非营利数字图书馆,收录了数百万册扫描版图书(包括古籍、绝版书等)。但它自带的 OCR(光学字符识别)质量参差不齐,且完全没有翻译功能。 - Google Gemini API 是 Google 最新的大语言模型接口(类似 ChatGPT 的 API),可同时处理 OCR 和翻译两项任务,无需像传统流程那样分别调用不同工具。 - Bookxlate 是一个 Chrome 浏览器扩展,用户在 Internet Archive 的书页上直接呼出翻译结果,无需下载图片、切换窗口或使用第三方软件。用户需要自备 Gemini API 密钥(有免费额度)。 - 该项目本身主要由 Claude(竞争对手 AI 模型)编写代码,翻译则由 Gemini 完成——作者对此做了免责声明,提示用户自行评估效果。