Show HN: Internet Archiveの書籍をその場でOCR&翻訳する「Bookxlate」
Bookxlateは、Internet Archiveの書籍をブラウザ上で直接OCR・翻訳できるChrome拡張機能。画像のダウンロードやウィンドウの切り替えといった面倒な作業は不要。Google Gemini APIを利用してラテン語などの古い書籍をリアルタイムで翻訳・読解できる。
背景メモ
Internet Archive(archive.org)は、書籍・音源・動画などを無料で公開する非営利デジタル図書館。古書や絶版本のスキャン画像を多数所蔵しているが、OCR(画像からの文字認識)精度が低く、とくにラテン語などの歴史的言語ではほぼ使えない。既存の翻訳ツールは画像をダウンロード→OCR→コピペ→翻訳という手作業が必要で、ページ数の多い書籍には実用的でなかった。
- BookxlateはChrome拡張機能。Internet Archiveの書籍ビューア上で、選択した領域をその場でOCRし英訳する(Google Gemini API利用)。
- ユーザー自身でGemini APIキーを取得する必要がある(無料枠あり)。
- コードはClaude(Anthropic)がほぼ生成、翻訳はGeminiが担当。作者は「粗悪品の恐れあり」と注意書きしている。
- 「Show HN」はHacker Newsで自分のプロジェクトを紹介するタグ。技術コミュニティからのフィードバックを求める場。