BookHalo BookHalo

Kindleに文字起こしが必要な理由。ハイライトとスクショでは、AIは読めない

KindleをAIに読ませようとすると、たいてい「ハイライトを書き出す」か「画面をスクショしてPDFにする」に行き着きます。どちらもうまくいきません。前者は線を引いた箇所しか残らないから。後者は1冊ぶんの重さに耐えられないからです。

先に結論: 画像のままのPDFは、数ページなら読めるAIもありますが、1冊ぶんになると重すぎて通りません。ハイライトは、引かなかった箇所が残りません。本文の全文をテキストにして渡すのが、唯一まともに効く形です。

4つの渡し方を比べる

AIに本を読ませる方法は、実質4つしかありません。精度が出るのは最後の1つだけです。

渡すものできることできないこと
書名だけ伝える それっぽい要約 手元の版とは章立ても訳語も違う。マイナーな本ほど嘘が混ざる
ハイライトのエクスポート 線を引いた箇所の整理・言い換え 引いていない箇所への質問。章全体の要約
スクショ・画像のままのPDF 図やレイアウトを見せる。数ページなら読み取れるAIもある 1冊ぶんは重すぎて通らない。何も返さないAIもある
全文テキスト 任意の箇所への質問。章単位の要約。通しの論旨 図表そのものの解釈(画像は別に要る)

スクショを撮ってPDFにすればいいのでは?

数ページなら通ります。1冊ぶんは通りません。実際に確かめました。

『夢十夜』のページ画像だけで作った19ページのPDF(テキスト層なし・4.8MB)を、同じ質問で2つのAIに渡しました。Claudeは本文を正確に引用して答えました。「爪立てるように、抜足をするように、手拭に遠慮をするように、廻った」という一文まで、原文どおりです。一方でChatGPTは、1分45秒考えたあと、3回とも何も返しませんでした。

つまり「AIは画像の文字を読めない」は、もう正確ではありません。読めるAIがあります。

それでも本1冊は渡せない

効くのは精度ではなく量です。

19ページ300ページに換算
画像のままのPDF4.8MB75MB前後
全文テキスト48KB約750KB

同じ中身で100分の1です。300ページの本を画像で渡そうとすると、多くのAIのアップロード上限を超えます。通ったとしても、1ページずつ画像を読ませることになるので時間がかかり、途中で切られます。

自動でスクショを撮るツールを使っても、同じです

ページをめくりながら撮影までまとめてこなすツールはいくつもあります。撮る手間は消えますが、できあがるのは枚数の増えた画像PDFで、重さの問題はむしろ悪化します。片付いているのは「撮る」ところだけで、「文字にする」工程は別にあります。

OCRを通すと、100分の1になる

画像から文字を取り出す処理をOCR(光学文字認識)と呼びます。ここを通すと、本1冊がテキストファイル1つに収まります。そうなって初めて、章をまたいだ質問にも、通しの論旨にも答えられるようになります。

日本語の本では、ここが素直に進みません。縦書き、ルビ、旧字、二段組み。英語向けの設定のまま通すと、行が混ざったり、ルビが本文に紛れ込んだりします。

ハイライトでは、引かなかった箇所が残らない

ハイライトは断片です。刺さった一文だけでは、その前後にあった前提、反論、具体例、結論が抜け落ちます。

特にビジネス書、技術書、思想書、研究系の本は、一文だけでは使いにくいです。著者が何を前提にして、どこで例を出し、どこで結論へ進んだのか。そこまで含めて初めて、読書メモとして使える形になります。

ハイライト中心

  • 刺さった一文を残す
  • あとで見返す
  • なぜ重要だったかを思い出す必要がある
  • AIには断片しか渡せない

文脈ごとのAI読書

  • 章や本全体の流れを残す
  • あとから質問できる
  • 主張、根拠、反論を分けられる
  • ChatGPTやNotebookLMで再利用できる
Kindle本を全文テキストにして、AI読書メモとして参照できる形に変える流れの図
一文の保存ではなく、章の流れごとAIツールで参照しやすいと、読書メモの質が変わる。

全文を渡したら、まず聞きたいこと

ハイライトを増やすより、本文の流れを渡してから、こう聞いた方が読書メモとして使いやすいです。

この章について、以下を分けて整理してください。

- 著者の主張
- 主張を支える具体例
- 前提になっている考え方
- 反論されそうな点
- 自分があとで考えるべき問い

この聞き方なら、ただの要約ではなく、自分が考えるための材料になります。

本の全文テキストをAIに渡し、要約から行動リストへ変換する流れの図
文脈があると、要約から行動、比較、問いの整理まで進めやすい。

NotebookLMなら、音声や動画にも広げられる

NotebookLMに本のテキストを入れると、質問できるだけではありません。音声解説、動画解説、スライド資料のように、読んだ本を別の形へ変えることもできます。

ハイライトだけでは、この広げ方が難しいです。NotebookLMが強いのは、ソース全体を前提にして、作品や本の構造を扱えるところです。

文字起こしの精度で、見るところ

OCRは完璧ではありません。ただ、AI読書に使う分には完璧である必要もありません。要約や質問に答えるうえでは、文脈が残っていれば数文字の誤変換は吸収されます。

気にするべきなのは、精度そのものよりどこで崩れるかです。縦書きで行が混ざる、ルビが本文に入り込む、見開きで段落が途切れる。この3つが起きていなければ、実用上は足ります。

正確な引用が必要なときだけ、元のページと突き合わせてください。参照用のPDFを一緒に持っておくと、その照合が早く済みます。

BookHaloの役割

BookHaloは、ハイライト管理アプリではありません。Kindle Cloud Readerで開いた本を文字起こしして、ChatGPTやNotebookLMに渡しやすいテキスト素材にするためのChrome拡張です。撮ることとOCRを通すことを、まとめて片付けます。

読書メモをAIで作りたいなら、最初に必要なのは凝ったプロンプトではなく、本をAIが読める形で持っておくことです。

実際の流れ

  1. Kindle Cloud Readerで本を開く
  2. BookHaloで実行する(1ページ約10秒)
  3. ZIPの中の書名がついたテキストファイル(例: 夢十夜.txt)をChatGPTやNotebookLMに入れる
  4. 要約、問い、比較、音声解説などに広げる

AIに読ませる全体の流れを見る

注意点

自分が正当にアクセスできる本を、自分用の読書メモや学習のために使う前提で考えるのが安全です。本文をそのまま公開したり、他人に配ったりする用途には向きません。

BookHaloはChrome Web Storeで公開中です。Kindle Cloud Readerで閲覧できる本を全文テキストと参照用PDFにして、ChatGPTやNotebookLMで個人用の読書メモとして参照しやすくできます。

Chrome Web StoreでBookHaloを開く

よくある質問

Kindleのスクショを撮ってAIに読ませればいいのでは?

画面を撮っただけのPDFでも、ページ数が少なければ読み取れるAIがあります。実際に19ページの画像PDFで試したところ、Claudeは本文を正確に引用して答えましたが、ChatGPTは3回とも何も返しませんでした。問題は量です。同じ19ページで画像PDFは4.8MB、全文テキストは48KB。100分の1です。300ページの本を画像で渡すと75MB前後になり、多くのAIの上限を超えます。

Kindleを自動でスクショするツールを使えば解決しますか?

解決しません。自動化されるのは撮る工程だけで、できあがるのは枚数の増えた画像PDFです。枚数が増えるほどファイルは重くなり、1冊ぶんではAIの上限を超えます。テキストにするにはOCRが別に要ります。

KindleのOCRは日本語の縦書きでも使えますか?

使えます。ただし英語向けの設定のまま通すと、行が混ざったりルビが本文に紛れ込んだりします。縦書き・ルビに対応した処理が必要です。

ハイライトのエクスポートだけでは足りませんか?

足りません。ハイライトに残るのは線を引いた箇所だけで、本文全体は残りません。章全体の要約や、引いていない箇所への質問には答えられません。