Kindleに文字起こしが必要な理由。ハイライトとスクショでは、AIは読めない
KindleをAIに読ませようとすると、たいてい「ハイライトを書き出す」か「画面をスクショしてPDFにする」に行き着きます。どちらもうまくいきません。前者は線を引いた箇所しか残らないから。後者は1冊ぶんの重さに耐えられないからです。
4つの渡し方を比べる
AIに本を読ませる方法は、実質4つしかありません。精度が出るのは最後の1つだけです。
| 渡すもの | できること | できないこと |
|---|---|---|
| 書名だけ伝える | それっぽい要約 | 手元の版とは章立ても訳語も違う。マイナーな本ほど嘘が混ざる |
| ハイライトのエクスポート | 線を引いた箇所の整理・言い換え | 引いていない箇所への質問。章全体の要約 |
| スクショ・画像のままのPDF | 図やレイアウトを見せる。数ページなら読み取れるAIもある | 1冊ぶんは重すぎて通らない。何も返さないAIもある |
| 全文テキスト | 任意の箇所への質問。章単位の要約。通しの論旨 | 図表そのものの解釈(画像は別に要る) |
スクショを撮ってPDFにすればいいのでは?
数ページなら通ります。1冊ぶんは通りません。実際に確かめました。
『夢十夜』のページ画像だけで作った19ページのPDF(テキスト層なし・4.8MB)を、同じ質問で2つのAIに渡しました。Claudeは本文を正確に引用して答えました。「爪立てるように、抜足をするように、手拭に遠慮をするように、廻った」という一文まで、原文どおりです。一方でChatGPTは、1分45秒考えたあと、3回とも何も返しませんでした。
つまり「AIは画像の文字を読めない」は、もう正確ではありません。読めるAIがあります。
それでも本1冊は渡せない
効くのは精度ではなく量です。
| 19ページ | 300ページに換算 | |
|---|---|---|
| 画像のままのPDF | 4.8MB | 75MB前後 |
| 全文テキスト | 48KB | 約750KB |
同じ中身で100分の1です。300ページの本を画像で渡そうとすると、多くのAIのアップロード上限を超えます。通ったとしても、1ページずつ画像を読ませることになるので時間がかかり、途中で切られます。
自動でスクショを撮るツールを使っても、同じです
ページをめくりながら撮影までまとめてこなすツールはいくつもあります。撮る手間は消えますが、できあがるのは枚数の増えた画像PDFで、重さの問題はむしろ悪化します。片付いているのは「撮る」ところだけで、「文字にする」工程は別にあります。
OCRを通すと、100分の1になる
画像から文字を取り出す処理をOCR(光学文字認識)と呼びます。ここを通すと、本1冊がテキストファイル1つに収まります。そうなって初めて、章をまたいだ質問にも、通しの論旨にも答えられるようになります。
日本語の本では、ここが素直に進みません。縦書き、ルビ、旧字、二段組み。英語向けの設定のまま通すと、行が混ざったり、ルビが本文に紛れ込んだりします。
ハイライトでは、引かなかった箇所が残らない
ハイライトは断片です。刺さった一文だけでは、その前後にあった前提、反論、具体例、結論が抜け落ちます。
- あとから見返しても、なぜその行を残したか思い出せない
- 一文だけだと、著者の主張が強く見えすぎる
- 反論や条件が抜けて、雑な要約になりやすい
- ChatGPTに渡しても、前後の文脈が足りず薄い回答になる
- 複数冊を比較しようとしても、断片同士の比較になってしまう
特にビジネス書、技術書、思想書、研究系の本は、一文だけでは使いにくいです。著者が何を前提にして、どこで例を出し、どこで結論へ進んだのか。そこまで含めて初めて、読書メモとして使える形になります。
ハイライト中心
- 刺さった一文を残す
- あとで見返す
- なぜ重要だったかを思い出す必要がある
- AIには断片しか渡せない
文脈ごとのAI読書
- 章や本全体の流れを残す
- あとから質問できる
- 主張、根拠、反論を分けられる
- ChatGPTやNotebookLMで再利用できる
全文を渡したら、まず聞きたいこと
ハイライトを増やすより、本文の流れを渡してから、こう聞いた方が読書メモとして使いやすいです。
この章について、以下を分けて整理してください。
- 著者の主張
- 主張を支える具体例
- 前提になっている考え方
- 反論されそうな点
- 自分があとで考えるべき問い
この聞き方なら、ただの要約ではなく、自分が考えるための材料になります。
NotebookLMなら、音声や動画にも広げられる
NotebookLMに本のテキストを入れると、質問できるだけではありません。音声解説、動画解説、スライド資料のように、読んだ本を別の形へ変えることもできます。
ハイライトだけでは、この広げ方が難しいです。NotebookLMが強いのは、ソース全体を前提にして、作品や本の構造を扱えるところです。
文字起こしの精度で、見るところ
OCRは完璧ではありません。ただ、AI読書に使う分には完璧である必要もありません。要約や質問に答えるうえでは、文脈が残っていれば数文字の誤変換は吸収されます。
気にするべきなのは、精度そのものよりどこで崩れるかです。縦書きで行が混ざる、ルビが本文に入り込む、見開きで段落が途切れる。この3つが起きていなければ、実用上は足ります。
正確な引用が必要なときだけ、元のページと突き合わせてください。参照用のPDFを一緒に持っておくと、その照合が早く済みます。
BookHaloの役割
BookHaloは、ハイライト管理アプリではありません。Kindle Cloud Readerで開いた本を文字起こしして、ChatGPTやNotebookLMに渡しやすいテキスト素材にするためのChrome拡張です。撮ることとOCRを通すことを、まとめて片付けます。
読書メモをAIで作りたいなら、最初に必要なのは凝ったプロンプトではなく、本をAIが読める形で持っておくことです。
実際の流れ
- Kindle Cloud Readerで本を開く
- BookHaloで実行する(1ページ約10秒)
- ZIPの中の書名がついたテキストファイル(例:
夢十夜.txt)をChatGPTやNotebookLMに入れる - 要約、問い、比較、音声解説などに広げる
注意点
自分が正当にアクセスできる本を、自分用の読書メモや学習のために使う前提で考えるのが安全です。本文をそのまま公開したり、他人に配ったりする用途には向きません。
BookHaloはChrome Web Storeで公開中です。Kindle Cloud Readerで閲覧できる本を全文テキストと参照用PDFにして、ChatGPTやNotebookLMで個人用の読書メモとして参照しやすくできます。
Chrome Web StoreでBookHaloを開くよくある質問
Kindleのスクショを撮ってAIに読ませればいいのでは?
画面を撮っただけのPDFでも、ページ数が少なければ読み取れるAIがあります。実際に19ページの画像PDFで試したところ、Claudeは本文を正確に引用して答えましたが、ChatGPTは3回とも何も返しませんでした。問題は量です。同じ19ページで画像PDFは4.8MB、全文テキストは48KB。100分の1です。300ページの本を画像で渡すと75MB前後になり、多くのAIの上限を超えます。
Kindleを自動でスクショするツールを使えば解決しますか?
解決しません。自動化されるのは撮る工程だけで、できあがるのは枚数の増えた画像PDFです。枚数が増えるほどファイルは重くなり、1冊ぶんではAIの上限を超えます。テキストにするにはOCRが別に要ります。
KindleのOCRは日本語の縦書きでも使えますか?
使えます。ただし英語向けの設定のまま通すと、行が混ざったりルビが本文に紛れ込んだりします。縦書き・ルビに対応した処理が必要です。
ハイライトのエクスポートだけでは足りませんか?
足りません。ハイライトに残るのは線を引いた箇所だけで、本文全体は残りません。章全体の要約や、引いていない箇所への質問には答えられません。