令音CEO / AIと人のハイブリッドで事業支援

AIで本を書く、という話をすると、たいてい「文章の質はどうなんですか」と聞かれる。

私は令音という一人会社で、AIと分担しながら本を4冊作った。その経験から言うと、質問の向きが少しずれている。文章そのものは、思っているより問題にならない。実際に苦しんだのは、出来上がったものが本当に読める状態になっているかを確かめる工程だった。

今日は、そこで実際に起きたことを書く。

検査は全部通っていた。それでも読めなかった

本には図版を入れた。1冊で32点ある。手で1点ずつ確認すると必ず取りこぼすので、機械で検査する仕組みを作った。見ているのは次の4つだ。

  • 色が混ざっていないか(紙は白黒なので、全画素が無彩色かを1画素単位で確認する)
  • 使ってはいけない数値や固有名詞が入っていないか
  • 入れると決めた注記が、実際に図の中にあるか
  • 枠からはみ出していないか

全部を通した。それでも、次の2件が起きた。

1件目。網掛けの帯の上に文字が乗っていて、下段がまったく判読できなかった。白黒印刷では、網掛けと文字が重なると文字のほうが必ず負ける。機械から見れば、色は混ざっていないし、文字はちゃんと存在している。検査項目のどれにも触れない。

2件目。入れると決めていた注記が、図の下端で切れていた。これも、文字列としては「存在している」ので、「注記があるか」の検査は通る。存在するが、見えない。

別の巻でも同じことが再現した。注記が結果のボックスに重なったり、見出しが矢印の上に乗ったりした。1冊目で学んだはずのことが、そのまま2冊目でも起きた。

「検査が通った」は「読める」の証明にならない。 これが、4冊を通していちばん高くついた教訓だった。

直せたものと、直せなかったもの

対処は2つ入れた。網掛けの上に文字が来るときは、自動で白い座布団を敷くようにしたこと。それと、枠外へのはみ出しを機械で検出するようにしたこと。

ただし、網掛けと文字がぶつかっていること自体は、今も機械では検出できていない。結局、生成した画像を目で見る工程は消えなかった。

ここで大事なのは、消えなかったという事実のほうだ。自動化を進めると「ここまでは機械、ここからは人」の線が動く。動くけれど、ゼロにはならない。ゼロにしようとした結果が、先の2件だった。

逆に、人が必ず取りこぼすものもあった

面白いのは、逆向きの失敗も同時に起きていたことだ。

原稿には、執筆中の作業メモを書き込んでいた。公開前に消す前提のものだ。一度きれいに消したのだが、その後の書き直しで11件が再び紛れ込んだ。

これを見つけたのは人ではなく、機械の検査だった。文字列の一致を見るだけの単純な仕組みが、人間の目視より確実だった。32点の図と数百頁の原稿を人が読み直して、11件を全部拾える気はしない。

つまり、こういうことになる。

得意 苦手
機械 数えられるもの・一致するもの・漏れなく全件 読めるか、伝わるか
人 読めるか、伝わるか 全件を漏れなく見ること

どちらかに寄せると、必ずもう一方の穴が開く。

だから、AIに本を書かせるとこうなる

以上をふまえて、私の分担はこうなっている。

テーマを決めて、何を書かないかを決めるのは自分。ここは渡さない。本の性格が決まる場所だからだ。

文章の下書きと、図の生成はAIに渡す。ここは実際に速い。質も、基準を具体的に渡しておけば実用になる。

機械の検査は、数えられるものに限定して全件に掛ける。色・禁止語・注記の有無・はみ出し。ここは人より確実なので、人が見ることを前提にしない。

最後に、必ず実物を目で見る。印刷される形で、上から下まで。ここを省いた回に限って事故が出た。

AIを入れて減ったのは執筆の時間で、増えたのは確認の時間だった、というのが正直な総括になる。合計では明らかに減っているが、配分が変わることを知らずに始めると、確認工程を省く方向に力が働く。そこが危ない。

まとめ

  • AIで本を作るとき、詰まるのは文章の質ではなく出来上がりの検証だった
  • 機械の検査を全部通った図が、網掛けと文字の重なりで判読できなかった
  • 注記は「存在する」が「見えない」状態になり、文字列の検査では捕まらなかった
  • 逆に、原稿に紛れ込んだ作業メモ11件を拾ったのは人ではなく機械だった
  • 機械は「数えられるもの」、人は「読めるかどうか」。線を引いて、どちらもゼロにしない

これから1冊目を出そうとしている人には、書く時間と同じだけ、確かめる時間を見積もっておくことを勧めたい。そこさえ折り込んでおけば、個人がAIと本を作るのは十分に現実的だ。

実際に作った4冊は令音の書籍ページにある。制作の詳細は、これからも記事にしていく。