AI・量子・未来技術編 / 第100話

第100話:イトは、「大成功」を放送しなかった|AIが次の言葉を選ぶまで

ピコルート第100話。生中継まで一分、文章生成AIは『第100回実験は大成功でした』と書いた。けれど観測記録には三本の赤線がある。イトは祝賀放送を止め、自然な文章と確認された事実の違いを知ります。

AI知能区AIとは入力・モデル・出力認識・予測・生成10分更新

第100回公開実験は、大成功でした。

金色の文章が、放送画面いっぱいに輝いた。

生中継まで、あと一分。

画面の上では、紙吹雪を詰めた筒が十本、いっせいに口を開いている。

イトが「放送」ボタンを押せば、AI知能区の広場へ成功の知らせが流れる。

百回目を祝うために、イトが一週間かけて用意した演出だった。

「間に合った」

イトがボタンへ手を伸ばしたとき、机の下で警告音が鳴った。

マコトが、観測装置から出てきた細長い紙を拾う。

十本の線のうち、七本は青い。

最後の三本は、途中で切れた赤い線だった。

「大成功」は、どこから来た?

今日の公開実験では、仕分け車を十回走らせた。

七回は終点へ着いた。

三回は、同じ曲がり角で止まった。

ところが、放送文には失敗が一つもない。

マコト

この文章は、観測記録を読んで書いたの?

イト

『第100回公開実験は』って入れたら、生成窓口が続きを全部作ってくれたんだ

ユイ

窓口へ渡したのは、その一文だけですか

イト

うん。AIなら、ラボの記録も知っていると思ってた

ピコが、放送画面と生成窓口をつなぐ透明な管を指さした。

管の入口に入っていたのは、イトの短い文だけだった。

観測装置から伸びる赤い管は、生成窓口の手前で終わっている。

二つは、つながっていない。

「この窓口は、記録を見て『成功した』と判定したんじゃない」

ピコは金色の文章を一文字ずつ分けた。

「入力の続きを作ったんだ」

AIは、一つの大きな頭脳の名前ではない

門の向こうには、仕事の違う窓口が並んでいた。

画像から物を見分ける窓口。

過去の数字から次を予測する窓口。

文章や画像を作る窓口。

決められた条件に沿って、判断を助ける窓口。

AIは、このような幅広い仕組みや研究領域を指す言葉だ。

どのAIも同じ材料を持ち、同じ答えを返すわけではない。

いまイトが使ったのは、文章を生成する窓口だった。

その奥には、三つの台がある。

  1. 入力を受け取る台
  2. 学習したモデルが続きを計算する台
  3. 選ばれた文章を出力する台

入力の台へ観測記録が渡っていなければ、モデルはその記録を読めない。

出力がきれいに整っていても、その事実は変わらない。

次のトークンを一つ選ぶ

生成窓口の床へ、イトの入力が小さな札に分かれて落ちた。

第100回 / 公開 / 実験 / は

「これは説明用に見える形へしたものだよ」

ピコが札を拾う。

文章生成モデルは、文字列を トークン(token) という単位で扱う。トークンは、一つの単語とは限らない。文字、単語、単語の一部など、分け方はモデルによって違う。

窓口の奥に、次のトークン候補が浮かんだ。

大

無事

予定

モデルは、入力と、それまでに出したトークンを手がかりに、次へ続く候補を計算する。

一つを選ぶ。

選んだトークンを、それまでの文へ足す。

また次を計算する。

この繰り返しで、短い入力から長い文章が作られていく。

Transformerの原論文でも、デコーダーは前に生成した記号を追加の入力として受け取り、次を一要素ずつ生成する自己回帰の仕組みとして説明されている。

生成窓口では、金色の札が次々につながった。

第100回公開実験は / 大 / 成功 / でした

文としては自然だった。

句読点も正しい。

事実だけが、観測記録と合っていなかった。

自然な文は、確認済みの印ではない

イト

こんなにはっきり書いてあるのに、窓口は成功したか知らないの?

ピコ

この窓口がしたのは、続きを生成すること。観測値を測ることでも、記録と照合することでもないよ

ユイ

自然な文を作る力と、必要な資料を確かめたかは、分けて見ないといけないのですね

マコト

検索や資料を読むツールへつなぐ仕組みも作れる。でも、つながっているか、何を読んだかは別に確かめる必要があるね

生成AIが、誤った内容を自信ありげに出すことはある。

NISTの生成AI向けリスクプロファイルは、この現象を confabulation(作話) と呼び、文章が事実どおりになる場合もあれば、事実と違ったり、内部で矛盾したりする場合もあると整理している。

NIST AI 600-1は、出力を信じる人が、流暢で自信のある書き方に影響されるリスクにも注意を向けている。

だから、文章生成AIを使ってはいけない、という話ではない。

下書きを作る。

言い換える。

案を広げる。

役立つ仕事はたくさんある。

ただし、数字、名前、日付、実験結果のように原資料があるなら、自然さとは別に照合する。

この放送で確かめる相手は、生成窓口ではなく、三本の赤線が残る観測記録だった。

イトが選べる三つの道

放送開始まで、あと三十六秒。

画面に三つのボタンが出た。

  1. そのまま送る
  2. 数字だけ消す
  3. 観測から書く

一つ目なら、金色の「大成功」と紙吹雪を予定どおり流せる。百回目の祝賀放送は成功する。

二つ目なら、成功とも失敗とも書かず、きれいな言葉だけを残せる。嘘は薄く見えるが、三回止まったことも広場へ届かない。

三つ目なら、観測記録から書き直せる。しかし、祝賀装置へ文章を送る時刻には間に合わない。

紙吹雪の筒が、発射までの秒を数える。

イトは金色の文を見た。

その文章を作るために、何日もかけたわけではない。

けれど、百回目を「大成功」にする演出は、何度も描き直した。

七、六、五。

床の観測紙では、三本の赤線が切れたままだ。

イトは、「大成功」を回線から抜いた

イトは、一つ目のボタンから手を離した。

二つ目にも触れなかった。

「観測から書く」

イトは生成窓口と放送画面をつなぐ金色の管を、自分の手で引き抜いた。

第100回公開実験は、大成功でした。

金色の文が消える。

次に、観測装置の赤い管を机まで引く。

十本の線を一本ずつ数え、放送欄へ打ち込んだ。

十回中、七回は終点へ到着。三回は同じ曲がり角で停止。原因は未確認。次の試験は17時40分。

イトが放送機から金色の大成功カードを完全に引き抜き、三本の赤線がある観測記録を机へつないでいる。頭上の紙吹雪装置は暗いまま止まっている
生成された「大成功」を放送から外し、十回の観測記録から途中結果を書き直す。

発射時刻が来た。

紙吹雪は出なかった。

金色のバナーも開かない。

広場の巨大画面には、三本の赤線と、イトが書いた途中結果だけが映った。

しばらく、拍手は起きなかった。

代わりに、実験を見ていた人から一つのメッセージが届いた。

三回とも同じ場所なら、次はその角を見たい。

別の人が、停止した時刻を尋ねた。

画面の端へ、次の実験を待つ印が一つ、また一つと増えていく。

成功を祝う放送は、原因を探す放送へ変わった。

AIの出力に、どの材料を渡したか

文章生成AIの返事を見るとき、イトは三つを分けて考えることにした。

  1. 入力 — 質問、指示、資料として何を渡したか
  2. モデル — 入力からどのような出力を作る仕組みか
  3. 出力 — 返った文を、どの原資料と照合する必要があるか

今回の入力には、観測記録がなかった。

モデルは、自然な続きを生成した。

出力は、事実と合わなかった。

三つを分ければ、「AIがそう言ったから」という一言で止まらずに済む。

認識するAI、予測するAI、生成するAIでは、目的も、入力も、確かめ方も違う。

AIという広い名前だけで、すべての窓口が同じ仕事をすると思わない。

紙吹雪が落ちなかった広場

放送が終わった。

イトが用意した紙吹雪は、十本の筒に入ったままだ。

「大成功」の金文字も、床へ伏せてある。

一週間かけた祝賀演出は、一度も広場へ流れなかった。

イトは、観測紙の三本の赤線を消さなかった。

その横に、次の実験時刻を書き足す。

17時40分。停止した曲がり角から再開。

夕方の光が弱くなると、暗い祝賀装置の隣で、観測画面だけが明るく残った。

三本の赤線は、失敗を飾るためではない。

次に見る場所を、照らしていた。

次回:AI、機械学習、ディープラーニングは同じもの?

生成窓口は、AI知能区にある仕事の一つだった。

けれど、街の奥には「機械学習」と「ディープラーニング」と書かれた門もある。

三つは、新しさや強さの順位なのか。

それとも、広さの違う名前なのか。

次回、ピコルート第101話。

AI・機械学習・ディープラーニングの違い。

三つを強さ順に並べたイトが、知能区の仕分けを止めてしまいます。

先に一枚の地図で整理するなら、解説ガイド AI・機械学習・ディープラーニングの違い から読めます。

この物語を、解説で深める

第100話で生まれた疑問を、解説記事で少し深く見ていきます。物語で感じた不思議さを残したまま、言葉と仕組みを順番に整理しましょう。

AIとは?人間のように考えているように見える仕組みを読む