私がAIとかくれんぼをした日
人間の直感と機械の論理が衝突する中、筆者がAIと隠れんぼをした体験談。AIは最適解を追求するあまり、予想外の戦略を展開し、人間の思考パターンとは異なるユニークなアプローチを見せた。この体験は、AIと人間の思考の違いを浮き彫りにし、機械の創造性について新たな視点を提供する。
背景メモ
OpenAIが2024年5月に公開した「GPT-4o(オムニ)」のリアルタイム音声・映像モードの進化ぶりを、著者が自宅での実験を通じて体感したレポート。
- GPT-4oは、テキスト・画像・音声をシームレスに処理できるマルチモーダルAIで、従来のChatGPT(テキスト→画像の順次処理)とは異なり、カメラ映像をリアルタイムで「見ながら」会話ができる。
- 著者がスマホのカメラで部屋のあちこちに隠れ、AIに「どこに隠れたか当ててごらん」と問いかけると、AIは映像の変化(例:カーテンの揺れ、靴の位置)を根拠に推論し、ほぼ正解を言い当てる。
- この能力は、OpenAIが2024年5月に発表した新機能で、一般提供は段階的に行われている。**見えているものについてAIと自然に会話できる**という点で、音声アシスタント(Siri/Alexa)やこれまでのチャットボットとは質的に異なる。
- 課題として、誤った確信(ハルシネーション)やプライバシー懸念(常時カメラONのリスク)も指摘されている。