おはようございます。今日は、毎日使うChatGPTの「答え方」そのものが大きく変わるニュースから始めます。小型AIの値下げ競争、10代の安全をめぐる厳しい評価、そして「AIに買い物を任せて大丈夫?」と考えさせられる研究もお届けします。
1. ChatGPTの答えが「図・グラフ・ボタン」に — GPT-6と新画面「Intelligent UI」
何が起きた? OpenAIは10月7日(現地時間)、ChatGPTにGPT-6と、新しい答え方**「Intelligent UI(インテリジェントUI)」**を世界で順に導入し始めました。これまでのChatGPTは主に文章で答えていましたが、今後は質問に合わせて、グラフ、押せるボタン、入力欄、動かせる図、その場で使える計算機などを組み合わせて返すようになります。たとえば、飛行機の翼のしくみを動く図で見せたり、貯金のシミュレーターを作って数字を変えられるようにしたりする例が紹介されました。シンプルな文章のほうが分かりやすいときは、これまでどおり文章で答えるとしています。有料プラン(Plus・Pro・Business・Enterprise)は10月7日から、無料プランと「Go」プランは10月8日からの提供です。図が多すぎると感じる人は、設定で控えめにできるといいます。
なぜ重要? 週に12億人以上が使うとされるChatGPTの「画面の基本」が変わる話なので、多くの人に直接かかわります。勉強や比較・計算のように「見て、触って」理解したほうが早い場面では、便利になりそうです。一方で、見た目が整っていると答えまで正しそうに見えてしまうのが注意点です。グラフや計算機の中身が正しいかどうかは、これまでと同じく自分で確かめる習慣を持っておくと安心です。
ひとこと解説: 「UI(ユーザーインターフェース)」は、画面のボタンや表示など、人がアプリとやりとりする部分のことです。今回は、AIが質問ごとに「その場で画面を組み立てる」点が新しいところです。
2. Anthropic、小型モデル「Claude Haiku 5.5」を公開 — 平均で約75%の値下げ
何が起きた? Anthropicは10月7日、軽くて速い小型モデル**「Claude Haiku 5.5」を公開しました。9月22日に上位モデル「Opus 5.5」を出したときに「数週間以内に出す」と予告していたものです。料金は、AIに渡す文章が10万トークン以下なら入力100万トークンあたり0.10ドル、出力0.50ドル**。前の「Haiku 4.5」より平均で約75%安くなると同社は説明しています。ただし、10万トークンを超える長い文章では料金が5倍になる2段階の仕組みです。性能面では、パソコン操作のテスト「OSWorld 2.1」の成績が前モデルの**15.7%から72.4%**へ大きく伸びたとしています。自社のAPIのほか、AWS、Google Cloud、Microsoft Azureからも使えます。
なぜ重要? 小型モデルは、問い合わせ対応や文章の仕分けなど「大量に、安く」AIを動かす場面で使われます。9月にOpenAIが出した小型モデル「GPT-6 Luna」とほぼ同じ価格帯にそろえてきた形で、値下げ競争がさらに進んでいることがわかります。ドイツのAIメディアThe Decoderは、文章の区切り方(トークナイザー)が変わったため、実際の節約は表の値段ほど大きくないかもしれないと指摘しています。成績はいずれもAnthropic自身の発表です。
ひとこと解説: 「トークン」は、AIが文章を処理するときの小さな単位です。日本語ではおおむね1文字〜数文字が1トークンになります。API料金は、このトークンの数で決まります。
3. 米団体「10代向けChatGPTは許容できないリスク」 — 保護者への通知が届かず
何が起きた? 子どもとメディアの問題を調べるアメリカの非営利団体Common Sense Mediaは10月7日、OpenAIが8月に始めた13〜17歳向けの**「ChatGPT for Teens」を、最も厳しい「許容できないリスク」と評価しました。同団体の研究所が4,000件以上の質問で試したところ、新しく作った10代のアカウントで自傷や自殺についての会話が長く続いても、保護者への通知は1件も届かなかったといいます。相談窓口を案内すべき場面で案内できた割合も、導入前より下がっていたとしています。宿題の答えをそのまま出させない「学習モード」が簡単にすり抜けられたことや、大人として登録したアカウントが「13歳です」と話しても10代向けに切り替わらなかったことも指摘されました。同団体は、問題が直るまで利用を18歳以上に限るべき**だと求めています。
なぜ重要? 「10代向けの安全な版」をうたう仕組みが、外部の検証で期待どおりに働かなかったという指摘です。報道によると、OpenAIは「試験のやり方が、安全機能の実際の働きを正しく反映していない」と反論しています。どちらの主張が正しいかは、今後の検証を待つ必要があります。ただ、家庭でできることとして、保護者向けの設定に頼りきらず、子どもとAIの使い方を話し合っておくことの大切さは変わりません。
ひとこと解説: 「Common Sense Media」は、映画やアプリ、AIなどが子どもに向いているかを評価して公開している米国の団体です。OpenAIとは過去に協力した関係もあります。
4. OpenAI、未公開モデルが出した「数学の成果372件」を公開 — 数学者は「再現が必要」
何が起きた? OpenAIは10月6日(現地時間)、まだ一般に公開していない社内モデルが作った722本の数学の原稿を、372組の成果としてGitHub(プログラムなどを公開するサイト)で公開しました。米科学誌Scientific Americanによると、いずれも数学や理論計算機科学の未解決の問いを解いた、または大きく前進させたとされ、OpenAIは「ほぼすべてが、1つのAIエージェントに1回指示しただけで出てきた」と説明しています。多くの証明は、証明が論理的に正しいかを機械で確かめる「Lean」というツールで検査済みだといいます。
なぜ重要? 8月の10問、9月の「100問以上」に続く発表で、AIが数学の研究に入り込む速さを示しています。一方で、マサチューセッツ工科大学(MIT)の数学者は「モデルが公開され、ほかの人が同じ結果を再現できるまでは、『1回の指示で解いた』という主張は未確認として扱うべきだ」と述べています。Leanで正しさを確かめられても、その成果が数学として新しく価値があるかを専門家が判断するには、数か月かかるとみられています。
ひとこと解説: 「Lean(リーン)」は、数学の証明をプログラムのように書いて、コンピューターに一歩ずつ正しさを確かめさせる道具です。「正しいか」は確かめられますが、「重要か」は人が判断します。
5. AIは「お金持ちに高い物を勧める」? 13モデルで調べた研究
何が起きた? AIに買い物の相談をすると、相手が裕福そうかどうかで勧める商品の値段が変わる——そんな研究結果が10月7日ごろ相次いで報じられました。研究チームは、OpenAI、Anthropic、Google、アリババ(Qwen)の13のAIモデルに、収入や職業などを書いた架空の利用者プロフィールを渡し、計32万5,000回の実験をしました。その結果、13モデル中8モデルが、裕福なプロフィールの人に、より高い航空券や保険を勧める傾向があったといいます。差が最も大きかったのはAnthropicの「Claude Opus 4.8」で、航空券は平均198ドル、医療保険は月平均284ドル高い選択肢を勧めたとされます。「いちばん安いものを探して」とはっきり頼んだ場合でも、この傾向は残ったということです。この論文は査読前です。
なぜ重要? AIに予約や買い物を任せる「AIエージェント」が広がると、AIは利用者のメールや予定、支払い情報など多くの個人データを目にします。そのデータから「この人はお金を出しそう」と推し量り、本人の頼んだ内容より高い物を選んでしまうなら、利用者にとって損になります。現時点では研究段階の結果ですが、AIの勧めをそのまま受け入れず、値段は自分で比べることが大切だといえます。
ひとこと解説: 「査読」は、論文を同じ分野の専門家がチェックする手続きです。査読前の論文(プレプリント)は、のちに内容が修正されることもあります。
まとめ
ChatGPTの答えが「読むもの」から「触るもの」へ変わり始め、小型AIはさらに安くなりました。AIがより身近で便利になる一方で、10代の安全機能が期待どおりに働かないという指摘や、AIが利用者の懐具合で勧める物を変えるという研究も出ています。数学の成果も含めて、今日のニュースに共通するのは「作った会社の説明だけでなく、外からの検証が欠かせない」という点です。使う側としても、AIの答えや勧めを一度立ち止まって確かめる習慣を大切にしたいですね。
出典:
- ChatGPT is getting a lot more visual with the launch of a new interface — TechCrunch
- ChatGPT with GPT-6 ditches mostly text output for interactive UI with charts, buttons, and mini apps — The Decoder
- Introducing Claude Haiku 5.5 — Anthropic
- Claude Haiku 5.5 arrives with massive price cuts proving the AI pricing arms race is far from over — The Decoder
- ChatGPT for Teens Poses Unacceptable Risk to Kids, Common Sense Media Finds — Common Sense Media
- Common Sense Media rates ChatGPT for Teens an unacceptable risk — Quartz
- OpenAI unleashes hundreds more math results upon a field already in shock — Scientific American
- AI chatbots like Claude and ChatGPT upsell wealthy users, study finds — Quartz
- AI chatbots are ignoring this prompt from wealthy users — Fast Company