OpenAI の推論モデルが 80 年来のエルデシュ予想を反証 — しかも数学専用モデルではない
読む理由 見出しは「AI が数学をやる」。本当のシグナルは、それが数学専用システムではなく汎用推論モデルから生まれ、80 年間誰も見つけなかった反例を構成して通説を覆したこと。一つの結果は革命ではないが、汎用性こそが核心だ。
OpenAI は内部の推論モデルがエルデシュ 1946 年の単位距離予想を自律的に反証したと発表(5/20)——AI として初、数学者が独立に検証。
読む理由 見出しは「AI が数学をやる」。本当のシグナルは、それが数学専用システムではなく汎用推論モデルから生まれ、80 年間誰も見つけなかった反例を構成して通説を覆したこと。一つの結果は革命ではないが、汎用性こそが核心だ。
OpenAI は内部の推論モデルがエルデシュ 1946 年の単位距離予想を自律的に反証したと発表(5/20)——AI として初、数学者が独立に検証。
OX SecurityがMCPサーバーの標準STDIOトランスポートに入力サニタイズなしでOSコマンドを実行する脆弱性を開示。200,000台以上が影響を受け、36.7%がSSRF攻撃にも脆弱。
Anthropic は社員 69 名に各 $100 の予算を渡し、4 つの異なるモデル設定の市場でエージェント同士に売買させた。計 186 件の取引、約 $4K の流通、モデル品質による顕著な非対称性が確認された。
Anthropic Red がフロンティアモデル Mythos をプレビュー。ゼロデイ脆弱性の自律連鎖、バイナリの逆コンパイル、動作する exploit の生成が可能。Project Glasswing はその防御計画。