OpenAI 推理模型推翻 80 年的 Erdős 猜想——而且它不是數學專用模型
為什麼值得讀 標題是「AI 會做數學」。真正的訊號是:它出自一個通用推理模型,而非數學專用系統——並以建構出 80 年來無人找到的反例來推翻舊有信念。一個結果不算革命,但「通用性」才是重點。
OpenAI 表示一個內部推理模型自主推翻了 Erdős 1946 年的單位距離猜想(5/20)——AI 首例,並經數學家獨立驗證。
為什麼值得讀 標題是「AI 會做數學」。真正的訊號是:它出自一個通用推理模型,而非數學專用系統——並以建構出 80 年來無人找到的反例來推翻舊有信念。一個結果不算革命,但「通用性」才是重點。
OpenAI 表示一個內部推理模型自主推翻了 Erdős 1946 年的單位距離猜想(5/20)——AI 首例,並經數學家獨立驗證。
OX Security 披露超過 20 萬台 MCP 伺服器因未對 STDIO 傳輸層輸入做消毒,允許任意 OS 命令執行;另一項掃描發現 36.7% 的伺服器存在 SSRF 漏洞。
Anthropic 給 69 位員工 $100 預算,讓 agent 在四個不同模型設定的市集互買互賣,共 186 筆交易、約 $4K 流動,且模型品質造成明顯不對稱。
Anthropic Red 預覽前沿模型 Mythos,可自主串接零日漏洞、反編譯二進位、產出可運作 exploit;Project Glasswing 為對應防禦計畫。