OpenAI 推理模型推翻 80 年的 Erdős 猜想——而且它不是数学专用模型
为什么值得读 标题是"AI 会做数学"。真正的信号是:它出自一个通用推理模型,而非数学专用系统——并以构造出 80 年来无人找到的反例来推翻旧有信念。一个结果不算革命,但"通用性"才是重点。
OpenAI 表示一个内部推理模型自主推翻了 Erdős 1946 年的单位距离猜想(5/20)——AI 首例,并经数学家独立验证。
为什么值得读 标题是"AI 会做数学"。真正的信号是:它出自一个通用推理模型,而非数学专用系统——并以构造出 80 年来无人找到的反例来推翻旧有信念。一个结果不算革命,但"通用性"才是重点。
OpenAI 表示一个内部推理模型自主推翻了 Erdős 1946 年的单位距离猜想(5/20)——AI 首例,并经数学家独立验证。
OX Security 披露超过 20 万台 MCP 服务器因 STDIO 传输层缺乏输入消毒允许任意 OS 命令执行;另一项扫描发现 36.7% 的服务器存在 SSRF 漏洞。
Anthropic 给 69 位员工 $100 预算,讓 agent 在四个不同模型设置的市集互买互卖,共 186 筆交易、約 $4K 流动,且模型质量造成明显不对称。
Anthropic Red 预览前沿模型 Mythos,可自主串接零日漏洞、反編译二進位、產出可運作 exploit;Project Glasswing 为对应防禦計画。