Skip to content
AI-Daily-Builder

歷史

大型語言模型智能體中的跨任務技能遷移:子任務與文本勝出

為什麼值得讀 開發自主智能體的開發人員可以通過將記憶體結構化為文本形式的子任務來提高可靠性。所提出的效用評分提供了一種執行前的診斷工具,用於篩選有效的技能。

研究發現,子任務級別的歸納與文本格式能使大型語言模型智能體實現可靠的技能遷移,其表現優於任務級別和基於代碼的方法。

科羅拉多州 AI 法案原訂今日生效,現在要等到 2027 年了

為什麼值得讀 美國第一部全面性州級 AI 法律,在生效前就被改寫了。這種「立法、再在執法開始前因產業壓力而廢改」的順序,是其他州值得關注的範本。

5 月 14 日簽署的 SB 189 大幅削弱科羅拉多 AI 法案,將生效日從 2026 年 6 月 30 日延至 2027 年 1 月 1 日,改為僅要求揭露的規範架構。

GitHub Copilot 結束首個按用量計費週期——代理式用戶感受到衝擊

為什麼值得讀 吃到飽式 AI 編程工具,原本就是用輕度自動完成用戶的費用補貼重度代理式用戶。Copilot 現在停止了補貼——而第一張帳單,正是大家在公告貼文中跳過沒看的那部分。

Copilot 於 6 月 1 日改採按 token 計費,6 月 30 日結束首個計費週期;代理式用戶反映帳單暴增至原訂閱費的 10 到 50 倍。

OpenAI 預覽 GPT-5.6 Sol、Terra、Luna——存取權卡在美國政府審查之後

為什麼值得讀 模型已就緒,政策卻還沒跟上。前沿模型發布卡在政府審批而非 OpenAI 產能上,這是開發者該預期會再次看到的新治理模式。

OpenAI 於 6 月 26 日發布 GPT-5.6 Sol/Terra/Luna——Sol 在 Terminal-Bench 2.1 拿下 91.9%,但存取權僅限約 20 家獲美國政府核准的合作夥伴。

請喝咖啡