分類: 人工智慧
- Codex 推出 Chrome 外掛,能幫你填表、報帳、打遊戲...操控整個瀏覽器
- 靜態評測已「過時」?OpenKG 持續更新 LLM 知識增強動態評測榜單 Dynamic OneEval-202605
- AI 終於學會「自我坦白」!Anthropic 最新論文震撼來襲,「內省適配器」讓黑箱模型自己說出隱藏行為
- Claude 的「夢境」機制如何運作
- 刷榜AI全陣亡!Meta、斯坦佛地獄級測試,GPT/Claude/Gemini交出0分
- 史丹佛新理論:揭開神經網路泛化之謎,Adam加一行程式碼,加速2.4倍
- Karpathy、Claude Code 之父 Boris 最新專訪,引爆全球程式設計師圈!
- Subquadratic — 效率即智慧
- HTML已死!前OpenAI工程師掀起網頁革命:用AI將整個螢幕變成無限直播像素串流,無一行HTML程式碼,網友:傳統Web開發結束,前端真要失業了!
- Agent-World:擴展真實世界環境,讓AI代理與環境協同進化!
- 資訊工程系第三次大蕭條?元兇:AI
- Anthropic共同創辦人預測:2028年AI將實現自我進化,無需人類參與
- 哈佛《Science》重磅:AI急診診斷準確率67%,超越資深主治醫師!但要取代醫生還早
- IBM的桑達雷桑表示,大多數AI寫程式「就像開著法拉利去買牛奶一樣」
- Abstract-CoT:推理token暴降11.6倍,無詞思維鏈打破LLM效率天花板
- 論文淺嚐 | 利用多智能體大型語言模型實現知識圖譜自動化擴充(NeurIPS 2025)
- DeepMind諾獎CEO最新訪談:現有大模型路徑不是死路,但大家都在用的暴力方法可能錯了;中國模型在開源領域已處於領先地位
- 一篇精彩的自我進化代理人最新系統性綜述
- Claude 4.6 正確率只有66%?Claw-Eval-Live 說:會修終端機 ≠ 能跨系統做事
- 你的Agent根本沒在學習,它只是在翻筆記本
- AI 正在把我們推向「雙輸」深淵:頂尖論文揭露「AI 裁員陷阱」
- DeepSeek連夜撤下的新論文,究竟說了什麼
- 軟體 3.0 時代來臨:從寫程式到指揮 AI,Karpathy 談程式設計的第三次典範轉移
- Qwen-Scope:看穿大型語言模型的「思考脈絡」
- GPT之父把AI丟回1930年:沒見過一行程式碼,卻「發明」了Python!