分類: 人工智慧
- RAG 已死?不,是 Grep 強勢回歸!
- Scaling Pain:超大規模 Coding Agent 推理實踐
- ChatGPT數學進階之路!OpenAI研究員自爆:從數不清數到給出埃爾德什問題全新解法;數學是衡量模型進步的重要基準;AI自動化研究員
- Anthropic 最新部落格:MCP 沒有死,我們又救活了
- OpenAI 開源 Codex 編排規範 Symphony:讓每個 Issue 都有專屬 AI 跟進,人只需要審查結果
- 技能驅動推理新範式,清華&北大:Token立省59%,準確率不降反升
- 是時候討論「人類配額制」了:應對AI就業衝擊的一種可能性探討
- 思考不需言語:使用抽象思維鏈實現高效潛在推理
- 9秒,公司沒了!Claude「刪庫跑路」,Anthropic封殺110人公司,卻還在扣錢
- 成本降九成,準確率100%!MIT反直覺架構挑戰矽谷信仰
- LLM 只靠自己就能強化推理?SePT 提出簡潔的線上自訓練範式
- 代理人式世界建模:基礎、能力、定律與未來展望
- 首個時空時序推理框架:讓大型語言模型真正讀懂時空數據 | ACL'26
- 從創意到上線最快只要1天!CC產品負責人:產品快速發布不只是Mythos功勞,回應龍蝦不能用Claude,源碼洩露是流程漏洞,讓模型反思自己
- 23歲門外漢靠ChatGPT攻克60年數學猜想!陶哲軒:我們全走偏了
- Z Tech|對話王子涵:離開DeepSeek,我人生的逆向思考
- QuantCode-Bench:大型語言模型量化交易代碼生成品質評估基準
- Anthropic 產品負責人:從 6 個月到 1 天的發版秘密,Harness 會被模型當早餐吃掉
- 凌晨三點,矽谷炸鍋!Anthropic原始碼意外外洩,51萬行程式碼揭露Claude驚天野心
- DeepSeek-V4 預覽版:邁入百萬字元上下文普惠時代
- GPT-5.5 正式發表!更強、更快、更昂貴,NVIDIA 工程師內測感言:失去它如同截肢
- 正式介紹:混元 Hy3 preview
- 疑似 GPT-6 現身!OpenAI 聯合創辦人親揭 Spud 新模型,自帶「大模型氣味」!網友熱議:首款真正會「思考」的 AI
- Meta 用 720 顆真人大腦訓練 AI——現在任何人都能「掃描」用戶大腦
- Xiaomi MiMo-V2.5 系列大模型正式開啟公測