最新文章
- 智能體長程搜尋的兩大痛點被解決了!中科院 DeepMiner 用 32k 跑近百輪,開源領先逼近閉源深度搜尋智能體大型語言模型數據集建構上下文管理AI研究...
- OpenAI共同創辦人罕見曝光公司「痛苦與困境」:我們正走向運算稀缺世界!內部GPU分配如玩俄羅斯方塊,Sora 2實為被弱化的原始模型人工智慧OpenAISoraAGI運算資源...
- 捨棄微調!史丹佛聯合發表「智能體情境工程」(ACE),模型效能提升 10%、Token 成本降低 83%AI技術情境工程無監督學習效能優化大型語言模型...
- 谷歌揭密:多代理人(Multi-Agent)推論才是擴展的未來。多代理人系統大型語言模型推論擴展人工智慧研究谷歌...
- Mamba 架構登上頂級會議 ICLR 2026,AI 大腦核心 Transformer 的王座還能坐穩嗎?AI 架構Mamba深度學習狀態空間模型Transformer...
- Claude Code 即將登陸 Claude AppAI 應用程式Anthropic行動開發GitHub 整合Claude Code...
- 遞迴推理HRM模型再進化!TRM兩層網路(7M參數)擊敗大型語言模型!人工智慧深度學習機器學習大型語言模型遞迴神經網路...
- 剛剛!清華等聯手開源 UltraRAG 2.0!效能飆升12%檢索增強生成RAG 2.0知識系統人工智慧大型語言模型...
- 谷歌加入 CUA 戰場,發布 Gemini 2.5 Computer Use:讓 AI 直接操作瀏覽器AI 代理程式瀏覽器自動化人工智慧安全Google Gemini深度學習...
- 極其重要,文件智能中的LLMs:綜述、進展、和未來趨勢文件智能大型語言模型多模態長文本處理RAG...
- 先驗與後驗機制加持,大型模型能否應對推理預測中的現實「溢出」?大型語言模型推理能力長程任務FutureX 基準動態評測...
- 剛才,GPT-5首次通過「哥德爾測試」!破解三大數學猜想人工智慧大型語言模型GPT-5組合最佳化數學證明...
- 中國團隊訓練出「脈衝大模型」,推理速度提升100倍人工智慧類腦計算中國科技運算效率大型語言模型...
- NeurIPS'25!AutoPrune:即插即用的自適應大模型剪枝框架深度學習模型模型輕量化自適應演算法剪枝技術視覺語言模型...
- 細胞世界的「高速公路」:揭密微小紋路如何讓混亂的細胞群自發排隊,走向有序細胞生物學生物物理學奈米技術組織工程自我組織...
- 上交大與史丹佛提出「長程式碼壓縮神器」:暴力瘦身 5.6 倍且效能不減程式碼壓縮大型語言模型上下文視窗AI研究軟體工程...
- 「零和學習」理論橫空出世,揭示大型語言模型縮放定律的真相!大型語言模型縮放定律損失減速訓練動態零和學習...
- 普林斯頓陳丹琦組新作:RLHF難支撐,RLVR有邊界?RLMT開闢第三條路大型語言模型強化學習模型訓練推理能力人類回饋...
- Agentic Coding表現創新高,全新KAT系列模型強力稱霸SWE-BenchAI程式開發大型語言模型軟體工程強化學習程式碼智慧...
- 首個程式碼世界模型引爆 AI 圈,賦能智慧體「真推理」,Meta 開源人工智慧大型語言模型開源軟體世界模型程式碼生成...