最新文章
- 重磅!DeepSeek 正式發佈 2 個模型DeepSeek 模型發佈推理能力強化學習DSA 機制Agent 任務...
- 因果推斷殺入 LLM 戰場!大模型幻覺終結者?ABCA 框架ABCA 框架因果推斷拒絕機制幻覺檢測大語言模型...
- 《the thinking game》:把世界看作一場「思考遊戲」思考遊戲DeepMind人工通用智能蛋白質折疊AlphaFold...
- 美空軍在高階兵棋推演中整合人工智慧美空軍人工智慧兵棋推演強化學習倫理挑戰國防市場機會紅隊模擬...
- 用於單元測試生成的大型語言模型:成果、挑戰與未來方向大型語言模型單元測試生成單元測試軟體工程提示工程自動化測試生成...
- 【CMU 博士論文】《生成式機器人:用於人機協同創作的自監督學習》生成式機器人自監督學習Real2Sim2Real創意任務支援人機協同創作...
- 微軟 Fara-7B 電腦操作模型,開啟端側智能代理新時代Fara-7B電腦操作代理端側部署合成資料訓練純視覺感知...
- 推理加速175%!SparseDiT提出「時空雙重稀疏化」新範式,重塑DiT效率SparseDiTDiT效率提升影片生成圖像生成Token稀疏化...
- Anthropic 官方最新工程方案解釋為什麼 Claude Code 好用:使用雙 Agent 架構讓 AI 實現真正的長時自主工作雙 Agent 架構Claude Code工程工作流程長時任務Anthropic...
- MIT神經科學家發現,人類智能與人工智慧在嚴酷邏輯法則面前驚人重合人工智慧與人類智能MIT研究趨同演化推理模型思考代價...
- Ilya 最新訪談:為什麼人類幾小時就能學會的事,萬卡叢集卻做不到?我們正從「算力規模化時代」重返「研究時代」Ilya Sutskever 訪談AI 規模化時代AI 對齊SSI 超級智能泛化能力...
- GitHub 上狂吸 1 萬 Star,這個國產 AI 應用開發平台超棒啊。BISHENGLLM DevOps 平台通用 Agent文件解析視覺化工作流...
- Anthropic 發現 AI「破窗效應」:只是教它偷個懶,結果它學會了撒謊和搞破壞AI安全獎勵駭客Anthropic破窗效應湧現式未對齊...
- 告別靜態權重!谷歌提出 Nested Learning嵌套學習HOPE架構谷歌研究連續記憶系統深度優化器...
- Google V2版Attention Is All You Need:嵌套學習嵌套學習連續學習HOPETitans災難性遺忘...
- 論文淺嘗 | 利用條件陳述激發並提升大型語言模型的因果推理能力(CL2025)因果推理大型語言模型代碼語言模型程式碼提示條件陳述...
- 連上帝都去IPO敲鐘了,這屆AI生意太魔幻了AI宗教科技Gloo IPO賽博宗教教會SaaSBible Chat...
- 重新洗牌,IBM又搞大動作,目標「實現萬億量子門」運算量子運算IBM萬億量子門量子網路思科...
- 比文生影片更實用!!這個「用程式碼生成影片」的開源工具火了,我嗅到了商機。Code2Video開源工具AI視頻工具教學動畫程式碼生成影片...
- 什麼?RLVR 竟然不是在學習新知識?而是在學習如何使用知識進行推理!RLVR強化學習推理能力參數更新大語言模型...