中国团队拿下ICRA'26最佳论文:Agentic Coding驱动工业制造通往自主通用智能
刚刚,在维也纳落幕的机器人顶会ICRA 2026上,最佳论文奖(自动化方向)颁给了一支中国团队。
斯坦福改变了LLM的生成顺序,Google把它做了出来。DiffusionGemma技术报告来了
Google DeepMind在6月份对外分享了DiffusionGemma的技术报告,明确指向了一条与现有主流完全不同的演进道路。当大家都在绞尽脑汁让大模型逐词吐字的速度变快时,谷歌干脆把生成顺序改了。
又一大模型发布!号称比肩Fable 5和Mythos
<p><img alt="又一大模型发布!号称比肩Fable 5和Mythos" loading="lazy" src="/static/uploads/covers/58a7cf78b06c5eb7e920291138b11f80.webp"/></p><p><br/></p><p><strong>Sakana AI提出大模型训练新思路。</strong></p><p><br/></p><p>
如何使用 Codex,进行长程任务
这两天在赶工,鞭策 Codex 赶紧把 AGI Bar 的小程序弄出来,已经连续蹬了 80+ 小时了,预估再蹬 20 个小时就能蹬完
SCI 论文配图 Prompt 怎么写?这篇直接抄
做科研的人应该都懂,论文配图真的很耗时间。
530 万人读的这篇:你一直在用 AI 最慢的方式——附一段你今天就能粘的「自循环」提示词
这篇文章有 530 万浏览。我想先弄明白:为什么是它?
你的AI正在「见人下菜」,亚马逊团队ACL高分论文,首次系统测评「记忆」如何影响LLM情商
近年来,个性化语言模型迅速普及。 从 ChatGPT、Claude 到各类垂直 agent,用户 “长期记忆” 功能也逐渐成为标配,它们被广泛部署在推荐系统、客户服务、情感陪伴等场景中。
机器人终于不瞎抓了!港大阿里联手开源FineVLA:用哪只手、抓哪里,一句话全搞定
机器人模型已经能根据“把杯子放进篮子”这类指令完成任务,但用哪只手?
1W+优质提示词!这个网站塞满了神级AI出图Prompt,复制就能直接用
今天给大家分享一个我最近经常刷的灵感外挂。
从 OpenClaw 到 FastClaw:如何设计优秀的多 Agent 架构
做了一年 Agent 基础设施,踩了无数坑,我终于想明白了一件事:好的 Agent 架构不是把所有功能塞进一个进程,而是让每一层都能独立演化。
AI中转站正在「裸奔」:清华团队提出首个可信原生中转基础设施TrustedARI
当 AI 智能体真正开始干活,它的每一次请求,都要经过一个你看不见的「中间人」。
过程比结果重要:一个不给标准答案的调参框架,让Agent自己把数据库性能榨出来
数据库自动调参,一直是大模型Agent的“看似完美、实则翻车”名场面。
Sakana AI发布模型Fugu Ultra,号称比肩Claude Fable
就在所有人还在为Claude Fable 5的突然消失而懵圈时,Sakana AI却高调宣布:我们的Fugu比肩Fable,还不怕出口管制。
何恺明团队发布像素空间文生图模型MiniT2I
文本生成图像的领域早已经是一片红海,看上去已经卷无可卷了。
同样算力质量更高,西湖大学把扩散缓存做成了“离线搜索题”
扩散模型生成得越来越好,但也越来越慢。
入选ECCV 2026!清华开源空间模型打败Gemini:真正的空间智能是在世界变化中持续学习
在机器人、自动驾驶、AR等真实场景中,空间理解从来都不是“看一眼图像”就能解决的问题。
不靠专家出题,8万条人类终端录像,炼成首个真实CLI工作流基准TerminalWorld
AI Agent 正在重塑软件开发。写代码、修 bug,它的能力肉眼可见地往上涨。但软件开发,从来不止 "写代码" 这一件事。装环境、配依赖、部署服务、编排容器、管理云资源、处理安全策略,这些 "让软件活起来" 的脏活累活,才是真实开发的大头。而它们,几乎都发生在同一个地方:终端。
清华NANO滤波器:非线性贝叶斯状态估计迈入优化迭代计算的新范式
NANO滤波器是一种新的非线性贝叶斯状态估计方法,它不依赖线性化模型,而是将预测和更新步骤转化为优化问题。这种方法在高斯分布空间中使用自然梯度,更精确地逼近最优后验,同时利用Stein引理避免显式求导,提升鲁棒性。
AI跑团/角色扮演为什么越玩越无聊?因为缺了一个导演系统!
深度长文分析!对AI原生游戏的探索!超长文章超多古法手搓!!
OpenAI发布最新里程碑:对齐的本质是「人格」
就在最近,OpenAI扔出一篇重磅论文。他们发现,只教AI好好看病,它写代码居然也不作弊了。方法简单到离谱:拿5%的训练数据,教模型在回答健康问题时诚实、谨慎、知错能改。