你以为是 AI 在干活,其实那个循环一直是你——一个 OpenAI 员工聊 loop engineering
OpenAI 的 tevfik 写了篇关于 loop engineering 的文章,开头那句我读完顿了一下。他说,他和 coding agent 协作,到现在大多还是同一个流程:我解释一个任务,等结果,审一遍,再发下一条指令。代码是 agent 写的,但我在后台还干着另一份活——我记着发生了什么、决定下一步做什么、判断这事到底完成没。
斯坦福报告:中国自主培养,顶尖AI人才崛起
斯坦福胡佛研究所追踪了 DeepSeek 七篇论文背后 356 名研究者的完整职业轨迹。美国培养出的最优秀 AI 人才正在大规模回流中国,而中国本土管道已经能独立产出前沿模型的核心贡献者。
从“一句成片”到“长轨推演”:探究多模态智能体在长视频编辑中的应用
近年来,大语言模型(LLMs)在长篇视觉叙事中展现出卓越潜力,生产方式正迅速从单一模型生成转向面向生产的智能体系统。但长视频剪辑仍然是一个极难控制的长期任务。模型有时会在缺乏素材依据的情况下强行生成,甚至在面对明显断档的转场或人物不一致时依然“盲目拼接”。
AI接管数字世界!华为Claw-Anything:面向跨设备、跨时间、跨服务的Claw评测与数据引擎
我们相信,常驻型 (always-on) AI 助理的下一次飞跃,不在于把某一个模型单点调得更聪明,而在于扩展智能体的上下文 (Scaling Agent Context)—— 不断拓宽助理能够持续 "感知 — 推理 — 执行" 的范围,作为生活连接器连接用户的信息孤岛,直到它能接管用户的整个数字世界。
沿着何恺明团队「漂移模型」再走一步:奖励只需排名,单步文生图偏好优化提速3.51倍
来自西湖大学和香港中文大学(深圳)的团队沿着这一思路提出 Drifting Preference Optimization(DrPO),把漂移场用于单步文生图模型的偏好后训练。在 DrPO 中,奖励只负责对候选图像排序,不参与反向传播。具体而言,针对同一个文本提示词,当前模型生成一组候选图像。高分样本在特征空间中产生吸引,低分样本产生排斥,并结合参考模型约束给出模型的更新方向。
CameraSquad:精准运镜,多视角一致——视频世界模型的空间智能新范式
如今,CameraSquad 的出现,让这种多视角一致的视频生成与 3D 世界状态构建成为现实。近日,中国科学院大学高林研究员团队联合卡迪夫大学、香港科技大学和快手可灵团队,提出了一种面向多轨迹并行生成的相机可控视频生成方法 CameraSquad [1],相关论文已被 ACM SIGGRAPH 2026 录用。
ICML 2026|从「鉴伪」到「修复」,AI图像取证进入闭环时代
对于 AI 生成图像中可能存在的不自然伪影,我们是否不仅能够将其定位和解释,还能进一步对其进行修复,使图像恢复为更加真实、自然的视觉外观?围绕这一问题,来自北京大学等机构的研究者提出了 GenShield:一个统一的自回归框架,将 AI 生成图像检测 与 图像伪影修复 结合到同一个闭环中,实现从 “诊断” 到 “修复” 的一体化建模。
深入理解 Claude Code:从 CLAUDE.md 到 Hooks、Skills、Subagents..
在常规的对话外,Claude Code(也可以是 Codex)其实还提供了一些别样的控制(或者说:上下文注入)方法,比如:CLAUDE.md、Rules、Skills、Subagents、Hooks、Output Styles、以及 System Prompt Append
LLM终于学会推公式了!博世x清华推出FunctionEvolve:LLM-SRBench提升3.6倍,AI-Feynman满分
来自博世中央研究院与清华大学的研究人员提出 FunctionEvolve 框架,在两大基准测试上大幅刷新了这项任务的结果。在 LLM-SRBench 的 129 个合成科学方程任务上,FunctionEvolve 最终给出的公式在 55.8% 的任务上与真实公式等价(SA@1 = 72/129),是此前最好结果的 3.6 倍;
碰撞暴降45.5%、200km 0接管!港大团队:自动驾驶真正的突破不在预训练,在后训练
香港大学李弘扬团队联合华为、上海创智学院及清华大学李升波教授团队,发表的最新论文World Engine: Towards the Era of Post-Training for Autonomous Driving给出了系统回答。
ICML 2026|Agent通讯的「运营商」哪家强?UIUC团队发布ProtocolBench
多智能体系统正在从学界走向业界。 在 Coding、Research 等真实场景里,越来越多系统不再只依赖单个 agent,而是由多个 Agent 分工协作:有人负责规划,有人负责检索,有人调用工具,
快手开源GoLongRL:23K样本、9大任务类型,长上下文RL荒的时代结束了
本研究由快手科技语言大模型团队完成,核心作者吕民轩、梅铁桦、杜坦隆等。快手科技与中国科学院大学联合提出 GoLongRL,一套完全开源的长上下文强化学习后训练方案,包含 23K 样本 RLVR 数据集
3D混合堆叠突破内存墙,16TB/s超大带宽释放大算力
专注3D架构AI云端大算力芯片研发设计的算苗科技今日宣布,旗下面向大模型推理的3D TokenPU芯片A4E已于6月15日正式流片,标志着中国在高端AI算力芯片领域,实现依托国产供应链、采用3D混合堆叠架构的大模型专用处理器落地,有望为国内大模型产业提供自主可控、高性能、高性价比的算力支撑。
星思半导体深耕应急通信场景,手机直连卫星企业成为行业重要力量
从千帆星座密集组网到手机直连试验星成功入轨,低轨卫星互联网正加速从“规模组网”走向“规模应用”。当自然灾害切断地面基站、人们进入偏远地区信号盲区或者全球搜救需要实时通信保障时,手机直连卫星技术便成为维系被困人群与外界进行联络的关键手段。
iPhone Air 2 将配置后置双摄和提升电池续航,重拾用户对轻薄机身的信心
市场对采用轻薄机身的智能手机反响不佳,因此 iPhone Air 初代产品在主要市场未能掀起浪花。
从非洲到全球南方:传音本地化模式开花结果,新兴市场信赖再升级
根据市场研究机构Omdia发布的数据显示,尽管一季度全球市场需求整体疲软,但传音控股展现出独特的经营韧性。报告期内,传音智能手机出货量同比微降,但营收实现24.58%的同比增长。这一逆向增长曲线背后,是传音在非洲之外的新兴市场稳定发力,充分印证了其深耕多年的本地化模式具备跨区域的生命力与可复制性。
让科技走进日常,启元推动个人机器人迈进大众消费市场
6月17日,启元机器人授权体验店亚洲首店围挡现身深圳卓悦中心,并于线上同步发布“你好,世界”主题品牌海报。这一双线联动的重磅动作,标志着启元从技术研发阶段全面转向市场落地阶段,消费级人形机器人走进个人用户迈出了里程碑式的关键一步。
睿创燧石全系列短波红外产品,赋能半导体、生物科研多元应用
短波红外(Short-Wave Infrared,简称SWIR)依赖物体对光线的反射作用成像,光线经物体吸收与反射形成差异化信号,由相机采集后生成清晰的灰度图像。睿创微纳智能光电品牌Raythink睿创燧石,短波产品矩阵丰富,包括线阵、焦平面阵列和高分辨率格式,可广泛应用于材料分选、半导体检测、生物科研等场景。
越疆将发布下一代陪伴交互AI人形机器人,以自研大模型重新定义家庭具身智能
2026年6月,深圳市越疆科技股份有限公司(02432.HK)预告即将发布下一代陪伴交互AI人形机器人,宣告重新定义家庭具身智能赛道。这款新品以越疆全栈自研的“空弈DobotWAM”具身大模型为智能大脑,具备理解人、适配人、服务人的全维度智能能力,标志着人形机器人从工商业场景向真实家庭场景的里程碑式跨越。
云从科技参与共建广州市粤港澳大湾区人工智能应用赋能中心
6月18日,在广州市发展和改革委员会(广州市人工智能产业发展办公室)指导下,广州市粤港澳大湾区人工智能应用赋能中心正式成立并揭牌。云从科技联合创始人、董事刘君代表公司出席揭牌仪式。