智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册

1080条提示词、7款模型大比拼:视频生成离「好看、好用又准确」还差多少?

当视频生成模型走出娱乐创作的舒适区,进入科学、医疗、教育等知识密集场景,它们是否还能生成事实准确、清晰可用的视频?

AITNT 2026-06-16 163 AI技术

ICLR 2026|美图提出位置编码场 PE-Field ,让 DiT 感知和控制 3D 空间

PE-Field将传统的2D位置编码扩展为结构化的3D场,使DiT能够更加直接地在3D空间中处理几何信息。

AITNT 2026-06-16 185 AI技术

低成本复刻Fable 5的路子找到了:OrcaRouter多模型组队,性能反超

AI网关OrcaRouter最近上线了一套可编程路由策略Routing DSL,多个模型同时答题,自动仲裁出最优解。几个你现在就能调用的“常规模型”,给它来个组合编排,跑出来的综合胜率,直接掀翻了Fable 5的单体基准线。Opus 4.8打不过Fable 5,GPT-5.5也单挑不过,但这两个拼一组,结果就反超了。

AITNT 2026-06-15 211 AI技术

一夜反转!「杀进第一梯队」的巴西LLM竟「套壳缝合」了国产模型

昨天,AI 圈大都被这一新闻「刷屏」:巴西里约热内卢市政府旗下的一家 IT 公司,平地一声雷地推出一款名为「Rio 3.5」397B 的开源模型,甚至还一路逆袭杀进了全球第一梯队,超越 Qwen 3.7 Plus 等开源模型,在多项基准测试中斩获 SOTA 性能。

AITNT 2026-06-15 234 AI技术

Agent终于长出了身体:Jiuwen Symbiosis背后的思考与实践

如果你在三年前问AI圈:未来最强的AI长什么样?

AITNT 2026-06-15 171 AI技术

代码定位太慢?蚂蚁ACL2026新作:FuseSearch-4B让模型自己学会「该搜多少」

新智元报道 【新智元导读】FuseSearch:学习型自适应并行执行 —— 一个40亿参数的模型,凭什么在代码定位上干过了商用闭源大模型?答案只有四个字:搜得更聪明。 在AI编程狂飙突进的今天,一个尴

AITNT 2026-06-15 217 AI技术

把真实GitHub仓库转化为可执行终端轨迹!TerminalTraj入选ICML 2026

被ICML 2026接收为Spotlight!

AITNT 2026-06-15 199 AI技术

HuggingFace CEO力荐,Bengio团队也押注:这个1500美元训出的HRM模型,凭什么火了?

好家伙,这次不是模型圈自嗨。

AITNT 2026-06-15 234 AI技术

啥?Fable 5一出,Skill和Prompt都白学了?

Workflow、Skill、SOP,可能真的要过时了。

AITNT 2026-06-15 208 AI技术

登Nature子刊!清华团队提出全球气候模态统一预测模型UniCM

全球气候异常事件正在深刻影响农业生产、水资源调度、能源管理和防灾减灾。

AITNT 2026-06-15 192 AI技术

不到 5 分钟复刻《我的世界》,Kimi K2.7 Code 到底有多能打?

朋友们,Kimi 又更新了。

AITNT 2026-06-15 195 AI产品

视频生成作为多模态推理新范式 | CVPR 2026

被CVPR 2026收录!

AITNT 2026-06-15 227 AI技术

0.6B VLM重塑AI修图推理流程,支持手机端侧部署,vivo+浙大出品

如今手机拍照已成日常,后期修图是提升照片质感的关键。

AITNT 2026-06-15 161 AI技术

BudgetMem:给Runtime Agent Memory装上「预算路由器」,让记忆系统学会按需分配运行成本

当 LLM Agent 处理长期对话、多轮交互和复杂文档时,Memory 已经成为不可或缺的核心模块。它帮助智能体保存历史、检索信息、维持个性化上下文,并支撑跨时间的推理能力。

AITNT 2026-06-15 250 AI技术

华为SpaceMind登顶空间智能权威榜:纯RGB视觉语言模型拿下70.6分,刷新李飞飞榜单记录

大模型已经能流畅对话、看图识物,但一个更底层的问题始终没被真正解决——它们是否「理解」了我们所处的三维世界?

AITNT 2026-06-15 182 AI技术

图片越糊越危险?西湖大学发现多模态大模型「攻击舒适区」

多模态大模型越来越会读图中文字,但最新研究显示,「读得出来」并不等于「防得住」。西湖大学 AGI Lab 的研究团队发现,当有害文本被渲染成低清、模糊或带噪图片后,模型在一个特定清晰度区间内反而更容易被越狱。

AITNT 2026-06-15 178 AI技术

看不清就乱答?多模态大模型的这个毛病终于有解了 | ICML 2026

雨雪、雾霾、镜头噪点、压缩失真、夜间弱光……

AITNT 2026-06-15 173 AI技术

KV Cache终于不用无脑全留了!百度&复旦用「投资回报率」重新分配缓存|ICML 2026

随着AI Coding、Agent、Deep Research 等应用快速普及,模型单次处理的上下文长度正在从几万Token迈向几十万甚至百万Token。

AITNT 2026-06-15 190 AI技术

CVPR 2026 | GaussianDWM:用3D高斯表示统一自动驾驶场景理解与多模态生成

自动驾驶世界模型的研究目标已经从单纯预测未来视觉帧,扩展到构建可用于场景理解、空间定位和后续决策的世界表示。如果模型只能生成外观上合理的未来图像,却无法回答场景中有哪些目标、目标位于何处,以及不同视角下的空间结构如何变化,那么它仍然缺少对三维驾驶环境的显式建模能力。

AITNT 2026-06-15 218 AI技术

PEFT方法评测不能只看下游分:通用能力损失也该被量化

近期,来自香港中文大学、西湖大学、德国马普所等机构的研究者提出了 PEFT-Arena —— 一个从稳定性‑可塑性权衡(stability–plasticity trade-off)视角重新审视 PEFT 方法的评测基准与分析框架。该工作已在 ICLR 2026 相关 workshop 上进行了展示,并开源了完整代码。

AITNT 2026-06-14 184 AI技术