

Gemini Robotics ER 2: powering robotics with video understanding, task orchestration, and multi-robot collaboration
(翻译)Gemini Robotics ER 2:以视频理解、任务编排与多机器人协作赋能机器人
Gemini Robotics ER 2 is a step change in video understanding, tool orchestration, and multi-robot collaboration for robotic applications.

李飞飞、吴佳俊再联手,打破世界模型和机器人动作的「巴别塔」
作者丨 幸丽娟 编辑丨岑 峰  

LLM-Driven Autonomous Vehicles Inherit Human Driver Biases in Pedestrian Yielding: Results and Implications From A New Benchmark
(翻译)LLM驱动的自动驾驶汽车在行人让行中继承人类驾驶员的偏见:来自新基准的结果与启示
Abstract page for arXiv paper 2609.00192: LLM-Driven Autonomous Vehicles Inherit Human Driver Biases in Pedestrian Yielding: Results and Implications From A New Benchmark
李飞飞的 World Labs,把赛博朋克的「超梦」做出来了
#欢迎关注爱范儿官方微信公众号:爱范儿(微信号:ifanr),更多精彩内容第一时间为您奉上。


和梁文锋师出同门,浙大00后做世界模型,将再融10亿元|36氪首发
文|王欣逸 编辑|张雨忻 世界模型赛道将再添一笔大额融资。 《智能涌现》独家获悉,近日,专注做4D世界模型领域的魔芯科技即将新一轮融资,融资规模或达10亿元,估值也有望跃升至近100亿元。这将是他们今年的第五轮融资,也是近一个月以来的第二轮融资。
全球AI视频榜单第一梯队再添中国力量:智象发布首款物理规律导向视频模型
智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0
Yann LeCun 万字演讲:「预测像素」是伪命题,JEPA 也并非凭空而来 | ECCV 2026
作者丨 幸丽娟 编辑丨岑 峰  

我所了解的机器视觉检测产品应用(6):深度学习还是传统算法?先别比准确率,算三笔账
面对客户对深度学习样本和接手问题的担忧,本文从产品视角出发,通过数据、周期、接手三笔账,深入剖析传统机器视觉与深度学习的选型逻辑。八成项目混着用,但谁当主力、谁跑龙套,每个项目都不一样。PM的价值不是替客户选,而是把技术选择题翻译成客户答得上来的业务问题。


World Action Modeling with Progressive Visual Planning
(翻译)使用渐进式视觉规划的世界动作建模
Abstract page for arXiv paper 2610.02508: World Action Modeling with Progressive Visual Planning
Speaking the Navigator's Language: Trajectory-Grounded Instruction Translation for Frozen Aerial VLN Agents
(翻译)说导航器的语言:面向冻结空中 VLN 智能体的轨迹驱动指令翻译
Abstract page for arXiv paper 2610.10635: Speaking the Navigator's Language: Trajectory-Grounded Instruction Translation for Frozen Aerial VLN Agents
