ECCV 2026 前瞻:LeCun 压轴演讲,中国团队发布轻量级人像模型与 CMU 提出通用 3D 修复方案

2026/08/27 16:13阅读量 2

ECCV 2026 将于 9 月 8-12 日在瑞典马尔默举行,官方议程揭晓,图灵奖得主 Yann LeCun 将领衔探讨基础模型,自动驾驶专家 Jamie Shotton 与视频感知学者 Kristen Grauman 共同聚焦世界模型与具身智能。技术亮点方面,东南大学等团队发布的 StreamTalk 模型以仅 71M 参数实现实时人像生成;卡内基梅隆大学提出的 FixAnything 则通过单一视频模型统一修复多种 3D 渲染伪影,为三维重建后处理提供新范式。

会议概况

欧洲计算机视觉会议(ECCV)作为计算机视觉领域三大顶会之一,第 19 届 ECCV 2026 将于 2026 年 9 月 8 日至 12 日在瑞典马尔默的 Malmö Arena 与 Malmömässan 会展中心举行。主会议及展览时间为 9 月 10 日至 12 日,研讨会和教程于 9 月 8 日至 9 日进行。

Keynote 核心议题:世界模型与自动驾驶

本届大会的学术主线明确指向“世界模型”、“自动驾驶”及“具身感知”。官方公布的三场 Keynote 嘉宾阵容如下:

  • Yann LeCun(Meta / 图灵奖得主):代表基础模型方向发表演讲。
  • Jamie Shotton(Wayve 首席科学家):聚焦自动驾驶中的世界模型应用。
  • Kristen Grauman(UT Austin / Meta FAIR):探讨视频理解与具身感知技术。
    此外,两场关于“AI in Research”的小组讨论将深入探讨 AI 在科研中的实际落地场景。工业界方面,PAL Robotics 将在 Expo 展区展示 TIAGo Pro 机械臂,演示视觉、仿真与物理 AI 的结合。

技术热点一:StreamTalk —— 极致轻量的人像生成模型

由中国东南大学、阿里巴巴及中国人民大学联合团队提出的 StreamTalk 模型,展示了在效率路线上的突破。该模型参数量仅为 71M,却能同时覆盖虚拟主播、远程呈现和互动 NPC 三大实时人像生成场景。这一进展表明,轻量级部署已成为中文多模态人像生成的重要趋势,对直播和虚拟人赛道具有直接的应用价值。

技术热点二:FixAnything —— 统一 3D 渲染修复范式

卡内基梅隆大学(CMU)Ramanan & Narasimhan 研究组发布了 FixAnything 模型。这是一个通用的视频模型,旨在解决 3D 表征后处理的痛点。它能够同时修复 3D 高斯泼溅(3DGS)、网格(mesh)以及稀疏点云渲染中产生的伪影,并输出具备照片级质量且 3D 一致的视频。该方法将原本分散的渲染修复任务统一收敛至视频生成模型,为游戏开发、仿真环境构建及三维重建流水线提供了新的工程解决方案。

其他值得关注的工作

  • TwinWorld Challenge:将于 9 月 8 日的研讨会现场公布结果。
  • 其他研讨会:包括 MELEX、FOUND、Safe World Models、MedVidU、SLoMO 及 QCVML 等主题,涵盖安全世界模型、医疗视频理解及高效视觉机器学习等前沿方向。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。