Token导航 LogoToken导航

学术研究 方向最近有哪些内容值得看

今日资讯 学术研究

学术研究 方向的重要产品、公司和事件变化,会在这里更集中地出现。

学术研究资讯

1,643

正文图片

8,217

CVPR 2026 3D 视觉前沿梳理:模型正在学会理解、生成和构建世界

CVPR 2026 3D 视觉前沿梳理:模型正在学会理解、生成和构建世界

3D 视觉正从重建生成,走向空间理解、动态模拟与工程化应用。 作者丨郑佳美 编辑丨岑 峰 如果说过去几年的视觉 AI 主要是在回答“模型能不能看懂一张图”,那么到 CVPR 2026,一个更清晰的趋势正在浮现: 模型正在被要求理解图像背后的三维世界。 二维图像只是现实世界在某个视...

2026-05-13 00:41
清华段岳圻团队论文:从调参数到做控制,文生图迎来一次方法论升级丨CVPR 2026

清华段岳圻团队论文:从调参数到做控制,文生图迎来一次方法论升级丨CVPR 2026

很多人在使用文生图工具时都会遇到类似的情况,输入一段很清晰的描述,希望画面中人物站在左边、动物在右边,或者希望海报上出现一段完整可读的文字,但生成结果却常常让人失望。 要么位置关系混乱,要么文字变形,要么整体画面看起来不自然。继续调整参数,有时结果会更接近描述,但画面质量却明显下...

2026-05-13 00:41
RAM——复杂场景下多人3D人体运动重建新框架 | CVPR 2026

RAM——复杂场景下多人3D人体运动重建新框架 | CVPR 2026

一、研究背景 从视频中准确理解并重建人体3D运动是计算机视觉的重要研究方向,在体育赛事分析、VR/AR、人机交互以及医疗康复等领域具有广泛应用价值。然而,在真实复杂场景中,该任务仍面临三大严峻挑战: 首先是身份关联不稳定——多人交互时,频繁的遮挡和快速运动容易导致ID Switc...

2026-05-13 00:41
上交大 x vivo 团队:一个简单改动,让 diffusion 全面提升丨CVPR 2026

上交大 x vivo 团队:一个简单改动,让 diffusion 全面提升丨CVPR 2026

很多人第一次觉得图像生成模型已经足够强,往往是在它能快速画出一张看上去不错的图的时候。但真正开始频繁使用之后,又会慢慢发现另一面。 比如做一张活动主视觉,前几次生成里主体、色调、氛围都对了,可一放大细节就会发现手部、材质、边缘关系经不起看。再比如给一篇文章配封面,模型明明理解了主...

2026-05-13 00:41
对话清华商宇丨从生成视频到支撑行动,世界模型需要新的评测标准

对话清华商宇丨从生成视频到支撑行动,世界模型需要新的评测标准

在今天的 AI 叙事里,“世界模型”几乎成了通往具身智能的必经之路。 它被期待理解物理规律、预测环境变化,并为机器人决策提供依据。但一个尖锐的问题是:当一个模型能生成一段足够逼真的未来视频时,我们究竟该相信它真的理解了世界,还是只是更擅长复刻世界的表象? 咬了一口的苹果会自动愈合...

2026-05-13 00:41
西湖大学张驰团队:不重训,也能让视频生成更长更稳丨CVPR 2026

西湖大学张驰团队:不重训,也能让视频生成更长更稳丨CVPR 2026

过去一段时间,AI 视频最让人惊艳的,往往都是前几秒。人物状态自然,光影氛围到位,动作也足够流畅,很容易让人产生一种感觉,视频生成已经离真正可用不远了。 但行业越往前走,问题也越清楚,真正难的从来不是做出一小段漂亮画面,而是能不能把这种质量稳定地延续下去。一旦视频时长被拉长,很多...

2026-05-13 00:41
CVPR 2026 世界模型论文全景梳理:从生成到建模的关键转变

CVPR 2026 世界模型论文全景梳理:从生成到建模的关键转变

在过去几年中,视频生成技术取得了令人瞩目的进展。从基于扩散模型的方法到大规模视频基础模型,生成结果在视觉质量上已经逐渐逼近真实世界。然而,当我们进一步审视这些模型时,一个更本质的问题开始显现:它们究竟是在“理解世界”,还是仅仅在“拟合像素分布”? 传统视频生成方法大多建立在 2D...

2026-05-13 00:41
西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026

西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026

过去两年,视频生成的发展几乎是指数级的。从最早只能生成模糊片段,到如今可以生成具有叙事结构、光影一致性甚至风格控制的长视频,行业表面上已经接近一个阶段性成熟。 但如果把评价标准从“能不能生成一段视频”稍微提高到“能不能控制镜头”,问题就会完全暴露出来。当前大多数模型仍然停留在一种...

2026-05-13 00:41
港中文薛天帆团队:实现 4K 全景视频生成,普通视频也能「长出空间」丨CVPR 2026

港中文薛天帆团队:实现 4K 全景视频生成,普通视频也能「长出空间」丨CVPR 2026

很多人都经历过这样一种落差。现实里的空间是立体的,是包围人的,是可以转身、抬头、回望的,可一旦被手机或相机拍成视频,世界立刻被压缩成一个窄窄的取景框。 暴雨来临前的天空并不只在镜头正前方,深夜街区的压迫感也不只来自路面,商场中庭、地下车站、展馆大厅、建筑内部,这些真正让人产生现场...

2026-05-13 00:41
上海人工智能实验室联合商汤大装置等共建AI全链路验证平台与生态社区

上海人工智能实验室联合商汤大装置等共建AI全链路验证平台与生态社区

近日,在第二届浦江AI学术年会上,上海人工智能实验室(上海AI实验室)联合北京智源研究院、中国科学院计算技术研究所、北京开源芯片研究院、商汤科技、IDEA数字经济研究院等机构,共同发起“国产软硬件适配验证合作计划”。该计划拟推出覆盖AI全流程的软硬件验证平台及自主生态社区,并预计...

2026-05-13 00:41
暂无图片

2026年了,AI Agent为什么还是“Demo很惊艳,上线就翻车”?

本文来自微信公众号: 人人都是产品经理 ,作者:周周粥粥 每次看到某个AI Agent产品发布demo,评论区清一色“太强了”“颠覆认知”,过两周再看,同一批人在骂“垃圾”“根本不能用”“又是智商税”。 这个循环从2024年延续到2026年,好像从来没有真正被打破过。 很多人把原...

中国拿下这届AI 顶会半壁江山,清华一家单挑斯坦福加MIT

中国拿下这届AI 顶会半壁江山,清华一家单挑斯坦福加MIT

本文来自微信公众号: APPSO ,作者:发现明日产品的,原文标题:《中国拿下这届 AI 顶会半壁江山,清华一家单挑斯坦福加 MIT》 全球AI顶会,快成中国卷王的专场了。 每年AI顶会放榜,各大机构都会暗戳戳地发喜报,比拼谁家被收录的论文多。但今年ICLR(国际学习表征会议)放...

2026-05-13 00:41