Token导航 LogoToken导航TokenDH.com

大模型 方向最近有哪些内容值得看

今日资讯 大模型

大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。

如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。

大模型资讯

3,263

正文图片

13,217

3.45亿月活扛不住算力账单:​豆包收费,​揭开大模型“免费午餐”的残酷真相

3.45亿月活扛不住算力账单:​豆包收费,​揭开大模型“免费午餐”的残酷真相

每经记者|李宇彤 每经编辑|余婷婷 豆包,终于向用户开出了第一份付费账单。 5月4日,当月活3.45亿、国内C端(消费者)用户规模第一的豆包,官宣68元/月至500元/月不等的分层订阅付费,国内大模型行业“免费为主、付费试水”的平衡被彻底打破。 图片来源:App Store截图 ...

暂无图片

大模型24小时融资狂潮:Kimi、阶跃星辰豪揽45亿美金,百模大战下估值剧烈分化

每经记者|郑欣蔚 每经编辑|毕陆名 5月8日,国产大模型赛道的资本热潮再添一把火。 据消息人士向《每日经济新闻》记者透露,“AI六小虎”成员阶跃星辰将完成近25亿美元融资。与此同时,公司已完成股份制改造,红筹架构拆除工作落地收尾,港股IPO冲刺按下快进键,剑指“国产大模型第三股”...

DeepSeek多模态模型来了 已公布技术报告

DeepSeek多模态模型来了 已公布技术报告

每经记者|叶晓丹 每经编辑|廖丹 4月30日,《每日经济新闻》记者注意到,DeepSeek在Github上正式发布了多模态模型,公布了背后的技术报告。 图片来源:Github网站 DeepSeek在技术报告中提到,尽管多模态大语言模型(MLLMs)取得了显著进展,但主流的思维链(...

2026-05-13 00:41
时隔两周中国AI大模型周调用量再超美国,腾讯Hy3 preview (free)位居榜首,DeepSeek-V4-Flash上榜环比增344%

时隔两周中国AI大模型周调用量再超美国,腾讯Hy3 preview (free)位居榜首,DeepSeek-V4-Flash上榜环比增344%

每经记者|宋欣悦 每经编辑|高涵 《每日经济新闻》根据OpenRouter最新数据测算,上周(4月27日至5月3日)全球AI大模型总调用量为23.9万亿Token,较此前一周增长8.6%,连续两周上涨。 其中,上榜的AI大模型中,中国AI大模型的周调用量上升至7.942万亿Tok...

2026-05-13 00:41
“五一”出游新趋势:AI成“大脑”,大模型旅游推荐信源暗藏啥玄机?

“五一”出游新趋势:AI成“大脑”,大模型旅游推荐信源暗藏啥玄机?

每经记者|宋欣悦 特约记者 温沐夏 每经编辑|张益铭 这个“五一”假期,“让豆包、点点等大模型做份旅游攻略”成为大众出行前的主流操作。从目的地选择、行程规划到食宿推荐,AI(人工智能)彻底改变了传统旅游决策模式。 但你有没有想过,我们随手用大模型生成的旅行攻略,背后真正支撑的信源...

2026-05-13 00:41
AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为

AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为

在过去两年的大模型工业化进程中,安全审计始终遵循着一套 “猫鼠游戏” 的默认设定:开发者微调模型以增强能力,而安全专家则通过红队测试(Red Teaming)或白盒探测来寻找潜在的 “后门” 或 “偏见”。这套逻辑的前提是:模型是一个被动的受访者,它的行为必须由外部观测者通过穷举...

CVPR 2026 世界模型论文全景梳理:从生成到建模的关键转变

CVPR 2026 世界模型论文全景梳理:从生成到建模的关键转变

在过去几年中,视频生成技术取得了令人瞩目的进展。从基于扩散模型的方法到大规模视频基础模型,生成结果在视觉质量上已经逐渐逼近真实世界。然而,当我们进一步审视这些模型时,一个更本质的问题开始显现:它们究竟是在“理解世界”,还是仅仅在“拟合像素分布”? 传统视频生成方法大多建立在 2D...

2026-05-13 00:41
深度解析:DeepSeek不差钱,为什么还要融500亿?

深度解析:DeepSeek不差钱,为什么还要融500亿?

某位多次接近梁文锋的顶级投资人曾无奈向雷峰网表示:梁文锋最讨厌两件事:跟VC吃饭,对外解释DeepSeek的决策。 这位幻方量化出身的程序员创业者,过去两年对所有找上门来的投资人说过同一句话——"VC的钱是负担"。腾讯来谈过,阿里来谈过,市面几乎每一家顶级风投都在他的闭门羹列表里...

2026-05-13 00:41
2050学习节「AGI 4 Science」专场:17位青年学者「挤」在3小时里,都讲了些什么?

2050学习节「AGI 4 Science」专场:17位青年学者「挤」在3小时里,都讲了些什么?

我们选择的道路,谁与我们同行,我们最终抵达何方。 作者丨周 蕾 编辑丨 岑 峰 2050是阿里云创始人王坚博士发起的一个非营利活动,自2018年起每年4月最后一个周末在杭州云栖小镇举办,定位是“年青人因科技而团聚”。它没有传统会议的“主办方—嘉宾”结构,而是一个由自愿者驱动、年青...

2026-05-13 00:41
从「座上宾」到「主战场」:具身智能如何完成对计算机视觉的「范式夺权」?| CVPR 2026

从「座上宾」到「主战场」:具身智能如何完成对计算机视觉的「范式夺权」?| CVPR 2026

当机器从识别图像走向介入现实,视觉研究的边界也被重新划定。 作者丨郑佳美 编辑丨马晓宁 如果您漫步在 CVPR 2026 的会场,会产生一种强烈的错觉:自己是不是跑错了场馆,误入了 ICRA 或者 IROS 的现场?满屏的机械臂抓取、足式机器人的越野导航、以及在虚拟沙盒中进行千亿...

2026-05-13 00:41
东南大学耿新团队:模型不是不会做,而是被「挤掉了能力」丨CVPR 2026

东南大学耿新团队:模型不是不会做,而是被「挤掉了能力」丨CVPR 2026

你可能遇到过这样一种情况,一个模型原本只做一件事的时候表现很好,但一旦不断往里面加新任务,它反而开始变差了。不是彻底失效,而是变得不稳定,有些能力开始下降,有些结果开始波动。问题不在于模型不会,而在于它原本会的东西,被后来加入的任务“挤掉了一部分”。 这背后其实有一个很少被说清楚...

2026-05-13 00:41
暂无图片

第一视角效率超过真机,深度机智发布全球首个以人类学习范式构建的具身基座模型

2026年,具身智能的泡沫与烈火同时燃烧。 宇树科技递交招股书,估值冲击百亿;Figure AI、Physical Intelligence等美国公司融资额屡创新高,将行业热度推向顶点。国内创业公司紧急跟进——堆数据、抢场景、拼本体,十万小时真机数据成为新的军备竞赛标的。 但喧嚣...

大模型不再只是生成:智象未来CTO姚霆谈AI如何开始“完成”一个“创作”

大模型不再只是生成:智象未来CTO姚霆谈AI如何开始“完成”一个“创作”

过去一年,AI行业一个越来越清晰的变化是,真正拉开差距的,已经不再只是某个模型单项能力是否更强,而是谁能把“能力”组织成“任务”,再把“任务”沉淀为“系统”。 文生图、图生视频、视频生成、3D生成、动作生成,这些曾经被分别讨论的技术模块,正在被重新放回同一个问题之下:如果未来的模...

2026-05-13 00:41
暂无图片

独家丨雷军马云罕见握手,千寻智能30天完成30亿元融资

据AI科技评论独家获悉,2026年4月7日,千寻智能完成新一轮10亿元融资。本轮融资由顺为资本、云锋基金联合领投,达晨财智、某头部人民币基金、银河源汇、图灵基金、新鼎资本、庚辛资本等重磅加持。 这距离该公司2月份完成的近20亿元融资,仅过去30天。(雷峰网) 30天内两轮融资累计...