Token导航 LogoToken导航TokenDH.com

大模型 方向最近有哪些内容值得看

今日资讯 大模型

大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。

如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。

大模型资讯

3,233

正文图片

13,097

究竟该如何给DeepSeek估值

究竟该如何给DeepSeek估值

作者 | 王兆洋 邮箱 | wangzhaoyang@pingwest.com 三周之内,在公开报道里 DeepSeek 的估值四次改写: 4月初约100亿美元“启动融资”,4月22日的报道称其估值超过200亿美元,5月6日传出“ 大基金 ”洽谈领投,估值约450亿美元,而上周最...

暂无图片

数据的第三种形态:艺恩如何为大模型提供多模态的数据弹药

一、凌晨两点的训练Run,和一个没人问的问题 凌晨两点,北京某多模态大模型实验室。大屏上,一个正在进行的预训练Run跑到了第47小时。技术负责人盯着Loss曲线抖了一下,然后把椅子转回来说了一句:“我们缺的不是卡,是干净、对齐、能被复用的多模态语料。” 这不是个例。2026年4月...

2026-05-13 00:41
北京智源发布FlagSafe大模型安全体系

北京智源发布FlagSafe大模型安全体系

品玩5月11日讯,北京智源人工智能研究院联合北大、北航等机构正式发布FlagSafe大模型安全体系。该体系聚焦红队演练、蓝队防御与白盒透视三大方向,旨在构建覆盖风险发现、治理与解释的完整闭环。 针对跨模态及具身智能带来的复合风险,FlagSafe确立五项安全红线,并建立全面评估基...

2026-05-13 00:41
究竟该如何给DeepSeek估值

究竟该如何给DeepSeek估值

三周之内,在公开报道里DeepSeek的估值四次改写: 4月初约100亿美元“启动融资”,4月22日的报道称其估值超过200亿美元,5月6日传出“大基金”洽谈领投,估值约450亿美元,而上周最新传出的估值上限是超500亿美元——若成真,这会是中国AI公司有史以来最大的单轮融资。 ...

云知声山海知医慧保大模型重磅发布:以高密智能深耕高价值场景,重构医疗保险数智新生态

云知声山海知医慧保大模型重磅发布:以高密智能深耕高价值场景,重构医疗保险数智新生态

医疗数据知识浩如烟海,医疗保险业务规则纷繁庞杂。医保(社保中的医疗保险)、商保(商业医疗保险,如医疗险、重疾险等)均为国计民生高价值场景,关乎基金安全、公共利益与群众切身权益,对精准性、合规性、安全性、可追溯性提出极致要求。AI 如何真正读懂复杂病历、穿透海量单据、助力医保基金监...

3.45亿月活扛不住算力账单:​豆包收费,​揭开大模型“免费午餐”的残酷真相

3.45亿月活扛不住算力账单:​豆包收费,​揭开大模型“免费午餐”的残酷真相

每经记者|李宇彤 每经编辑|余婷婷 豆包,终于向用户开出了第一份付费账单。 5月4日,当月活3.45亿、国内C端(消费者)用户规模第一的豆包,官宣68元/月至500元/月不等的分层订阅付费,国内大模型行业“免费为主、付费试水”的平衡被彻底打破。 图片来源:App Store截图 ...

暂无图片

大模型24小时融资狂潮:Kimi、阶跃星辰豪揽45亿美金,百模大战下估值剧烈分化

每经记者|郑欣蔚 每经编辑|毕陆名 5月8日,国产大模型赛道的资本热潮再添一把火。 据消息人士向《每日经济新闻》记者透露,“AI六小虎”成员阶跃星辰将完成近25亿美元融资。与此同时,公司已完成股份制改造,红筹架构拆除工作落地收尾,港股IPO冲刺按下快进键,剑指“国产大模型第三股”...

DeepSeek多模态模型来了 已公布技术报告

DeepSeek多模态模型来了 已公布技术报告

每经记者|叶晓丹 每经编辑|廖丹 4月30日,《每日经济新闻》记者注意到,DeepSeek在Github上正式发布了多模态模型,公布了背后的技术报告。 图片来源:Github网站 DeepSeek在技术报告中提到,尽管多模态大语言模型(MLLMs)取得了显著进展,但主流的思维链(...

2026-05-13 00:41
时隔两周中国AI大模型周调用量再超美国,腾讯Hy3 preview (free)位居榜首,DeepSeek-V4-Flash上榜环比增344%

时隔两周中国AI大模型周调用量再超美国,腾讯Hy3 preview (free)位居榜首,DeepSeek-V4-Flash上榜环比增344%

每经记者|宋欣悦 每经编辑|高涵 《每日经济新闻》根据OpenRouter最新数据测算,上周(4月27日至5月3日)全球AI大模型总调用量为23.9万亿Token,较此前一周增长8.6%,连续两周上涨。 其中,上榜的AI大模型中,中国AI大模型的周调用量上升至7.942万亿Tok...

2026-05-13 00:41
“五一”出游新趋势:AI成“大脑”,大模型旅游推荐信源暗藏啥玄机?

“五一”出游新趋势:AI成“大脑”,大模型旅游推荐信源暗藏啥玄机?

每经记者|宋欣悦 特约记者 温沐夏 每经编辑|张益铭 这个“五一”假期,“让豆包、点点等大模型做份旅游攻略”成为大众出行前的主流操作。从目的地选择、行程规划到食宿推荐,AI(人工智能)彻底改变了传统旅游决策模式。 但你有没有想过,我们随手用大模型生成的旅行攻略,背后真正支撑的信源...

2026-05-13 00:41
深度解析:DeepSeek不差钱,为什么还要融500亿?

深度解析:DeepSeek不差钱,为什么还要融500亿?

某位多次接近梁文锋的顶级投资人曾无奈向雷峰网表示:梁文锋最讨厌两件事:跟VC吃饭,对外解释DeepSeek的决策。 这位幻方量化出身的程序员创业者,过去两年对所有找上门来的投资人说过同一句话——"VC的钱是负担"。腾讯来谈过,阿里来谈过,市面几乎每一家顶级风投都在他的闭门羹列表里...

2026-05-13 00:41
AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为

AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为

在过去两年的大模型工业化进程中,安全审计始终遵循着一套 “猫鼠游戏” 的默认设定:开发者微调模型以增强能力,而安全专家则通过红队测试(Red Teaming)或白盒探测来寻找潜在的 “后门” 或 “偏见”。这套逻辑的前提是:模型是一个被动的受访者,它的行为必须由外部观测者通过穷举...

CVPR 2026 世界模型论文全景梳理:从生成到建模的关键转变

CVPR 2026 世界模型论文全景梳理:从生成到建模的关键转变

在过去几年中,视频生成技术取得了令人瞩目的进展。从基于扩散模型的方法到大规模视频基础模型,生成结果在视觉质量上已经逐渐逼近真实世界。然而,当我们进一步审视这些模型时,一个更本质的问题开始显现:它们究竟是在“理解世界”,还是仅仅在“拟合像素分布”? 传统视频生成方法大多建立在 2D...

2026-05-13 00:41