
大模型首选格式Markdown,被30年前的工具取代了?
我才刚开始用Markdown不到一年,怎么现在Markdown就要被淘汰了? 事情经过是这样的, Claude Code 团队成员Thariq在X上发表了一篇文章,标题叫《Using Claude Code: The Unreasonable Effectiveness of H...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,233
正文图片
13,097

我才刚开始用Markdown不到一年,怎么现在Markdown就要被淘汰了? 事情经过是这样的, Claude Code 团队成员Thariq在X上发表了一篇文章,标题叫《Using Claude Code: The Unreasonable Effectiveness of H...

作者 | 王兆洋 邮箱 | wangzhaoyang@pingwest.com 三周之内,在公开报道里 DeepSeek 的估值四次改写: 4月初约100亿美元“启动融资”,4月22日的报道称其估值超过200亿美元,5月6日传出“ 大基金 ”洽谈领投,估值约450亿美元,而上周最...
一、凌晨两点的训练Run,和一个没人问的问题 凌晨两点,北京某多模态大模型实验室。大屏上,一个正在进行的预训练Run跑到了第47小时。技术负责人盯着Loss曲线抖了一下,然后把椅子转回来说了一句:“我们缺的不是卡,是干净、对齐、能被复用的多模态语料。” 这不是个例。2026年4月...

henry 发自 凹非寺 量子位 | 公众号 QbitAI VLA已死,世界动作模型当立。遥操已死,人类的传感器数据长存。 在今年的红杉AI Ascent 2026上,Jim Fan只用了20分钟,就给机器人行业连开了两场“葬礼”。 第一场,送别过去三年几乎统治具身智能的VLA;...

允中 发自 凹非寺 量子位 | 公众号 QbitAI 机器人拉个拉链,到底需不需要“脑子”? 过去几年,从OpenVLA到π0、π0.5,具身大模型已经能让机器人把指令和动作连得有模有样。 但一旦包的位置挪了几厘米,或者光照暗了一点,它们往往就会“大脑宕机”。 究其原因,是因为这...

品玩5月11日讯,北京智源人工智能研究院联合北大、北航等机构正式发布FlagSafe大模型安全体系。该体系聚焦红队演练、蓝队防御与白盒透视三大方向,旨在构建覆盖风险发现、治理与解释的完整闭环。 针对跨模态及具身智能带来的复合风险,FlagSafe确立五项安全红线,并建立全面评估基...

三周之内,在公开报道里DeepSeek的估值四次改写: 4月初约100亿美元“启动融资”,4月22日的报道称其估值超过200亿美元,5月6日传出“大基金”洽谈领投,估值约450亿美元,而上周最新传出的估值上限是超500亿美元——若成真,这会是中国AI公司有史以来最大的单轮融资。 ...

医疗数据知识浩如烟海,医疗保险业务规则纷繁庞杂。医保(社保中的医疗保险)、商保(商业医疗保险,如医疗险、重疾险等)均为国计民生高价值场景,关乎基金安全、公共利益与群众切身权益,对精准性、合规性、安全性、可追溯性提出极致要求。AI 如何真正读懂复杂病历、穿透海量单据、助力医保基金监...

传统数据中心过去主要用于数据的存储、检索与处理。但在生成式 AI 与代理式 AI 时代,这些设施已演变为 AI Token 工厂。随着 AI 推理成为其核心工作负载,它们的主要产出已转变为以 Token 形式制造的智能。 这一转变也需要对包括总体拥有成本(TCO)在内的 AI 基...

Jay 发自 凹非寺 量子位 | 公众号 QbitAI 中国AI研究员的性格、魅力和真诚……让人倍感亲切。 这是艾伦研究所(Ai2)的研究员 Nathan Lambert ,在最近结束中国之行后,发自内心的一番感慨。 在Nathan眼里, 国内的LLM圈子简直是天堂 ,大家彼此尊...

每经记者|李宇彤 每经编辑|余婷婷 豆包,终于向用户开出了第一份付费账单。 5月4日,当月活3.45亿、国内C端(消费者)用户规模第一的豆包,官宣68元/月至500元/月不等的分层订阅付费,国内大模型行业“免费为主、付费试水”的平衡被彻底打破。 图片来源:App Store截图 ...

每经记者|叶晓丹 每经编辑|廖丹 4月30日,《每日经济新闻》记者注意到,DeepSeek在Github上正式发布了多模态模型,公布了背后的技术报告。 图片来源:Github网站 DeepSeek在技术报告中提到,尽管多模态大语言模型(MLLMs)取得了显著进展,但主流的思维链(...

每经记者|宋欣悦 每经编辑|高涵 《每日经济新闻》根据OpenRouter最新数据测算,上周(4月27日至5月3日)全球AI大模型总调用量为23.9万亿Token,较此前一周增长8.6%,连续两周上涨。 其中,上榜的AI大模型中,中国AI大模型的周调用量上升至7.942万亿Tok...

每经记者|宋欣悦 每经编辑|高涵 《每日经济新闻》记者根据OpenRouter最新数据测算,上周(4月20日至26日)全球AI大模型总调用量为21.9万亿Token,较此前一周增长6.3%,连续两周下滑后小幅回升。 其中,上榜的AI大模型中,中国AI大模型的周调用量下滑至4.37...

每经记者|宋欣悦 特约记者 温沐夏 每经编辑|张益铭 这个“五一”假期,“让豆包、点点等大模型做份旅游攻略”成为大众出行前的主流操作。从目的地选择、行程规划到食宿推荐,AI(人工智能)彻底改变了传统旅游决策模式。 但你有没有想过,我们随手用大模型生成的旅行攻略,背后真正支撑的信源...

快科技5月12日消息, Zyphra近日正式联手AMD推出全新开源AI平台Zyphra Cloud,直接对标DeepSeek,通过纯AMD硬件生态挑战当前AI市场格局。 Zyphra Cloud针对DeepSeek V3.2、Kimi K2.6以及GLM 5.1等前沿长文本、开源...

某位多次接近梁文锋的顶级投资人曾无奈向雷峰网表示:梁文锋最讨厌两件事:跟VC吃饭,对外解释DeepSeek的决策。 这位幻方量化出身的程序员创业者,过去两年对所有找上门来的投资人说过同一句话——"VC的钱是负担"。腾讯来谈过,阿里来谈过,市面几乎每一家顶级风投都在他的闭门羹列表里...

在过去两年的大模型工业化进程中,安全审计始终遵循着一套 “猫鼠游戏” 的默认设定:开发者微调模型以增强能力,而安全专家则通过红队测试(Red Teaming)或白盒探测来寻找潜在的 “后门” 或 “偏见”。这套逻辑的前提是:模型是一个被动的受访者,它的行为必须由外部观测者通过穷举...

在过去几年中,视频生成技术取得了令人瞩目的进展。从基于扩散模型的方法到大规模视频基础模型,生成结果在视觉质量上已经逐渐逼近真实世界。然而,当我们进一步审视这些模型时,一个更本质的问题开始显现:它们究竟是在“理解世界”,还是仅仅在“拟合像素分布”? 传统视频生成方法大多建立在 2D...