大模型 方向最近有哪些内容值得看
今日资讯 大模型
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,401
正文图片
13,759

别只盯着大模型了,这家运营商正在下一盘「通算智」融合的大棋
5 月 8 日,中国移动在 2026 移动云大会上,抛出了一个 AI 时代的新命题—— Token,不仅推出万亿级词元(Token)服务体验包和升级后的移动模型服务平台 MoMA,更重要的还是全新发布的 Token 运营生态体系,将 Token 打造成连接算力、模型、应用与用户的...

AI大牛争夺战:字节Seed成AI黄埔军校,大厂人才流动比模型迭代还快?
在深度求索发布的DeepSeek V4技术报告中,一份近300人的「研究与工程」作者名单引发外界关注,因为名单中的10人被标注「已离职」。 具体来看,DeepSeek V4核心开发团队成员中,王炳宣(Bingxuan Wang)、阮肿(Chong Ruan)、郭达雅(Daya G...

AI 营销,到底改变了什么
作者|Cynthia 编辑| 郑玄 最近有一个感受,AI 营销工具越来越多,但企业获客的成本分文未减;用户刷到的广告越来越多,但想买的东西却越来越少。 尤其是营销端, 如果一个企业突然决定增大投放力度,通常不是因为找到了什么更优的投放链路,更大概率是对手投流增加了。 于是,投流就...

群核黄晓煌:创业者的「命」,归根结底来自「世界观」
对创业者来说,「命」这个东西由天也由己。而所有的胜利,最终都是世界观的胜利。 对话|张鹏 编辑| Li Yuan 今天,群核上市了。 按常理说,到了这个节点,CEO 往往会被资本市场、投资人、媒体、路演塞满日程,整个人都处在一种高度紧绷的状态里。 但有点出乎我意料的是,可能是因为...

在硅谷和两个 AI 工程师聊完,我觉得下一代汽车可能不是车了
头图来源:吉利汽车 触目所及,满眼都是绿色。围绕着展览馆区域,整个圣何塞市中心,包括人们胸前的证件,充满了硅谷特有的「赛博绿」。 这是英伟达 GTC2026 大会的现场,全球超过 3 万人,来到这里,希望能更贴近快速进化的 AI 的最前沿。仿佛受到人们热情的感染,加州今年的天气反...

腾讯Hy3 preview上线,姚顺雨加入后的成绩单出炉
作者 | 黄昱 4月23日,腾讯正式揭开了Hy3 preview (混元3.0预览版)的神秘面纱,并开源。 Hy3 preview 是一个快慢思考融合的 MoE 语言模型,总参数 295B,激活参数 21B,最大支持 256K 上下文长度。 不难发现,Hy3 preview并没有...

AMD 推出 vLLM-ATOM 插件,深度优化国产大模型推理表现
近日,AMD 正式发布了名为 vLLM-ATOM 的全新插件。这款工具的核心使命是在维持现有工作流不变的前提下,显著榨取硬件潜能,为 DeepSeek-R1、Kimi-K2以及 gpt-oss-120B 等主流大语言模型的推理过程实现大幅提速。 对于开发者而言, vLLM 是一套...

MiniMax 大模型“叫错人名” 稀宇科技:特定词元后训练不足导致
近日,稀宇科技(MiniMax)发布了一份技术报告,详细剖析了其 M2系列模型为何无法准确输出“马嘉祺”等特定人名的深层原因。这起看似偶然的错误,实际上揭示了当前大模型训练中普遍存在的一个隐蔽缺陷。 词元偏移:被“挤压”的向量空间 问题的核心源于大模型处理文本的基本单位——分词器...
2. 11 倍反超美国!中国AI大模型周调用量稳居全球首位
在全球AI技术加速迭代的背景下,中国大模型市场正展现出极强的爆发力与应用韧性。根据OpenRouter 最新 发布的行业测算数据,在刚刚过去的 5 月 4 日至 5 月 10 日这一周,全球AI大模型的总调用量达到了惊人的25. 7 万亿Token,较前一周增长7.5%,呈现出连...
告别手机号时代?中国移动发布AI-eSIM,让万物皆可“大模型”
在近日举办的 2026 移动云大会上,一项有望重塑智能连接格局的技术成果正式亮相。通过创新构建的 AI-eSIM多生态智能服务体系 ,移动通信领域实现了“运营商码号即大模型账号”的跨越式突破。这一体系将AI-eSIM定位为Token经济的新入口,通过流量、词元与智能体的融合运营,...
爆增300%!国产大模型新贵MiniMax关联公司增资至 40 亿元
近日,国产AI大模型领域的头部企业 MiniMax 再次引起业界关注。根据 最新 的工商登记信息显示,其关联公司上海稀宇极智科技有限公司已完成重磅增资,注册资本由原来的10亿元大幅提升至40亿元,增幅高达300%。 这家成立于2021年11月的科技企业,由闫俊杰担任法定代表人。其...
M4 MacBook Pro 性能实测:24GB 内存挑战本地 AI 极限
随着苹果 M4 芯片的普及,如何在不依赖云端算力的情况下,在本地顺畅运行大语言模型(LLM)成为了开发者关注的焦点。近日,开发者 jola 分享了其在 24GB 内存版本的 M4 MacBook Pro 上部署本地 AI 工作流的深度实践。测试结果显示,经过优化的 Qwen 3....
小米自研大模型MiMo实战能力获国际认可
在AI业界 权威 平台OpenRouter的 最新 统计数据中,开源Agent框架Hermes Agent的调用量成功登顶全球榜首。数据显示,该框架的日均Token调用量已达 2910 亿,周调用量更是突破了1. 75 万亿规模。 在这份亮眼的成绩单背后,小米自研的MiMo大模型...

基于千问最新大模型构建,阿里发布全新AI店小蜜
AI技术正迎来行业化、场景化解决方案的蓬勃发展。基于平台大规模的智能服务实践,阿里将领先的智能技术与大模型算法应用于商家客服体系,正式升级全新AI店小蜜,让智能客服从“会话”走向“办事”,从“标准应答”变得“更懂用户”。 5月11日,阿里发布全新AI店小蜜。据发布会介绍,这是电商...

拒绝大力出奇迹,PRISM框架让dLLM也能高效Test-Time Scaling
近年来,大模型能力提升的焦点正在从「训练时扩展」转向「推理时扩展」。从 Best-of-N、Self-Consistency 到更复杂的搜索与验证框架,Test-Time Scaling 已经成为提升大模型复杂推理能力的重要范式。 然而,一个长期被忽视的问题是:这些方法大多默认模...

火山引擎发布业界首个Agent套餐包:整合多模态模型与联网工具
5月11日,火山引擎正式发布业界首个“Agent套餐包”——Agent Plan,标志着AI应用加速从单一的编程辅助向通用智能体(General Agent)跨越。该计划突破了传统模型订阅的单一维度,深度整合了字节跳动自研的Doubao-Seed、Doubao-Seedance、...

大模型首选格式Markdown,被30年前的工具取代了?
文 | 字母AI 我才刚开始用Markdown不到一年,怎么现在Markdown就要被淘汰了? 事情经过是这样的,Claude Code团队成员Thariq在X上发表了一篇文章,标题叫《Using Claude Code: The Unreasonable Effectivene...

2.11 倍领先!中国AI大模型周调用量再超美国:腾讯Hy3 preview (free)蝉联第一,DeepSeek三款模型上榜,MiniMax M2.7落榜
每经记者|宋欣悦 每经编辑|高涵 《每日经济新闻》根据OpenRouter最新数据测算,上周(5月4日至5月10日)全球AI大模型总调用量为25.7万亿Token,较此前一周增长7.5%,连续三周上涨。 其中,上榜的AI大模型中,中国AI大模型周调用量达7.941万亿Token,...