
KV缓存里,扔掉的那些token真的重要吗?答案可能会让你意外
先说一个可能会让你愣一下的事实。 大语言模型做长链条推理的时候,会生成一大堆文字,几千甚至上万个token。为了让模型在生成下一个词的时候能记住前面写了什么,系统会把每个已经算过的token的关键信息存起来,这就是所谓的KV缓存。 KV缓存*:模型在生成过程中保存的一堆中间计算结...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,233
正文图片
13,097

先说一个可能会让你愣一下的事实。 大语言模型做长链条推理的时候,会生成一大堆文字,几千甚至上万个token。为了让模型在生成下一个词的时候能记住前面写了什么,系统会把每个已经算过的token的关键信息存起来,这就是所谓的KV缓存。 KV缓存*:模型在生成过程中保存的一堆中间计算结...

在 9 月 16 日举行的 2026 vivo 开发者大会上,vivo 宣布蓝心大模型全面升级,打造以个人为中心的智能体大模型矩阵,并发布四款核心模型:Blue LM-RealTime、Blue LM-Nano、Blue LM-Flash 以及 Blue LM-Pro,覆盖语音理...

MiniMax H3 的开源,可能比外界看到得更仓促。 7 月 31 日,H3 与 Seedance 2.5 同日发布。外界很容易把它理解成一次提前设计的开源狙击:Seedance 2.5 刚刚把原生生成时长拉到 30 秒,MiniMax 宣布开放 H3 权重,让后来者借社区的力...
本文来自微信公众号: 字母AI ,作者:苗正 在发布了GPT-6之后,OpenAI的首席科学家雅库布·帕乔茨基(Jakub Pachocki)发表了一篇文章,标题叫做《一种异类智能》(An Alien Mind)。 文章的主题老生常谈,当AI的能力持续增强,我们还能否管得住AI?...

就在这两天,联发科正式发布新一代旗舰移动平台天玑9600 Pro。作为天玑首款Pro旗舰,它率先采用台积电2nm制程,并以全新AI原生架构重构移动计算,带来双超大核CPU、重构双NPU、神经网络渲染与智能影像等一系列架构级升级,推动性能、能效、AI、游戏、影像以及通信显示体验全面...

作者:雨谷,题图来自:AI生成 8月下旬,"人形机器人第一股"宇树科技正式登陆科创板。然而,上市前黄仁勋亲自站台、联想火线入股带来的超高关注,并没有让宇树科技的股价延续造富神话。上市第11个交易日,宇树科技股价盘中跌破550元,较1100元高点已经"腰斩"。 就在同一时间,另一群...

ITCOW牛新网 9月6日消息,阿里千问开源Qwen‑Drive‑1.0‑4B,该模型基于Qwen3.5‑4B打造,也是业内首个面向自动驾驶场景的视觉语言基础模型。 模型预训练阶段统一处理3D感知、视觉问答任务,还拓展至运动规划能力,完整保留原有视觉语言模型架构。它采用分阶段训练...

ITCOW牛新网 9月7日消息,科大讯飞正式发布星火Spark‑X2.5多语言文本生成大模型。该模型采用MoE架构,参数规格293B‑A30B,整套训练流程跑在全国产平台,支持256K上下文窗口。 能力层面,星火X2.5重点强化代码生成与AI智能体能力,支持200余种语言,在语言...

【TechWeb】过去一年具身智能很火热,却一直没有回答关键问题:训练机器人到底更应该依赖真实数据还是仿真数据?通用大模型会不会“降维打击”具身模型?机器人什么时候才能真正进入可持续商业化? 在2026 Inclusion·外滩大会上,苏度科技联合创始人兼CEO韩铮、蚂蚁灵波科技...
xAI 首席执行官埃隆·马斯克今天在 X 平台透露,Grok 4.8 将是一款参数量达 2.5 万亿的 AI 模型,而且是用一套全新的 C++ 软件栈训练出来的。他同时给出明确节点:Grok 4.8 将在本周完成训练,随即启动强化学习阶段。 时间线往回看还有一处插曲。马斯克此前曾...

文 | AI资本观 01|五天,一百万人和一道禁令 ChatGPT上线五天以后,已经有100万人在那个聊天框里打过字了。 奥特曼庆祝100万用户达成,马斯克互动|2022年12月5日 他们甚至也很意外。 那时候,OpenAI甚至还没有把它当成一款成熟产品来卖(8月他们已经完成了更...

在传言中的5万亿参数大模型之外,张一鸣正在亲自带领字节AI探索另一条路径:世界模型。 9月7日,知情人士透露,字节正在筹备一款面向实时空间视频生成的AI模型。 张一鸣正亲自督导新模型的研发工作,计划于下月推出。 据悉,新模型基于字节视频生成模型Seedance构建,在每秒20帧的...

henry 发自 凹非寺 量子位 | 公众号 QbitAI Token词元替代了Byte字节,但不意味着大模型都得是Token。 字节模型,特别是蒸馏后,有点儿新说法。 最近,来自Meta FAIR和华盛顿大学的论文《突破Token天花板:蒸馏出更小、更强的字节模型》,提出了一个...
文 | 影子备忘录 2026年9月,互联网大厂的AI奖学金项目几乎在同一时间窗口密集落地。百度奖学金启动申请,面向全球高校华人在校生,10个名额,每人20万元科研奖金,附带校招绿色通道。 字节跳动奖学金首次开放全球申请,名额突破20个,每人20万科研奖金外加10万导师奖金。 腾讯...
文 | 影子备忘录 9月初,在AI竞赛中,互联网大厂发生了两件内卷大事。 一件是字节跳动用约296亿美元的银团贷款规模落定,成为2026年以来亚洲第二大的美元计价贷款交易,最初目标200亿美元,因银行认购订单超过300亿美元而扩容。 阿里则在8月完成800亿港元新股配售,启动不到...

9月14日,以“智能时代网安护航”为主题的2026年广东省网络安全宣传周在华南理工大学广州国际校区拉开序幕。在新技术新应用展示区,多家企业携最新成果集中亮相。置身展区,“人工智能+”的产业图景尽收眼底,前沿智能终端、大模型安全、算力网络防护、关键信息基础设施、AI应用安全成为舞台...

一个亲手把阿里具身大脑基础模型从0做到行业SOTA的人选择离开 9月14日,经多位业内人士证实, 阿里巴巴达摩院首席科学家(P10级别)、具身智能实验室负责人赵德丽已正式离职 。截至发稿,本人及阿里方面均未公布下一步安排。 消息一出,迅速引发行业高度关注。赵德丽是 达摩院视觉基础...

IT时代网9月15日消息,本周在规模盛大的 Dreamforce 技术大会上,Salesforce 发布了一款名为 Koa 的全新 AI 模型,这也是该公司首款推理大模型。Koa 基于英伟达开源权重的 Nemotron 模型打造,双方联合完成后续微调训练,使其擅长处理销售、市场营...

在近日举办的 Dreamforce 技术大会上,Salesforce 正式发布了其首款推理大模型 Koa。该模型基于英伟达开源权重的 Nemotron 底座打造,由两家企业联合进行后续微调训练,旨在深度赋能销售、市场营销以及客户服务等企业核心业务场景。 长期以来,企业级的智能化转...