强化Agent能力,为何成为国产基础大模型2026年重要发展方向?
每经记者|叶晓丹 每经编辑|杨军 近期,国产大模型动作频频。 4月2日,阿里发布千问新一代大语言模型Qwen3.6-Plus。4月8日,DeepSeek(深度求索)上线专家模式,这是DeepSeek走红以来首次在产品端引入模式分层设计,此前3月份,DeepSeek释放了和Agen...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,277
正文图片
13,279
每经记者|叶晓丹 每经编辑|杨军 近期,国产大模型动作频频。 4月2日,阿里发布千问新一代大语言模型Qwen3.6-Plus。4月8日,DeepSeek(深度求索)上线专家模式,这是DeepSeek走红以来首次在产品端引入模式分层设计,此前3月份,DeepSeek释放了和Agen...

你知道吗?就在你刷着手机、感叹AI模型怎么越来越“笨重”的同时,大洋彼岸的实验室里,一场关于让大模型“瘦身”并“跑得更快”的静默革命,已经悄然进入了新的阶段。最近,一篇署名中出现了梁文锋的DeepSeek新论文,带着一个名为“NSA”的注意力机制闯入了大家的视野。这可不是什么国家...

本文来自微信公众号: 底线思维 ,作者:鲍韶山 2026年5月初,有媒体披露了一场得到某个超级政治行动委员会(Super PAC)支持的协同舆论攻势。该委员会与OpenAI、帕兰提尔(Palantir)及安德里森·霍洛维茨(Andreessen Horowitz)等公司的高管存在...
出品|虎嗅科技组 作者|宋思杭 编辑|苗正卿 头图|月之暗面X北京大学光华学院 月之暗面和DeepSeek都在加速竞争人才。 虎嗅获悉,5月12日,月之暗面(以下简称“月暗”或Kimi)总裁张予彤现身北京大学光华管理学院,与院长田轩进行了一场闭门对谈。 据虎嗅独家获悉,在这场校园...

【TechWeb】5月7日消息,腾讯混元官方公众号今日发文称,自上线以来,Hy3 preview的 Token 调用量持续增加,目前总量已经是上一代版本模型 Hy2 的10倍之多,尤其是代码和智能体类场景的 Token 调用量增明显,在腾讯的 WorkBuddy/Codebudd...
在电动车还在艰难拓荒的早期,智能化就是前者用来和燃油车做出区分的重要指标:特斯拉Model S率先用一块中控屏代替了物理按键,汽车座舱从此开始由电子座舱向智能座舱升级。 不过可惜的是,行业里迟迟没跑出IPhone那样定义一个时代的成熟产品,智能化大多局限在更多的屏幕、简单的车机以...

每经记者|宋欣悦 每经编辑|高涵 《每日经济新闻》根据OpenRouter最新数据测算,上周(4月6日至12日) 全球AI大模型总调用量为21万亿Token,环比下滑22.2%,结束了此前十周连涨的趋势。 其中,上榜的AI大模型中,中国AI大模型的周调用量下滑至5.826万亿To...

Aurelia 发自 凹非寺 量子位|公众号 QbitAI 2026年,具身智能的关注点,已经从硬件本体,转移到了数据模型。 一边是融资新闻里动辄千台机器人部署的豪言,一边是研究者发现两万小时数据,真正有效的可能不到三千小时。这个行业正在进入一种集体焦虑。 当机器人从实验室走向真...

图片为AI生成 如果你习惯从天眼查上嗅探大厂的动向,这两天大概率会被一条工商变更信息震一下:国内AI大模型领域的明星玩家MiniMax(稀宇科技),居然把注册资本从10亿人民币直接拉升到了40亿人民币,增幅高达300%! 在现金流为王的大模型圈,这不是一笔小数目。很多人可能好奇,...

本文来自微信公众号: 量子位 ,作者:关注前沿科技,原文标题:《挑战扩散自回归统治!字节提出视觉生成第三种路线,让模型像人类一样边画边改》 ber!这个五一假期,我也是真够忙的: 自拍、电影、追剧、街头采访、听音乐会,还抽空回老家结了次婚…… (咳咳)不卖关子了,其实以上这些,通...

4月21日,上海新增1款已完成备案的生成式人工智能服务,为特斯拉车机语音大模型服务。次日,特斯拉方面人士向媒体回应称“敬请期待”。 这意味着特斯拉在华智能座舱的AI化改造进入实质推进阶段,但具体上线时间和功能范围尚未披露。 此次备案的语音大模型面向车机交互场景,试图通过生成式AI...

4月22日,蚂蚁集团百灵大模型团队推出新款Instruct模型Ling-2.6-flash。该模型总参数量1040亿,激活参数量74亿,采用混合线性架构,是一种高度稀疏化的MoE设计。模型已通过API开放,输入每百万tokens定价0.1美元,输出0.3美元,首周提供免费试用。 ...

快科技5月8日消息,DeepSeek V4在4月24日发布之后,官方也没闲着,各种降价优惠之外最大的消息就是融资,估值从200亿美元一直涨到了最新的450亿美元。 根据The Information的爆料,DeepSeek计划融资500亿元, 而且6月份计划推出DeepSeek ...

抓住风口,看懂趋势 本期要点:特朗普开始发行AI时代的“美元” 你好,我是王煜全,这里是王煜全要闻评论。 最近,有个消息在喧嚣的科技新闻中似乎并不起眼,那就是特朗普家族推出了一项AI聚合服务。 可是,这件事远不止是卖API那么简单,特朗普家族正在把“影响力”转化为AI时代的支付系...

最近,“智能体”和“词元”成为人们时常聊起的话题。看似小众的人工智能开源项目,正在催生全新业态模式和市场机遇。这轮技术热潮中,国产大模型技术突飞猛进、应用不断拓展,不仅为智能经济发展注入活力,也逐渐成为全球创新的基座。 作为新一轮科技革命和产业变革的重要牵引,人工智能当前正处于一...

田晏林 发自 凹非寺 量子位 | 公众号 QbitAI 当全行业还在卷大模型参数、烧算力、拼Token消耗时,已经有企业实打实地在用大模型 帮客户赚到真金白银 。 这些年,天下苦SaaS久矣,更苦“AI好看不好用”。 大模型发展突飞猛进,新模型不断涌现。但早期B端企业获得感较弱,...

文 | AIX财经,作者 | 金玙璠,编辑 | 魏佳 中国的AI四小龙,加起来值一万亿了。 5月初,《金融时报》援引消息人士披露,DeepSeek新一轮融资估值锁定在450亿美元,由国家大基金(国家集成电路产业投资基金)领投。4月初,DeepSeek首次被曝出融资消息,外界流传的...

感谢IT之家网友 風見暉一 的线索投递! IT之家 5 月 13 日消息,在今日的联发科天玑开发者大会(MDDC 2026)上,群联电子与联发科共同展示全球首款手机端单机运行大模型平台, 成功在天玑 9500 平台上实现手机端单机运行 20B 大语言模型 。 通过群联全球首款专利...

凤凰网科技讯 5月14日,在昨日召开的天玑开发者大会2026(MDDC 2026)上,MediaTek推出天玑AI智能体化引擎2.0、天玑AI开发套件3.0等一系列面向端侧AI的工具,并公布了多项移动端游戏图形与音频优化技术。 根据官方披露,过去三年天玑AI生态伙伴数量增长240...

品玩4月28日讯,阶跃星辰近日宣布,正式发布新一代自动语音识别模型StepAudio 2.5 ASR。该模型创新性地将大语言模型推理加速技术引入语音识别领域,基于ASR与MTP-5深度融合架构,实现了推理速度提升400%、时延降低60%的突破。 在性能方面,模型在主流评测基准上超...