
“Token”必须死?
本文来自微信公众号:腾讯科技,作者:晓静,编辑:徐青阳,题图来自:AI 生成 “我语言的局限,即意味着我世界的局限。”( Die Grenzen meiner Sprache bedeuten die Grenzen meiner Welt. ) 哲学家维特根斯坦在1921年写下...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,409
正文图片
13,803

本文来自微信公众号:腾讯科技,作者:晓静,编辑:徐青阳,题图来自:AI 生成 “我语言的局限,即意味着我世界的局限。”( Die Grenzen meiner Sprache bedeuten die Grenzen meiner Welt. ) 哲学家维特根斯坦在1921年写下...
近日,中国AI产业正在经历一场从宏观政策到微观财务数据的全面共振。国务院重磅文件明确人工智能立法提速,发改委谋划出台“AI+”配套文件,字节跳动追加AI资本开支,智谱与MiniMax双双纳入恒生科技指数. 一连串事件密集释放出一个明确信号,国产AI产业已经走过技术能力追赶期,正式...

允中 发自 凹非寺 量子位 | 公众号 QbitAI 人工智能正以前所未有的速度重塑世界。 当大模型从数字世界走入物理世界、重塑社会肌理,我们一直都在追问:AI的下一程,路在何方? 这一年,AI的发展正在进入一个全新的阶段。而在这一跨越中, 智能体与世界模型无疑成为了今年最核心的...

随着大模型兴起,人工智能产业飞速发展,但面临的算力、能耗瓶颈也日益凸显。为破解算力资源不足、能耗增长过快等难题,上海已布局类脑智能这一未来产业,希望在人脑启发下,开发出更高效的芯片、更聪明的模型。 昨天,2026类脑智能产业创新发展大会在长阳创谷举行,现场展示了上海类脑智能未来产...

多模态训练狠狠烧钱,世界模型公司也都在疯狂融资。 股指起飞,叙事铺天盖地,人人都说自己在做世界模型——但智象未来,是这批公司当中少见的「异类」。 这家公司的联合创始人兼 CTO 姚霆博士告诉 APPSO,他们在一个业界今天还不认可的方向上,下了一笔很大的赌注。 「如果成了,我们的...

谁才是最大赢家? 刚刚的,面壁智能联合 OpenBMB 搞了个端侧开源周。今天作为开源周的第一天,端出来的是个好东西 BitCPM-CANN,模型权重只需要约 200 MB 的内存,手表也够跑 同时,这是首款【基于国产算力平台训练】的【三值大模型】,并开源。对于这个模型,从量化算...

本文来自微信公众号: APPSO ,作者:发现明日产品的,原文标题:《一家「非主流」AI公司的豪赌:所有模态,一锅炖了 | 对话智象未来姚霆》 多模态训练狠狠烧钱,世界模型公司也都在疯狂融资。 股指起飞,叙事铺天盖地,人人都说自己在做世界模型——但智象未来,是这批公司当中少见的「...

当前,测试时扩展范式普遍致力于增加推理长度。然而,已有研究表明,随着推理长度的持续增长,以垂直扩展为核心的计算范式容易陷入探索僵化等问题。因此,从另一维度拓展推理的宽度显得尤为重要。K2.5、Step3-VL 和 LongCat-Flash-Thinking 等模型已在推理宽度方...

IT之家 5 月 25 日消息,面壁智能联合清华大学、OpenBMB 开源社区,今天正式发布并开源其在低比特大模型训练方向的最新成果 ——BitCPM-CANN。 官方表示,这是中国首个完全基于国产算力平台(华为昇腾)实现端到端训练并开源的三值(1.58-bit)大模型。从量化算...

01 推荐语 即将结束博士生涯的童晟邦,正站在另一个起点上。 这位在纽约大学读博期间同时师从Yann LeCun与谢赛宁的年轻研究者,最近宣布加入由Yann LeCun推动的AI研究与创业计划AMI Labs,而谢赛宁则是AMI的联合创始人兼首席科学官。 过去几年里,他同时与Ya...
一个 8B 参数的大模型,通常需要约 16GB 显存。参数越多,越吃显存,这就是为什么,内存价格一天比一天高。 现在,有一种方法, 可以省下 6 倍显存,却几乎不损耗模型性能。 过去两年,围绕这个看似极端的思路,一条全球性的技术竞赛正在成型。而就在这条赛道上,一个完全基于国产算力...

机器之心编辑部 5 月 22 日,Tri Dao 在社交媒体上转发了 Han Guo 的一条推文。他还写道:「经过一些数学重写,结果发现 Transformer 的所有内容都是一系列 GEMM + epilogue(矩阵乘法加尾声)。给定一些优化的原语,LLM(以及新手)就可以为...

(来源:麻省理工科技评论) 上周二(5月19日)的 Google I/O 主题演讲上,Google DeepMind CEO 德米斯·哈萨比斯(Demis Hassabis)宣称我们正“站在奇点的山脚下”。这句话很抓人——所谓“奇点”是一个理论上的未来时刻,届时 AI 将迅速超越...

本文为《Token经济学》系列第九期,算力货币Token正在重塑AI时代的价值坐标,本文从Token范式本身的结构来观察,探讨大语言模型能否走到AGI。 文|晓静 编辑|徐青阳 “我语言的局限,即意味着我世界的局限。”( Die Grenzen meiner Sprache be...
根据 OpenRouter 刚刚发布的最新监测数据,全球大模型调用市场正在经历一场“向东看”的剧烈范式转移。上周(5 月 18 日至 5 月 24 日),全球 AI 大模型总调用量攀升至 28.9 万亿 Token ,环比增长 7.4%,展现出连续五周不间断的强劲增长势头。 在这...

原标题:28.9万亿Token!全球AI大模型周调用量五连涨,国产AI连续4周超美国,DeepSeek-V4-Flash登顶,Kimi K2.6跌出榜单 《每日经济新闻》根据OpenRouter最新数据测算,上周(5月18日至5月24日)全球AI大模型总调用量为28.9万亿Tok...

每经记者|宋欣悦 每经编辑|高涵 《每日经济新闻》根据OpenRouter最新数据测算,上周(5月18日至5月24日)全球AI大模型总调用量为28.9万亿Token,较此前一周增长7.4%,连续五周上涨,大模型调用需求仍在持续释放。 其中,上榜的AI大模型中,中国AI大模型周调用...
据央视新闻报道,近期人工智能创投市场热度持续攀升,一季度全球人工智能领域共发生近600起融资事件,总额突破1100亿元,同比激增185.4%。进入5月,本土创投生态动能依旧强劲,月之暗面、阶跃星辰等国产大模型企业接连拿下超过300亿元的巨额融资;同时,具身智能赛道也备受资本青睐,...

有投资者向 创维数字(000810.SZ) 提问,公司2025年年报首次提出"感-端-智"技术架构和"智能原生"战略,强调将算力前置到终端设备。请问在物理AI时代浪潮中,公司希望扮演什么样的角色?目前围绕这一战略,公司在端侧的物理AI大模型融合、数字人交互等方面具体推进了哪些行动...