
算力缺的不是“卡”,而是Token丨ToB产业观察
一个中小企业的技术负责人最近遇到了一个头疼的问题。他们采购了一批国产GPU卡,打算在自有环境里部署一个开源大模型,用于内部知识库问答。硬件到货之后,团队花了整整两周时间,模型还是跑不起来。问题不在于卡本身——单看标称算力,这批国产卡能达到国际主流产品的七八...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,297
正文图片
13,365

一个中小企业的技术负责人最近遇到了一个头疼的问题。他们采购了一批国产GPU卡,打算在自有环境里部署一个开源大模型,用于内部知识库问答。硬件到货之后,团队花了整整两周时间,模型还是跑不起来。问题不在于卡本身——单看标称算力,这批国产卡能达到国际主流产品的七八...

文|光锥智能,作者 | 魏琳华 ,编|刘俊宏 七、八、九三个月,大模型行业像打了鸡血。 从海外"御三家"到国内大模型厂商,轮番发布的新模型让人目不暇接。9月第一周,OpenAI、Anthropic、谷歌你方唱罢我登场,Claude Fable 5.1、Gemini Flash 3...

DeepSeek V4.1 Flash发布后,不仅速度变快,而且内容更准确,还有原生多模态。 全网对DeepSeek V4.1 Flash好评如潮,梁文锋再次被奉为“梁圣”。 相较于V4 Flash,V4.1 Flash最大的特点是推倒重来,采用了和V4 Flash完全不同的非对...
文 | 字母AI DeepSeek V4.1 Flash发布后,不仅速度变快,而且内容更准确,还有原生多模态。 全网对DeepSeek V4.1 Flash好评如潮,梁文锋再次被奉为"梁圣"。 相较于V4 Flash,V4.1 Flash最大的特点是推倒重来,采用了和V4 Fla...
蚂蚁集团 AI 安全实验室近日正式开源大模型内生式安全护栏技术 SingProbe。该技术区别于主流的外挂式安全审核模式,通过复用基座模型推理过程中的隐藏状态,以不足0.5% 的额外计算开销,实现 token 级实时风险评估,可同步完成意图分类、安全检测和幻觉识别任务,在医疗等高...

本文来自微信公众号: 硅谷101 ,作者:硅谷101 你相信,我们其实生活在一个虚拟世界中吗? 马斯克曾在Lex Fridman的采访中被问到:如果有一天人类实现AGI,并且只能向它提出一个问题,他会问什么? 思考了十秒之后,他给出的答案是: “What's outside th...
本文来自微信公众号: AIGC从0到1 ,作者:王零壹 2026年9月10日,上海交大、清华、字节、小红书、上海AI实验室等机构的一篇论文,在中文AI圈刷屏。 论文标题很大:《The Last AI Built by Humans》 人类建造的最后一个AI。 它描绘了这样一条路线...
本文来自微信公众号: AIX财经 ,作者:AIX财经团队,编辑:魏佳 买的是增长,还是入场券? AIX财经(AIXcaiijng)原创 B站刚学会赚钱,就准备把一整年的利润重新押出去。 2025年,这家公司第一次实现全年GAAP盈利,净利润11.9亿元。几个月后,管理层宣布,20...

本期速览: 1. 前字节腾讯AI核心研发孙鹏加盟星尘智能; 2. 智谱GLM5架构负责人白雨石加入腾讯混元; 3. 月之暗面被曝秘密递表港交所; 4. 原DeepSeek研究员魏浩然加入百度; 5. 百度BMU引入北美大模型预训练专家; 6. VAST完成约30亿元B轮及B+轮融...

你有没有玩过Wordle? 就是那个每天一个单词,你猜五个字母,系统告诉你哪个字母对了、哪个字母在但位置错了、哪个字母压根不在里面的游戏。这游戏简单到小学生都能上手,规则清清楚楚写在那儿。 但如果让一个只有20亿参数的小AI模型来玩呢? 结果可能让你意外。研究者发现,这个叫Qwe...

2026年初,有一群清华的研究者算了一笔账,算完之后他们自己都愣住了。 如果想复现SmolLM3-3B这个开源模型的训练过程,需要花多少钱?答案是71.9万美元。如果想复现Llama-3.2-3B呢?答案是150万美元。这些数字听起来像是某个大公司的年度预算,但事实上,这只是"从...

每经记者|宋欣悦 每经编辑|兰素英 《每日经济新闻》根据OpenRouter最新数据测算,上周(9月7日至9月13日)全球AI大模型总调用量为127万亿Token,环比增长10.43%。 其中,上榜的AI大模型中,中国AI大模型周调用量达61.17万亿Token,环比增长7.85...

ITCOW牛新网 9月11日消息,小米技术正式发布并开源工业级目标说话人语音识别大模型Xiaomi‑CocktailASR‑1,旨在解决语音识别领域的“鸡尾酒会难题”,也就是多人同时说话时识别效果大幅下降的问题。 模型采用端到端LLM架构,输入一段目标人物的参考音频作为声纹提示,...

单科冠军不够,具身智能落地需要没有结构性短板的底座 作者丨邓哲敏 编辑丨齐铖湧 一个模型同时占据四个能力子榜单的榜首,这在具身智能行业里不多见。 RoboColiseum 是由智元机器人发起,联合高校、科研机构、开源社区及机器人企业共同建设的评测平台,它把评测拆成四个维度:指令跟...

阿尔伯塔大学团队提出FAME框架,给持续强化学习一个可求解的公式。 作者丨邓哲敏 编辑丨齐铖湧 今天教会机器人拧瓶盖,明天再让它抓杯子,它可能又把拧瓶盖忘得一干二净。 反观人类,这类现象极少出现。人脑拥有成熟的记忆分工体系,新旧知识有序存储,习得新事物的同时不会冲刷掉旧有认知。 ...

9月15日,联发科发布天玑9600系列旗舰芯片,包含天玑9600 Pro和天玑9600M。这是联发科第一款台积电2nm手机芯片。同一天,vivo官宣X500 Pro系列全球首发这颗芯片,OPPO Find X10 Pro Max也在首批搭载名单中。 参数层面,天玑9600 Pro...

过去两年,大模型几乎是一场仅限于中美的竞速赛。 美国科技圈盯着中国模型,计算开源距离闭源前沿还剩几个百分点;中国公司盯着芯片、训练成本和发版速度,想知道差距还能压缩到几个月。双方都有自己的前沿模型、算力和完整的互联网产业,把竞争细化到了小数点上。 那赛场之外的国家着急吗? 当然急...
9月14日,四川省眉山市东坡区太和镇永丰村的千亩高标准农田开镰收割。和往年不同,今年这片田里有300亩首次用上了水稻专用 AI 大模型做田间管理——种田这件事,正从"凭经验看田"转向"靠数据决策"。 永丰村的田埂上挤满了前来观摩的农技专家和种植户,大家等着看一场实测:由四川省科技...

阶跃星辰于9月15日正式发布了全新的 StepAudio3系列语音大模型。本次发布的模型矩阵包含StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen以及StepAudio3Music五款产品,并且多款模型在权威评...
上海人工智能实验室开源了基础大模型书生-S2。它的通用能力跻身开源第一梯队,而在生物、材料、化学以及多项科学长程任务上,表现已经能比肩顶尖闭源模型。 架构是这次最值得说的地方。书生-S2采用 Memory Decoder 架构,引入可插拔的专业记忆模块——等于给模型装了一个能随时...