Token导航 LogoToken导航TokenDH.com

大模型 方向最近有哪些内容值得看

今日资讯 大模型

大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。

如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。

大模型资讯

3,297

正文图片

13,365

算力缺的不是“卡”,而是Token丨ToB产业观察

算力缺的不是“卡”,而是Token丨ToB产业观察

一个中小企业的技术负责人最近遇到了一个头疼的问题。他们采购了一批国产GPU卡,打算在自有环境里部署一个开源大模型,用于内部知识库问答。硬件到货之后,团队花了整整两周时间,模型还是跑不起来。问题不在于卡本身——单看标称算力,这批国产卡能达到国际主流产品的七八...

2026-09-16 10:34
三个月价格腰斩,大模型的“聪明”正在贬值?

三个月价格腰斩,大模型的“聪明”正在贬值?

文|光锥智能,作者 | 魏琳华 ,编|刘俊宏 七、八、九三个月,大模型行业像打了鸡血。 从海外"御三家"到国内大模型厂商,轮番发布的新模型让人目不暇接。9月第一周,OpenAI、Anthropic、谷歌你方唱罢我登场,Claude Fable 5.1、Gemini Flash 3...

2026-09-16 10:34
DeepSeek“推倒重来”

DeepSeek“推倒重来”

DeepSeek V4.1 Flash发布后,不仅速度变快,而且内容更准确,还有原生多模态。 全网对DeepSeek V4.1 Flash好评如潮,梁文锋再次被奉为“梁圣”。 相较于V4 Flash,V4.1 Flash最大的特点是推倒重来,采用了和V4 Flash完全不同的非对...

2026-09-16 10:34
暂无图片

DeepSeek“推倒重来”

文 | 字母AI DeepSeek V4.1 Flash发布后,不仅速度变快,而且内容更准确,还有原生多模态。 全网对DeepSeek V4.1 Flash好评如潮,梁文锋再次被奉为"梁圣"。 相较于V4 Flash,V4.1 Flash最大的特点是推倒重来,采用了和V4 Fla...

2026-09-16 10:34
暂无图片

蚂蚁开源 SingProbe:以轻量探针实现大模型生成风险实时拦截,计算开销不足 0.5%

蚂蚁集团 AI 安全实验室近日正式开源大模型内生式安全护栏技术 SingProbe。该技术区别于主流的外挂式安全审核模式,通过复用基座模型推理过程中的隐藏状态,以不足0.5% 的额外计算开销,实现 token 级实时风险评估,可同步完成意图分类、安全检测和幻觉识别任务,在医疗等高...

暂无图片

小破站砸10亿搞AI,图啥?

本文来自微信公众号: AIX财经 ,作者:AIX财经团队,编辑:魏佳 买的是增长,还是入场券? AIX财经(AIXcaiijng)原创 B站刚学会赚钱,就准备把一整年的利润重新押出去。 2025年,这家公司第一次实现全年GAAP盈利,净利润11.9亿元。几个月后,管理层宣布,20...

2026-09-16 10:34
AI大模型周报:前字节腾讯AI核心研发孙鹏加盟星尘智能;月之暗面被曝秘密递表港交所;智谱架构负责人加盟腾讯;千问办公首月用户破3000万…

AI大模型周报:前字节腾讯AI核心研发孙鹏加盟星尘智能;月之暗面被曝秘密递表港交所;智谱架构负责人加盟腾讯;千问办公首月用户破3000万…

本期速览: 1. 前字节腾讯AI核心研发孙鹏加盟星尘智能; 2. 智谱GLM5架构负责人白雨石加入腾讯混元; 3. 月之暗面被曝秘密递表港交所; 4. 原DeepSeek研究员魏浩然加入百度; 5. 百度BMU引入北美大模型预训练专家; 6. VAST完成约30亿元B轮及B+轮融...

一个2B小模型,怎么才能学会好好玩文字游戏

一个2B小模型,怎么才能学会好好玩文字游戏

你有没有玩过Wordle? 就是那个每天一个单词,你猜五个字母,系统告诉你哪个字母对了、哪个字母在但位置错了、哪个字母压根不在里面的游戏。这游戏简单到小学生都能上手,规则清清楚楚写在那儿。 但如果让一个只有20亿参数的小AI模型来玩呢? 结果可能让你意外。研究者发现,这个叫Qwe...

2026-09-16 10:24
横扫四榜,DM0.5 凭什么面面俱到?

横扫四榜,DM0.5 凭什么面面俱到?

单科冠军不够,具身智能落地需要没有结构性短板的底座 作者丨邓哲敏 编辑丨齐铖湧 一个模型同时占据四个能力子榜单的榜首,这在具身智能行业里不多见。 RoboColiseum 是由智元机器人发起,联合高校、科研机构、开源社区及机器人企业共同建设的评测平台,它把评测拆成四个维度:指令跟...

2026-09-16 10:24
强化学习大本营新作:如何破解「学新忘旧」困局

强化学习大本营新作:如何破解「学新忘旧」困局

阿尔伯塔大学团队提出FAME框架,给持续强化学习一个可求解的公式。 作者丨邓哲敏 编辑丨齐铖湧 今天教会机器人拧瓶盖,明天再让它抓杯子,它可能又把拧瓶盖忘得一干二净。 反观人类,这类现象极少出现。人脑拥有成熟的记忆分工体系,新旧知识有序存储,习得新事物的同时不会冲刷掉旧有认知。 ...

2026-09-16 10:24
MiniMax M3“入籍”沙特,中国开源模型拿下“国家级大客户”

MiniMax M3“入籍”沙特,中国开源模型拿下“国家级大客户”

过去两年,大模型几乎是一场仅限于中美的竞速赛。 美国科技圈盯着中国模型,计算开源距离闭源前沿还剩几个百分点;中国公司盯着芯片、训练成本和发版速度,想知道差距还能压缩到几个月。双方都有自己的前沿模型、算力和完整的互联网产业,把竞争细化到了小数点上。 那赛场之外的国家着急吗? 当然急...

暂无图片

AI 大模型下田"掌舵":四川眉山永丰村 300 亩试点田,水稻最高亩产 863.6 公斤

9月14日,四川省眉山市东坡区太和镇永丰村的千亩高标准农田开镰收割。和往年不同,今年这片田里有300亩首次用上了水稻专用 AI 大模型做田间管理——种田这件事,正从"凭经验看田"转向"靠数据决策"。 永丰村的田埂上挤满了前来观摩的农技专家和种植户,大家等着看一场实测:由四川省科技...

2026-09-16 10:24
暂无图片

上海 AI Lab 开源多模态基础大模型书生-S2:Memory Decoder 插拔记忆,科学长程任务对标顶尖闭源

上海人工智能实验室开源了基础大模型书生-S2。它的通用能力跻身开源第一梯队,而在生物、材料、化学以及多项科学长程任务上,表现已经能比肩顶尖闭源模型。 架构是这次最值得说的地方。书生-S2采用 Memory Decoder 架构,引入可插拔的专业记忆模块——等于给模型装了一个能随时...