Token导航 LogoToken导航

大模型 方向最近有哪些内容值得看

今日资讯 大模型

大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。

大模型资讯

3,443

正文图片

13,921

强化学习大本营新作:如何破解「学新忘旧」困局

强化学习大本营新作:如何破解「学新忘旧」困局

阿尔伯塔大学团队提出FAME框架,给持续强化学习一个可求解的公式。 作者丨邓哲敏 编辑丨齐铖湧 今天教会机器人拧瓶盖,明天再让它抓杯子,它可能又把拧瓶盖忘得一干二净。 反观人类,这类现象极少出现。人脑拥有成熟的记忆分工体系,新旧知识有序存储,习得新事物的同时不会冲刷掉旧有认知。 ...

2026-09-16 10:24
MiniMax M3“入籍”沙特,中国开源模型拿下“国家级大客户”

MiniMax M3“入籍”沙特,中国开源模型拿下“国家级大客户”

过去两年,大模型几乎是一场仅限于中美的竞速赛。 美国科技圈盯着中国模型,计算开源距离闭源前沿还剩几个百分点;中国公司盯着芯片、训练成本和发版速度,想知道差距还能压缩到几个月。双方都有自己的前沿模型、算力和完整的互联网产业,把竞争细化到了小数点上。 那赛场之外的国家着急吗? 当然急...

暂无图片

AI 大模型下田"掌舵":四川眉山永丰村 300 亩试点田,水稻最高亩产 863.6 公斤

9月14日,四川省眉山市东坡区太和镇永丰村的千亩高标准农田开镰收割。和往年不同,今年这片田里有300亩首次用上了水稻专用 AI 大模型做田间管理——种田这件事,正从"凭经验看田"转向"靠数据决策"。 永丰村的田埂上挤满了前来观摩的农技专家和种植户,大家等着看一场实测:由四川省科技...

2026-09-16 10:24
暂无图片

上海 AI Lab 开源多模态基础大模型书生-S2:Memory Decoder 插拔记忆,科学长程任务对标顶尖闭源

上海人工智能实验室开源了基础大模型书生-S2。它的通用能力跻身开源第一梯队,而在生物、材料、化学以及多项科学长程任务上,表现已经能比肩顶尖闭源模型。 架构是这次最值得说的地方。书生-S2采用 Memory Decoder 架构,引入可插拔的专业记忆模块——等于给模型装了一个能随时...

紫东太初开源 ZDTaichu5.0-9B:10B 参数内空间具身能力最强通用多模态大模型

紫东太初开源 ZDTaichu5.0-9B:10B 参数内空间具身能力最强通用多模态大模型

9月15日,紫东太初正式开源ZDTaichu5.0-9B,模型不大实力超群,空间理解专业能力同档最强,通用能力仍居第一梯队。更稀缺的是,本次ZDTaichu5.0-9B不只开权重,更公开数据生产详细方案,并已在科研自动化、智能制造真实实体场景完成验证。此次开源,意味着国产多模态大...

为什么欧洲做得出光刻机,却做不出大模型?

为什么欧洲做得出光刻机,却做不出大模型?

在几轮工业革命中长期领先的欧洲,到了人工智能时代,也开始担心自己掉队。 据英国《卫报》报道,9月14日,欧洲央行行长拉加德发出警告,欧洲必须发展自己的人工智能技术并建设更多数据中心,否则将面临被美国或者中国切断供应的威胁。 拉加德在维也纳就欧洲与人工智能发表讲话 几乎同一天,路透...

2026-09-16 10:24
批量自动化崩老头,一个AI搞定了,这个呢

批量自动化崩老头,一个AI搞定了,这个呢

本文来自微信公众号: 非凡油条 ,作者:豆腐乳儿,原文标题:《批量自动化崩老头,一个AI搞定了 这个呢》 转账成功的提示弹出来,显示金额52块,备注“给宝贝买奶茶”。 他盯着屏幕等回复。30秒后,"她"发来一段语音,声音软软的: "哥哥最好了,喝到你买的奶茶,一整天的累都没了。"...

2026-09-16 10:24
中国模型,全球底座

中国模型,全球底座

文 | 字母榜 中国大模型被"套壳",现在已经不是新闻了,这不,前几天又爆出来一个。 9月2日,沙特AI公司HUMAIN发布了HUMAIN M3模型,发布之初,官方直接宣称这是"100% Saudi Model"(100% 沙特模型)。 虽说这个公司的名字可能对于我们来说有些陌生...

2026-09-15 22:43
OpenAI宣布未公开大模型攻克千禧年难题:只用了88小时

OpenAI宣布未公开大模型攻克千禧年难题:只用了88小时

快科技9月9日消息,当地时间本月8日,OpenAI对外公布重磅成果, 其一款尚未对外发布、数学能力显著强于GPT-6 Astra的内部大模型,借助约1万个AI智能体协同工作,仅耗时88小时,完成纳维 - 斯托克斯存在性与光滑性问题的证明 。 这是克雷数学研究所2000年提出的七大...

2026-09-15 22:43
零代码AI训练平台AI大模型训练工作站DLTM技术全解析:让团队也能打造专属AI模型

零代码AI训练平台AI大模型训练工作站DLTM技术全解析:让团队也能打造专属AI模型

当AI技术从实验室走向产业落地,最大的瓶颈早已不是算法本身,而是企业如何将AI能力与自身业务场景快速结合。传统AI开发模式依赖专业算法团队,周期长、成本高、迭代慢,大量中小微企业只能望AI兴叹。 本地大模型推理服务器DLTM企业级AI模型工作站的出现,正在打破这一技术壁垒,通过零...

2026-09-15 22:43
AI大模型周报:腾讯敬业度调查被指假匿名;传智谱挖走某新势力数十员工;曝DeepSeek聘中信证券筹备科创板IPO;腾讯芯片负责人高剑林离职创业…

AI大模型周报:腾讯敬业度调查被指假匿名;传智谱挖走某新势力数十员工;曝DeepSeek聘中信证券筹备科创板IPO;腾讯芯片负责人高剑林离职创业…

本期速览: 1. 腾讯敬业度调查被指假匿名; 2. 传智谱从某车企新势力挖走数十名员工; 3. 腾讯芯片研发负责人高剑林离职创业; 4. 曝DeepSeek聘中信证券筹备科创板IPO; 5. 传字节空间视频AI模型下月推出,张一鸣亲自督战; 6. 知情人士辟谣月之暗面双重上市; ...

对话比尔•盖茨:中美大模型各有4家,能够保持最先进水平

对话比尔•盖茨:中美大模型各有4家,能够保持最先进水平

文 | 新浪科技 康路 发自纽约 今日,盖茨基金会掏出 10 亿美元“砸”向人工智能,宣布将在未来两年花费重金,推动这项前沿技术不只为富人服务,也能帮最贫困的人改变命运。 在发布前夕,新浪科技与盖茨基金会主席比尔·盖茨展开了一场小范围对话。 在交流中,盖茨不仅高度评价“中国大模型...

2026-09-15 22:43
暂无图片

每日调用量破 10 亿次!微信开源 WeMM-Embedding 多模态大模型,全面领跑国际权威榜单

近日,微信 AI 官方正式宣布将通用多模态嵌入模型WeMM-Embedding向全球开源,并推出了包含2B、4B 以及9B 在内的三个不同参数版本。该模型展现出了极强的多模态兼容能力,不仅全面支持文本、图像、视频,还能原生处理视觉文档以及任意交错的混合多模态输入。 技术底座与多模...

暂无图片

新研究将大语言模型视为“认知病毒”,持续动脑方可“抵御感染”

IT之家 9 月 9 日消息,当地时间 8 日,据外媒 Futurism 报道,一支国际研究团队在新论文中提出,AI 的普及与病毒扩散有一些惊人的相似之处。这篇论文尚未经过同行评审,试图构建新的理论框架,解释人们 为何越来越离不开各类 AI 工具 ,以及这种依赖如何改变整个社会认...

2026-09-15 22:43
用125亿分之6的参数,打平3970亿的旗舰模型

用125亿分之6的参数,打平3970亿的旗舰模型

2026年初,如果你去看开源大模型的排行榜,会发现一件挺反常的事。 通义千问团队刚发布的Qwen3.8-Flash-Next,总参数125B(十亿),但每个token实际只激活6B。这个数字放在整个模型家族里显得有点寒酸,因为它要对标的,是上一代397B总参数、17B激活参数的旗...

2026-09-15 22:43
计划有变,他准备当首富

计划有变,他准备当首富

作者 | 荣智慧 编辑 | 向现 唯物的中国芯片产业深度观察 9月9日,深度求索委托中信证券筹备科创板IPO的消息被证实。创始人梁文锋合计持有约78%的股权。若公司市值“按计划”突破1万亿元人民币,梁文锋资产约为7800亿元,将超过现首富、字节跳动创始人张一鸣(资产约5429亿元...

2026-09-15 22:43