
20岁写出Transformer的人,真开源了2180亿大模型
新智元报道 【新智元导读】刚刚,Cohere放出2180亿参数的MoE大模型Command A+,单张B200可跑,支持48种语言,还带原生引用能力。但这次发布最炸的,不在参数表上,而在那一个许可证:Apache 2.0。 「Attention Is All You Need」,...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,406
正文图片
13,770

新智元报道 【新智元导读】刚刚,Cohere放出2180亿参数的MoE大模型Command A+,单张B200可跑,支持48种语言,还带原生引用能力。但这次发布最炸的,不在参数表上,而在那一个许可证:Apache 2.0。 「Attention Is All You Need」,...

松果财经讯,5月20日,在2026阿里云峰会上,阿里云正式推出金融级通用智能体“点金”。该产品直连市场行情与阿里资产,并原生接入Wind万得、盈米且慢、东方财富、恒生聚源等权威数据源。 为满足金融行业对安全与合规的高标准要求,“点金”内置全链路审计机制与三重合规防线。据公开资料,...
(本文作者为 竞合人工智能,钛媒体经授权发布) 文 | 竞合人工智能 2026年5月20日的阿里云峰会,本该是阿里科技实力的高光时刻。 新一代平头哥AI芯片M890正式亮相,千问大模型迭代至3.7-Max旗舰版本,从自研算力芯片,到核心大模型,再到云计算与淘宝电商的全链路打通,阿...
作者 | AICon 全球人工智能开发与应用大会 策划 | 李忠良 编辑 | 宇琪 你是否也遇到过这种尴尬:在 ChatGPT 里刚定好的方案,换到 Cursor 写代码时,一切又要重头说起。Agent 今年最大的坎儿,不是智商,而是“记性”。为什么“长文本”没能彻底解决记忆问题...

(文/陈济深 编辑/张广凯) "去年的东西都是nothing。" 在5月20日阿里云峰会后的媒体沟通会上,阿里云智能集团资深副总裁、公共云事业部总裁刘伟光谈起Token收入时,反复强调,在一个高速增长的市场里,任何基于去年数据的份额讨论都已经没有意义。 去年底,刘伟光曾公开表态"...

保定智能信号管控平台从1.0版本跃升至2.0版本了,标志着我市交通管理迈入“数智赋能”新阶段。 简单来说,这次升级引入了“交通大模型”技术,让红绿灯系统不仅有了“眼睛”,更有了会思考的“大脑”,能根据实时路况主动做出最优调整。 那么,这个聪明的“大脑”在五四路与阳光大街交叉口是如...

(文/陈济深 编辑/张广凯) "去年的东西都是nothing。" 在5月20日阿里云峰会后的媒体沟通会上,阿里云智能集团资深副总裁、公共云事业部总裁刘伟光谈起Token收入时,反复强调,在一个高速增长的市场里,任何基于去年数据的份额讨论都已经没有意义。 去年底,刘伟光曾公开表态"...
5月22日,据千问APP消息,近期, 阿里巴巴(BABA.US) 发布全新一代千问旗舰模型Qwen3.7-Max,千问APP、PC端及网页端(qianwen.com)同步接入。 将千问APP更新至最新版(6.9.7及以上)后,点击下方胶囊“Qwen3.7-Max”,或在PC端及网...

听雨 发自 凹非寺 量子位 | 公众号 QbitAI ImageNet之后,李飞飞再出手! 李飞飞团队最新发布 ESI-Bench ——一个专门用来评测具身空间智能的新基准。 过去的空间智能评测默认给模型最优观测,而ESI-Bench第一个把观察者变成行动者,闭合了感知-行动回路...

ImageNet之后,李飞飞再出手! 李飞飞团队最新发布 ESI-Bench ——一个专门用来评测具身空间智能的新基准。 过去的空间智能评测默认给模型最优观测,而ESI-Bench第一个把观察者变成行动者,闭合了感知-行动回路。 它为具身空间智能领域提供了一个系统性的评测框架,覆...

近日,山东省互联网信息办公室公布最新一批生成式人工智能服务已备案信息,雷神科技“雷神大模型”成功通过备案,正式获得山东省生成式人工智能合规准入许可,成为电竞全场景领域率先合规落地的垂类大模型。这一成果标志着“雷神大模型”在语料安全、模型安全、安全措施、安全自评估等维度符合国家监管...
协同,企业级智能体的另一道工程题。 本文为IPO早知道原创 作者|Stone Jin 微信公众号|ipozaozhidao 日前,滴普科技(1384.HK)创始人、执行董事、董事会主席兼CEO赵杰辉发表了题为《协同,企业级智能体的另一道工程题》的思考。 以下是全文精选: 三个判断...

AI究竟如何为产业创造价值?见证AI从“热点”转化为“生产力”的关键一跃。 今天的顺丰已经用AI调度着中国三分之一的航空货运。从百万人的协同、二十万辆车的调度,到每天五千万票件的动态路由——物流供应链的复杂度,正是AI落地的最佳试验田。一个超大规模网络如何用大模型、Agent和运...

阿里当下的尴尬,从来不是技术不行,也不是战略走错,而是价值认知的错位。 2026年5月20日的阿里云峰会,本该是阿里科技实力的高光时刻。 新一代平头哥AI芯片M890正式亮相,千问大模型迭代至3.7-Max旗舰版本,从自研算力芯片,到核心大模型,再到云计算与淘宝电商的全链路打通,...

本文来自微信公众号: 集智俱乐部 ,作者:任筱芃 建模——这个听起来高深的词,本质上只是给一个黑箱喂入输入、拿到输出。传统做法要求你亲手搭建黑箱内部的每一条管道:数据清洗、特征工程、模型选择、参数调优、结果可视化,任何一个环节出错都要回头排查。2025年初,Andrej Karp...

近日,字节跳动(ByteDance Research)正式开源了其原生统一多模态大模型—— Lance 。 在当前 AI 行业动辄堆砌数百亿甚至上万亿参数、或者靠“拼积木”组装大模型的风气下,Lance 的出现无疑是一记重锤:它不仅以 仅3B(30亿)的极致轻量化激活参数量 实现...

文 | 胡说成理 如果要在一句话里概括独立大模型赛道这两年发生的事,可以这样说: "AI六小龙"这个标签出生于2023年4月,死亡于2025年下半年。 事实之一是,六家变成了四家。 零一万物2025年放弃了万亿参数以上的超大基模预训练,百川智能的转身更早一些。2025年4月10日...

编辑 | 泽南 这是一个打破传统大语言模型解码限制的研究。 英伟达提出了全球首个三模式的大语言模型系列,只需简单更改注意力模式 / 掩码,即可在自回归、扩散和自推测解码之间切换。 一个模型,三种解码模式,没有额外的草稿模型,没有架构变更。 最快的模式 token 吞吐量能提升 4...

品玩5月22日讯,智谱今天宣布,正式面向部分企业客户推出GLM-5.1高速版API。该模型输出速度达到400 tokens/s,刷新了当前全球大模型厂商API的速度上限。 这一突破打破了行业长期以来“高速即轻量”的惯例,首次在国产大模型中将旗舰级能力与极致低延迟同时带入生产环境,...