Redis 之父为 DeepSeek 抱不平:美国 AI 圈又为“蒸馏”吵起来了
作者 | Tina 2026 年 6 月 15 日,Redis 之父 Salvatore Sanfilippo,也就是 antirez ,在 X 上发了一串推文,情绪罕见地激烈: “中国模型之所以强大,绝不是因为它们对美国模型进行‘蒸馏’(distillation)。通过 API...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,516
正文图片
14,308
作者 | Tina 2026 年 6 月 15 日,Redis 之父 Salvatore Sanfilippo,也就是 antirez ,在 X 上发了一串推文,情绪罕见地激烈: “中国模型之所以强大,绝不是因为它们对美国模型进行‘蒸馏’(distillation)。通过 API...

怎么在一个被免费喂大的市场,让人重新为服务付费? 文丨高洪浩 陈佳惠 编辑丨黄俊杰 截至上半年,每天 2 亿多人使用的豆包应用每天收入不足百万元,主要来自电商佣金。 而到今年 5 月,豆包应用每天消耗数千万元——参照火山引擎公开 API 价格,结合豆包大模型的毛利率、豆包用户使用...

阿里巴巴正将大模型的竞争从数字世界延伸至物理世界。 6月16日,阿里巴巴发布千问具身智能大模型Qwen-Robot系列, 一次性推出涵盖操作、移动与世界模型的三大模型,构成千问大模型家族首个完整的具身智能模型体系 。 三者分别赋予机器人灵巧操作、自主导航与环境认知能力,既可独立部...

“ 让 AI 看懂人类社会需分几步走? 01 打造会思考、懂人的视觉 AI 想象一个场景:你坐在曼谷一家餐厅,手机对准一张泰语菜单:2026年的 AI 不仅能把泰文翻译成中文——这已经像是上个时代的把戏了——它还能记住你是素食主义者,从二十道菜里挑出那三道不含肉的,用标准泰语帮你...

该图片使用了AI生成技术 阿里一口气放出三个大招,要给机器人装上小脑、大脑、直觉。 作者 | 程茜 编辑 | 漠影 机器人前瞻6月16日报道,刚刚,阿里发布 首个具身大模型Qwen-Robot系列 ,包含三大模型,这也是千问大模型家族首个完整的具身智能模型系列。 VLN移动模型Q...

作者 | Tina 2026 年 6 月 15 日,Redis 之父 Salvatore Sanfilippo,也就是 antirez ,在 X 上发了一串推文,情绪罕见地激烈: “中国模型之所以强大,绝不是因为它们对美国模型进行‘蒸馏’(distillation)。通过 API...

本文来自微信公众号: InfoQ ,作者:Tina,原文标题:《Redis 之父为 DeepSeek 抱不平:美国 AI 圈又为“蒸馏”吵起来了》 2026年6月15日,Redis之父Salvatore Sanfilippo,也就是antirez,在X上发了一串推文,情绪罕见地激...

智谱官方于6月15日通过港交所公告确认,已推出最新一代旗舰模型GLM-5.2,模型提供达到1M的长上下文处理能力,并将在下周遵循MIT协议全面开源。 这是智谱自今年2月发布GLM-5以来的又一次重要产品迭代。 从参数来看,GLM-5.2延续了MoE稀疏混合专家架构与动态稀疏注意力...

在具身智能技术从实验室迈向真实世界的关键节点,机器人如何精准理解指令并在复杂环境中自主作业,成为了行业攻克的焦点。6月16日,阿里巴巴正式推出千问具身智能大模型Qwen-Robot系列,为各类机器人提供了一个能够理解自然语言、感知三维环境并掌握物理规律的“通用底座”。 Qwen-...
近期,AI大模型竞争已从单纯参数比拼转向Agent能力、长上下文及商业化落地的综合较量。国盛证券指出,随着GLM-5.2等国产模型在代码生成与企业级应用上的性能提升,主权AI正成为国家战略资产。Anthropic新模型发布后遭遇美国出口管制,也进一步凸显国产替代的战略必要性。 此...

南方财经 21世纪经济报道记者 张伟泽 香港报道 6月2日,瑞士嘉盛银行亚洲区首席投资总监陈东在接受21世纪经济报道记者专访时表示,从长期视角来看,大模型最终可能演变为一种类似于“水电煤”的基础设施,若各模型间的推理能力差异缩小,普通用户将难以分辨,大模型本身便会趋于同质化,竞争...

来源:猎云精选,文/王非 又一门“卖铲子”的生意,开始赚钱了。 2023年开始火热的“百模大战”,让“卖铲子”的算力硬件商赚得盆满钵满。类似的情况,正在具身智能产业“情景再现”,数据采集从业者正在密集融资且收获大量订单: 3月,光轮智能完成10亿元融资,成为全球第一个具身数据独角...

离谱了。 这两天,AI 圈都在疯传一个叫 Le Chaton Fat 的新模型。 30T MoE、256 个专家、100 万上下文窗口、多模态多语言,跑分全面碾压 Claude Fable 5、Claude Opus 4.8 和 GPT-5.5。 好家伙,规格一甩出来,不少人当场...

当智能逼近临界点。 👦🏻 主持:Koji 🥷 整理编辑:十字路口 🧑🎨 排版: Zeoooo Hi 我是 Koji,上周六我在 MiniMax Dev Meetup 上主持了一场圆桌讨论,并录制了一期现场播客。嘉宾包括: 🧑🏻💻 IO 闫俊杰:MiniMax ...

ICML 2026 PRM-PBE方法示意图 尽管大语言模型在代码生成和程序推理任务中取得了显著进展,但其在Programming-by-Example(PBE)任务中的表现仍受到明显限制。PBE要求模型仅根据输入输出样例推断潜在程序逻辑,并合成能够满足所有样例的程序。现有LLM...

ITCOW牛新网 6月16日消息,阿里巴巴今日揭晓了千问大模型家族中首个完整的具身智能模型系列——Qwen-Robot。该系列包含专为机械臂操作设计的视觉—语言—动作(VLA)模型 Qwen-RobotManip、负责视觉—语言—导航(VLN)的移动模型 Qwen-RobotNa...

2026年6月15日,Livis Day理想汽车软件与具身智能发布会在北京举办,理想汽车正式提出具身智能汽车的完整定义,即同时拥有电动车、职业司机、AI计算机与生活助手四大能力的智能体。围绕这一定义,发布会系统展示了全新一代理想空间交互体验、自研具身智能模型、自研全球首款动态数据...
这项由华为诺亚方舟实验室与英国伦敦玛丽女王大学联合开展的研究,于2026年6月以预印本形式发布,论文编号为arXiv:2606.06735,有兴趣深入了解的读者可通过该编号查询完整论文。 **研究概要** 当你和一个AI聊天助手说话时,你有没有想过,如果能悄悄在它"脑子里"拨动一...

6月16日,阿里巴巴发布千问具身智能大模型 Qwen-Robot 系列,包含 VLA 操作模型 Qwen-RobotManip、VLN 移动模型 Qwen-RobotNav 和世界模型 Qwen-RobotWorld三大模型。这是千问大模型家族首个完整的具身智能模型系列——三个模...