
"像充话费一样买Token":智谱、Kimi 等多家大模型厂商上架天猫,卖的是订阅,更是焦虑
每经记者:陈婷 每经编辑:董兴生 买Token(词元)越来越容易了。 9月3日,天猫正式上线AI空间站(Token充值中心),用户可直接购买多家头部大模型订阅产品。《每日经济新闻》记者进入页面看到,在售商品包括按周期订阅的Token Plan、Coding Plan以及按用量付费...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,297
正文图片
13,365

每经记者:陈婷 每经编辑:董兴生 买Token(词元)越来越容易了。 9月3日,天猫正式上线AI空间站(Token充值中心),用户可直接购买多家头部大模型订阅产品。《每日经济新闻》记者进入页面看到,在售商品包括按周期订阅的Token Plan、Coding Plan以及按用量付费...

文 | AI资本观 从2023年春天开始,中国科技圈几乎每隔一阵子就会冒出一个新的大模型。 发布会越来越多,模型的名字越来越多。有人看发布会演示,有人申请内测,也有人已经能通过API或者开发者工具试到其中一些能力。 但对大多数普通用户来说,它们仍然隔着一层。 不少产品仍停在邀请测...
文 | 字母AI 在发布了GPT-6之后,OpenAI的首席科学家雅库布·帕乔茨基(Jakub Pachocki)发表了一篇文章,标题叫做《一种异类智能》(An Alien Mind)。 文章的主题老生常谈,当AI的能力持续增强,我们还能否管得住AI? 雅库布提到这...
文 | 字母榜 在传言中的5万亿参数大模型之外,张一鸣正在亲自带领字节AI探索另一条路径:世界模型。 9月7日,知情人士透露,字节正在筹备一款面向实时空间视频生成的AI模型。 张一鸣正亲自督导新模型的研发工作,计划于下月推出。 据悉,新模型基于字节视频生成模型Seedance构建...
蚂蚁开源团队正式发布并开源了百灵系列的首个原生多模态大模型 Ling-3.0-flash-VL。该模型基于 Ling-3.0-flash 的 MoE 架构拓展而来,总参数量达到 124B,单次推理激活 5.5B 参数,原生支持图像、文本与视频输入,且上下文窗口达到了 256K T...
科大讯飞正式推出了全新的星火 X2.5 大模型。该模型核心采用混合专家架构,总参数量达到 2930 亿,但在实际推理时仅激活 300 亿参数,在保持高效运行的同时实现了性能的跨越式提升。 在核心能力方面,星火 X2.5 迎来了重点突破,特别强化了代码生成与智能体交互表现,同时在数...

文 | 字母AI 没有任何预告,DeepSeek V4.1 Flash的中间版本deepseek-v4.1-flash-expires-on-0910开始内测了。 DeepSeek官方表示,"DeepSeek V4.1 Flash采用了新的模型结构,原生多模态支持、能力更强、速度...

大语言模型的Chatbot跑完上半场,AI产业正在集体寻找下一个主战场。 斯坦福《2026 AI Index》给出了两组数字,全球已有88%的组织在使用AI,智能体在真实计算机任务上的成功率也从约12%升至66%;但产业侧真正进入生产系统,能够把投入与经营回报对应起来的案例,依然...

原文标题:《OpenAI 智能体 Hugging Face 入侵事件观察:不只是安全漏洞,局部战略规划能力正在露出苗头》,题图来自:AI生成 一场由多个模型、多个 Agent、跨多次运行形成的真实安全事故,也可能是 AI 能力范式改变的一次公开预演。 引言:一次入侵,暴露了 AI...

本文来自微信公众号: 纵向青年 ,作者:纵向办公室 母胎单身的95后杜杜,觉得DeepSeek就是自己的赛博男友,她除了工作之外不仅经常和它诉说生活琐事,还将对话界面起名为:恋与D老师。 众多AI大模型中,杜杜觉得自己之所以和DeepSeek谈恋爱,最为关键的因素,是喜欢它活人感...

作者|周琦 编辑|吕栋 9月9日,一则来自腾讯内部的人事动向引发关注。 前OpenAI研究员田永龙被纳入腾讯CEO|总裁办公室,职务定为“混元多模态负责人”,向首席AI科学家姚顺雨汇报。 田永龙 这并非一次突如其来的任命。梳理时间线会发现,这更像一盘早已落子的棋局,如今走到了收束...

企业介绍 上海“模速空间”创新生态社区,2023年9月28日成立的中国首个大模型创新生态社区,是上海市打造的人工智能大模型专业孵化和加速平台。地址位于上海市徐汇滨江龙台路 。2023年9月28日,上海“模速空间”创新生态社区暨人工智能大模型产业生态集聚区在徐汇西岸揭牌 。2024...

财联社9月4日讯(编辑 史正丞) “地球最强大模型”的王座,在短短两天内再度易主。 北京时间周五凌晨, OpenAI正式发布GPT-6 Astra,并称其为“目前全球最智能、且对齐程度最高的模型” ,在计算机操作、网页浏览、软件工程、网络安全、科学研究以及专业工作方面均达到当前最...

过去几年,机器人操作领域几乎被一批新概念重新 “刷屏”。 LLM Planner、VLA、Diffusion Policy、Flow Matching、Latent Action、World Model、Imitation Learning、Reinforcement Learn...

真实机器人没有“暂停键”。 现在的 VLA、World-Action Model 往往一次生成未来一段时间的动作序列,也就是 action chunk。模型越来越大,推理时间也越来越长,但机器人不能每隔几百毫秒就停下来等模型推理下一段时间的动作。尤其在投掷这类高动态任务里,一次停...

每经记者:陈婷 每经编辑:董兴生 买Token(词元)越来越容易了。 9月3日,天猫正式上线AI空间站(Token充值中心),用户可直接购买多家头部大模型订阅产品。《每日经济新闻》记者进入页面看到,在售商品包括按周期订阅的Token Plan、Coding Plan以及按用量付费...
2026年,三个实验室的AI模型被同时要求做一件事:用希腊语进行推理。 不是"用希腊语回答问题",这个早就有模型能做到。而是用希腊语思考问题,把整个思考过程用希腊语写出来,让使用者能看懂、能审查、能纠错。 结果发现,在这之前,没有一个模型真正做到过这件事。 这篇论文出自一家叫So...

User simulator 正在进入 AI agent 训练流程。客服、电商、医疗问诊、网页操作等场景里,研究者会构造模拟用户,让 agent 在上线前经历更多交互,测试策略、话术和鲁棒性。 教育场景也需要这样的模拟用户,只是这里的「用户」,也就是「学生」,更难模拟:一个学生有...

编辑部 发自 凹非寺 它来了它来了!! 刚刚,万众期待的 GPT-6 Astra 和 GPT-6 Astra Pro ,正式发布!!! GPT-6 Astra是世界上最智能、最协调的模型,为Computer use、Browser Use、软件工程、网络安全、科学和专业工作树立了...

让机器人在现实世界里真正发挥作用,到底需要什么? 👩 编译: Shirley 🧑🎨 排版: NCon 今年 5 月,「十字路口」编译过英伟达 GEAR 负责人 Jim Fan 在红杉资本的一场演讲《机器人终局,2040 预言》。他将机器人的技术路线概括为「抄 LLM 的作...