Token导航 LogoToken导航TokenDH.com

阿里发布Qwen3.8-Omni-Flash,百万Token输入低至0.8元;智谱拟融资超390亿港元 | AI圈又发生什么了

更新时间 2026-09-18来源 AI新榜正文 2947字阅读约 10分钟8 张图片

1.阿里发布Qwen3.8-Omni-Flash,百万Token输入低至0.8元

9月18日,阿里千问上线原生全模态模型Qwen3.8-Omni-Flash,可同时处理文字、图片、音频和视频,支持100万Token上下文。官方称,在30项评测中,该模型较上一代Qwen3.5-Omni-Plus平均提升超过26%;在长音视频理解任务中,OmniVideoBench准确率由63.4提升至67.8,Token消耗减少约45.7%。图文音视频输入价格低至每百万Token 0.8元。

模型支持最长一小时音视频分析,可完成说话人识别、转录、会议纪要、待办提取和风险分析,并能结合工具发送邮件、整理任务或编写代码。在内容生产场景中,它可完成歌曲结构分析、歌词生成、短剧翻译、角色配音、音轨重混和成片质检。配套的Qwen-MM-Plugins提供Video2Note和Omni Skill Creator,可将长视频整理成图文笔记,或从操作演示中提炼可复用的Agent技能。实时版支持边接收音视频边响应,并可结合空间声音与画面判断声源方向和距离。

图片

2.智谱GLM-5.3-FlashX上线,更快更流畅

智谱宣布推出GLM-5.3-FlashX,API已正式开放,模型标识为“GLM-5.3-FlashX”。该模型此前曾以“Ox Alpha”名称与全球开发者见面,官方称其在GLM-5.3-Flash基础上,进一步优化了推理基础设施和服务性能,最高生成速度可达每秒200个Token。

智谱表示,GLM-5.3-Flash此前调用量持续增长。为应对企业和开发者不断增加的使用需求,智谱在10万张国产芯片提供的推理算力基础上,继续加大基础设施投入,并对推理流程进行优化。此次升级主要体现在响应速度和交互流畅度上,模型的定位和能力体系没有改变。

官方称,GLM-5.3-Flash长期保持同尺寸模型中的较高智能水平,并兼顾调用成本。GLM-5.3-FlashX目前已可通过智谱开放平台API调用,开发者也能在体验中心直接试用。

图片

3.奥特曼称OpenAI存在“后Astra”内部模型

近日,在与Salesforce CEO马克·贝尼奥夫的对谈中,OpenAI CEO萨姆·奥特曼谈及公司内部模型进展。他表示,GPT-5.5的数学能力大致相当于普通数学教授,GPT-5.6可达到全球前1%至2%数学教授的水平;在Astra之后,OpenAI还有一款内部模型,已经能够处理顶尖数学家难以解决的问题。

奥特曼没有公布该模型的名称、测试结果或具体题目。OpenAI总裁Greg Brockman此前提到,公司在另一项“千禧年大奖难题”上取得进展,但同样没有公开具体内容。理论计算机科学家Scott Aaronson近日在个人博客中讨论AI快速发展对数学研究的冲击,称自己未来继续证明定理,可能更多是出于兴趣,而不是因为人类不可替代。

图片

4.智谱拟融资超390亿港元,主要投向模型研发与算力建设

智谱科技(港股代码:02513)近日向港交所披露融资计划,拟通过配售新股和发行零息可转债合计募资约392.7亿港元。其中,最多配售2196.5万股新H股,每股作价714港元;同时发行本金总额为201.4亿元人民币的美元结算零息可转债,初始换股价为892.5港元。两项交易相互独立,仍需满足相关交割条件。
根据公告,约60%的募集资金将用于下一代GLM基础模型研发、训练与推理算力及相关基础设施,约15%用于业务拓展、战略投资和潜在并购,其余资金用于营运资金及一般企业用途。路透社报道称,智谱今年7月还曾通过配售新股融资约40亿美元。本轮融资规模显示,大模型公司的竞争已从模型能力延伸到算力储备和资本调度。
图片

5.Gemini 4 Pro“偷跑”传闻流出,谷歌尚未确认

近日,模型竞技平台Arena新增一款名为“gemini-3.8-flash”的模型,引发开发者猜测,其可能是谷歌下一代旗舰Gemini 4 Pro的测试版本。部分用户分享了网页设计、SVG生成和代码任务的体验,称其速度与交互效果较好;网络流传的对比图还显示,该模型在DeepSWE、Terminal-Bench等项目中领先GPT-6 Astra和Claude Fable 5.1。

但目前没有证据证明“gemini-3.8-flash”就是Gemini 4 Pro,也没有公开评测能够支持“全面碾压”其它模型的说法。Arena官方更新记录只确认,9月2日将Gemini 3.8 Flash加入部分榜单;谷歌官方渠道尚未发布Gemini 4 Pro,关于谷歌已实现递归自我改进、模型拥有1000万Token上下文等说法,均来自网友爆料。

图片

6.谷歌被曝测试数学推理模型,支持百万Token上下文

据X账号@lyraxana消息,谷歌正基于DeepThink V3构建一款内部实验模型,代号“Mathematica”,主要面向复杂符号运算和数学难题。API信息显示,该模型内部标识为“deepthink-mathematica-tf-raw-thoughts”,上下文窗口最高约100万Token,单次输出上限为6.5万Token。

网络泄露的配置中,其被标记为“UNSTABLE_EXPERIMENTAL”,并带有谷歌内部测试使用的“Teamfood”标签,显示它仍处于实验和员工测试阶段。谷歌尚未公开确认“Mathematica”的存在,也没有公布模型性能、开放时间或具体评测成绩。谷歌此前已推出面向国际数学奥林匹克竞赛的Gemini DeepThink模式,并于9月15日发布Gemini 3.8 Live及Live Extended Thinking。

图片

7.Vidu上线Image 2.5,Fast与Pro分开满足速度和画质需求

Vidu近日上线全能Image 2.5图像生成模型,提供Fast和Pro两种模式。Fast主打快速出图,适合灵感试错、批量生成和需要频繁修改的场景;Pro则更强调画面细节和成图质量,适合海报、产品视觉、角色设定等对精度要求更高的任务。

从官方展示内容看,Image 2.5主要面向文字生图和视觉创作流程,用户可以根据提示词生成不同风格的图像。目前公开信息尚未披露两种模式的具体生成速度、分辨率、价格和基准测试成绩,最终差异仍需等待更多实测。

图片

8.芒果推出全AIGC历史纪录片《台湾岛纪》


9月17日,芒果首部全面梳理中国台湾历史的AI学术纪录片《台湾岛纪》在湖南卫视、芒果TV开播。节目共5集,从三国时期孙权派人探寻夷洲讲起,讲到隋唐、宋元时期的交流与治理,再到郑成功收复台湾、清代统一、台湾建省以及1945年光复,梳理近1800年有文献记载的历史脉络。

《台湾岛纪》由湖南广播电视台、湖南快乐阳光等出品,芒果伯璟创制、芒果灵创提供技术支持。官方称,这是首部画面全部由AIGC生成的长篇纪录片。创作团队平均年龄约22至23岁,全片塑造116个历史人物形象、复原约486个场景。节目以古籍、论文和专家研究为基础,AI主要承担视觉呈现,不直接替代历史考证和内容审核。

节目于9月17日至24日每周一至周四19:30播出。湖南卫视称,首集播出后引发观众讨论,美兰德蓝鹰指数显示其融合传播指数位列全网热播纪录片前列。

图片

欢迎分享、点赞、推荐 
 一起研究AI 
文章标签Qwen智谱阿里云模型发布融资大模型
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多