
讯飞星火发布X2-Flash,国产算力实现大模型降本增效突破
品玩4月29日讯,科大讯飞正式发布星火X2-Flash模型,并同步开放API调用。该模型采用MoE架构,总参数30B,最大支持256K上下文。其在智能体、代码等能力上大幅提升,实测效果接近万亿级参数模型,Tokens消耗成本降至主流大尺寸模型的三分之一。 实测显示,在深度研究报告...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,445
正文图片
13,925

品玩4月29日讯,科大讯飞正式发布星火X2-Flash模型,并同步开放API调用。该模型采用MoE架构,总参数30B,最大支持256K上下文。其在智能体、代码等能力上大幅提升,实测效果接近万亿级参数模型,Tokens消耗成本降至主流大尺寸模型的三分之一。 实测显示,在深度研究报告...

近期,市数据局联合市委网信办组织召开大模型备案培训会议。相关县(市、区)数据部门、备案企业负责同志参加培训。市数据局主管负责同志参加并主持会议。 会议邀请金谷物联算法工程师阎晓旭授课,分享大模型备案工作流程。阎晓旭从开展大模型备案流程、需要重点关注的政策文件、提前准备的内容等三个...
本文来自微信公众号: ToBeSaaS ,作者:戴珂 当下的AI到底算不算行业泡沫,其实还没人能下最终定论。但有一点不用怀疑,如今整个AI行业,早已走进了暴力破解式狂奔的时代。 大家都在拼最简单粗暴的路子:模型参数拼命往大里做,训练算力无脑往上堆,预训练语料库一味扩容内卷,还没完...

编者按:本文来自微信公众号 “机器之心”(ID:almosthuman2014),作者:穿越1930的,创业邦经授权转载。 「一个训练数据截止到 1911 年的模型,能不能自己推导出爱因斯坦 1915 年提出的广义相对论?」今年年初,哈萨比斯给出了一个极其硬核的 AGI 判定标准...

随着黄仁勋踏上前往特朗普的空军一号,智谱股价暴涨36.9%,收报1150港元,创下历史新高。 从1月8日上市时的116.20港元发行价算起,智谱的股价在短短四个多月内增长了900%。 而就在暴涨之前不到24小时里,智谱创始人唐杰深夜在X上发布了一条推文,大谈了自己对整个AI产业的...

GPT Image 2 凭什么这么强? 是扩散模型又迭代了一版?是把 DiT 的参数量从 7B 扩到 20B?是训了更多高质量数据? 这些答案都对,但都不够。 以下是我们与多位从业者交流后,提炼出的几个值得关注的技术方向,并尝试做出更清晰的解释。 先给结论:OpenAI 很可能已...

每经记者|叶晓丹 每经编辑|廖丹 “不诱于誉,不恐于诽,率道而行,端然正己。” 过去一周,围绕DeepSeek新模型发布、适配华为芯片以及融资消息此起彼伏。4月24日,在市场高预期中,DeepSeek-V4新模型正式发布。 1M超长上下文、Agent 能力、世界知识和推理性能是本...
本文来自微信公众号: MacTalk ,作者:池建强,原文标题:《DeepMind 创始人 Hassabis 语出惊人:百万 token 只是在贴胶带,AGI 在 2030 年》 Demis Hassabis是谁?他是英国计算机科学家、人工智能专家,也是Google DeepMi...
本文来自微信公众号: 自然系列 ,作者:Nature Portfolio 全文要点速览: 《自然》一篇论文发现:AI生成的数据可能含有“潜意识”信号:人类不可见,但AI能学到。 用AI生成数据训练新模型,称为模型蒸馏,这一方式更便宜、更快速。 但研究显示,教师模型的偏好或危险倾向...

不知道最近你们的朋友圈里,有没有突然出现很多好看的信息图,排版干净,文字清晰,图标对齐,放进 PPT 直接能用。 不是你们的朋友艺术细胞爆炸了,而是 OpenAI 新模型的功劳。有设计师在 X 上问:“我还有存在的必要吗?”,评论区不语一味地发图。 引起如此高的热度,是因为 AI...

百度于2026年5月11日正式发布新一代语言模型Ernie5.1,该模型基于今年1月推出的、拥有2.4万亿参数的Ernie5.0预训练底座提取而成。通过创新的“一次性弹性训练框架”,百度实现了在单一训练运行中优化多种尺寸模型的能力,使得Ernie5.1的预训练成本仅为同类模型的6...
通用人工智能实验室 MiniMax(稀宇科技)近日正式宣布启动一项名为「10x Team」的全球人才合作计划。该计划的核心目标是寻找并汇聚各行业的顶尖专家,共同探索大模型在特定垂直领域的深度应用。MiniMax 希望通过行业深度的认知与前沿 AI 技术的结合,将大模型的生产力属性...

作者|林易 编辑|重点君 豆包准备开始收费了。 这个消息可以说是最近国内AI圈的一大热点话题。根据豆包在App Store页面发布三档订阅价格来看,标准版连续包月68元,加强版200元,专业版500元;连续包年分别为688元、2048元和5088元。 很多网友在看到这条消息之后,...

作者 | 黄昱 具身智能领域那堵长期存在的“智力高墙”,正在被一点点打破。 2月10日,阿里巴巴达摩院正式发布具身智能大脑基础模型 RynnBrain,并一次性开源了包括业界首个 30B MoE(混合专家模型)架构在内的 7 个全系列模型。 这一动作具有一定的里程碑意义。据介绍,...
在近日举办的第二十八届中国北京国际科技产业博览会上,一款能够“听懂”藏语并以藏语思维进行创作的大模型成为了全场关注的焦点。这款名为“DeepZang”的大模型由西藏大学研发团队深度参与开发,不仅展示了AI在多语言处理上的突破,更标志着少数民族语言正加速融入全球数字化浪潮。 长期以...

“人类智能 = 推理 + 长期记忆”。 当AI 推理能力的竞赛进入白热化,整个行业开始意识到:infra层面的记忆缺失,正成为限制 AI 走向个性化与自进化的最大瓶颈。 没有长期记忆的 Agent,就像一个虽然考上了清华、但每天醒来都不认识亲妈的天才。而大量涌入记忆赛道的公司,很...
近期有消息称,快手正考虑将其自主研发的视频生成大模型“可灵AI”进行拆分,并计划独立开启Pre-IPO融资。据悉,此次融资的目标估值高达 200 亿美元,并预计在明年正式启动上市程序。 这一估值数字在资本市场引发了广泛关注。截至 5 月 11 日港股收盘,母公司快手科技的总市值约...

近日,字节跳动旗下AI应用“豆包”宣布推出付费订阅服务。从免费到付费,先圈地后变现,“熟悉的配方,熟悉的味道”,互联网“养肥”再收割的剧本,要在AI赛道重新上演? 01 AI“免费”为何玩不下去了 AI时代,大模型算力消耗不是取之不尽的水,而是越用越贵的油,AI大模型的每一次服务...