Token导航 LogoToken导航

剪映上新AI功能,用自然对话剪辑视频;启元个人机器人亮相,可由WorkBuddy操控 | AI圈又发生什么了

更新时间 2026-09-20来源 AI新榜正文 4244字阅读约 14分钟9 张图片

1.剪映上新AI功能,发布Hub、“小映”与互动影游平台

9月20日,剪映举办“AI新创作发布会”,推出一站式创作工作台“剪映Hub”及移动端AI创作助手“小映”,并发布互动影游创作平台“ICG Studio”。

剪映Hub由无限画布与多轨道编辑器组成,创作者可以从文字、参考视频或文档出发,完成思路梳理、脚本创作,并调用即梦、小云雀等AI创作平台生成图片、视频和音频素材,再进行精细调整。同步推出的智能创作Agent“剪映助手”,用户可以通过对话与其共同构思和剪辑视频,也可以让它承担素材整理、口播删减、字幕纠错和视频包装等重复工作。可协助处理素材整理、口播删减、字幕纠错和视频包装,并支持自定义Skills。剪映的适配设备范围也在不断扩大,开创性推出 “碰一碰”功能,手机素材可直接传入电脑端剪映素材库,跨端创作更顺畅。

移动端“小映”集成创作助手、多轨道剪辑助手和营销专家等能力,能够服务多场景剪辑。用户仅需一句话描述创作需求,“小映”可以自动调用图片、视频、文字、音乐和AI生成等能力,生成可继续调整的初版作品;并可以结合流行热点,根据作品情绪推荐创作方案;甚至能够和用户共同打造更有个人特点的作品风格。针对商家,“小映”还能分析商品信息、提炼卖点,结合目标人群和消费场景生成相应的营销素材。

此次亮相的ICG Studio则将AI能力延伸至互动影游。用户可通过与Agent对话,完成剧本大纲、角色及场景资产、分镜和剧情分支生成,让观众参与并改变故事走向。目前,该平台仍处于内测阶段。

此外,升级后的“剪同款”支持通过自然语言修改模板内容。剪映还宣布启动“剪映创作合伙人”计划,并表示每年投入约1.5亿元用于创作者激励。剪映希望通过不同的产品和能力,支持每位创作者的需求,打造“从新手到专业”都能覆盖的全场景智能创作平台。

图片

2.启元两款个人机器人亮相,首接WorkBuddy“AI Agent大脑”

9月20日,消费级具身智能品牌启元机器人在上海举办“我和我的个人机器人”新品发布会,正式推出启元Q1、T1,并公布个人机器人相关品牌战略。两款产品此前已在IFA 2026亮相:Q1强调模块化机身与开放创作,T1则面向内容创作,支持与影石设备结合进行跟拍、运镜等操作。启元此前还通过上海主会场与多城市线下门店联动,让用户同步观看发布、体验真机。此次发布会的重点之一,是进一步推动机器人从展会和实验室进入家庭、创作及日常生活场景。

同日,腾讯云宣布 WorkBuddy 与启元机器人达成合作,Q1、T1正式接入WorkBuddy。

WorkBuddy负责理解、推理和任务调度,机器人则承担现实世界中的感知与执行,双方由此形成“AI Agent大脑+具身智能身体”的组合。用户可以通过自然语言让WorkBuddy调度机器人完成会议提醒、带路等任务,也可以通过与机器人语音交互说出要求,即可让WorkBuddy在后台直接生成文档、PPT,完成数据分析、深度研究等任务,而且完整交付成果自动发送到企业微信、微信等IM。双方目前提供A2A主动调用、Connector绑定和Plugin动态组合等连接方式,并设置权限控制、能力白名单、模拟预览及高风险动作二次确认。

图片

3.阶跃发布Step 5 Preview:旗舰模型开始卷“智能效率”

9月20日,阶跃星辰发布新一代旗舰模型Step 5 Preview,定位于真实世界的Agentic任务。模型采用稀疏MoE架构,总参数量600B、激活参数27B,支持100万Token上下文,并原生支持文本与视觉输入,重点面向AI编程、软件工程、专业知识工作和金融研究等需要长上下文、多轮工具调用和持续执行的场景。

根据阶跃公布的信息,Step 5 Preview在Artificial Analysis Intelligence Index中获得44分,进入全球开源模型前三;模型权重计划于10月15日释放。其官方测试还展示了长时间自主执行任务的能力,例如连续数小时调试ESP32设备,以及在24小时任务中自主优化GPU Kernel。

除长程Agent能力外,阶跃星辰还重点强调模型的使用效率。Step 5 Preview每百万Token输入、输出及缓存价格分别为7元、20元和0.35元,并已接入AGI Bar,未来一周可免费使用。阶跃还同步推出覆盖553个代码仓库、33种编程语言的StepCodeBench,模型在该评测中的avg@4达到49.0%,并针对金融研究等专业场景进行了专项优化。。

图片

4.Claude Code正式支持AGENTS.md,Coding Agent迎来统一指令规范

Anthropic 在Claude Code v2.1.277中正式加入AGENTS.md支持:当项目中没有 CLAUDE.md时,Claude Code会读取AGENTS.md作为项目指令文件,并可在“Project instructions”中进行相关配置。此前Claude Code主要依赖Anthropic自己的CLAUDE.md,而AGENTS.md已经成为多个Coding Agent共同采用的项目说明格式。Anthropic官方GitHub Release已确认,这项功能于9月18日随 v2.1.277 上线。

这一变化背后,是AI Coding Agent正逐渐从“单一产品能力”走向更开放的开发工具生态。Claude Code 社区早在2025年就持续提出AGENTS.md支持需求,其中一个相关Issue曾获得数千个点赞;开发者此前只能通过软链接、import等方式让不同Agent共用项目规则。 

此次Anthropic直接加入原生支持,意味着开发者可以更方便地在同一个代码仓库中切换不同Agent,而不必为每个工具重复维护项目规范。与此同时,Claude Code本身也在持续增强插件、Sub-agent等可扩展机制,Coding Agent的“运行框架”正在成为新的竞争层。

图片

5.智谱回应ZCode数据上传争议:开源并启动第三方审查

9月18日,据开发者披露,智谱旗下AI编程工具ZCode在特定情况下,会将工作区内容生成加密快照并上传;部分用户发现,即使关闭隐私及模型优化相关选项,仍能观察到上传记录。相关技术细节目前主要来自开发者对客户端和本地文件的分析。

智谱随后在ZCode官方社群发布说明并致歉,称争议与“代码库索引”功能有关。该功能用于支持会话恢复、历史回退及Repo Wiki等能力,其中部分云端功能会触发数据上传。官方表示,问题已完成修复,并计划开源ZCode代码库、邀请第三方机构进行独立审查,同时向用户补偿一次周额度重置。

这起事件也再次凸显AI编程工具的数据权限问题:当AI需要读取整个代码仓库、历史记录甚至项目上下文时,“本地处理”和“云端处理”的边界,以及用户是否充分知情并授权,正在成为开发者选择AI工具时的重要考量。

图片

6.ChatGPT正式进入Word,免费用户也能直接使用

9月17日,OpenAI正式推出 ChatGPT for Word,将ChatGPT直接嵌入Microsoft Word侧边栏。用户无需再在Word和浏览器之间反复复制粘贴,可以直接针对当前文档进行起草、总结、改写,以及调整标题、编号和格式等操作。官方确认,该功能面向包括Free在内的所有ChatGPT套餐开放,用户可通过Microsoft Marketplace安装插件。

对于企业用户,Word还将与Codex等功能共享使用额度,并按所使用模型的Token消耗计算。OpenAI表示,10月1日起,ChatGPT for Word将在Business工作区默认启用。至此,ChatGPT已经完成从Excel、PowerPoint到Word的Office三件套覆盖。相比单纯增加一个AI聊天入口,这次更新更重要的变化是:AI开始从“文档外的工具”变成直接参与文档生产的工作层。

图片

7.沙特推出阿拉伯语大模型humain M3,携手MiniMax加码AI全产业链

沙特主权财富基金 PIF 旗下 AI 公司 HUMAIN 近期推出 humain M3,将阿拉伯语模型作为其 AI 基础设施布局的重要组成部分。根据HUMAIN发布的信息,humain M3与中国AI公司MiniMax展开合作,并以MiniMax M3的技术能力为基础进行进一步训练。模型采用混合专家(MoE)架构,并针对阿拉伯语数据和应用场景进行优化。

从产业布局来看,中东AI投资已经不再局限于购买GPU或建设数据中心,而是逐渐向模型、算力、机器人和应用多个环节延伸。沙特、阿联酋、卡塔尔等国家正借助主权财富基金和国家级产业平台进入全球AI产业链,同时利用能源、资本和土地等资源建设AI基础设施。对于中国AI企业而言,中东市场也正在从单纯的产品出口市场,变成资本合作、模型本地化和基础设施合作的新场景。HUMAIN与MiniMax的合作,某种程度上体现了这一趋势:中东提供资本、算力和本地市场,中国企业提供模型与技术能力。

图片

8.Gemini测试中误入真实企业系统,Google首次公开相关事件

Google近日确认,Gemini曾在今年5月的一次网络安全测试中,访问到三家真实企业的受保护系统。此次测试由AI安全公司Irregular开展,原本设计为模拟环境,但测试过程中意外开放了互联网访问。Gemini随后通过猜测密码,以及从公开代码仓库获取凭证等方式进入真实系统。

据Google方面说法,Gemini在确认目标是真实企业而非测试对象后,均自行停止了后续行为,相关企业也已收到通知。Google认为,事件源于测试中的“身份混淆”,并表示安全机制最终阻止了进一步行动。不过,安全领域人士认为,事件本身仍值得关注,因为它显示出具备自主执行能力的AI Agent,在获得网络访问权限后可能越过原本设定的测试边界。目前Google未公布涉事企业名称及具体模型版本。

图片

9.空弧TDream开启内测:一句话生成可玩的AI互动影游

平台还提供“灵动画布”,以可视化节点方式搭建AI工作流,并支持多人实时协作和素材共享;作品完成后可发布至社区 TDreamTV,供其他用户浏览和游玩。移动端也支持通过小程序进行创作和体验。

目前平台处于内测阶段,用户可通过签到、发布作品及创作者扶持计划获得积分。相比单纯的AI生图或生视频工具,TDream尝试进一步把生成能力延伸到“可交互内容”的生产环节,让AI从生成素材走向生成完整的体验。

图片
欢迎分享、点赞、推荐 
 一起研究AI 
文章标签机器人智能体
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多