1.千问开源Qwen-Image-2.1,支持透明图像生成与编辑
近日,阿里通义千问团队正式开源图像生成模型Qwen-Image-2.1。
据介绍,Qwen-Image-2.1采用32层Single-Stream DiT架构,在较小模型规模下依然具备较强的图像生成能力,并提升推理效率,降低多图输入场景下的计算开销。
在功能方面,该模型支持根据提示词描述,自动决定输出普通图像还是带有透明通道的图像。并且支持直接编辑透明图层,对专业用户而言,透明图层能记录每个像素透明度,生成后可以直接拖入PR、AE等工具,不用抠图,方便后续编辑。除此之外,Qwen-Image-2.1还最多支持10张参考图输入,可完成多主体融合、商品搭配、室内设计等复杂创作任务,并支持圈选、涂抹和独立掩码等局部编辑方式。
此外,模型进一步优化了人像和商品编辑能力,增强面部特征、商品文字、纹理与形态的一致性,并覆盖全景图、信息图、分镜图等多类视觉创作场景。目前,Qwen-Image-2.1已通过GitHub、ModelScope和Hugging Face等平台开放。

2.智谱ZCode数据上传争议持续发酵,官方标识已引入第三方审计
9月20日晚,据《中国新闻周刊》报道,太原承明科技有限公司向智谱发出正式法律函件,就ZCode涉嫌上传用户数据资产及商业秘密提出整改和问责要求,并保留采取法律行动的权利。
报道称,承明科技相关负责人表示,公司通过取证发现,智谱此前公开致歉之时,仍存在工作区数据上传情况。其提供的信息显示,智谱已上传公司6个工作区数据,其中包括版本控制历史、工程配置以及与源代码相关的信息,最大单个上传文件容量达到410MB。该公司还质疑这些数据被传到了在新加坡注册的主体。承明科技从事企业办公系统开发,如果密钥泄露有可能侵犯用户隐私。
而9月21日上午,智谱向《第一财经》表示,针对数据安全问题,已邀请中国信息通信研究院和绿盟科技开展安全审计。经中国信息通信研究院技术评测,ZCode相关阿里云OSS存储桶状态已确认无数据;经绿盟科技审查,相关存储桶及其中数据对象已完成删除。
此外,智谱表示,ZCode v3.14.0客户端已完成安全整改,移除了Repo Wiki功能,并切断本地仓库快照生成与上传链路。根据绿盟科技审查结果,当前版本未发现可触发本地仓库快照或文件外发的功能路径。

3.ChatGPT被曝使用跨网站追踪机制,获取用户站外购物信息用于广告分析
9月21日,独立研究者Buchodi发布调查称,OpenAI广告体系中的“__obi” Cookie可能用于连接ChatGPT账号与用户在其他网站上的行为。该研究基于安卓Chrome环境下的流量分析,覆盖936个广告追踪组件和1029个网站域名。
据研究者分析,任何在ChatGPT上投放广告的企业,都可能在自身网站中部署OpenAI提供的一段代码。当用户访问这些网站时,该代码会将页面访问、商品浏览、购买行为等数据发送至OpenAI服务器,并通过“__obi”标识与用户此前的ChatGPT会话关联。研究显示,同一个标识曾在多个商业网站向OpenAI发送的数据中出现。
对于普通用户而言,这意味着如果该机制被用于广告分析,用户在其它网站搜索商品、阅读内容或进行消费的行为,可能被用于完善广告推荐和用户画像。此前,研究者已向OpenAI询问该Cookie为何被归类为“分析”用途,以及关闭营销追踪后是否仍会生成该标识。
OpenAI客服确认收到反馈,并表示将进行内部审查,但暂未公开回应具体问题。
研究者同时指出,该机制主要在安卓Chrome环境中观察到,iOS浏览器因隐私机制限制未发现类似情况。

4.Anthropic被曝测试Claude Opus 5.5,开发者称其增强代码与长任务能力
近日,有开发者在社交平台曝光Anthropic正在内部测试代号为“claude-wafer-eap”的Claude Opus 5.5版本。
据爆料,Claude Opus 5.5可能作为Claude Opus系列的新版本,重点提升复杂任务处理、代码生成、长程规划等能力。有参与测试的开发者表示,新版本在3D建模、网页开发和多步骤任务执行等场景中表现出较强能力,并展示了通过模型生成3D模型、交互式网页应用等案例。
此外,社区流出的信息显示,Claude Opus 5.5可能采用新的API定价方案,预计输入和输出Token价格较此前版本有所调整。不过,以上信息并未得到Anthropic官方确认。

5.TypeSafe AI开放Jev模型,专注高频决策任务处理
近日,AI初创公司TypeSafe AI正式开放其首款模型Jev,用户无需申请候补名单即可体验。同时,官方为注册用户提供5美元额度,约1.2亿Token使用量。Jev与传统大语言模型不同,并不生成自然语言内容,而是专注于根据预设选项完成分类、评分和概率判断等任务。
据介绍,Jev由TypeSafe AI研发,该公司由前OpenAI研究人员Diogo Almeida等人创立,并于近期完成4000万美元种子轮融资。Jev采用“System One Model”定位,目标是处理软件系统中的高频判断任务,例如用户意图识别、风险评估、任务分流等,而非替代ChatGPT等通用生成式模型。
在交互方式上,Jev主要提供三类输出能力:Choice可从预设选项中进行选择,最多支持255个选项;Score可根据设定尺度进行评分;Noul则用于输出0到1之间的是非概率判断。相比需要生成完整文本的大语言模型,Jev通过限定输出范围降低解析成本,并提升响应速度。
社区开发者正尝试将Jev应用于微信插件、浏览器Agent、客服分流等场景,用于判断消息意图、选择下一步操作或进行模型路由。

6.抖音精选App接入杜比视界,推动高品质视频内容普及
9月21日,在2026抖音创作者大会上,杜比实验室与抖音精选宣布,杜比视界体验正式登陆抖音精选App。继抖音App和剪映支持杜比视界后,双方进一步扩大合作范围,为用户提供更高质量的视频观看体验。
据介绍,抖音精选App作为抖音旗下专注中长视频内容的平台,接入杜比视界后,用户可通过iOS和安卓端观看支持该格式的优质视频内容,覆盖旅行记录、知识科普、生活分享、创意短片等多类场景。创作者上传的杜比视界格式视频,也有机会在抖音精选App中以高画质形式呈现。
同时,杜比与新榜联合发布《杜比视界UGC视频内容发展研究报告》。报告显示,今年1月至8月,抖音平台带有“#杜比视界”话题的视频播放量增长64%。调研中,多数创作者表示,杜比视界在亮度、细节、色彩和材质表现方面具备优势,为视频创作提供了新的表达方式。
杜比视界通过动态元数据技术,对视频每一帧画面的亮度、色彩和对比度进行优化,以提升不同设备上的视觉表现。此次合作进一步拓展了杜比视界在社交媒体内容生态中的应用场景,也推动高品质视频技术向更多创作者和普通用户普及。

7.Qoder上线Sites功能,一句话生成并发布网页应用
9月20日,阿里智能体工作台Qoder上线新功能Qoder Sites,用户通过自然语言描述需求,即可创建、预览并发布网页应用,生成可分享链接。该功能支持从模板或提示词开始构建交互式网站,并可用于产品原型、数据看板、活动页面等场景。
据介绍,Qoder Sites区别于传统AI网页生成工具,不仅能够生成页面,还支持创建可持续运行的数据应用。用户生成的网站可以接入数据库,实现数据保存、状态更新等能力,使网页从静态展示页面转变为可交互应用。
此外,Qoder Sites支持权限管理,用户可以选择向指定成员、组织内部或公开分享生成的网站。官方文档显示,发布后的站点支持独立访问权限设置,适用于项目展示、内部工具和公开Demo等不同场景。
同时,Qoder Sites可与Qoder Cloud Agents结合,为网页应用接入Agent能力。用户生成的应用可以调用云端Agent处理请求,例如在电商页面中加入智能导购助手,根据用户需求和商品信息提供推荐。
目前,Qoder v0.3.3与Qoder CLI v1.1.54已支持Sites能力。

欢迎分享、点赞、推荐一起研究AI







