浅译快报

精选

AI × 艺术设计前沿,客观汇集每日动态、征集机会与 SKILL 评测。

头版
OpenAI 开发者日 2026 回顾· 9月29日一手 产品

OpenAI 9 月 29 日在旧金山举办 2026 开发者日,发布 20 多项更新:由 GPT-6 Astra 驱动、在云端有自己电脑和浏览器的常驻智能体 Dots,逐步向 Pro、Business Premium 和企业版开放;团队与 AI 共同编辑的 ChatGPT Space;API 价格为 Astra 五分之一的 GPT-6.1 Sol;以测试版开放、可在托管浏览器里操作网页的 Agents API;插件可在侧栏和对话旁打开完整界面,Adobe 同日为 ChatGPT 插件加入修图和 PDF 编辑面板。

推荐理由 智能体有了自己的云端电脑,用户离线时也能继续工作,并进入团队共用的文档;插件可以在对话旁打开完整的编辑面板。

OpenAI 于 9 月 29 日在旧金山 Fort Mason 举办 2026 开发者日(DevDay),开场主题演讲全程直播,当天发布 20 多项更新。ChatGPT 方面,新推出的 Dots 是一种常驻智能体:由 GPT-6 Astra 驱动,在云端有自己的电脑和浏览器,用户关机后仍可继续调研、分析数据、准备文档和编写软件,可以在 ChatGPT、Slack、Microsoft Teams 里对话或通话;目前逐步向 Pro 100/200/500(欧洲经济区、英国和瑞士以外的 18 岁以上用户)、Business Premium 和企业版开放。ChatGPT Space 让团队成员与 ChatGPT、Codex 或自己的 dot 在同一个空间里编辑可自动更新的新文档 Pages,协作幻灯片和表格即将推出。API 方面,GPT-6.1 Sol 每百万 token 输入 2 美元、输出 10 美元,是 GPT-6 Astra 的五分之一;Agents API 以测试版开放,由 OpenAI 托管 Codex 的执行框架,新增的电脑操作让智能体在 OpenAI 托管的浏览器里完成任务;新的 Ultrafast 服务档先向 GPT-6 Astra 开放,价格是标准档的 6 倍。插件现在可以在侧栏、对话旁面板和文件编辑器中打开完整界面;Adobe 同日为 ChatGPT 中的 Adobe 插件加入由 Photoshop、Adobe Express 驱动的修图面板,以及用 Acrobat 工具编辑 PDF 的面板。

智能体开始有自己的云端电脑,用户离线时也能继续工作,并进入团队共用的文档;和设计相关的变化集中在插件:修图、改 PDF 可以在对话旁的面板里手动完成。

查看原始来源 ↗

OpenAI 开发者文档 / Variety / 迪士...· 9月24日一手编辑精选 行业

OpenAI 的 Sora 2 视频模型与 Videos API 于 9 月 24 日关停,官方文档写明没有一对一的替代 API;迪士尼 2025 年底宣布的角色授权与 10 亿美元入股计划,在 3 月关停消息公布时已退出。

OpenAI 的 Sora 2 视频模型与 Videos API 已于 9 月 24 日关停。OpenAI 在 3 月 24 日的弃用通知中列出 Videos API、sora-2、sora-2-pro 及其快照,推荐替代一栏为空;视频生成指南写明没有一对一的替代 API。Sora 独立应用定于 4 月 26 日下线(据 The Decoder)。迪士尼 2025 年 12 月宣布与 OpenAI 签订三年授权、让 200 多个角色进入 Sora,并计划入股 10 亿美元,交易仍需谈判最终协议;3 月关停消息公布时,Variety 报道迪士尼退出合作,据 exchange4media 报道双方未发生资金往来。此后 ElevenLabs、ComfyUI 等平台陆续下架 Sora 相关功能。

Sora 的 Videos API 从开放到关停不到一年,依赖单一闭源视频 API 的创作流程需要预留替换路径。

查看原始来源 ↗

Adobe 官方博客· 9月24日一手 产品

Adobe 推出 Adobe in Gemini,可在 Gemini 对话中调用 Photoshop、Lightroom、Express 和 Firefly 的工具;Adobe for Claude 插件首次并入 Acrobat 工具,可调用 80 多个工具,并新增 PDF 与 Express 设计的交互式编辑器。

推荐理由 Adobe 的对话端接入已覆盖 ChatGPT、Claude、Copilot、Slack 和 Gemini,Claude 端新增的交互式编辑器可在对话中直接手动修改 PDF 和设计。

9 月 24 日,Adobe 推出 Adobe in Gemini:用户可在 Google Gemini 对话中调用 Photoshop、Lightroom、Adobe Express 和 Firefly 的工具修图、制作营销素材和修改设计,覆盖所有 Gemini 订阅档位,需登录 Adobe 账号;按 Google 的可用性说明,目前仅支持英文,限个人 Google 账号使用。同日 Adobe for Claude 插件首次并入 Acrobat 工具,可调用的工具增至 80 多个,并新增 PDF 交互式编辑器(调整页序、编辑文字、批注)、Document Review 技能和基于图层的 Express 设计编辑器。两项均从当日起在全球逐步推出。

同一套 Adobe 工具已能在 ChatGPT、Claude、Copilot、Slack 和 Gemini 中调用,各平台开放的工具范围和使用条件不同,使用前需分别确认。

查看原始来源 ↗

最新精选 全部资讯 →
9月29日周二
Adobe 官方博客· 9月29日一手 产品

Adobe 9 月 29 日配合 OpenAI 开发者日,为 ChatGPT 中的 Adobe 插件加入在侧边面板打开的交互式编辑器:图片与设计编辑由 Photoshop 和 Adobe Express 驱动,可选中对象或涂抹区域让 ChatGPT 修改,再用色相、饱和度、对比度等滑块微调;PDF 可用 Acrobat 工具直接改文字、加高亮。当天起在 ChatGPT 网页版和 App 全球逐步推出。

AO另有 1 家来源
推荐理由 局部修改可以先用一句话交给 AI,再用滑块手动收尾,不必重新生成整张图。

Adobe 于 9 月 29 日配合 OpenAI 开发者日,更新 ChatGPT 中的 Adobe 插件,加入在侧边面板打开的交互式编辑器。图片与设计编辑器由 Photoshop 和 Adobe Express 驱动:用户可以选中对象或用画笔涂抹一块区域,让 ChatGPT 调用插件做针对性修改,再用色相、饱和度、对比度等滑块微调;编辑器按修改类型显示控件,例如要求改某个物体的颜色时,只对选区显示颜色控件。编辑器里的调整会作为上下文回到对话,不必重新上传或重新说明。PDF 可以在侧边面板里用 Acrobat 工具直接改文字、加高亮,选中的段落也能用来引导后续对话。OpenAI 当天发布的插件扩展同样允许插件在对话旁打开面板,并在侧栏和文件编辑器中呈现自己的界面。更新从当天起在 ChatGPT 网页版和 App 全球逐步推出。

局部修改可以先用一句话交给 AI,再用滑块手动收尾,不必重新生成整张图。

查看原始来源 ↗

9月28日周一
World Labs 官方博客· 9月28日一手 行业

World Labs 9 月 28 日宣布已签署最终协议加入 AMD:联合创始人李飞飞将出任 AMD 执行副总裁兼首席科学家,直接与 CEO 苏姿丰合作,Justin Johnson 与 Ben Mildenhall 继续带领 World Labs 团队;交易预计 2026 年底前完成,需通过监管审批。

推荐理由 做世界模型的头部团队并入芯片厂商,空间智能方向的研发与底层算力绑得更紧,Atlas、Marble 等产品的后续走向值得关注。

World Labs 于 9 月 28 日宣布,已与 AMD 签署最终协议加入 AMD。World Labs 成立于 2024 年,自去年起与 AMD 开展深度技术合作,从在 AMD GPU 上优化模型训练与推理开始。公告称,联合创始人李飞飞将出任 AMD 执行副总裁兼首席科学家,直接与 CEO 苏姿丰合作;Justin Johnson 与 Ben Mildenhall 将继续带领 World Labs 团队,并入后组成 AMD 的前沿研究机构。双方表示将共同建设覆盖硬件、软件、平台与开放模型的端到端 AI 生态。交易预计在 2026 年底前完成,需通过监管审批等常规交割条件,公告未披露交易金额。World Labs 此前在 9 月 1 日发布了世界模型 Atlas。

世界模型公司并入芯片厂商,空间智能方向的研发与底层算力绑得更紧;Atlas 与 Marble 等产品的后续走向值得关注。

查看原始来源 ↗

9月23日周三
Google 官方博客· 9月23日一手 产品

Google 9 月 23 日宣布,任何 Google 或 Google Workspace 账号都可以在桌面端 Google Vids 里免费用 Gemini Omni 1.1 Flash 生成视频:可延展场景并保持人物、光线与环境一致,指定片段的精确时长,生成或放大到 1080p;每段生成内容都嵌入 SynthID 不可见水印。

推荐理由 同一代视频模型进了免费的办公工具,没有预算的个人和小团队也能直接用来做宣传短片、活动视频。

Google 于 9 月 23 日宣布扩大 Google Vids 的开放范围:任何 Google 或 Google Workspace 账号都可以在桌面端访问 vids.new,选择「Create AI videos」,免费用 Gemini Omni 1.1 Flash 生成视频。新增的控制包括:延展场景并保持画面上下文、光线、人物外观与环境一致;指定生成片段的精确时长,便于对齐旁白;以 1080p 生成新片段,或把已有 AI 片段放大到 1080p;另提供现成模板。每段用 Omni 1.1 生成的片段都嵌入 SynthID 不可见水印。免费使用有额度,个人账号可通过 Google AI 订阅获得更多生成次数,Workspace 商业版与企业版有更大的生成额度池;官方称 Gemini 3.8 Flash-Lite 语音合成即将加入 Vids。

同一代视频模型进了免费的办公工具,没有预算的个人和小团队也能直接用来做宣传短片、活动视频。

查看原始来源 ↗

9月22日周二
PixVerse 官方博客· 9月22日一手 模型

PixVerse 9 月 22 日发布实时世界模型 R2:生成的世界持续运行,会话中的提示词、动作与音频输入会改变之后的发展而不重置,可用 WASD 与方向键操控角色和镜头;PixVerse 游戏引擎已改用 R2,一批示例世界在 world.pixverse.video 开放体验。

推荐理由 世界模型从生成片段走向可以进入、会记住操作的持续世界,互动叙事和游戏原型可以直接在上面搭。

PixVerse 于 9 月 22 日发布实时世界模型 R2,是 1 月推出的 R1 的升级。R2 生成的世界在用户进入后持续运行,会话更长、更连贯:提示词、动作或音频输入不只改变当前画面,还会更新世界状态、影响之后的发展,前面的操作在同一会话中一直有效;可以用 WASD 键操控角色、方向键移动镜头,文字、参考图、音频与动作控制都能输入同一个运行中的世界。官方示例包括创作者基于 R2 做的互动电影游戏,同一处剧情会按玩家的选择生成不同走向。官方介绍其做法是持续训练同一个因果自回归主干模型,再把它压缩到可实时运行,技术报告另行发布。PixVerse 7 月推出的游戏引擎已改用 R2,一批示例世界在 world.pixverse.video 开放体验。

世界模型开始支持持续交互与状态延续,互动叙事、游戏原型可以直接在生成的世界里搭建和试玩。

查看原始来源 ↗

OpenAI API 更新日志· 9月22日一手 模型

OpenAI 9 月 22 日在 API 上线 GPT-6 Sol 与 GPT-6 Luna 两款推理模型,支持文本和图像输入、文本输出。标准定价(输入 272K token 以内,每百万 token):Sol 输入 $2、输出 $10;Luna 输入 $0.10、输出 $0.50。官方把 Sol 定位为兼顾能力与成本,Luna 面向成本敏感、调用量大的任务。

OO另有 1 家来源
推荐理由 与 9 月 3 日发布的旗舰 GPT-6 Astra 组成三档;Luna 的输入价格约为 Astra 的百分之一,是估算批量调用成本的直接参照。

OpenAI 于 9 月 22 日在 API 发布 GPT-6 Sol(gpt-6-sol)与 GPT-6 Luna(gpt-6-luna)。两款均为推理模型,接受文本与图像输入、输出文本,可通过 Responses API 与 Chat Completions API 调用。标准定价(输入不超过 272K token,每百万 token):Sol 输入 $2、缓存输入 $0.20、输出 $10;Luna 输入 $0.10、缓存输入 $0.01、输出 $0.50。按官方模型目录的分工,复杂推理与编程用旗舰 GPT-6 Astra,兼顾能力与成本用 Sol,成本敏感、调用量大的任务用 Luna。9 月 25 日 OpenAI 修复了一个影响这两款模型图像理解的编码问题;9 月 29 日又发布了 GPT-6.1 Sol。

Luna 的输入价格约为旗舰 Astra 的百分之一,给批量内容处理、分类抽取这类高频调用留出了成本空间。

查看原始来源 ↗

9月21日周一
ComfyUI 官方· 9月21日一手编辑精选 产品

ComfyUI v0.37.0(9 月 21 日)原生支持 Qwen-Image 2.1(文生图、编辑、背景移除三个模板,可输出透明图)和 MoGe 3 单图几何估计;v0.37.1(9 月 22 日)新增腾讯 HY Image 3.5 Preview 文生图与编辑合作节点,编辑节点最多接 5 张参考图、原生 2K 输出。

ComfyUI 于 9 月 21 日发布 v0.37.0,原生支持阿里 Qwen 团队 9 月 20 日发布的 Qwen-Image 2.1:同一模型完成文生图与编辑,可输出带透明通道的图像,官方提供文生图、图像编辑和背景移除三个模板;该模型采用 Qwen Research License,仅限非商业用途。同版本加入微软 MoGe 3 单图几何估计(ViT-L、ViT-g 两个检查点,可输出深度图与法线),并在检测到足够快的磁盘时自动启用快速加载。9 月 22 日的 v0.37.1 新增腾讯 HY Image 3.5 Preview 文生图与编辑合作节点:编辑节点可接 1–5 张参考图,原生最高 2K(选 4K 时由模型放大),在腾讯服务器上通过 API 运行。

透明图输出和背景移除进入节点工作流,抠图、叠加可以在同一条流程里完成;用 Qwen-Image 2.1 做商业项目前需要先确认许可。

查看原始来源 ↗

9月17日周四
Semafor(独家)/ AlphaSignal· 9月17日编辑精选 产品

Pika 将产品从单一视频生成工具重构为多模型创意工作室,集成 7 个 AI 模型并新增逐镜头清单生成、重打光与换装工具套件。

Pika 于9月17日宣布将产品从单一视频生成工具重构为多模型创意工作室,集成 Seedance 2.5、Veo 3.1、GPT Image 2.5、MiniMax H3、Grok Imagine 等 7 个 AI 模型,并推出独立应用套件(Video Studio、Color Grade、Extend Video、Edit Image、Character Studio、Product Shot);核心新特性包括:输入基本描述后自动生成可编辑逐镜头清单、重打光工具、角色与服装替换工具套件;平台自动路由至最优模型,同时支持手动指定。

Pika 的转型说明 AI 视频工具的竞争焦点已从单一模型质量转向多模型整合平台体验,逐镜头清单生成对短片创作和教学视频制作有实用价值。

查看原始来源 ↗

9月16日周三
Midjourney 官方更新日志· 9月16日一手编辑精选 产品

Midjourney Alpha 9/16 更新:新增韩文语言界面支持

Midjourney Alpha 9/16 更新:新增韩文语言界面支持;V8.2 编辑器改进——图片附件提示词输入框进入提示词栏(图文混合提示更流畅)、Draft 批次显示来源网格与悬停预览、Enhance 按钮替代原 Upscale 按钮;移动端与平板端布局重新适配,触控体验优化。

该动态揭示了 AI 视觉生成与多模态工具领域的最新进展,对艺术设计研究与实践具有参考价值。

查看原始来源 ↗

Figma 官方博客(release-notes)· 9月16日一手编辑精选 产品

Figma 推出 Weave 节点支持将 Design 画框拖入 AI 工作流、Shaders 开放测试版通过提示词生成动效着色器,并上线 Weave 社区工具发布功能。

Figma 于9月16至17日推出三项功能更新:Weave 节点允许将 Design 画框直接拖入 Weave AI 工作流作为节点输入,支持批量生成品牌一致的营销素材;Shaders 开放测试版可通过 AI 提示词生成火焰、扭曲、动效等视觉特效着色器,并提供代码查看器供进一步定制,无需编程背景;Weave 社区工具发布功能允许创作者将自建 AI 工作流工具发布至 Figma 社区,共享节点资产。

Weave 节点将静态设计直接接入 AI 规模化生产链路,Shaders 开测版则让无编程背景的设计学生也能实验 AI 生成动态视觉特效。

查看原始来源 ↗

arXiv.org· 9月16日一手编辑精选 论文

arXiv 论文 2609.18065 提出系统性框架梳理生成式图像模型视觉界面的提示输入、控制粒度、迭代模式与输出展示四大核心维度。

arXiv 论文 2609.18065(9月16日)提出一套系统性的设计空间(Design Space)框架,梳理生成式图像模型视觉用户界面的核心维度,包括提示输入范式(文字/图像/草图/混合)、控制粒度(全局/局部/风格/结构)、迭代交互模式(单次/多轮/协作)以及输出展示策略(对比/时间轴/探索网格);通过对 Midjourney、Adobe Firefly、DALL·E 等主流生图界面进行系统性分类编码,为界面设计研究和工具开发提供参照。

这是生成式图像界面领域少有的系统性综述,提供了批判性评估 AI 生图工具的理论框架,适合作为课程进阶理论环节的参考材料。

查看原始来源 ↗

TechCrunch + Anthropic 官方· 9月16日一手编辑精选 产品

Anthropic 将 Claude.ai 聊天与 Cowork 工作空间合并至单一窗口,并推出 Claude Design 支持跨项目品牌一致性管理。

Anthropic 于9月16日正式推出 Claude 统一界面,将 Claude.ai 聊天功能和 Cowork(项目/工作空间)合并至单一窗口,系统自动将用户请求路由至最合适的模式;同步推出 Claude Design 功能,支持跨项目保持品牌一致性,可与 Claude Code 协同工作,提供画布式编辑界面及更多工具连接。

Claude Design 的品牌一致性功能与设计工作流直接相关,统一界面进一步降低了非技术类高校用户的上手门槛。

查看原始来源 ↗

9月15日周二
arXiv(arXiv:2609.11638)+ 生数...· 9月15日一手编辑精选 模型

生数科技发布 Vidu S2,包含实时 720p 数字人生成与无中断流式视频风格编辑两个子模型,在线演示同步开放。

生数科技(Shengshu Technology)于9月15日发布 Vidu S2,包含两个子模型:Vidu S2-Avatar 支持实时生成 720p 数字人,可在对话中动态替换参考图、跟随舞蹈等复杂肢体指令;Vidu S2-Editing 实现流式实时视频风格编辑,包括风格渲染、换装、换人、换背景,整个过程无需中断视频流。论文同时展示了 VR 空间中的实时视频生成与编辑能力,配套在线演示已开放(vidu.com/vidu-stream),对应论文为 arXiv:2609.11638。

实时流式视频编辑能力让换装、换背景等操作接近「直播即生成」,对影视、时尚设计与数字人方向的创作工具链影响直接,VR 空间扩展亦值得关注。

查看原始来源 ↗

ElevenLabs 官方博客· 9月15日一手编辑精选 产品

ElevenLabs 将 MCP 连接器从纯语音扩展至多模态全链路,单次 OAuth 安装接入 50 余个语音、音乐、图像与视频生成模型。

ElevenLabs 于9月15日将 MCP 连接器从纯语音扩展至多模态创作全链路:单次 OAuth 安装即可接入语音、音乐、图像与视频生成共 50 余个模型;托管服务端位于 api.elevenlabs.io/v1/mcp;支持 Claude、ChatGPT、Cursor、Grokbot、Hermes 等主流 AI 客户端;用户在同一对话线程内可依次完成剧本、配音、配乐、音效到视频的完整创意流程,无需切换工具。

单一 MCP 连接器覆盖声音、图像到视频的完整创作链路,标志 MCP 生态从代码辅助向创意生产管线全面延伸。

查看原始来源 ↗

GlobeNewswire + PR Newswire· 9月15日一手编辑精选 产品

CorelDRAW Graphics Suite September 2026 Update 新增 Text-to-Vector AI,支持从文字描述直接生成可商用、可编辑矢量图形路径,并将 PowerTRACE 速度提升 4 倍。

Corel 于9月15日发布 CorelDRAW Graphics Suite September 2026 Update,核心新功能为 Text-to-Vector AI:用户输入文字描述,Vector Craft(创意探索模式)和 Vector Master(精准输出模式)可直接生成可商用的可编辑矢量图形路径,消除手工描摹步骤;同步升级 PowerTRACE 4.0(位图转矢量处理速度提升 4 倍)及 Print & Cut 工作流对多色醋酸薄膜、透明箔纸等特种材料的支持。

传统矢量设计工具内嵌 AI 文字生成能力,让学生可以直接获得可编辑矢量素材原型,是 AI 进入矢量工作流的一个典型节点。

查看原始来源 ↗

GitHub (comfyanonymous/Comf...· 9月15日一手编辑精选 产品

ComfyUI v0.36.0 新增 FastH3 8步蒸馏视频、BFL FLUX 视频编辑、YuE2 音乐生成与 Tripo P2 3D 等多项节点,单一工作流覆盖文字到视频配乐完整链路。

ComfyUI 于9月15日发布 v0.36.0,新增多项重量级节点:FastVideo FastH3(8步蒸馏 MiniMax H3,支持文生视频、图生视频与原生音频同步)、BFL FLUX Video Edit($0.03/秒视频编辑 API,保留原片运动轨迹与音频)、YuE2 音乐生成模型、Tripo P2(文字/图像/多视角→3D)、Marigold V2(深度/法线/反照率估计)以及 Generic Loops 与 Video Concatenate 节点;H3 ControlNet 获 Comfy Compiler 完整兼容支持;配套发布 ComfyUI Desktop v1.6.0,支持 Apple Silicon 全原生 MPS 加速。

单一 ComfyUI 工作流现已覆盖文字到视频再到配乐的完整链路,FastH3 仅需 8 步即可生成带原生音频的视频,BFL FLUX Video Edit 的低单价亦使学生作业级实操具备可行性。

查看原始来源 ↗

Black Forest Labs 官方文档 + Co...· 9月15日一手编辑精选 模型

Black Forest Labs 推出 FLUX Video Edit API,$0.03/秒输出,可按文字描述精准修改视频中指定元素,同时完整保留原片运动轨迹与音频。

Black Forest Labs 于9月15日推出 FLUX Video Edit API,计费标准为 $0.03/秒输出。该 API 接受源视频与文字描述,可精准修改视频中指定元素(换服装、替换背景、改变材质等),同时完整保留原片运动轨迹与音频;已通过 ComfyUI v0.36.0 原生节点接入,亦支持直接调用 BFL API,底层能力与 FLUX 图像模型家族共用。

「改元素不改运动」解决了 AI 视频二次编辑中时序一致性的核心痛点,$0.03/秒的低单价使教学实操场景的成本具体可控。

查看原始来源 ↗

查看全部资讯 →