Fable 5.1 和 GPT-6 Astra 能生成视频吗?
简短回答是不能:OpenAI 的模型页把视频标为不支持,Anthropic 的文档写明输出只有文本。而且 OpenAI 自家的视频模型 Sora 正在关停,API 将于 9 月 24 日关闭。那这些模型有什么用:它们写提示词,你要么手工复制,要么让它们以工具调用的方式发出去。
社交媒体上流传的视频底下总是同一句话:「人工智能一键做出来的」。被点名的模型通常也是同两个:OpenAI 的 GPT-6 Astra 和 Anthropic 的 Claude Fable 5.1。那就直接问:这两个能生成视频吗?
简短回答:不能。不是被关掉了,而是它们根本没有这种输出形态。
文档是怎么写的
GPT-6 Astra。OpenAI 的模型页把视频标为不支持的模态,音频也是。图像可以返回,但渲染的不是模型:而是通过 Responses API 调用一个独立的图像生成工具。
Claude Fable 5.1。Anthropic 的文档一句话讲完:所有当前模型接受文本与图像输入,产出文本输出。别说视频,连图像输出都没有。
OpenAI 的视频模型正在关停
这里有一段常被跳过。「OpenAI 能做视频」这句话的依据是 Sora,而 Sora 正在关停。时间线是:
- 2026 年 3 月 24 日 · 宣布关停。
- 2026 年 4 月 26 日 · sora.com 与应用下线。
- 2026 年 9 月 24 日 · API 关闭。也就是两周后。
截止日之后,与账号关联的内容将被删除。OpenAI 没有给出视频生成何时回归的时间表。见诸报道的原因是经济而非能力:运营成本与收入始终不匹配,最初的热度退去,版权与肖像问题也一直没解决。
所以如果问的是「OpenAI 有没有视频模型」,这个月底答案就会变。
那这些模型到底怎么用
这才是真正要问的:它们从哪里进入链条,是手工还是通过 API?有两条路,而两条路上模型都不生成画面。
1. 手工,让它写提示词。你让模型为某个镜头写一段视频提示词,再把这段文字复制到视频工具自己的界面里。两个产品之间没有任何连接,搬运工是你。Astra 说的「我只写提示词」正是这里,也是多数人在做的事。
2. 通过 API,作为工具调用。你给模型定义一个工具:一个叫「生成视频」的函数,背后是视频模型的 API。模型在对话中决定调用它,自己写好提示词发过去,再把返回的文件交给你。在 OpenAI 这边是 Responses API 的工具机制,在 Anthropic 这边是工具使用或 MCP。
演示里的「一个按钮」就是第二条路。但要看清被调用的是什么:别人的 API。模型仍然在写、在决定、在触发,铺画面的不是它。两条路的差别只在于谁搬运那段文字。
它在链条里的其他活儿
- 脚本与分镜计划。把题目拆成段落,定下每个镜头多长、什么顺序。
- 分镜提示词。机位、光线、运动、时长,翻译成视频模型听得懂的话。这一环往往最决定成片质量。
- 链条的代码。把视频模型、配音和剪辑接起来的脚本。所谓「一个按钮」,通常就是它。
- 检查画面。因为接受图像输入,可以把渲染出的一帧给它看,让它说「手多了一根指头,提示词这样改」。
- 文字活儿。标题、简介、字幕、翻译。
一句话,这些模型负责写、决定和触发,不负责出画面。
画面是谁渲染的
另有一批模型在铺画面:Seedance(字节跳动)、Runway、Kling、Veo、Luma。要搭三维场景,还会加上 Blender 这类传统软件。配音是另一个模型。此外还有 Wan 这样的开放权重视频模型,可以跑在你自己的硬件上。
做这些视频的人多半也都写了:工具名字会出现在简介或片尾。并没有谁在隐瞒。
X 上的对比在量什么
这直接关系到对比视频。以「Astra 做了这个、Fable 5.1 做了那个」并列摆出的画面,并不是两个语言模型的输出;既然两者都做不了视频,画面就出自第三个模型。
这里不是两个模型的较量,而是两条链条的较量。两条链上的视频环节甚至可能是同一个产品,那样差别就来自谁把提示词写得更好。诚实的对比会写明视频由哪个模型渲染、用了哪些设置。
这件事的实质
在这里找骗局并不合适,工具通常都写了。问题在于什么会留在脑子里:标题上是两个语言模型的名字,而做出画面的那个模型躺在简介里。
Sora 的关停则给出另一个教训。你租来的视频模型是会被关掉的,而且不是因为能力不够,是因为账算不过来。把链条压在单一闭源产品上的团队,等这个产品关停时就得把那一环重建一遍。所以让开放权重模型跑在自己的硬件上,不只是成本问题,更是连续性问题。
该问的是:这条链有几环,每一环归哪个模型,以及那个模型明天关停了你怎么办。