fal 在发布 benchmark 中表示,H3 Max 生成 5 秒视频的模型推理约为 3 秒。这比 5 秒视频的播放时间更短,但不代表每一次浏览器请求都能在 3 秒内完成全部流程。
用户等待时间还可能包括:
- 上传一到两张源图;
- 可选提示词扩展;
- 请求校验与积分预留;
- 服务商排队;
- 模型推理;
- Webhook 送达或状态轮询;
- 把完成的视频复制到持久化存储;
- 文件传输到浏览器。
fal 的 benchmark 主要描述模型执行,应用必须完成整条链路后,视频才会出现在历史记录中。
- **视频时长:**15 秒输出比 5 秒包含更多内容。
- **提示词扩展:**高质量模式可能先花额外时间补全提示词。
- **图片输入:**上传与远程获取素材发生在模型推理之前。
- **服务商负载:**繁忙时段可能产生队列。
- **文件传输:**更大的视频保存和传输更慢。
- **临时网络状态:**轮询或 Webhook 延迟会影响结果出现时间。
- 测试创意时先选 5 秒 480P。
- 提示词已经明确时使用均衡扩展。
- 上传尺寸适当的图片,不使用不必要的超大文件。
- 每次草稿只安排一个主要动作。
- 保存有效提示词和参数,不依赖记忆重写。
只有引用 fal 并写明日期时,才使用“5 秒视频模型推理约 3 秒”。本站不会承诺所有请求 3 秒交付,因为队列、网络、上传、提示词处理和存储不属于这一项测量。
资料来源:fal — Introducing H3 Max,发布于 2026 年 8 月 27 日。