多场景AI电影制作工具
freescene是一个开源命令行工具,可将一句话创意转化为多场景AI短片。它利用LLM编写脚本,通过视频API渲染场景,再用ffmpeg拼接成MP4。支持免费试用、付费套餐或自建后端,兼容多种模型和服务。
freescene 是一款开源的命令行工具,旨在将用户的简单文字创意自动转化为多场景的AI电影。它的工作原理分为三个核心步骤:首先,一个大语言模型(LLM)充当电影导演的角色,根据用户输入的一句话创意,生成多个场景的文字描述;接着,每个场景描述被发送到兼容OpenAI接口的视频生成API,渲染为短视频片段;最后,通过ffmpeg将这些片段拼接成一个完整的MP4文件。如果遇到编解码器不匹配的情况,工具会自动回退到libx264重新编码,确保兼容性。
安装freescene非常简单,只需运行 pip install freeai-scene,同时需要确保系统中已安装ffmpeg。该工具默认使用Free.ai的API服务,但用户可以通过环境变量灵活切换到其他后端。例如,可以分别指定用于脚本编写的LLM(如GPT-5、Qwen3-30B等)和用于视频渲染的模型(如CogVideoX、HunyuanVideo等),甚至可以将两者交给不同的服务商处理。这种设计使得freescene具有很强的可定制性,适合不同需求的用户。
在成本方面,freescene采用按token计费的模式。免费注册用户每天可获得30,000个token,足够制作一部默认的三场景四秒电影。如果需要更多,可以购买5美元的token包(约200K tokens,可制作约6部电影),或者自建GPU后端实现零成本运行。工具在每次运行前会显示成本估算,并支持 --dry-run 参数进行预览,避免意外消耗配额。
除了命令行界面,freescene还提供了Python API和异步接口,方便开发者集成到自己的应用中。该工具基于Free.ai的/movie管线提取而成,使用MIT开源许可证,社区活跃,支持多种模型和服务。对于对AI视频生成感兴趣的开发者来说,freescene是一个实用且灵活的工具。