岳东晓博士
26-05-24 00:24 微博认证:美国加州律师,明尼苏达大学物理学博士

微博转视频流程。整个程序是在自己的计算机本地运行。硬件是一台搭配 RTX3090 的 Windows 11 桌面电脑,部分代码在 WSL下运行;图像生成是在 Windows下运行 Comfy-UI。 使用大语言模型千问 qwen3.6-35b-a3b 进行情景划分并配图描述,使用 zImageTurbo 进行图像生成, index-tts2 进行声音克隆与文字转语音。Python 代码负责指挥与合成,由 OPEN-AI 的 Codex 编写。两键生成,先点一下生成情景脚本,再点一下合成视频。附图是界面截屏。

#AI# http://t.cn/AX6f7S6u

发布于 美国