AI视频生成上手指南:Open Generative AI

发布时间:2026/9/9 17:04:22

AI视频生成上手指南:Open Generative AI
AI视频生成上手指南Open Generative AI【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个可自托管的开源 AI 视频与图像生成工作室把 Flux、Midjourney、Kling、Sora、Veo 等 400 余个模型接入统一界面覆盖文生视频、图生视频与唇形同步的完整产出链路。项目采用 MIT 许可证提供在线版、桌面客户端与本地推理三种启动方式无需订阅费。能力与定位速览功能模块一句话说明关键组件路径图像生成文生图 / 图生图双模式单次最多 14 张参考图src/components/ImageStudio.js视频生成文生视频 40 模型、图生视频 60 模型参数随模型自适应src/components/VideoStudio.js唇形同步肖像音频或视频音频生成说话视频9 个专用模型src/components/LipSyncStudio.js影视镜头控制机身、镜头、焦段、光圈选择转为提示词修饰src/components/CinemaStudio.js工作流编排节点编辑器把图像、视频、音频模型连成多步管线src/components/WorkflowStudio.jsWeb 版基于 Next.js 的 App Router 构建入口页面在app/studio/目录桌面版与共享包packages/studio/复用同一份模型定义两边能力保持一致。环境准备与三种启动方式在线版免安装浏览器打开托管地址即可使用全部工作室模型列表始终跟随最新版本适合先体验再决定是否自建。桌面客户端macOSDMG、WindowsNSIS、LinuxAppImage/DEB均有预构建安装包从源码构建则需要 Node 18git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run electron:dev注意npm run setup不可省略它会在装依赖后构建packages/studio等 workspaces 子包只跑npm install起不来服务。本地推理仅桌面客户端支持内置两条独立引擎。sd.cpp 打包在应用内在本机跑图像模型支持 Metal/CUDA/Vulkan/ROCmWan2GP 是你在 GPU 机器上自建的 PythonPyTorch 服务应用通过 HTTP 提交任务可跑 Flux、Wan 2.2、Hunyuan 等视频与图像模型。硬件上8GB 内存的机器建议只跑 SD 1.5 级别的小模型跑 2.5GB 以上的扩散模型推荐 16GB 起Wan2GP 侧需要 CUDA/ROCm GPU。两者区别本地推理权重跑在你自己的显卡上、免 API Key云端模式则把请求发往 API 网关首次使用需在界面里配置访问密钥。桌面客户端中的工作室界面暗色玻璃拟态 UI顶部为各工作室标签页从提示词到成片核心工作流文生视频在 Video Studio 输入场景描述默认展示 40 余个文生视频模型Kling、Sora、Veo、Seedance、Hailuo 等主逻辑在 src/components/VideoStudio.js。参数控件会随所选模型自动刷新宽高比16:9、9:16、4:3 等与时长5/10/15 秒只列出该模型支持的档位。点击生成后客户端先提交 prompt 与参数再轮询任务状态拿到视频 URL 后写入右侧历史面板可直接全分辨率下载。生成工作室界面顶部输入提示词切换标签页后选择模型与参数图生视频上传一张起始帧图像后工作室自动切换到 60 余个图生视频模型集Kling I2V、Veo3 I2V、Runway I2V、Wan I2V、Midjourney I2V此时提示词变为可选用来描述期望的运动轨迹。上传过的参考图会进入本地上传历史下次复用无需再次上传多参考图模型按你勾选的顺序提交。唇形同步音频驱动的说话视频Lip Sync 提供两种输入模式。「肖像音频」模式上传人像照片与音频即可得到说话视频模型含 Infinite Talk、Wan 2.2 Speech to Video、LTX Lipsync 等分辨率可选 480p 至 1080p「视频音频」模式则为现有视频重做口型模型含 LatentSync、Sync、Veed 等。实现位于 src/components/LipSyncStudio.js页面刷新后未完成的同步任务会自动恢复轮询。后期镜头控制生成素材后可切到 Cinema Studio 按专业摄影语言微调机身从 8K 数字机到 70mm 胶片、镜头含变形宽幅与复古定焦、焦段覆盖 8mm 至 85mm、光圈 f/1.4 到 f/11。这些选择会被翻译成镜头语法的提示词修饰项注入下一次生成而不是在本地做滤镜处理。Cinema Studio 的「Classic 16mm Film」机型选项模拟复古胶片纹理进阶批量、API 与模型扩展Workflow Studio 批量编排Workflow Studio 用节点编辑器把图像、视频、音频模型连成多步管线自带模板库与社区工作流Playground 可以交互式试跑。每条管线同时暴露 API 调用入口适合把「生成—修图—转视频」这类重复流程批量执行。提交加轮询的两步 APIsrc/lib/muapi.js 封装了统一的调用模式首个请求返回request_id随后轮询结果端点直至状态完成。自建系统对接时照此写即可const res await muapi.generateVideo({ apiKey, model: seedance-2.0, prompt: 霓虹夜街缓慢推镜, aspect_ratio: 16:9, duration: 5 });扩展模型列表全部模型定义集中在 packages/studio/src/models.js每条含id、参数 schema分辨率、宽高比、时长支持与映射到 API 路径的endpoint。新增模型只需在此追加一条定义Web 端与桌面端随共享包同步生效不需要改工作室组件。适用人群、技术栈与资源入口适合谁需要统一界面横向比较多模型视频生成效果、或要求数据留在自己机器上的团队不适合谁只想零配置开箱即用的用户——云端模式需要访问密钥本地模式需要自备 GPU。技术栈Next.js 15 / React 19 / Tailwind CSS / Electronnpm workspaces 单仓库共享 UI 库位于packages/studio/。完整安装、本地推理与排错步骤见 README.md架构与状态管理背景见 project_knowledge.md问题反馈与社区讨论在仓库的 Issues 区评估这类自托管 AI 视频生成方案时最省事的起点是先 clone 仓库完整跑通一次文生视频链路再决定是否接本地推理。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

单片机毕业设计-基于 STM32 的红外车位检测与车辆出入管理系统设计 基于 STM32 的停车场刷卡计费与语音播报系统设计(016507)

单片机毕业设计-基于 STM32 的红外车位检测与车辆出入管理系统设计 基于 STM32 的停车场刷卡计费与语音播报系统设计(016507)

2026/9/9 17:04:22

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于嵌入式单片机,Java、小程序技术领域和毕业项目实战 ✌️…

用一条命令把真实世界生成 Minecraft 世界:Arnis 从首次跑通到批量复现

用一条命令把真实世界生成 Minecraft 世界:Arnis 从首次跑通到批量复现

2026/9/9 17:04:22

用一条命令把真实世界生成 Minecraft 世界:Arnis 从首次跑通到批量复现 【免费下载链接】arnis Generate any location from the real world in Minecraft with a high level of detail. 项目地址: https://gitcode.com/GitHub_Trending/ar/arnis Arnis 读取…

电竞鼠标选购指南:从握姿、模具到无线方案全面解析

电竞鼠标选购指南:从握姿、模具到无线方案全面解析

2026/9/9 16:54:21

这次我们来聊一个不需要显卡、不需要 Python 环境,但同样能让玩家纠结很久的外设话题:鼠标选购。标题里这一串型号——Vaxee NP-01 Ergo、Vaxee NP-01S V3、Vaxee Inca、兰族、雷蛇毒蝰 V4 Pro、罗技 GPW5,基本是目前电竞鼠标圈里讨论度最高的…

电子组装MES转型:从智能防错到AI驱动的路径解析

电子组装MES转型:从智能防错到AI驱动的路径解析

2026/9/9 17:54:24

上周刚帮一家做汽车电子的客户处理完SMT线体换线防错的问题,甲方生产主管跟我说了句让我印象特别深的话:“以前换线最怕的就是料上错,一上错就是批量事故,一块PCBA上百颗料,靠人眼睛看根本防不住。”这句话其实点出了电…

SillyTavern 桌面版 Electron 跨平台打包完整教程:双击图标即开 AI 聊天

SillyTavern 桌面版 Electron 跨平台打包完整教程:双击图标即开 AI 聊天

2026/9/9 17:54:24

SillyTavern 桌面版 Electron 跨平台打包完整教程:双击图标即开 AI 聊天 【免费下载链接】SillyTavern LLM Frontend for Power Users. 项目地址: https://gitcode.com/GitHub_Trending/si/SillyTavern 打包完成后,SillyTavern 会变成一个独立的桌…

AI编程依赖过深,开发者技能退化如何自救?

AI编程依赖过深,开发者技能退化如何自救?

2026/9/9 17:54:24

这个话题我得先泼一盆冷水。Anthropic最近把关于AI编程与开发者技能的调研结论放了出来,几乎算是给所有天天用AI写代码的程序员敲了一记警钟:依赖越深,能力退得越快。这不是什么危言耸听,报告里关于代码重复率上升、开发者审查工作…

朴素贝叶斯中的独立事件:从概率原理到文本分类实战

朴素贝叶斯中的独立事件:从概率原理到文本分类实战

2026/9/9 17:54:24

今天继续聊朴素贝叶斯分类器。上一篇我们梳理了贝叶斯定理的基本形态,知道了先验概率、后验概率和似然度之间的关系。这一篇要把朴素贝叶斯真正“朴素”的地方讲透——也就是 概率中的独立事件 。 很多初学者在学朴素贝叶斯时,公式能看懂,…

系统学习ArcGIS Pro:科研数据工作流与Python自动化实战

系统学习ArcGIS Pro:科研数据工作流与Python自动化实战

2026/9/9 17:54:24

如果现在要系统学习 ArcGIS Pro,最合理的做法不是按软件菜单顺序去学,而是围绕一条科研数据工作流来学:从 GIS 理论到数据管理,从空间分析到遥感影像,从三维建模到 Python 自动化。只有把这条链路打通,才能…

KernelSU 安装模式完整指南:GKI 与 LKM 快速选型、手把手安装与救砖

KernelSU 安装模式完整指南:GKI 与 LKM 快速选型、手把手安装与救砖

2026/9/9 17:44:23

KernelSU 安装模式完整指南:GKI 与 LKM 快速选型、手把手安装与救砖 【免费下载链接】KernelSU A Kernel based root solution for Android 项目地址: https://gitcode.com/GitHub_Trending/ke/KernelSU 第一次刷 KernelSU,最容易栽的坑就是装错运…

中国人民大学杨琳团队《Nature Communications》 | 全球潮汐湿地土壤有机碳时空格局与环境驱动:一项2009-2020年的全球评估

中国人民大学杨琳团队《Nature Communications》 | 全球潮汐湿地土壤有机碳时空格局与环境驱动:一项2009-2020年的全球评估

2026/9/9 1:14:29

本文首发于“生态学者”!从“湿地面积”到“土壤碳密度”:为什么需要重新认识潮汐湿地蓝碳变化?潮汐湿地位于陆地与海洋的交汇地带,包括红树林、盐沼和潮滩,是全球重要的蓝碳生态系统。其土壤能够长期储存大量有机碳&a…

adb抓包

adb抓包

2026/9/8 4:55:53

前言 本文介绍如何通过 tcpdump 在 Android 手机上抓取网络数据包,并在电脑端使用 Wireshark 进行分析。适用于需要排查 App 网络请求、分析接口调用或调试网络问题的开发与测试场景。1. 手机要有 root 权限2. 下载 tcpdump3. adb push C:\Users\zhangkuixun\Downlo…

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战

2026/9/8 22:37:26

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战 在云原生基础设施中,容器镜像体积直接决定了服务的部署速度与弹性扩容敏捷度。对于传统的 Go / Java 微服务,镜像体积通常被严格控制在 50MB 到 200MB 以内,拉取镜像只…

扩散模型图像恢复实战:从DDPM原理到PyQt5可视化系统

扩散模型图像恢复实战:从DDPM原理到PyQt5可视化系统

2026/9/9 0:03:36

简介:面向毕业设计场景的PyQt5扩散模型图像恢复项目,提供完整Python源码与项目说明,适合图像处理、深度学习方向的高年级本科生与研究生参考。项目在模块设计上覆盖图像处理、扩散模型、参数配置、用户界面与结果评估五部分,具体涉…

开关电源环路裕量测试实战:相位裕量与增益裕量详解

开关电源环路裕量测试实战:相位裕量与增益裕量详解

2026/9/9 0:03:36

1. 项目概述:为什么环路裕量测试是电子工程师绕不开的“体检项目”“从零开始的电子工程师生活(6)——环路裕量测试”,这个标题一出来,老电源工程师可能已经下意识摸了摸示波器探头,新同事则大概率在想&…

定时插座芯片怎么选?专用定时IC与单片机MCU选型对比

定时插座芯片怎么选?专用定时IC与单片机MCU选型对比

2026/9/9 0:03:36

拆开市面上不同价位的定时插座,你会发现一个有意思的现象:有的里面躺着一颗黑色的软封装芯片,丝印都看不清;有的则是一块小小的蓝色或绿色PCB,上面赫然印着STM8或者STC的字样。同样叫"定时插座",…

远程协作的工作台整理

远程协作的工作台整理

2026/9/9 16:28:52

远程协作的工作台整理远程协作的核心不是再加一个工具,而是让交接信息足够完整。异步任务要写明目标、输入位置、完成标准和需要决策的人。 工作台的最小配置 将日程、待办、代码和沟通入口收拢到少数固定位置;通知按紧急程度分层。工作台不需要模仿办公…

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

2026/9/8 3:19:39

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能分类:[AI/大模型]细分主题:AI 增强型 CI/CD 流水线自动化与 GitOps 实践:Agent 工作流、工具调用与任务拆解:从原型到生产的验收清单很多团队在尝试用大…

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

2026/9/8 4:00:23

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场分类:[工程技术]细分主题:Kubernetes 生产环境运维与排障实战:可复制的项目复盘模板与决策记录大部分团队的事故复盘报告,最后都变成了躺在 Confluence 或钉…