ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

Open Generative AI本地部署指南

Open Generative AI本地部署指南 Open Generative AI本地部署指南【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个可自托管的开源 AI 图像与视频生成工作室把 Flux、Midjourney、Kling、Sora、Veo 等 420 主流模型装进同一套界面。它解决的是不付订阅费、没有内容过滤、数据不出本机也能用上一套完整的生成工作台。最直观的一点——所有模型定义都开放在同一个文件里你改一处云端版和本地版同时生效。⚡ 它凭什么值得一试这一节讲它和普通付费平台最直接的三点区别。一个库全模型420 模型定义集中在单一文件packages/studio/src/models.js应用里图像、视频、Cinema、口型、工作流等 14 个工作室全部从它读取每个模型的画幅、分辨率、时长等参数选项都声明在这份清单里。零过滤生成没有提示词拒答也没有内容护栏。你写什么就发给模型什么MIT 许可证下代码和产物都归你处置。本地推理桌面版自带两套本地引擎——sd.cpp 在本机跑图像模型Wan2GP 连接你自己的 GPU 服务器没有 GPU 也可以只用云端模型两条路都通。功能全景速览下表按类别列出主要能力规模数字来自 README 对模型文件的核对结果。类别规模代表能力典型用途文本到图像70Flux、Midjourney v7、Nano Banana 2概念图、广告主视觉图像到图像70Nano Banana 2 Edit最多 14 张参考图、背景去除风格迁移、修图增强文本到视频85Kling、Sora 2、Veo 3、Seedance 2.03–12 秒短视频片段图像到视频120Seedance 2.0 I2V、Kling I2V让单帧画面动起来视频到视频35AI Clipping、Vibe Motion长视频自动提取高光口型同步15Infinite Talk、LTX Lipsync、Sync人像音频 → 说话视频音频15文本生成音乐、音频编辑配乐、旁白生成Cinema 工作室6 种机身 / 11 种镜头焦距 8–85mm、光圈 f/1.4–f/11电影质感静帧技术底座怎么搭的这一节讲它底层的三层模型数据、本地推理、API 调用只说各自负责什么。一份模型清单全应用吃这一份models.js 是仓库里唯一的数据源头由模型数据自动生成每个模型条目记录 API 端点、参数 schema提示词、画幅、分辨率、时长和提供方工作室页面不硬编码选项而是根据 schema 动态渲染控件新增模型后界面自动补全自托管版本与官方托管在线版共用这份文件一次更新两处同步双引擎本地推理localInference.js 负责桌面版的本地引擎管理sd.cpp 引擎Stable Diffusion 的 C 实现随应用打包Apple Silicon 走 MetalLinux/Windows 支持 CUDA/Vulkan/ROCm模型库Z-Image Turbo/Base、Dreamshaper 8、Realistic Vision v5.1、SDXL 等跑 Z-Image 建议 16GB 内存Wan2GP 模式桌面应用只是 HTTP 客户端你在 CUDA/ROCm GPU 机器上自跑 Wan2GP 服务器把地址填进设置即可配置入口Settings → Local Models一键下载引擎与模型默认存放在应用数据目录统一的 API 调用muapi.js 客户端使用“提交后轮询”的统一模式POST /api/v1/{模型端点}提交任务返回请求 ID轮询GET /api/v1/predictions/{id}/result直到状态完成鉴权用x-api-key请求头密钥只存在浏览器 localStorage不经过任何第三方 三步跑起来这一节按安装 → 配置 → 首次生成的顺序从 0 到出第一张图只需要几条命令。第 1 步 安装# 1. 克隆仓库必须带上子模块 git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI # 2. 安装依赖并构建工作区包不可省略 npm run setup # 3. 启动 Web 版浏览器打开 localhost:3000 npm run dev三种部署方式任选桌面版新手推荐从 release 页下载对应平台的安装包无需 Node 环境macOS 首次启动需按 README 说明解除系统拦截Web 版上面的npm run dev即可开发调试生产环境用npm run build npm run startDocker仓库自带 docker-compose.yml执行docker compose up -d后访问 3001 端口第 2 步 配置首次使用会提示输入模型服务 API 密钥如果只用本地模型可以跳过。本地推理则进 Settings → Local Models 安装引擎、下载模型。第 3 步 首次生成打开 Image Studio输入提示词、选好模型点击生成或者打开 ⚡ Local 开关改用本地模型全程不消耗云端额度。谁在用、怎么用这一节选三个典型场景每个都按痛点 → 怎么用 → 效果来讲。1. 小团队做游戏美术资产痛点外包角色和场景美术贵改稿周期长风格难统一。怎么用Image Studio 批量生成角色概念图用最多 14 张参考图锁住风格再用 Workflow Studio 把图像增强、视频模型串成自动流程。效果设计阶段一轮提示词就能拿到几十张候选方案参考图让多轮产出的风格保持一致。2. 自媒体 / 营销做广告素材痛点同一产品要铺多个投放位人工修图、裁图跟不上节奏。怎么用Marketing Studio 从一个输入出发生成多组广告创意变体Cinema Studio 用 f/1.4 浅景深这类参数统一出片调性。效果一张基础图派生出多种画幅、多种风格的投放素材一次会话产出整套。3. 口播视频 / 数字人创作者痛点逐帧对口型极其耗时现成软件大多要订阅。怎么用Lip Sync Studio 提供两种模式——“人像图音频 → 说话视频”“视频音频 → 口型同步”选 Infinite Talk 或 LTX Lipsync 等模型等待结果即可。效果一条分钟级口播视频只需准备两份输入图像或视频 音频不用手工调任何一帧。写在最后Open Generative AI 把 420 模型和 14 个工作室装进了一个开源仓库让“自托管生成工作台”从特权变成默认选项。需要 AI 图像和视频生成能力时你不必再在订阅费和封闭生态之间二选一。现在就可以做的三件事体验托管在线版注册官方托管版账号不装任何东西就能用全部工作室本地部署下载桌面安装包或docker compose up单机部署参与贡献修改 models.js 添加新模型或提 PR 修复一个 bug【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表