自研图片/视频模型 接入codex
6 个图片模型和 4 个视频模型。
[!TIP]
ergouzi/e-image主打便宜和快速。当前按次计费,每张约0.04 元;模型、参数和价格可能调整,请以模型广场实时展示为准。
如何使用
- 自研模型的接口协议,不兼容当前的openai协议
- 需要通过封装的 Dogzee 图片/视频 Skills 或 Dogzee Media MCP 来使用
- 将仓库的 skills 或 mcp 拷贝到本地项目的.agents/目录,或者让AI帮忙安装
- 将二狗子的url+图片密钥,告诉AI,让它配置到 skill 或 mcp
- 像调用普通 skill 一样,调用 skill 输入提示词,如:“帮我生成一张图片, 雨夜上海街头,电影感摄影,霓虹灯倒映在湿润路面”
开始前
- 已创建自研图片视频模型的 API 密钥。
- 注意,自研图片视频模型 的密钥,和使用 gpt 模型的密钥,是独立的,不能混用。
- gpt 模型的密钥,用于驱动 codex,图片/视频模型的密钥,用于驱动 skill 或 mcp
共用基础配置:
| 项目 | 值 |
|---|---|
| Base URL | https://ergouzi.life |
| 图片/视频分组密钥 | sk-xxxx |
支持的 10 个模型
图片模型
| 模型 ID | 主要用途 | 关键输入 |
|---|---|---|
ergouzi/e-image | 快速、低价的通用文生图 | prompt |
ergouzi/e-image-edit | 根据原图和提示词编辑图片 | prompt、images |
ergouzi/e-image-ideogram | 海报、文字和精确布局 | prompt |
ergouzi/e-image-try-on | 人物与服装参考图的虚拟试衣 | person_image、garment_images |
ergouzi/e-image-upscale | 放大图片并增强细节 | image |
ergouzi/e-rmbg | 移除图片背景 | image |
视频模型
| 模型 ID | 主要用途 | 关键输入 |
|---|---|---|
ergouzi/e-video | 文生视频、图生视频和带音频的视频生成 | prompt,可选 image、audio |
ergouzi/e-video-animate | 使用源视频动作驱动参考图片 | video、image |
ergouzi/e-video-avatar | 使用人物图片和音频或台词生成口播视频 | image,以及 audio 或 voice_script |
ergouzi/e-video-replace | 把源视频中的人物替换为参考人物 | video、images |
模型的完整字段、枚举和实时计费以模型广场详情页的 API 标签为准。