自研图片/视频模型 接入codex

6 个图片模型和 4 个视频模型。

[!TIP] ergouzi/e-image 主打便宜和快速。当前按次计费,每张约 0.04 元;模型、参数和价格可能调整,请以模型广场实时展示为准。

如何使用

  • 自研模型的接口协议,不兼容当前的openai协议
  • 需要通过封装的 Dogzee 图片/视频 Skills 或 Dogzee Media MCP 来使用
  • 将仓库的 skills 或 mcp 拷贝到本地项目的.agents/目录,或者让AI帮忙安装
  • 将二狗子的url+图片密钥,告诉AI,让它配置到 skill 或 mcp
  • 像调用普通 skill 一样,调用 skill 输入提示词,如:“帮我生成一张图片, 雨夜上海街头,电影感摄影,霓虹灯倒映在湿润路面”

开始前

  • 已创建自研图片视频模型的 API 密钥。
  • 注意,自研图片视频模型 的密钥,和使用 gpt 模型的密钥,是独立的,不能混用。
  • gpt 模型的密钥,用于驱动 codex,图片/视频模型的密钥,用于驱动 skill 或 mcp

共用基础配置:

项目值
Base URLhttps://ergouzi.life
图片/视频分组密钥sk-xxxx

支持的 10 个模型

图片模型

模型 ID主要用途关键输入
ergouzi/e-image快速、低价的通用文生图prompt
ergouzi/e-image-edit根据原图和提示词编辑图片prompt、images
ergouzi/e-image-ideogram海报、文字和精确布局prompt
ergouzi/e-image-try-on人物与服装参考图的虚拟试衣person_image、garment_images
ergouzi/e-image-upscale放大图片并增强细节image
ergouzi/e-rmbg移除图片背景image

视频模型

模型 ID主要用途关键输入
ergouzi/e-video文生视频、图生视频和带音频的视频生成prompt,可选 image、audio
ergouzi/e-video-animate使用源视频动作驱动参考图片video、image
ergouzi/e-video-avatar使用人物图片和音频或台词生成口播视频image,以及 audio 或 voice_script
ergouzi/e-video-replace把源视频中的人物替换为参考人物video、images

模型的完整字段、枚举和实时计费以模型广场详情页的 API 标签为准。