Mountsea AI API 介绍
视频、图像、音乐、对话 — 一个 Key,一套 REST。探索 Mountsea AI API 的全部能力。每个服务都可以从卡片直接进入。
核心能力
Mountsea AI 提供统一网关,覆盖视频、图像、音乐和语言:Google (Gemini)
基于 Veo 2 / Veo 3 / Veo 3.1、Omni 和 Nano Banana 模型的视频与图像生成
🚧 Sora2(不可用)
当前在 Mountsea 不可用。视频生成请改用 Gemini 视频。
OpenAI (GPT Image)
GPT Image 2 图像生成与编辑——异步任务 API + 官方
openai SDK 兼容XAI (Grok)
基于 xAI Grok 模型的图像与视频生成
Suno
音乐生成、片段 Persona 与 Voice Persona、Studio 精修与定制模型
ElevenLabs
AI 音乐生成,支持作曲计划、视频配乐与音轨分离,由 ElevenLabs 驱动
Producer
基于 Google DeepMind Lyria 3 Pro 模型的 AI 音乐生成
Chat
多协议 AI 对话网关,支持 OpenAI、Claude 和 Gemini API
选一条路径
先看能力总览
从 Gemini 视频 / 图像开始,或打开上方任意服务卡片。
克隆 Suno 人声
片段 Persona,或 Voice Persona:Clone Voice(
/voices,收费)/ Init + Complete(免费)。5 分钟跑通
拿 Key、发第一个请求、轮询任务。
查用量
积分、服务列表与用量检索。
为什么选择 Mountsea AI
一站式 AI 平台
一个 API Key 即可访问多个领域的 AI 服务——无需为每个 AI 提供商单独管理账号和凭证。多协议 LLM 网关
Chat 服务支持 OpenAI 兼容 API、Anthropic (Claude) API、OpenAI Responses API 和 Google Gemini 原生 API。直接使用官方 SDK——只需修改base_url。
全面的 AI 模型覆盖
接入顶级 AI 提供商的领先模型:高性价比
以极具竞争力的价格享受优质 AI 工具。平台提供高质量、可扩展的解决方案,同时保持项目成本可控。Google (Gemini) — 视频、图像与 SDK 兼容
基于 Google 前沿 AI 技术,分为三大模块:- 🎥 视频生成 — 使用 Veo 2 / Veo 3 / Veo 3.1 与 Omni 创建视频。支持
text2video、img2video、ingredients2video(仅 Veo)、1080p/4K 超分、延长、重拍、物体插入/移除。 - 🖼️ 图像生成 (Nano Banana) — 使用 Nano Banana Fast / Pro / 2 / 2-lite 创建和编辑图像,支持多种宽高比,最高 4K 分辨率。
- 🔌 Gemini 兼容接口(官方 SDK) — Google 官方 @google/genai SDK 的直接替代。将 Base URL 设为
https://api.mountsea.ai/gemini即可使用generateContent/streamGenerateContent。图像模型(gemini-2.5-flash-image、gemini-3.1-flash-image-preview、gemini-3-pro-image-preview)自动路由到 Nano Banana。
Sora2 — 当前不可用
Sora2 历史文档保留以备参考 →XAI (Grok) — 图像与视频生成
基于 xAI Grok 模型:- 文生图 — 使用 grok-imagine-image 从文本提示生成高质量图像,支持多种比例(1:1, 2:3, 3:2, 9:16, 16:9)
- 图生图 — 提供参考图引导生成,输出尺寸跟随参考图
- 文生视频 — 使用 grok-imagine-video 从文本提示生成视频,可控制时长(6s/10s/15s)、比例和分辨率(480P/720P)
- 图生视频 — 使用参考图引导视频生成,比例和分辨率自动跟随参考图
- 异步任务 — 所有生成请求返回
taskId用于轮询
OpenAI — GPT Image 生成与编辑
基于 OpenAI 最新 GPT Image 2 模型:- 文生图 — 从文本提示生成图像,支持灵活尺寸(1024x1024, 1024x1536, 1536x1024)和质量级别
- 图像编辑 — 通过 URL 或 base64 data URL 编辑现有图像
- 局部重绘 — 使用蒙版图像重绘输入图像的特定区域
- 透明背景 — 生成透明背景图像(
background: transparent) - 两种 API 风格:
- 异步任务 API(
/openai/images)— 统一端点,返回taskId轮询 - OpenAI 兼容 API(
/openai/v1/images/*)— 官方 SDK 直接替换,只需修改base_url
- 异步任务 API(
Suno — 音乐生成
由 Suno AI 驱动,提供全套音乐创作与处理工具:- 音乐生成 — 通过统一
/generate端点支持 15 种任务类型:创建、延长、翻唱、混搭、采样、灵感生成等,模型从chirp-v35到chirp-v55 - 音效 — 从文本描述生成单次或循环音效
- 歌词生成 — 生成原创歌词或两首歌的混搭歌词
- 声音角色 — 通过单任务两阶段声纹验证流程(init → 等待短语 → complete)从录音创建已验证的声音角色
- 自定义模型 — 用自己的音频(6+ 训练片段)训练个性化音乐模型,然后使用
chirp-custom:<uuid>生成 - 音频处理 — 拼接片段、重制音轨(V4.5+/V5 模型)、变速并保持音高
- 音轨分离 — 分离为人声 + 伴奏(双轨)或全部独立音轨
- 音频导出 — 导出为 MP4(含可视化)、无损 WAV 或 MDI (MIDI) 格式
- 音频分析 — 获取同步歌词时间线、强拍检测和增强风格标签
- 人声角色 — 从片段提取人声特征,创建可复用角色以保持一致的 vocal 风格
ElevenLabs — AI 音乐生成
由 ElevenLabs music_v1 模型驱动:- 文生音乐 — 从简单文本提示或结构化作曲计划生成音乐,支持段落级风格与歌词控制
- 作曲计划 — AI 生成结构化计划,含段落、全局/局部风格与歌词——免费,不消耗积分
- 视频配乐 — 自动为视频内容生成匹配的背景音乐(最多 10 个视频,总计 600 秒)
- 音轨分离 — 将音频分为 2 轨(人声 + 伴奏)或 6 个独立音轨
- 局部编辑 — 编辑现有歌曲的特定段落(仅企业版)
- 多种输出格式 — MP3、PCM、Opus,可配置采样率与比特率
Producer — AI 音乐生成
由 Google DeepMind Lyria 3 Pro 模型驱动,提供高质量音乐生成:- 创建音乐 — 从声音提示、歌词和图像生成原创曲目
- 图像引导生成 — 用图像影响生成音乐的情绪与风格
- 纯器乐模式 — 生成无人声曲目
- 音轨分离 — 将音频分离为独立音轨(人声、鼓、贝斯等)
- 多格式导出 — 下载为 MP3/M4A/WAV 音频,或使用预设可视化器生成视频
Chat — 多协议 AI 网关
支持多种 API 协议的统一网关:- ✅ 直接使用官方 SDK(OpenAI、Anthropic、Google GenAI)
- ✅ 完整流式、函数调用与工具支持
- ✅ 兼容 Claude Code、Cursor、Cherry Studio 等 AI 工具
- ✅ 访问 GPT-5.1/5.2、Claude 4.5/Opus/Sonnet、Gemini 2.5/3/3.1 模型
如何开始
1
获取 API Key
在 offoff.ai 注册,进入 API Keys 页面,创建新的 API Key。
2
选择服务
根据需求选择合适的服务——视频、图像、音乐或对话。
3
发起首次 API 调用
在请求头中使用
Authorization: Bearer your-api-key,调用对应端点。4
跟踪并下载结果
对于异步任务(视频/音乐),轮询任务状态端点直至完成,然后下载内容。
API Base URL
所有 API 请求的基础地址为:例外:Claude (Anthropic) 兼容 API 使用
https://api.mountsea.ai/chat/claude 作为 Base URL。立即开始
准备好将 AI 能力集成到您的应用中了吗?- 📖 查看快速开始指南
- 🎬 探索 Gemini 视频与图像 API
- 🔌 使用官方
@google/genaiSDK 尝试 Gemini 兼容 API - 🚧 Sora2 视频 API — 当前不可用
- 🖼️ 探索 XAI (Grok) 图像与视频 API
- 🎨 使用异步任务和官方
openaiSDK 尝试 OpenAI GPT Image API - 🎵 探索 Suno 音乐 API
- 🎶 探索 ElevenLabs 音乐 API
- 🎧 探索 Producer 音乐 API
- 💬 探索 Chat LLM 网关
- 📞 需要帮助?联系我们
用 AI 的力量改造您的创意项目。立即开始构建精彩应用!