模型 API¶
Macaron 托管模型 API 通过 OpenAI 兼容端点服务 Macaron-V1 模型家族。你使用在 dashboard 创建的 API key 调用,它暴露与 MinT dashboard「使用方法」面板为 curl、Claude Code、 Codex、OpenCode、ccswitch 配置的同一 chat-completions 接口。
这与自部署 MinT 推理接口(/oai/api/v1,针对本地 MinT 服务器与 Qwen3 基座模型)不同,
后者记录在「自部署」页签下。

区域端点¶
选择与你所在区域匹配的 base URL:
| 区域 | Base URL |
|---|---|
| 中国大陆以外 | https://mint.macaron.im |
| 中国大陆 | https://mintcn.macaron.xin |
API 路径附加在 base URL 之后,例如 {base_url}/v1/chat/completions。
Macaron 模型家族¶
Macaron-V1 是基于 Mixture-of-LoRA 架构的开放智能体模型家族:冻结基座模型加一组小型 专家 LoRA 适配器,路由器在每个用户轮次选择一个专家。托管阵容包括 748B 旗舰 Venti、 50B Tall、编码专精的 Coding-Venti,以及 GLM-5.2 基座。
完整模型家族、架构与基准摘要见什么是 Macaron。托管模型 列表与定价见模型。
开始使用¶
- 在 dashboard(
/dashboard→ API Keys)创建 API key。key 以sk-为前缀。见 鉴权。 - 从托管阵容中选择模型。
- 使用集成中六种支持方式之一集成。
- 通过用量中描述的 dashboard 统计监控用量。
快速示例¶
curl https://mint.macaron.im/v1/chat/completions \
-H "Authorization: Bearer <MACARON_API_KEY>" \
-H "Content-Type: application/json" \
-d '{
"model": "macaron-v1-venti",
"messages": [
{"role": "user", "content": "Why is the sky blue?"}
],
"stream": true,
"max_completion_tokens": 1024
}'
将 <MACARON_API_KEY> 替换为你的 dashboard key;如适用,将 mint.macaron.im 替换为
中国大陆端点(mintcn.macaron.xin)。