跳转至

模型 API

Macaron 托管模型 API 通过 OpenAI 兼容端点服务 Macaron-V1 模型家族。你使用在 dashboard 创建的 API key 调用,它暴露与 MinT dashboard「使用方法」面板为 curl、Claude Code、 Codex、OpenCode、ccswitch 配置的同一 chat-completions 接口。

这与自部署 MinT 推理接口(/oai/api/v1,针对本地 MinT 服务器与 Qwen3 基座模型)不同, 后者记录在「自部署」页签下。

Dashboard 概览——「管理账户」工作台,展示你的 base URL、API key、模型配置与六种集成方式。

区域端点

选择与你所在区域匹配的 base URL:

区域 Base URL
中国大陆以外 https://mint.macaron.im
中国大陆 https://mintcn.macaron.xin

API 路径附加在 base URL 之后,例如 {base_url}/v1/chat/completions

Macaron 模型家族

Macaron-V1 是基于 Mixture-of-LoRA 架构的开放智能体模型家族:冻结基座模型加一组小型 专家 LoRA 适配器,路由器在每个用户轮次选择一个专家。托管阵容包括 748B 旗舰 Venti、 50B Tall、编码专精的 Coding-Venti,以及 GLM-5.2 基座。

完整模型家族、架构与基准摘要见什么是 Macaron。托管模型 列表与定价见模型

开始使用

  1. 在 dashboard(/dashboard → API Keys)创建 API key。key 以 sk- 为前缀。见 鉴权
  2. 托管阵容选择模型
  3. 使用集成中六种支持方式之一集成
  4. 通过用量中描述的 dashboard 统计监控用量

快速示例

curl https://mint.macaron.im/v1/chat/completions \
  -H "Authorization: Bearer <MACARON_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "macaron-v1-venti",
    "messages": [
      {"role": "user", "content": "Why is the sky blue?"}
    ],
    "stream": true,
    "max_completion_tokens": 1024
  }'

<MACARON_API_KEY> 替换为你的 dashboard key;如适用,将 mint.macaron.im 替换为 中国大陆端点(mintcn.macaron.xin)。