MiniMax-M3.1-Flash-Preview 暂时仅通过 Token Plan 和 MiniMax Code 提供。
快速开始
1. 安装 Anthropic SDK
2. 配置环境变量
3. 调用 API
Python
4. 特别注意
在多轮 Function Call 对话中,必须将完整的模型返回(即 assistant 消息)添加到对话历史,以保持思维链的连续性:- 将完整的
response.content(包含 thinking/text/tool_use 等所有块)添加到消息历史 response.content是一个列表,包含多种类型的内容块,必须完整回传
支持的模型
使用 Anthropic SDK 时,支持MiniMax-M3.1-Flash-Preview MiniMax-M3 MiniMax-M2.7 MiniMax-M2.7-highspeed MiniMax-M2.5 MiniMax-M2.5-highspeed MiniMax-M2.1 MiniMax-M2.1-highspeed MiniMax-M2 模型:
TPS(Tokens Per Second)的计算方式详见常见问题 > 接口相关。
Anthropic API 兼容接口支持
MiniMax-M3.1-Flash-Preview MiniMax-M3 MiniMax-M2.7 MiniMax-M2.7-highspeed MiniMax-M2.5 MiniMax-M2.5-highspeed MiniMax-M2.1 MiniMax-M2.1-highspeed MiniMax-M2
模型。如需使用其他模型,请使用标准的 MiniMax API 接口。兼容性说明
支持的参数
在使用 Anthropic SDK 接入时,我们支持以下输入参数:Thinking 控制
thinking 参数用于控制模型是否可以输出 thinking 内容块。不同模型的行为不同:
传入
thinking: {"type": "disabled"} 时返回的错误信息:thinking 内容块时,后续轮次中应原样保留这些内容块,尤其是在工具调用对话中。
思考深度控制(仅 MiniMax-M3.1-Flash-Preview)
MiniMax-M3.1-Flash-Preview 支持通过 output_config.effort 调节思考深度,档位从低到高为 low、medium、high、xhigh、max。档位越高,模型思考越充分,输出的 thinking token 和响应耗时也越多。省略 output_config.effort 时默认为 max。
none 不支持,会返回 400。
curl
Messages 字段支持
对
MiniMax-M3.1-Flash-Preview 和 MiniMax-M3,URL 或 base64 视频最大 50 MB,图片最大 10 MB,请求体最大 64 MB。更大的视频请通过 Files API 上传后传入 mm_file://{file_id},Files API 视频最大 512 MB。
图片 token 用量会随图片尺寸和内容变化。以下是单张图片的粗略估算;准确用量以 POST /anthropic/v1/messages/count_tokens 或响应中的 usage 为准:
Anthropic API 兼容接口也支持
POST /anthropic/v1/messages/count_tokens,可用于 MiniMax-M3.1-Flash-Preview 和 MiniMax-M3 调用前预估输入 token 用量,不会生成模型输出。
示例代码
流式响应
Python
注意事项
如果在使用模型过程中遇到任何问题:- 通过邮箱 Model@minimaxi.com 等官方渠道联系我们的技术支持团队
- 在我们的 Github 仓库提交Issue