claude-opus-4-8 API 文档
Anthropic claude-opus-4-8 · Chat 模型。Model ID: claude-opus-4-8,Anthropic 当前最强通用可用 Opus 模型,面向长周期 Agent 编码、复杂推理和专业知识工作。
ChatAnthropic主推模型1 家上游
Anthropic 当前最强通用可用 Opus 模型,面向长周期 Agent 编码、复杂推理和专业知识工作。
- Claude Opus 4.8 是 Anthropic 在 2026-05-28 发布的 Opus 系列模型,官方定位为当前最强的 generally available model。
- 它建立在 Claude Opus 4.7 之上,重点增强长周期 agentic coding、复杂推理、专业知识工作、工具调用可靠性和长上下文任务稳定性。
- 官方文档显示,Claude Opus 4.8 在 Claude API、Amazon Bedrock 和 Vertex AI 上默认支持 1M token context window;Microsoft Foundry 为 200k context。最大输出为 128k tokens。
适用场景
- 需要模型在大型代码库里做迁移、重构、bug sweep、测试修复或跨文件代码审查时
- 需要长周期 Agent 工作流持续推进、多工具协作、遇到阻碍后自动恢复时
- 需要综合长文档、财报、法律材料、研究资料、表格和多阶段项目上下文时
- 需要专业知识工作输出更少返工、更强自检和更高结构化质量时
接入说明
- OpenAI 兼容工具可使用 https://www.kukuai.fyi/api-proxy/china/v1,并把请求体 model 设置为 claude-opus-4-8。
- Claude / Anthropic 风格工具通常使用根地址 https://www.kukuai.fyi/api-proxy/china,再按工具要求填写模型 ID。
- Claude Opus 4.8 默认 effort 为 high;如果你的客户端显式设置 effort,则以客户端设置为准。
- 模型支持 adaptive thinking;简单任务可直接响应,复杂多步骤问题会按需触发推理。
- 它继承 Claude Opus 4.7 的工具和平台能力,并新增 mid-conversation system messages、公开 refusal stop_details、fast mode research preview、更低的 prompt cache 最小长度等能力。
使用提醒
- 新上模型的价格、限速、上下文、权限和可用线路以 kukuai.fyi 控制台当前配置为准。
- 如果业务已有 claude-opus-4-7 稳定链路,可先灰度切换到 claude-opus-4-8,再扩大使用范围。
- 与 Claude Opus 4.7 一样,Messages API 下不支持把 temperature、top_p、top_k 设置为非默认值;相关参数请省略,并用提示词控制输出风格。
- 如果走 Claude 原生 Messages API,adaptive thinking 需要显式设置 thinking: {type: "adaptive"};未设置时 thinking 不会自动开启。
- Claude Opus 4.8 不支持旧式 extended thinking budget;需要思考模式时使用 adaptive thinking 和 effort 参数。
能力标签
1M 上下文128k 输出adaptive thinkingtool use
推荐场景
- 长周期 Agent 编码
- 大型代码库迁移
- 复杂文档分析
- 企业知识工作
接口路径
POST https://www.kukuai.fyi/api-proxy/china/v1/chat/completions
该路径由模型分类决定:Chat / Image / Video / Audio 使用不同 endpoint, 同一分类内通常只需要替换 model 字段。Chat 模型还要区分 OpenAI 兼容协议与 Anthropic / Claude 协议。
请求需在 Header 中携带 Authorization: Bearer <API_KEY>。完整字段说明见 Chat Completions API。
API 文档
| 项目 | 值 |
|---|---|
| Endpoint | POST /v1/messages 或 POST /v1/chat/completions |
| Model ID | claude-opus-4-8 |
| Content-Type | application/json |
| 接口类型 | Claude 模型:Claude 工具优先用 Anthropic Messages 协议;OpenAI 工具可用兼容协议 |
| Base URL | Claude Code / Anthropic SDK 用 https://www.kukuai.fyi/api-proxy/china;OpenAI SDK / Cursor 用 https://www.kukuai.fyi/api-proxy/china/v1。 |
Headers / 鉴权
| 字段 | 类型 | 必填 | 说明 |
|---|---|---|---|
Authorization | string | 必填 | 使用 Bearer <KUKUAI_API_KEY>。API Key 在 kukuai.fyi 控制台创建。 |
Content-Type | string | 必填 | 请求体格式。音频转写上传文件时使用 multipart/form-data。默认值: application/json |
Accept | string | 可选 | 非流式接口返回 JSON;Chat 流式请求会返回 SSE 数据流。 默认值: application/json 或 text/event-stream |
Chat 协议差异
Chat 模型不只看模型名,还要看你使用的客户端协议。 Claude Code / Anthropic SDK 和 OpenAI SDK 拼出来的路径不同。
| 协议 | Base URL | Endpoint | Body |
|---|---|---|---|
| OpenAI 兼容 | https://www.kukuai.fyi/api-proxy/china/v1 | POST /v1/chat/completions | { "model": "claude-opus-4-8", "messages": [...] } |
| Anthropic / Claude 推荐 | https://www.kukuai.fyi/api-proxy/china | POST /v1/messages | { "model": "claude-opus-4-8", "messages": [...] } |
这个模型属于 Claude 系列;Claude Code、Anthropic SDK、OpenClaw 等工具建议优先走 Anthropic / Claude 风格。
请求参数
以下字段按当前模型分类生成。价格、上下文长度、限速、可用线路等动态信息以 kukuai.fyi 控制台为准。
| 字段 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 必填 | 当前模型 ID:claude-opus-4-8。复制时请保持大小写一致。 |
messages | array<Message> | 必填 | 多轮对话历史。每条消息包含 role 和 content。 |
stream | boolean | 可选 | 是否使用 SSE 流式返回。适合聊天界面和长回答。 默认值: false |
temperature | number | 可选 | 采样温度,值越高越发散。正式业务建议先固定后再调优。 默认值: 1 |
max_tokens | integer | 可选 | 本次生成的最大 token 数。模型上下文边界以控制台为准。 |
response_format | object | 可选 | 结构化输出配置,例如 { "type": "json_object" }。 |
tools | array<Tool> | 可选 | Function calling 工具定义。是否支持取决于具体模型和账号配置。 |
响应字段
响应结构保持 OpenAI 兼容风格;媒体类模型可能返回异步任务 ID 或资源 URL。
| 字段 | 类型 | 必填 | 说明 |
|---|---|---|---|
id | string | 必填 | 本次补全的唯一 ID,便于排障关联日志。 |
object | string | 必填 | 固定为 chat.completion 或流式 chunk 类型。 |
model | string | 必填 | 实际承担推理的模型 ID。 |
choices | array<Choice> | 必填 | 生成结果数组,包含 message、delta 或 finish_reason。 |
usage | object | 可选 | Token 用量统计。流式请求可能在结束包或非流式响应中返回。 |
状态码
| 状态码 | 类型 | 必填 | 说明 |
|---|---|---|---|
200 | OK | 必填 | 请求成功,响应体结构见上方响应字段。 |
400 | Bad Request | 可选 | 请求字段不合法,例如缺少必填字段、图片尺寸格式错误或文件格式不支持。 |
401 | Unauthorized | 可选 | API Key 缺失、无效或格式错误。 |
404 | Not Found | 可选 | Endpoint 或模型不存在。请确认路径为 /v1/chat/completions, 模型 ID 为 claude-opus-4-8。 |
429 | Rate Limited | 可选 | 触发限速、并发限制或余额不足。控制台会展示当前账号可用额度。 |
5xx | Upstream Error | 可选 | 上游或线路异常。可切换等价线路重试,并保留请求 ID 便于排查。 |
错误与排查
401:检查Authorization是否为Bearer <API_KEY>,以及 Key 是否仍有效。404:检查 endpoint 是否为/v1/chat/completions, 以及模型名claude-opus-4-8是否在控制台可见。429:触发限速或余额不足时,降低并发、缩短请求,或到控制台查看额度。5xx:优先切换等价线路重试,并记录请求 ID 方便排障。
请求示例
curl https://www.kukuai.fyi/api-proxy/china/v1/chat/completions \
-H "Authorization: Bearer $KUKUAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-4-8",
"messages": [
{"role": "user", "content": "用一句话介绍 kukuai.fyi"}
]
}'期望响应(精简示例):
json
{
"id": "chatcmpl-claude-o",
"object": "chat.completion",
"created": 1730000000,
"model": "claude-opus-4-8",
"choices": [
{
"index": 0,
"finish_reason": "stop",
"message": { "role": "assistant", "content": "..." }
}
],
"usage": { "prompt_tokens": 24, "completion_tokens": 64, "total_tokens": 88 }
}