200K tokens 上下文窗口,按英文平均 4 字符/token 估算,约可处理 80 万字符;中文场景约 30-50 万字符。
最佳实践
- 使用 prompt caching 减少重复计算
- 合理拆分文档:单文档 < 100K,多文档分批
- 避免无用历史消息:用 system + 单轮 messages 替代长对话
Claude Sonnet 4.7 支持 200K tokens 上下文窗口,约相当于 30-50 万字符。本文讲解如何拆分文档 / 缓存提示 / 减少 token 浪费。
200K tokens 上下文窗口,按英文平均 4 字符/token 估算,约可处理 80 万字符;中文场景约 30-50 万字符。
长文本场景选 Claude Sonnet 4.7 (200K context);代码生成选 GPT-5 / Claude Sonnet 4.7;性价比场景选 DeepSeek V3.2 (¥1.6/M);中文叙事选千问 / Kimi;推理任务选 DeepSeek-R1 / Claude thinking 模式。
Anthropic Claude Sonnet 4.7、DeepSeek-R1 等推理模型的 thinking 模式参数详解:thinking_budget、reasoning_effort 等。
详解典名词元 API 中转价 = 官方价 × 厂商折扣的计算方式:以 Claude Sonnet 4.7 输入 $3/M tokens 为例,按汇率换算 + 0.95 折扣 = 约 ¥20.5/M tokens,按调用实际 token 数实时扣费。
OpenAI / Anthropic / Gemini 三家函数调用协议对比,tool_choice 参数详解,多工具并发调用最佳实践。Agent 编排必读。
OpenAI 官方 SDK 完全兼容典名词元 API:只需修改 base_url 即可使用 GPT-5 / GPT-5-mini,无需改业务代码。含 Python / Node.js 实战示例。
通过典名词元 API 中转服务,国内开发者可直连调用 Anthropic Claude / OpenAI GPT / Google Gemini 等模型,平均延迟 50ms,无需 VPN 或代理,base_url 改一行即可。