月之暗面 Moonshot
长上下文前沿模型,具备原生视觉能力与可配置推理强度。Kimi K3 最高 100 万上下文,按人民币计价,缓存命中的输入价显著更低。
网关会路由到的每一家上游、各自擅长什么、以什么货币计价。每张卡片都链接到该供应商自己的文档,本页任何一条你都能回到源头核实。
长上下文前沿模型,具备原生视觉能力与可配置推理强度。Kimi K3 最高 100 万上下文,按人民币计价,缓存命中的输入价显著更低。
GLM-5.2 提供 100 万上下文与最高 128K 输出,并支持 Function Calling 与结构化输出——这正是多数开发工作流真正需要的组合。
文本与视频同属一家。Qwen3.8 Max Preview 是 100 万上下文的推理模型,仍处预览阶段;Wan 2.7 为文生视频,按生成秒数计费,支持 720P 与 1080P。
100 万上下文、最高 384K 输出,支持工具调用与思考模式;按美元计价,其缓存命中折扣是本页所有供应商中最高的之一。
同一体系下的高速文本模型与图像模型。Seedream 5.0 Pro 首张免费,之后按张计费,仅在超过 236 万像素时才进入更高一档。
文生视频,按生成秒数计费,支持 720P 与 1080P——当你想在同一个 Key 下再接一条创意流水线时,可作为 Wan 的替代。
平台上覆盖面最广的一家:40 多个模型,涵盖旗舰对话、推理、图像、转录与实时音频;整个网关的请求格式也正是以其为标准。
Claude Sonnet 5 目前的输入价为优惠价,有效期至 2026 年 8 月 31 日。另有六个历史版本仍可调用,方便锁定特定版本的团队。
十个模型,含图像生成、Computer Use 预览版,以及用于流式音视频的 Live API;输入超过 20 万 tokens 后适用长上下文档位。
降级列表有没有用,取决于备选是否真的可比。跨供应商的覆盖面,才让故障切换成为真正的答案,而不是一个更慢的报错。
当一个任务在三个模型上都跑得不错,你就可以按成本挑。前提是这三个都已经只差一次配置改动。
各家供应商会各自调整条款、区域与可用性。同时接入多家,意味着某一家的决定不会自动变成你的故障。
请选择任一商务联系人。
请使用微信扫码添加任一商务联系人。