综合主力 / 图文全能
首选 ChatGPT:编程、数学和多媒体均衡,适合日常主力与生图。
以 Claude 为 1.0× 基准。十维评分分别参考真实榜单或同口径评测(Artificial Analysis / Arena / SuperCLUE / Vectara / AIME·HMMT / SWE-bench);“综合评分”由其余能力维度等权汇总,Reddit r/LocalLLaMA 与近 30 天公开实测口碑用于交叉核验。
本页统一以 Claude Fable 5 作为能力与 API 价格基线;消费订阅以最低可选择 Fable 5 的 Pro $20/月作为价格基线,Fable 5 在 Pro 中另按 Usage Credits 计费。
综合评分由编程、推理、数学、写作、中文、多媒体(多模态,即文本/图片/语音/视频多种格式的支持)、智能体、长上下文与可靠性九项综合汇总。点击任一列即可按该维度重新排序。
琥珀色是 Claude Fable 5;选择一个挑战者叠加。
订阅比较各产品“可选择本页旗舰模型的最低公开付费月费”;模型是否另扣积分、Credits 或按量费用会单独标注。API 比较公开 list price,综合价固定按 90% 普通输入 + 10% 输出计算,不计缓存折扣;DeepSeek 无消费订阅,置底并显示 API 综合价。
同一份额度按任务强度分两档测算:代码任务指高强度——反复读写整个项目、上下文长、工具调用密集,额度烧得最快;办公任务指低强度——资料检索、文档与表格整理,上下文小、调用少,同样额度约耐用两到三倍。
首选 ChatGPT:编程、数学和多媒体均衡,适合日常主力与生图。
主选 Kimi:编程、智能体和长上下文突出;预算低用 GLM(同价位可运行时长最长),预算高选 Claude。
首选 豆包:中文、写作与多媒体更突出;跨语言多媒体任务可选 Gemini。