同样的编程任务,Claude Fable 5收费¥70/百万token,Kimi K3只要¥4——差距17倍。2026年7月16日,月之暗面发布2.8万亿参数开源模型K3,美媒Axios直接发问:美国AI高价收费模式还能撑多久?[[13]][[17]]
K3参数规模
2.8万亿
全球最大开源模型,比DeepSeek V4 Pro的1.6万亿大75%
编程榜得分
1679分
FrontendCodeArena登顶第一,超越Claude Fable 5的1631分
K3 vs Fable 5定价
¥4 vs ¥70
每百万token输入价格,相差17倍
美国模型占比跌幅
72%→33%
OpenRouter平台美国模型Token请求占比持续下滑
这笔钱从哪来、流向哪里
编程任务定价链路(每百万token,输入/输出):
· K3:¥4 / ¥18[[3]]
· Grok 4.5:¥14 / ¥42[[3]]
· GPT-5.6 Sol:¥35 / ¥210[[3]]
· Claude Opus 4.8:¥35 / ¥175[[3]]
· Claude Fable 5:¥70 / ¥350[[3]]
谁的护城河在松动: Anthropic计划9月将Opus 4.8价格再提高50%,而K3以Opus 4.8三分之一不到的价格提供接近性能。企业实际切换成本正在从"技术迁移"变成"财务必选项"。[[19]][[20]]
K3核心数字逐条核实
综合能力 GDPval-AAv2
1687分
全球第三,超Claude Opus 4.8 Max的1600分【官方技术文档】
长周期Agent AA-Briefcase
1527分
全球第二,超GPT-5.6 Sol Max的1495分【Artificial Analysis】
上下文窗口
100万token
KDA架构实现百万级上下文6.3倍解码加速【官方技术文档】
长文检索 BrowseComp
91.2分
单Agent无上下文压缩,当前该维度最高分【官方评测】
K3 vs Opus 4.8 vs GPT-5.6 Sol 四维对比
维度
K3(开源)
Claude Opus 4.8(闭源)
GPT-5.6 Sol(闭源)
输入定价
¥4/百万token
¥35/百万token
¥35/百万token
GDPval-AAv2
1687分(第3)
1600分(第4)
第2(Max版)
上下文长度
100万token
未公开披露
未公开披露
开放程度
开放权重,可下载部署
完全闭源
完全闭源
编程榜FCA
1679分(第1)
未上榜
低于K3
用脚投票:切换正在发生
已发生的切换案例:
Lindy公司将全部业务从Claude切换至DeepSeek,推理成本下降95%。[[40]]
OpenRouter平台数据显示,美国模型Token请求占比从72%跌至33%,中国AI模型周调用量连续多周全球第一。[[44]][[45]]
尚属预测的部分: K3发布后是否会加速这一趋势,目前仍在观察中。
高价模式两个关键变量
变量一:开源性能还能逼近多少
当前K3已在编程、长上下文、Agent任务上超越Opus 4.8,整体仅次于Fable 5和GPT-5.6 Sol。若后续迭代继续收窄差距,闭源高价模式的性能溢价支撑将进一步弱化。[[7]][[19]]
变量二:Anthropic涨价能否留住用户
据Anthropic官网信息,该公司计划9月将Opus 4.8价格提高约50%(输入升至$3/百万token,输出升至$15/百万token)。如果企业对价格敏感度高于对性能差异的容忍度,涨价可能加速切换,而非巩固用户。两条线的走向,将决定接下来一年格局。[[20]][[19]]
普通用户和开发者怎么看
API用户(无需自行部署):
K3已上线官网、KimiCode及兼容OpenAI SDK的API,可直接调用。适合编程、长文档处理、Agent任务场景。[[10]][[25]]
本地部署用户(需自建算力):
INT8量化后需约2.8TB显存,普通服务器无法承载,仅适合大型企业或科研机构。完整权重计划7月27日开放。[[18]][[9]]
闭源模型仍有优势的场景: 纯后端复杂算法推演、对响应速度要求极高的实时任务,目前K3"稳"但"慢"的特点仍存在差距。[[5]]
目前,这已经成为一个美国与中国之间的竞争问题。美国AI公司显然感到担忧。
Raffi Krikorian
Mozilla首席技术官,接受Axios采访
申宝配资提示:文章来自网络,不代表本站观点。