中国人工智能初创公司Moonshot AI开发的Kimi K3模型在Frontend Code Arena编程测试中跃居首位,这一成绩促使美国前白宫加密货币主管David Sacks发出警告,认为美国过于严格的监管可能会削弱其在全球AI竞争中的优势。
据测试结果,Kimi K3不仅在Frontend Code Arena中排名第一,还在多个其他AI基准测试中表现强劲。David Sacks指出,这一结果令人担忧,因为Kimi K3在多项评估中与领先模型表现接近。他批评美国对数据中心建设的限制、各州级法规以及拟议的联邦审查制度,认为这些可能拖慢美国开发者,而中国企业则持续构建先进系统。“这就是你们输掉AI竞赛的方式,”Sacks写道。
Sacks认为,美国在互联网时代之所以成为科技领导者,是因为允许公司无需事先获得政府批准即可开发产品。他呼吁华盛顿在AI领域采取类似策略,同时仅针对特定安全风险实施精准规则。
Moonshot AI构建的Kimi K3拥有2.8万亿参数、百万token上下文窗口以及原生多模态能力。该模型专为长代码任务和需要完成多个关联任务的智能体工作流设计。该公司称,其Kimi Delta Attention系统在处理百万token上下文时,解码速度提升高达6.3倍;Attention Residuals技术则在总成本增加不到2%的情况下,将训练效率提高约25%。
除了Frontend Code Arena,Kimi K3在GDPval v2上获得1668的Elo评分,超越GLM-5.2、GPT-5.5和Claude Opus 4.8,尽管Claude Fable 5仍保持更高分数。在AutomationBench-AA测试中,该中国模型获得53%的分数,并在智能体主导的SaaS工作流测试中排名第一。通过nextjs.org/evals发布的结果显示,Kimi K3在更短时间内完成任务的成功率与Fable相媲美。
Moonshot AI已通过Kimi.com、Kimi Work、Kimi Code和Kimi API发布Kimi K3,并计划于7月27日前开源模型权重,让开发者有更多机会测试和适配其能力。
Sacks将Kimi K3的表现与华盛顿如何监管前沿AI的激烈辩论联系起来。他的批评覆盖了联邦预审批提案、数据中心建设限制以及各州不断推出的AI法规。联邦层面,美国政府已批准约100家企业和机构有限访问Anthropic的Claude Mythos 5模型。商务部长Howard Lutnick在给Anthropic联合创始人Tom Brown的信中表示,选定的合作伙伴可在特定保障措施下使用该模型。Sacks虽然承认AI安全需要政府关注,但认为其他国家不会效仿美国的限制措施。在他看来,阻碍基础设施或模型开发的规则可能使美国公司面临更少限制的外国实验室的竞争。
总统特朗普也以对华竞争为由推动其科技和数字资产议程。他敦促参议院通过《CLARITY法案》,认为延迟加密货币立法可能让中国抢占先机,而其政府则将美国宣传为“世界加密货币之都”。Sacks对Kimi K3的回应将同样的竞争逻辑应用于人工智能:明确风险,但不要在美国开发者面前设置审批障碍。
