AI News HubLIVE
站内改写2 分钟阅读

AI本应惠及所有人,价签却说不

真实测试表明,使用美国顶级模型如GPT-5.6 Sol运行AI代理两小时需花费300美元,而中国开源模型如DeepSeek V4 Flash完成类似任务仅需不到3美元。尽管能力差距极小,但这种价格差异将小企业、自由职业者和学生排除在AI受益范围之外。文章呼吁竞争性定价,并警告地缘政治限制可能进一步加剧访问难题。

来源Hacker News AI作者: marvinlewis

在不久前的一次测试中,我们让一个AI代理连续工作了两小时。这不是演示,也不是玩具项目,而是真实的工作——中小企业设立业务时常做的事情:调研、起草、配置、迭代。这本应是AI让一切变得更简单、更普及的事情。然而,账单显示:300美元。这是GPT-5.6 Sol,OpenAI当前的旗舰模型。两小时,三百美元。换算成一周的真实业务使用,成本将达到数千美元。更令人不安的是:同样的工作,我们使用了美国以外的模型,成本仅为个位数。相同的质量水平,相同的能力等级,价格却只有大约三十分之一。这不是关于token优化或提示工程的帖子,而是关于谁能够使用我们这一代最强大的技术,谁从一开始就被价格挡在门外。

具体来看,根据2026年7月的官方定价,OpenAI GPT-5.6系列每百万token的输入输出费用:旗舰Sol为5美元/30美元,中等Terra为2.50美元/15美元,廉价Luna为1美元/6美元。而中国前沿模型方面,Kimi K3为3美元/15美元,DeepSeek V4 Pro为0.44美元/0.87美元,DeepSeek V4 Flash仅为0.14美元/0.28美元。实际应用中,一个两小时的AI代理会话大约消耗300万输入token和900万输出token。因此,使用GPT-5.6 Sol的成本约为285美元,而使用DeepSeek V4 Flash仅需约2.94美元,相差近100倍。

在能力方面,差距微乎其微。根据Artificial Analysis Intelligence Index,GPT-5.6 Sol得分为59,Kimi K3为57,仅差2分。在编程基准测试中,Kimi K3甚至排名第一;在研究生级别的推理测试GPQA Diamond上,它创下了开源模型的最佳记录93.5%。战略与国际研究中心(CSIS)指出,美国模型的高昂价格对许多开发者和政府构成挑战,而中国开源模型提供了更便宜的替代方案,随着能力差距缩小,价格差异将更加重要。

这不仅仅是美国与中国的竞争,更是AI可及性的问题。目前,高昂的成本使得只有风险资本支持的新创公司、大型企业和能优化token使用的开发者才能负担得起顶尖AI。而小企业主、自由职业者、非营利组织、学生和普通家长却被排斥在外。如果技术只有富人能用,它非但不能提升所有人,反而会加剧不平等。

价格差距的结构性原因在于开源与闭源。Kimi K3和DeepSeek是开源的,任何人都可以下载并在第三方提供商上运行,市场竞争压低了推理成本。而GPT-5.6 Sol是闭源的,只能通过OpenAI的API访问,单一供应商定价缺乏竞争。OpenAI虽推出了分层定价,但即使最便宜的Luna也比DeepSeek V4 Flash贵7倍(输入)和21倍(输出),远远不够。

地缘政治因素使情况更加紧迫。2026年6月,美国政府暂停了Anthropic的Fable和Mythos模型的外国访问权限;2026年7月,路透社报道中国当局与阿里巴巴、字节跳动和智谱讨论可能限制海外访问最先进模型,包括尚未发布的开源模型。如果双方都筑起高墙,普通用户将失去低价选择,而美国公司则在没有竞争压力下继续收取高价,这将是所有人最坏的局面。

我们呼吁美国AI公司(OpenAI、Anthropic、Google)在能力领先的同时,也要在可及性上领先,提供真正能让学生、自由职业者和小企业主全天候使用的当前代模型。美国政策制定者应在国家安全与公民可及性之间取得平衡,确保美国AI出口计划包含可负担的定价。同时,我们鼓励每个人知晓并尝试这些开源模型——DeepSeek V4 Flash以约3美元完成两小时代理会话,Kimi K3在输出成本减半的情况下接近前沿。AI的力量不应只属于预算充足的企业,而应属于每一个人。