AI本應惠及所有人,價籤卻説不
真實測試表明,使用美國頂級模型如GPT-5.6 Sol運行AI代理兩小時需花費300美元,而中國開源模型如DeepSeek V4 Flash完成類似任務僅需不到3美元。儘管能力差距極小,但這種價格差異將小企業、自由職業者和學生排除在AI受益範圍之外。文章呼籲競爭性定價,並警告地緣政治限制可能進一步加劇訪問難題。
在不久前的一次測試中,我們讓一個AI代理連續工作了兩小時。這不是演示,也不是玩具項目,而是真實的工作——中小企業設立業務時常做的事情:調研、起草、配置、迭代。這本應是AI讓一切變得更簡單、更普及的事情。然而,賬單顯示:300美元。這是GPT-5.6 Sol,OpenAI當前的旗艦模型。兩小時,三百美元。換算成一週的真實業務使用,成本將達到數千美元。更令人不安的是:同樣的工作,我們使用了美國以外的模型,成本僅為個位數。相同的質量水平,相同的能力等級,價格卻只有大約三十分之一。這不是關於token優化或提示工程的帖子,而是關於誰能夠使用我們這一代最強大的技術,誰從一開始就被價格擋在門外。
具體來看,根據2026年7月的官方定價,OpenAI GPT-5.6系列每百萬token的輸入輸出費用:旗艦Sol為5美元/30美元,中等Terra為2.50美元/15美元,廉價Luna為1美元/6美元。而中國前沿模型方面,Kimi K3為3美元/15美元,DeepSeek V4 Pro為0.44美元/0.87美元,DeepSeek V4 Flash僅為0.14美元/0.28美元。實際應用中,一個兩小時的AI代理會話大約消耗300萬輸入token和900萬輸出token。因此,使用GPT-5.6 Sol的成本約為285美元,而使用DeepSeek V4 Flash僅需約2.94美元,相差近100倍。
在能力方面,差距微乎其微。根據Artificial Analysis Intelligence Index,GPT-5.6 Sol得分為59,Kimi K3為57,僅差2分。在編程基準測試中,Kimi K3甚至排名第一;在研究生級別的推理測試GPQA Diamond上,它創下了開源模型的最佳記錄93.5%。戰略與國際研究中心(CSIS)指出,美國模型的高昂價格對許多開發者和政府構成挑戰,而中國開源模型提供了更便宜的替代方案,隨着能力差距縮小,價格差異將更加重要。
這不僅僅是美國與中國的競爭,更是AI可及性的問題。目前,高昂的成本使得只有風險資本支持的新創公司、大型企業和能優化token使用的開發者才能負擔得起頂尖AI。而小企業主、自由職業者、非營利組織、學生和普通家長卻被排斥在外。如果技術只有富人能用,它非但不能提升所有人,反而會加劇不平等。
價格差距的結構性原因在於開源與閉源。Kimi K3和DeepSeek是開源的,任何人都可以下載並在第三方提供商上運行,市場競爭壓低了推理成本。而GPT-5.6 Sol是閉源的,只能通過OpenAI的API訪問,單一供應商定價缺乏競爭。OpenAI雖推出了分層定價,但即使最便宜的Luna也比DeepSeek V4 Flash貴7倍(輸入)和21倍(輸出),遠遠不夠。
地緣政治因素使情況更加緊迫。2026年6月,美國政府暫停了Anthropic的Fable和Mythos模型的外國訪問權限;2026年7月,路透社報道中國當局與阿里巴巴、字節跳動和智譜討論可能限制海外訪問最先進模型,包括尚未發佈的開源模型。如果雙方都築起高牆,普通用户將失去低價選擇,而美國公司則在沒有競爭壓力下繼續收取高價,這將是所有人最壞的局面。
我們呼籲美國AI公司(OpenAI、Anthropic、Google)在能力領先的同時,也要在可及性上領先,提供真正能讓學生、自由職業者和小企業主全天候使用的當前代模型。美國政策制定者應在國家安全與公民可及性之間取得平衡,確保美國AI出口計劃包含可負擔的定價。同時,我們鼓勵每個人知曉並嘗試這些開源模型——DeepSeek V4 Flash以約3美元完成兩小時代理會話,Kimi K3在輸出成本減半的情況下接近前沿。AI的力量不應只屬於預算充足的企業,而應屬於每一個人。