中國AI(Kimi K3)能申報美國税表嗎?(TaxCalcBench)
一項新基準TaxCalcBench測試了AI模型處理美國税務申報的能力,中國AI模型Kimi K3通過OpenRouter成功集成,表明其在複雜税務計算中的潛力。
近年來,人工智能在專業領域的應用不斷拓展,從自然語言處理到複雜推理任務,AI模型的能力邊界持續延伸。近日,一個名為TaxCalcBench的新基準測試引發了廣泛關注。該基準專門用於評估AI模型是否能夠準確處理美國税務申報這一高度複雜的任務。税務申報不僅涉及大量的法律條文和計算規則,還需要模型具備嚴密的邏輯推理能力,這對AI的閲讀理解、數值運算和規則遵循能力提出了極高要求。
2026年7月20日,開源項目tax-calc-bench的GitHub存儲庫中出現了一項重要的拉取請求(PR)。該PR由開發者michaelrbock提交,旨在通過OpenRouter服務為中國AI模型Kimi K3添加支持。OpenRouter是一個提供多種AI模型接口的平台,使得Kimi K3能夠無縫接入TaxCalcBench的評測流程。該PR在提交後迅速獲得了項目維護者KaraMolisee的審核通過,並於7月21日成功合併到主分支。這意味着Kimi K3正式成為TaxCalcBench評測體系的一部分,儘管具體的評測分數尚未公佈,但集成本身已經表明該模型在税務處理領域通過了初步的技術驗證。
Kimi K3由北京月之暗面科技有限公司(Moonshot AI)開發,此前在中文自然語言處理任務中表現出色。此次跨領域涉足美國税務申報,不僅展示了Kimi K3的通用性和遷移學習能力,也引發了關於開源社區如何促進AI模型在垂直行業應用的熱議。TaxCalcBench項目旨在為税務領域提供一個標準化的AI能力評估框架,未來可能影響會計師行業的工作模式。項目的GitHub頁面顯示,該項目已獲得102顆星和23個分支,説明社區對税務AI的關注度正在上升。
不過需要強調的是,美國税務申報涉及嚴格的法律責任,目前AI模型仍處於輔助工具階段,不能完全替代專業會計師。TaxCalcBench的評估結果可以為模型選型和產品開發提供參考,但實際應用中仍需人工審核。這一集成事件也反映了中國AI模型在國際開源項目中的參與度提升,對於推動全球AI技術的多元化發展具有積極意義。