AI News HubLIVE
站內改寫1 分鐘閱讀

llm 0.32rc2 發佈

llm 0.32rc2 版本修復了依賴問題,並新增兩個功能:默認模型改為 GPT-5.6 Luna,以及新的 llm openai endpoint 命令,可直接與任意兼容 OpenAI 的端點交互。

Simon Willison 發佈了 llm 0.32rc2 版本,這是繼 RC1 之後的一個快速迭代,主要修復了一個依賴問題,並帶來了兩項實用的新功能。

首先,默認模型發生了變更:對於未自定義默認模型的用户,現在默認模型從之前的 GPT-4o mini 升級為 GPT-5.6 Luna。Luna 是一款性能更優、更先進的模型,但價格也略有提高:輸入令牌每百萬 0.20 美元,輸出令牌每百萬 1.20 美元,而 GPT-4o mini 分別為 0.15 美元和 0.60 美元。如果用户想切換回更經濟的選項,可以使用 llm models default gpt-4o-mini 恢復為 GPT-4o mini,或者使用 llm models default gpt-5-nano 切換到更便宜的 GPT-5 nano,其價格僅為輸入每百萬 0.05 美元、輸出每百萬 0.40 美元。這一變更旨在讓用户默認使用更強大的模型,同時保留靈活的選擇權。

其次,新增的 llm openai endpoint 命令是該版本的一大亮點。它允許用户直接向任意兼容 OpenAI Chat Completions API 的端點發送提示、進行對話或列出模型,而無需預先配置模型。這些調用不會被記錄,非常適合測試和臨時使用。Willison 表示,他此前一直缺少一個便捷的 CLI 工具來測試各種 OpenAI 模擬端點,因此決定將這一功能直接集成到 LLM 中。

更令人驚喜的是,使用這一功能甚至不需要安裝 LLM。用户可以通過 uvx 一行命令即可運行,例如調用 LM Studio 本地模型的命令:uvx --pre llm openai endpoint http://127.0.0.1:1234/v1 -T llm_version -T llm_time --td -m google/gemma-4-31b 'what is the current LLM version? And the time?'。輸出結果可在 GitHub 上查看。這一特性極大地簡化了與本地或第三方 OpenAI 兼容模型的交互流程。

總的來説,llm 0.32rc2 不僅修復了依賴問題,還通過默認模型升級和新的端點命令增強了實用性和靈活性,尤其是為開發者提供了更便捷的 CLI 工具來探索各種模型。