AI News HubLIVE
站內改寫1 分鐘閱讀

llm 0.32rc2 釋出

llm 0.32rc2 版本修復了依賴問題,並新增兩個功能:預設模型改為 GPT-5.6 Luna,以及新的 llm openai endpoint 命令,可直接與任意相容 OpenAI 的端點互動。

Simon Willison 釋出了 llm 0.32rc2 版本,這是繼 RC1 之後的一個快速迭代,主要修復了一個依賴問題,並帶來了兩項實用的新功能。

首先,預設模型發生了變更:對於未自定義預設模型的使用者,現在預設模型從之前的 GPT-4o mini 升級為 GPT-5.6 Luna。Luna 是一款效能更優、更先進的模型,但價格也略有提高:輸入令牌每百萬 0.20 美元,輸出令牌每百萬 1.20 美元,而 GPT-4o mini 分別為 0.15 美元和 0.60 美元。如果使用者想切換回更經濟的選項,可以使用 llm models default gpt-4o-mini 恢復為 GPT-4o mini,或者使用 llm models default gpt-5-nano 切換到更便宜的 GPT-5 nano,其價格僅為輸入每百萬 0.05 美元、輸出每百萬 0.40 美元。這一變更旨在讓使用者預設使用更強大的模型,同時保留靈活的選擇權。

其次,新增的 llm openai endpoint 命令是該版本的一大亮點。它允許使用者直接向任意相容 OpenAI Chat Completions API 的端點傳送提示、進行對話或列出模型,而無需預先配置模型。這些呼叫不會被記錄,非常適合測試和臨時使用。Willison 表示,他此前一直缺少一個便捷的 CLI 工具來測試各種 OpenAI 模擬端點,因此決定將這一功能直接整合到 LLM 中。

更令人驚喜的是,使用這一功能甚至不需要安裝 LLM。使用者可以透過 uvx 一行命令即可執行,例如呼叫 LM Studio 本地模型的命令:uvx --pre llm openai endpoint http://127.0.0.1:1234/v1 -T llm_version -T llm_time --td -m google/gemma-4-31b 'what is the current LLM version? And the time?'。輸出結果可在 GitHub 上檢視。這一特性極大地簡化了與本地或第三方 OpenAI 相容模型的互動流程。

總的來說,llm 0.32rc2 不僅修復了依賴問題,還透過預設模型升級和新的端點命令增強了實用性和靈活性,尤其是為開發者提供了更便捷的 CLI 工具來探索各種模型。