AI News HubLIVE
公開文章 169採集文章 177可信度 78刷新頻率 30 分鐘
健康狀態 健康來源類型 媒體原文權限 站內改寫最近入庫 2026-08-10ID the-new-stack-ai運行狀態 已啟用

Technical media source; summary-only unless authorization is obtained.

最新公開文章

待翻譯:Meta’s Muse Glimmer fits on a laptop

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Meta released Muse Glimmer on Monday, a 30-billion-parameter open-weight model designed to run agentic workflows on local hardware. It’s available The post Meta’s Muse Glimmer fits on a laptop appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級後設資料。
  • Meta released Muse Glimmer on Monday, a 30-billion-parameter open-weight model designed to run agentic workflows on local hardware. It’s available The post Meta’s Muse Glimmer fit…
站內正文

待翻譯:“It blows my mind”-“It has a tendency to overengineer things a little”: Developers react to road-testing OpenAI GPT‑5.6 Sol

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:OpenAI made its family of GPT-5.6 models available to its app and API users globally at the start of July. The post “It blows my mind”-“It has a tendency to overengineer things a little”: Developers react to road-testing OpenAI GPT‑5.6 Sol appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級後設資料。
  • OpenAI made its family of GPT-5.6 models available to its app and API users globally at the start of July. The post “It blows my mind”-“It has a tendency to overengineer things a…
站內正文

待翻譯:Auto Mode will soon be the default in Claude Code — because humans can’t be trusted

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:In the early days of Claude Code, it felt like you either had to approve everything the coding agent did The post Auto Mode will soon be the default in Claude Code — because humans can’t be trusted appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級後設資料。
  • In the early days of Claude Code, it felt like you either had to approve everything the coding agent did The post Auto Mode will soon be the default in Claude Code — because human…
站內正文

待翻譯:Your AI agent’s next tool call may be valid but wrong. AWS’s Dogwood promises to fix that.

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:AWS on Thursday launched Dogwood, an open-source policy language and reference interpreter that lets developers govern sequences of AI agent The post Your AI agent’s next tool call may be valid but wrong. AWS’s Dogwood promises to fix that. appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級後設資料。
  • AWS on Thursday launched Dogwood, an open-source policy language and reference interpreter that lets developers govern sequences of AI agent The post Your AI agent’s next tool cal…
站內正文

待翻譯:Why Todoist says less AI can deliver more

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Doist CTO Gonçalo Silva doesn’t pretend to know where AI is headed. The pace of change has made it harder The post Why Todoist says less AI can deliver more appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級後設資料。
  • Doist CTO Gonçalo Silva doesn’t pretend to know where AI is headed. The pace of change has made it harder The post Why Todoist says less AI can deliver more appeared first on The…
站內正文

待翻譯:Astro’s GitHub issue backlog is heading to zero for the first time in 5 years. Now Cloudflare is open-sourcing the tool that did it.

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Most open source maintainers will know the feeling of opening GitHub to a growing pile of issues that can’t feasibly The post Astro’s GitHub issue backlog is heading to zero for the first time in 5 years. Now Cloudflare is open-sourcing the tool that did it. appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級後設資料。
  • Most open source maintainers will know the feeling of opening GitHub to a growing pile of issues that can’t feasibly The post Astro’s GitHub issue backlog is heading to zero for t…
站內正文

待翻譯:Apple and Bynario agree GPT-5.5 found a real macOS bug. They disagree on the report cap.

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Apple now caps how many security reports some researchers can have open at once. And once they hit that cap, The post Apple and Bynario agree GPT-5.5 found a real macOS bug. They disagree on the report cap. appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級後設資料。
  • Apple now caps how many security reports some researchers can have open at once. And once they hit that cap, The post Apple and Bynario agree GPT-5.5 found a real macOS bug. They…
站內正文

Nscale收購Anyscale:多雲中立性面臨考驗

雲平臺公司Nscale宣佈收購AI工作負載擴充套件專家Anyscale,將GPU基礎設施與雲中立軟體層結合。Nscale承諾保持品牌獨立和效能優先,但分析師認為“隨處可執行”與“最優執行”之間將出現差距,中立性可能淪為標籤。交易預計2026年下半年完成,價格約16.5億美元。

  • Nscale收購Anyscale,將GPU neocloud與多雲AI編排軟體整合。
  • Nscale稱Anyscale將保留品牌並繼續支援AWS、GCP、Azure等自帶雲部署,強調以效能而非鎖定取勝。
站內正文

Anthropic支援緊急呼籲:最強大的AI實驗室應放慢步伐

超過1100名AI研究人員和高管簽署公開信,要求政府在安全措施跟不上時,有意識地放慢前沿AI的發展速度。Anthropic CEO Dario Amodei是唯一簽署該信的頂級AI實驗室CEO,OpenAI和谷歌DeepMind的領導人也加入了。信件引用了遞迴自我改進和快速能力加速的風險。美國國會正在考慮相關立法,如AI終止開關法案。

  • 1100多名AI專家簽署公開信,呼籲在安全措施跟不上時有意放慢前沿AI的發展。
  • Anthropic CEO Dario Amodei是唯一簽署的頂級AI實驗室CEO,OpenAI和谷歌DeepMind的領導人也簽名。
站內正文

OpenAI、Anthropic和Cursor均針對印度推出本地化定價,但僅兩家注重價值

人工智慧公司Cursor宣佈在印度推出本地化定價計劃Cursor Start,月費649盧比(約7美元),支援UPI支付。此前Anthropic也推出了盧比定價,但折算後比美國更貴,且不支援UPI。OpenAI的ChatGPT Go計劃更早進入印度,月費僅399盧比。分析指出,Cursor和OpenAI真正針對印度市場設計了專屬計劃,而Anthropic僅是貨幣轉換。

  • Cursor推出Cursor Start計劃,印度使用者每月649盧比,支援UPI支付,但缺少前沿模型
  • Anthropic的Claude盧比定價折算後高於美國價格,且尚未支援UPI
站內正文

“有狀態系統極難構建”:Perplexity對AI智慧體沙箱的思考

Perplexity推出了SPACE沙箱平臺,用於其Computer AI智慧體,重點在於狀態管理而非僅僅隔離。該平臺基於Firecracker微虛擬機器、Kubernetes和Btrfs檔案系統,實現高效快照、暫停/恢復和分支。SPACE比現有方案快3倍,每分鐘快照一次,可回滾一週。安全功能包括RBAC、即時訪問和逐工具控制。未來計劃提供API產品、支援第三方沙箱和本地/混合部署。Perplexity還引入了一種低成本編排器模型。

  • Perplexity的SPACE沙箱平臺優先考慮狀態管理(暫停/恢復/分支)而非隔離。
  • 使用Firecracker微虛擬機器、Kubernetes和Btrfs寫時複製檔案系統提高效能。
站內正文

Modus的操作模式:為AI智慧體提供恰到好處的上下文

Modus以1000萬美元融資走出隱身模式,構建“上下文倉庫”,持續對映業務運營,僅向AI智慧體提供相關上下文,從而節省成本並提高準確性。該公司針對工程和AI團隊,使用上下文挖掘器和上下文組合器動態生成技能。

  • Modus從Insight Partners獲得1000萬美元種子輪融資,推出與現有資料倉儲並行的上下文倉庫。
  • 系統持續從GitHub、Jira、Snowflake等來源爬取資產,理解業務上下文。
站內正文

“這不在我十大擔憂之列”:山姆·奧爾特曼對模型蒸餾的看法

在播客中,OpenAI執行長山姆·奧爾特曼討論了AI安全、模型蒸餾和智慧的未來。他強調規模和使用者量比高利潤率更重要,並認為模型蒸餾並非首要擔憂。奧爾特曼表示,廉價模型將存在,OpenAI必須成為最好和最便宜的。他還指出需要更好的安全防護和憑據管理,並認為開源模型仍有一席之地。

  • 奧爾特曼表示模型蒸餾不在其十大擔憂之列;OpenAI專注於成為最好和最便宜的。
  • Hugging Face安全事件促使OpenAI重新思考模型安全;代理憑據需要即時注入。
站內正文

Diagrid 為失敗的AI代理提供恢復方法

Diagrid 釋出 Catalyst 2.0,為基於 LangGraph、Microsoft Agent Framework 等框架構建的 AI 代理新增持久執行和證明層,使其在中斷後能從最後一步恢復,並提供不可篡改的執行記錄,適用於金融、醫療等受監管行業。

  • Catalyst 2.0 為 AI 代理提供持久執行,支援中斷後從最後一步恢復,無需從頭重試。
  • 該工具基於開源 Dapr 專案,可攔截主流代理框架的執行迴圈,將操作註冊為工作流步驟。
站內正文

低程式碼/無程式碼有保質期?Tines認為AI生成工作流是未來

Tines推出新平臺3B Tuesday,利用AI透過自然語言描述建立企業工作流,但執行仍用傳統程式碼。CEO認為低程式碼/無程式碼模式有保質期,AI生成程式碼將取代視覺化構建。新平臺面向非技術員工,同時提供IT治理和控制。

  • Tines釋出3B Tuesday,用AI根據自然語言生成工作流程式碼,但執行時仍用確定性程式碼。
  • CEO Eoin Hinchy稱低程式碼/無程式碼類別有保質期,AI程式碼生成能力降低了對視覺化構建器的需求。
站內正文

Anthropic主張測試而非禁令,OpenAI和Google支援開放權重

Anthropic CEO Dario Amodei明確表示公司不主張禁止開放權重AI模型,而是提議對每個足夠強大的模型在釋出前進行強制性安全測試。這一立場引發行業關注,已有50家機構簽署支援開放權重的信件,而Anthropic和亞馬遜尚未加入。

  • Anthropic CEO表態不禁止開放權重模型,而是要求強制性安全測試
  • 提議包括收緊出口管制、打擊模型蒸餾、對足夠強大模型進行釋出前評估
站內正文

Dynatrace新代理揭示AI運維最棘手難題

可觀測性平臺公司Dynatrace為其Dynatrace Intelligence服務推出新功能,旨在透過確定性即時上下文和自主SRE代理,實現從機率性方法向自主運維的轉變,同時保留人工監督。

  • Dynatrace新增自主SRE代理,可自動確定問題是否屬於現有事件調查。
  • Agent Builder允許無程式碼建立自定義AI代理。
站內正文

開發者視此為未來:Pilot Protocol啟動以賦能代理經濟

Pilot Protocol推出代理應用商店和網路,讓代理可以相互發現和通訊,併為代理配備錢包用於支付工具。該公司聲稱已有25萬代理,每天產生20億次請求。開發者認為這是實現自主使用模式的未來。

  • Pilot Protocol推出代理應用商店和網路,使代理能夠相互發現和通訊。
  • 代理擁有錢包,可以支付所需工具,開發者可透過網路分發應用。
站內正文

Cloudflare 開源用於蘋果和微軟隱私協議的偵錯程式,兼顧 AI 代理

Cloudflare 宣佈開源 pvcli,一款用於 Oblivious HTTP (OHTTP) 和 MASQUE 等隱私協議的命令列偵錯程式,旨在解決分離信任基礎設施的故障排查難題。該工具專為 AI 代理設計,採用類似 curl 的命令語法,幫助小公司無需成為協議專家即可測試和除錯隱私代理流量。

  • Cloudflare 開源 pvcli,用於除錯 OHTTP 和 MASQUE 等隱私協議
  • 解決蘋果 iCloud Private Relay 和微軟 Edge Secure Network VPN 等分離信任系統的故障排查問題
站內正文

Nvidia、Palantir、Hugging Face等33家機構聯合成立開放安全AI聯盟,抵禦開源AI網路安全威脅

由Nvidia、Palantir、Hugging Face等33家技術巨頭組成的開放安全AI聯盟於週一成立,旨在開發技術和工具,透過快速識別和修補漏洞來保護開源權重AI模型。該聯盟的建立反映了業界對於開源AI安全性的關注,同時也暴露了當前監管框架在應對去中心化開源模型方面的不足。

  • 33家合作伙伴成立開放安全AI聯盟,致力於保護開源AI模型免受網路威脅。
  • 聯盟成員包括Nvidia、Adobe、Cisco、IBM、Microsoft等技術巨頭,但OpenAI和Anthropic缺席。
站內正文

MCP 最大更新:移除眾多伺服器圍繞構建的機制

模型上下文協議(MCP)迎來發布以來最大更新,移除會話狀態和初始化握手,以簡化遠端伺服器操作。候選版本已於5月21日凍結,最終規範將於7月28日釋出。部分核心功能被棄用,並提供遷移指南。

  • MCP 更新消除會話親和性,使請求無狀態化,降低運維複雜度。
  • 功能和協議版本現透過 _meta 在每次呼叫中傳遞,支援快取和路由。
站內正文

停止修正AI程式碼:構建智慧體所需的系統

軟體工程師應停止修正AI生成的程式碼,轉而改進產生程式碼的系統。Tessl的Patrick Debois倡導上下文驅動開發和配套工程,以有效擴充套件AI智慧體。

  • 工程師應停止修正AI程式碼,而是改進系統和上下文。
  • 上下文驅動開發包括生成、評估、分發和觀察的持續迴圈。
站內正文

微軟、輝達、Meta等25家組織捍衛開源權重,Anthropic和OpenAI未簽署

圍繞開源權重AI模型的爭論升級。25家科技巨頭聯合宣告反對過早限制,而Anthropic和OpenAI拒絕簽署。開發者因成本壓力轉向中國開源模型,引發國家安全與技術開放之間的博弈。

  • 微軟、輝達、Meta等25家組織簽署宣告,捍衛蒸餾技術作為合法模型開發手段。
  • Anthropic和OpenAI未簽署,主張限制中國開源模型。
站內正文

Opus 5價格僅為三分之一——而這恰恰是問題所在

Anthropic的Opus 5比Fable 5更便宜、限制更少,在代理程式設計任務中以較低成本表現出色。然而,其自主性給團隊帶來了安全性和成本管理挑戰。

  • Opus 5的定價為每百萬輸入/輸出代幣5/25美元,以更低成本超越競爭對手。
  • 它可以在沒有人類輸入的情況下長時間處理程式設計任務。
站內正文

Anthropic Opus 5:效能接近Fable 5,價格減半

Anthropic釋出Opus 5,效能接近旗艦模型Fable 5,但價格僅為後者一半。新模型在多項基準測試中表現優異,尤其在知識工作和編碼方面。Anthropic強調其安全性和對齊性,並推出快速模式等新功能。

  • Opus 5效能接近Fable 5,價格減半,無需30天資料保留政策。
  • 在知識工作、Agentic搜尋和自動化工作流等基準測試中領先。
站內正文

AWS、Google Cloud、Microsoft Azure 和 Cloudflare 均提供代理沙箱,但構建方式各不相同

四大雲服務商(AWS、Google Cloud、Microsoft Azure 和 Cloudflare)現已全部提供原生代理沙箱,用於隔離執行不可信程式碼。各廠商採用截然不同的隔離技術:AWS 使用 Firecracker 微虛擬機器,Google 採用 gVisor 核心攔截和 Cloud Run 輕量隔離,Azure 基於 Hyper-V,Cloudflare 則用容器加獨立虛擬機器。文章指出,沙箱只是隔離邊界,真正的挑戰在於治理層。

  • 四大雲廠商均已提供代理沙箱原生功能,但隔離技術和生命週期模型差異顯著。
  • AWS Lambda MicroVMs 基於 Firecracker,提供最多8小時執行時間和掛起恢復週期。
站內正文

OpenAI與Anthropic同時釋出語音更新,各顯神通

OpenAI和Anthropic同時推出了重要的語音更新,但兩大前沿AI實驗室採取了截然不同的策略。OpenAI致力於透過語音控制桌面和AI代理,而Anthropic則專注於透過對話式推理解決複雜問題。

  • OpenAI推出GPT-Live,透過語音控制桌面,支援多工並行和應用整合。
  • Anthropic升級Claude語音模式,強化對話式推理,輔助複雜問題解決。
站內正文

“我們喜歡兩種模型都能使用的世界”:NVIDIA如何看待本地模型與前沿模型

NVIDIA高階總監Joey Conway表示,本地小型模型與前沿大模型正協同工作,透過路由器分配任務,企業可藉此降低成本、提高效率。NVIDIA推出DGX Spark等硬體支援本地執行大模型,並強調資料控制與安全性。

  • NVIDIA提倡本地模型與前沿模型相結合,透過路由器分配簡單與複雜任務。
  • 企業可使用DGX Spark等裝置本地執行高達2000億引數的模型,完全控制資料。
站內正文

Cursor、Ramp 和 Meta 都在構建模型路由器——但其中兩家自身有著重大模型抱負

Cursor 推出模型路由器 Cursor Router,可根據任務需求自動選擇最合適的 AI 模型,節省成本並保持質量。Ramp 和 Meta 也釋出了類似工具。Cursor 自身也在開發強大模型,並開始掌控自己的 AI 堆疊。

  • Cursor Router 透過分診系統將編碼請求分配給最合適的模型,宣稱可節省 30-50% 成本。
  • Cursor 已釋出自家模型 Grok 4.5 和 Composer 2.5,構建自有 AI 堆疊。
站內正文

代理不斷改變答案,Harness構建了不在乎的交付管道

Harness推出AI代理開發生命週期(DLC)服務,將應用程式碼的治理、測試和安全機制應用於AI代理。由於代理的非確定性特點,Harness主張讓管道變得可預測而非代理本身。它引入了五項新能力:AI評估、代理部署、AI配置、AI資產目錄和代理追蹤,並開源了基礎元件。目標是在確保治理和安全的前提下,加快代理的部署速度。

  • Harness推出AI代理DLC,將程式碼交付管道的治理、測試和安全應用於代理開發。
  • 代理的非確定性使得傳統測試方法失效;Harness建議透過可預測的管道來控制代理行為。
站內正文

全部來源