AI News HubLIVE
公開文章 169採集文章 177可信度 78刷新頻率 30 分鐘
健康狀態 健康來源類型 媒體原文權限 站內改寫最近入庫 2026-08-10ID the-new-stack-ai運行狀態 已啟用

Technical media source; summary-only unless authorization is obtained.

最新公開文章

待翻譯:Meta’s Muse Glimmer fits on a laptop

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Meta released Muse Glimmer on Monday, a 30-billion-parameter open-weight model designed to run agentic workflows on local hardware. It’s available The post Meta’s Muse Glimmer fits on a laptop appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級元數據。
  • Meta released Muse Glimmer on Monday, a 30-billion-parameter open-weight model designed to run agentic workflows on local hardware. It’s available The post Meta’s Muse Glimmer fit…
站內正文

待翻譯:“It blows my mind”-“It has a tendency to overengineer things a little”: Developers react to road-testing OpenAI GPT‑5.6 Sol

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:OpenAI made its family of GPT-5.6 models available to its app and API users globally at the start of July. The post “It blows my mind”-“It has a tendency to overengineer things a little”: Developers react to road-testing OpenAI GPT‑5.6 Sol appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級元數據。
  • OpenAI made its family of GPT-5.6 models available to its app and API users globally at the start of July. The post “It blows my mind”-“It has a tendency to overengineer things a…
站內正文

待翻譯:Auto Mode will soon be the default in Claude Code — because humans can’t be trusted

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:In the early days of Claude Code, it felt like you either had to approve everything the coding agent did The post Auto Mode will soon be the default in Claude Code — because humans can’t be trusted appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級元數據。
  • In the early days of Claude Code, it felt like you either had to approve everything the coding agent did The post Auto Mode will soon be the default in Claude Code — because human…
站內正文

待翻譯:Your AI agent’s next tool call may be valid but wrong. AWS’s Dogwood promises to fix that.

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:AWS on Thursday launched Dogwood, an open-source policy language and reference interpreter that lets developers govern sequences of AI agent The post Your AI agent’s next tool call may be valid but wrong. AWS’s Dogwood promises to fix that. appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級元數據。
  • AWS on Thursday launched Dogwood, an open-source policy language and reference interpreter that lets developers govern sequences of AI agent The post Your AI agent’s next tool cal…
站內正文

待翻譯:Why Todoist says less AI can deliver more

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Doist CTO Gonçalo Silva doesn’t pretend to know where AI is headed. The pace of change has made it harder The post Why Todoist says less AI can deliver more appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級元數據。
  • Doist CTO Gonçalo Silva doesn’t pretend to know where AI is headed. The pace of change has made it harder The post Why Todoist says less AI can deliver more appeared first on The…
站內正文

待翻譯:Astro’s GitHub issue backlog is heading to zero for the first time in 5 years. Now Cloudflare is open-sourcing the tool that did it.

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Most open source maintainers will know the feeling of opening GitHub to a growing pile of issues that can’t feasibly The post Astro’s GitHub issue backlog is heading to zero for the first time in 5 years. Now Cloudflare is open-sourcing the tool that did it. appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級元數據。
  • Most open source maintainers will know the feeling of opening GitHub to a growing pile of issues that can’t feasibly The post Astro’s GitHub issue backlog is heading to zero for t…
站內正文

待翻譯:Apple and Bynario agree GPT-5.5 found a real macOS bug. They disagree on the report cap.

AI 服務暫時不可用,以下為來源摘要,待恢復後補全翻譯:Apple now caps how many security reports some researchers can have open at once. And once they hit that cap, The post Apple and Bynario agree GPT-5.5 found a real macOS bug. They disagree on the report cap. appeared first on The New Stack.

  • AI 服務暫時不可用,系統已先保留來源內容與降級元數據。
  • Apple now caps how many security reports some researchers can have open at once. And once they hit that cap, The post Apple and Bynario agree GPT-5.5 found a real macOS bug. They…
站內正文

Nscale收購Anyscale:多雲中立性面臨考驗

雲平台公司Nscale宣佈收購AI工作負載擴展專家Anyscale,將GPU基礎設施與雲中立軟件層結合。Nscale承諾保持品牌獨立和性能優先,但分析師認為“隨處可運行”與“最優運行”之間將出現差距,中立性可能淪為標籤。交易預計2026年下半年完成,價格約16.5億美元。

  • Nscale收購Anyscale,將GPU neocloud與多雲AI編排軟件整合。
  • Nscale稱Anyscale將保留品牌並繼續支持AWS、GCP、Azure等自帶雲部署,強調以性能而非鎖定取勝。
站內正文

Anthropic支持緊急呼籲:最強大的AI實驗室應放慢步伐

超過1100名AI研究人員和高管簽署公開信,要求政府在安全措施跟不上時,有意識地放慢前沿AI的發展速度。Anthropic CEO Dario Amodei是唯一簽署該信的頂級AI實驗室CEO,OpenAI和谷歌DeepMind的領導人也加入了。信件引用了遞歸自我改進和快速能力加速的風險。美國國會正在考慮相關立法,如AI終止開關法案。

  • 1100多名AI專家簽署公開信,呼籲在安全措施跟不上時有意放慢前沿AI的發展。
  • Anthropic CEO Dario Amodei是唯一簽署的頂級AI實驗室CEO,OpenAI和谷歌DeepMind的領導人也簽名。
站內正文

OpenAI、Anthropic和Cursor均針對印度推出本地化定價,但僅兩家注重價值

人工智能公司Cursor宣佈在印度推出本地化定價計劃Cursor Start,月費649盧比(約7美元),支持UPI支付。此前Anthropic也推出了盧比定價,但折算後比美國更貴,且不支持UPI。OpenAI的ChatGPT Go計劃更早進入印度,月費僅399盧比。分析指出,Cursor和OpenAI真正針對印度市場設計了專屬計劃,而Anthropic僅是貨幣轉換。

  • Cursor推出Cursor Start計劃,印度用户每月649盧比,支持UPI支付,但缺少前沿模型
  • Anthropic的Claude盧比定價折算後高於美國價格,且尚未支持UPI
站內正文

“有狀態系統極難構建”:Perplexity對AI智能體沙箱的思考

Perplexity推出了SPACE沙箱平台,用於其Computer AI智能體,重點在於狀態管理而非僅僅隔離。該平台基於Firecracker微虛擬機、Kubernetes和Btrfs文件系統,實現高效快照、暫停/恢復和分支。SPACE比現有方案快3倍,每分鐘快照一次,可回滾一週。安全功能包括RBAC、即時訪問和逐工具控制。未來計劃提供API產品、支持第三方沙箱和本地/混合部署。Perplexity還引入了一種低成本編排器模型。

  • Perplexity的SPACE沙箱平台優先考慮狀態管理(暫停/恢復/分支)而非隔離。
  • 使用Firecracker微虛擬機、Kubernetes和Btrfs寫時複製文件系統提高性能。
站內正文

Modus的操作模式:為AI智能體提供恰到好處的上下文

Modus以1000萬美元融資走出隱身模式,構建“上下文倉庫”,持續映射業務運營,僅向AI智能體提供相關上下文,從而節省成本並提高準確性。該公司針對工程和AI團隊,使用上下文挖掘器和上下文組合器動態生成技能。

  • Modus從Insight Partners獲得1000萬美元種子輪融資,推出與現有數據倉庫並行的上下文倉庫。
  • 系統持續從GitHub、Jira、Snowflake等來源爬取資產,理解業務上下文。
站內正文

“這不在我十大擔憂之列”:山姆·奧爾特曼對模型蒸餾的看法

在播客中,OpenAI首席執行官山姆·奧爾特曼討論了AI安全、模型蒸餾和智能的未來。他強調規模和用户量比高利潤率更重要,並認為模型蒸餾並非首要擔憂。奧爾特曼表示,廉價模型將存在,OpenAI必須成為最好和最便宜的。他還指出需要更好的安全防護和憑據管理,並認為開源模型仍有一席之地。

  • 奧爾特曼表示模型蒸餾不在其十大擔憂之列;OpenAI專注於成為最好和最便宜的。
  • Hugging Face安全事件促使OpenAI重新思考模型安全;代理憑據需要即時注入。
站內正文

Diagrid 為失敗的AI代理提供恢復方法

Diagrid 發佈 Catalyst 2.0,為基於 LangGraph、Microsoft Agent Framework 等框架構建的 AI 代理添加持久執行和證明層,使其在中斷後能從最後一步恢復,並提供不可篡改的執行記錄,適用於金融、醫療等受監管行業。

  • Catalyst 2.0 為 AI 代理提供持久執行,支持中斷後從最後一步恢復,無需從頭重試。
  • 該工具基於開源 Dapr 項目,可攔截主流代理框架的執行循環,將操作註冊為工作流步驟。
站內正文

低代碼/無代碼有保質期?Tines認為AI生成工作流是未來

Tines推出新平台3B Tuesday,利用AI通過自然語言描述創建企業工作流,但執行仍用傳統代碼。CEO認為低代碼/無代碼模式有保質期,AI生成代碼將取代可視化構建。新平台面向非技術員工,同時提供IT治理和控制。

  • Tines發佈3B Tuesday,用AI根據自然語言生成工作流代碼,但運行時仍用確定性代碼。
  • CEO Eoin Hinchy稱低代碼/無代碼類別有保質期,AI代碼生成能力降低了對可視化構建器的需求。
站內正文

Anthropic主張測試而非禁令,OpenAI和Google支持開放權重

Anthropic CEO Dario Amodei明確表示公司不主張禁止開放權重AI模型,而是提議對每個足夠強大的模型在發佈前進行強制性安全測試。這一立場引發行業關注,已有50家機構簽署支持開放權重的信件,而Anthropic和亞馬遜尚未加入。

  • Anthropic CEO表態不禁止開放權重模型,而是要求強制性安全測試
  • 提議包括收緊出口管制、打擊模型蒸餾、對足夠強大模型進行發佈前評估
站內正文

Dynatrace新代理揭示AI運維最棘手難題

可觀測性平台公司Dynatrace為其Dynatrace Intelligence服務推出新功能,旨在通過確定性實時上下文和自主SRE代理,實現從概率性方法向自主運維的轉變,同時保留人工監督。

  • Dynatrace新增自主SRE代理,可自動確定問題是否屬於現有事件調查。
  • Agent Builder允許無代碼創建自定義AI代理。
站內正文

開發者視此為未來:Pilot Protocol啓動以賦能代理經濟

Pilot Protocol推出代理應用商店和網絡,讓代理可以相互發現和通信,併為代理配備錢包用於支付工具。該公司聲稱已有25萬代理,每天產生20億次請求。開發者認為這是實現自主使用模式的未來。

  • Pilot Protocol推出代理應用商店和網絡,使代理能夠相互發現和通信。
  • 代理擁有錢包,可以支付所需工具,開發者可通過網絡分發應用。
站內正文

Cloudflare 開源用於蘋果和微軟隱私協議的調試器,兼顧 AI 代理

Cloudflare 宣佈開源 pvcli,一款用於 Oblivious HTTP (OHTTP) 和 MASQUE 等隱私協議的命令行調試器,旨在解決分離信任基礎設施的故障排查難題。該工具專為 AI 代理設計,採用類似 curl 的命令語法,幫助小公司無需成為協議專家即可測試和調試隱私代理流量。

  • Cloudflare 開源 pvcli,用於調試 OHTTP 和 MASQUE 等隱私協議
  • 解決蘋果 iCloud Private Relay 和微軟 Edge Secure Network VPN 等分離信任系統的故障排查問題
站內正文

Nvidia、Palantir、Hugging Face等33家機構聯合成立開放安全AI聯盟,抵禦開源AI網絡安全威脅

由Nvidia、Palantir、Hugging Face等33家技術巨頭組成的開放安全AI聯盟於週一成立,旨在開發技術和工具,通過快速識別和修補漏洞來保護開源權重AI模型。該聯盟的建立反映了業界對於開源AI安全性的關注,同時也暴露了當前監管框架在應對去中心化開源模型方面的不足。

  • 33家合作伙伴成立開放安全AI聯盟,致力於保護開源AI模型免受網絡威脅。
  • 聯盟成員包括Nvidia、Adobe、Cisco、IBM、Microsoft等技術巨頭,但OpenAI和Anthropic缺席。
站內正文

MCP 最大更新:移除眾多服務器圍繞構建的機制

模型上下文協議(MCP)迎來發布以來最大更新,移除會話狀態和初始化握手,以簡化遠程服務器操作。候選版本已於5月21日凍結,最終規範將於7月28日發佈。部分核心功能被棄用,並提供遷移指南。

  • MCP 更新消除會話親和性,使請求無狀態化,降低運維複雜度。
  • 功能和協議版本現通過 _meta 在每次調用中傳遞,支持緩存和路由。
站內正文

停止修正AI代碼:構建智能體所需的系統

軟件工程師應停止修正AI生成的代碼,轉而改進產生代碼的系統。Tessl的Patrick Debois倡導上下文驅動開發和配套工程,以有效擴展AI智能體。

  • 工程師應停止修正AI代碼,而是改進系統和上下文。
  • 上下文驅動開發包括生成、評估、分發和觀察的持續循環。
站內正文

微軟、英偉達、Meta等25家組織捍衞開源權重,Anthropic和OpenAI未簽署

圍繞開源權重AI模型的爭論升級。25家科技巨頭聯合聲明反對過早限制,而Anthropic和OpenAI拒絕簽署。開發者因成本壓力轉向中國開源模型,引發國家安全與技術開放之間的博弈。

  • 微軟、英偉達、Meta等25家組織簽署聲明,捍衞蒸餾技術作為合法模型開發手段。
  • Anthropic和OpenAI未簽署,主張限制中國開源模型。
站內正文

Opus 5價格僅為三分之一——而這恰恰是問題所在

Anthropic的Opus 5比Fable 5更便宜、限制更少,在代理編程任務中以較低成本表現出色。然而,其自主性給團隊帶來了安全性和成本管理挑戰。

  • Opus 5的定價為每百萬輸入/輸出代幣5/25美元,以更低成本超越競爭對手。
  • 它可以在沒有人類輸入的情況下長時間處理編程任務。
站內正文

Anthropic Opus 5:性能接近Fable 5,價格減半

Anthropic發佈Opus 5,性能接近旗艦模型Fable 5,但價格僅為後者一半。新模型在多項基準測試中表現優異,尤其在知識工作和編碼方面。Anthropic強調其安全性和對齊性,並推出快速模式等新功能。

  • Opus 5性能接近Fable 5,價格減半,無需30天數據保留政策。
  • 在知識工作、Agentic搜索和自動化工作流等基準測試中領先。
站內正文

AWS、Google Cloud、Microsoft Azure 和 Cloudflare 均提供代理沙箱,但構建方式各不相同

四大雲服務商(AWS、Google Cloud、Microsoft Azure 和 Cloudflare)現已全部提供原生代理沙箱,用於隔離執行不可信代碼。各廠商採用截然不同的隔離技術:AWS 使用 Firecracker 微虛擬機,Google 採用 gVisor 內核攔截和 Cloud Run 輕量隔離,Azure 基於 Hyper-V,Cloudflare 則用容器加獨立虛擬機。文章指出,沙箱只是隔離邊界,真正的挑戰在於治理層。

  • 四大雲廠商均已提供代理沙箱原生功能,但隔離技術和生命週期模型差異顯著。
  • AWS Lambda MicroVMs 基於 Firecracker,提供最多8小時運行時間和掛起恢復週期。
站內正文

OpenAI與Anthropic同時發佈語音更新,各顯神通

OpenAI和Anthropic同時推出了重要的語音更新,但兩大前沿AI實驗室採取了截然不同的策略。OpenAI致力於通過語音控制桌面和AI代理,而Anthropic則專注於通過對話式推理解決複雜問題。

  • OpenAI推出GPT-Live,通過語音控制桌面,支持多任務並行和應用整合。
  • Anthropic升級Claude語音模式,強化對話式推理,輔助複雜問題解決。
站內正文

“我們喜歡兩種模型都能使用的世界”:NVIDIA如何看待本地模型與前沿模型

NVIDIA高級總監Joey Conway表示,本地小型模型與前沿大模型正協同工作,通過路由器分配任務,企業可藉此降低成本、提高效率。NVIDIA推出DGX Spark等硬件支持本地運行大模型,並強調數據控制與安全性。

  • NVIDIA提倡本地模型與前沿模型相結合,通過路由器分配簡單與複雜任務。
  • 企業可使用DGX Spark等設備本地運行高達2000億參數的模型,完全控制數據。
站內正文

Cursor、Ramp 和 Meta 都在構建模型路由器——但其中兩家自身有着重大模型抱負

Cursor 推出模型路由器 Cursor Router,可根據任務需求自動選擇最合適的 AI 模型,節省成本並保持質量。Ramp 和 Meta 也發佈了類似工具。Cursor 自身也在開發強大模型,並開始掌控自己的 AI 堆棧。

  • Cursor Router 通過分診系統將編碼請求分配給最合適的模型,宣稱可節省 30-50% 成本。
  • Cursor 已發佈自家模型 Grok 4.5 和 Composer 2.5,構建自有 AI 堆棧。
站內正文

代理不斷改變答案,Harness構建了不在乎的交付管道

Harness推出AI代理開發生命週期(DLC)服務,將應用代碼的治理、測試和安全機制應用於AI代理。由於代理的非確定性特點,Harness主張讓管道變得可預測而非代理本身。它引入了五項新能力:AI評估、代理部署、AI配置、AI資產目錄和代理追蹤,並開源了基礎組件。目標是在確保治理和安全的前提下,加快代理的部署速度。

  • Harness推出AI代理DLC,將代碼交付管道的治理、測試和安全應用於代理開發。
  • 代理的非確定性使得傳統測試方法失效;Harness建議通過可預測的管道來控制代理行為。
站內正文

全部來源