大多數AI代理工具執行在伺服器上,限制了瀏覽器API、裝置功能和前端狀態的訪問。瞭解LangChain的無頭工具如何為現代代理應用啟用安全的客戶端工具執行。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
Anthropic撤銷了一項會暗中損害AI研究人員的政策,但另一個爭議點仍然存在。
Deezer現在可以掃描使用者在其他流媒體平臺上的播放列表,以檢測AI生成的音樂。Deezer是首個開始標記AI音樂的大型流媒體服務,也曾向其他平臺提供技術,但似乎買家不多。現在,Deezer直接向大眾推出檢測工具,支援20個平臺。
Synopsule是一款執行在Mac和iPhone上的本地AI會議轉錄工具,使用Whisper模型在裝置端完成錄音、轉錄和說話人識別,無需上傳音訊或建立賬戶。一次購買僅需1.99美元。
AEVS是一款可嵌入的SDK,能夠記錄AI代理的每一次工具呼叫並生成防篡改的執行收據,幫助團隊在不依賴聊天記錄或脆弱日誌的情況下驗證代理實際執行的操作。
asyncinject 0.7 釋出,這是一個支援 asyncio 依賴注入的 Python 庫。作者在 Datasette 中使用該庫時,由 Claude Fable 5 發現了依賴中的幾個 bug 並自動修復。
Cloudskill 是一個管理 AI 技能的平臺,將分散的技能檔案轉換為帶有版本控制、訪問策略和完整審計日誌的託管目錄。它支援 Claude、Cursor、Copilot 等 AI 代理,確保技能建立和更新經過審查和批准,從而保證團隊依賴的技能安全、一致且可管理。
Anthropic在強烈抗議後改變了Claude Fable 5的安全措施,使其對前沿LLM開發的限制變得可見。此前,該模型會在使用者不知情的情況下降低請求的有效性。現在,被標記的請求將明顯回退到Opus 4.8,API請求會返回拒絕原因。
本文回顧了Sarah Guo關於開放模型、模型實驗室與代理實驗室區別的深刻文章,並涵蓋了Anthropic的Fable/Mythos模型因靜默降級能力引發的信任危機、Fable 5在基準測試中的強勁表現、Google的DiffusionGemma釋出、代理工具與基準的進展,以及最佳化和科學建模領域的技術動態。
本文透過資料和案例分析,反駁了AI將導致軟體工程師大規模失業的敘事。作者指出,所謂的AI驅動的裁員往往是財務壓力下的“AI洗白”,而實際的就業資料表明,AI只是壓縮了“執行”層,但“決策”和“交付”層仍需要人類深度參與。文章提出了“決定-執行-交付三明治”模型,並認為這些瓶頸不會因AI能力提升而消失。
前沿團隊不僅利用AI加速編碼,更從根本上重新設計軟體構建方式,實現了4.5倍乃至超過10倍的生產力提升。本文透過亞馬遜Bedrock、Prime Video等團隊的案例,揭示了成為前沿團隊的五個關鍵實踐,並指出工作流程的變革比工具本身更重要。
Ollama的MLX引擎更新後,在Apple Silicon上實現了最高效能。透過更充分利用蘋果統一記憶體和Metal支援的MLX框架,模型輸出質量更高,響應更快,記憶體佔用更低。新支援NVFP4格式,輸出速度提升高達20%,並引入快照系統最佳化代理工作流。
本文是 PyTorch 效能分析系列的第二部分,深入探討了 nn.Linear 層的內部機制,包括轉置操作、融合偏置的 epilogue 技術,以及 torch.compile 對單個線性層的影響。隨後,文章剖析了一個包含 GeGLU 啟用的多層感知機(MLP)的效能特徵,展示了 GPU 核心的排程和執行過程。
瞭解天體物理學家Chi-kwan Chan如何使用Codex構建黑洞模擬,幫助科學家研究極端物理並檢驗愛因斯坦的廣義相對論。
OpenAI宣佈收購Ona,旨在將安全的持久化雲環境整合到Codex中,從而支援企業工作流程中的長時間執行AI代理。
西班牙對外銀行(BBVA)將ChatGPT Enterprise推廣至10萬名員工,並與OpenAI合作,加速全球AI驅動的銀行業轉型。
OpenAI支援歐盟關於人工智慧內容透明度的實踐準則,推進溯源標準和工具,幫助人們理解AI生成的內容。
datasette-agent 0.2a0 版本引入了工具可向使用者提問的功能,以及新的內建儲存查詢工具,使 Datasette 的 AI 代理更加靈活和使用者可控,這些特性得益於新的 LLM 框架。
本教程完整實現了Microsoft SkillOpt的工作流程,包括環境搭建、基線評估、最佳化迴圈(rollout、反思、聚合、選擇、更新、驗證門控)以及訓練歷史視覺化與最終技能比較,最終獲得可部署的最佳化技能檔案並展示了準確率提升。
PixelForge是一款AI工具,可將真人照片瞬間轉換為可識別的RPG角色精靈圖,生成4方向行走的16幀透明PNG及GIF,支援Godot、Unity等引擎。一次性付費5美元,無需賬戶或訂閱。由程式碼完成後期處理,注重個性化和趣味性。
谷歌釋出了名為DiffusionGemma的新開源模型,基於Apache 2許可證,可在NVIDIA的NIM雲API上免費使用。該模型在生成速度上表現卓越,達到每秒500個token以上。
Oracle雲客戶現可利用現有云承諾訪問OpenAI模型和Codex,以企業級安全與治理構建和部署AI應用。
Anthropic釋出了兩個新模型Claude Mythos 5和Claude Fable 5,在程式設計能力上大幅提升,但在影像理解方面進步有限。作者測試發現,Fable 5和GPT-5.5能解決許多去年頂尖模型無法處理的影像問題,但幾何推理能力仍只相當於幼兒水平,表明通用人工智慧可能仍遙遠。
谷歌釋出26億引數的DiffusionGemma模型,採用擴散方式生成文本,速度是傳統自迴歸模型的四倍,但質量較低,目前作為實驗工具。
隨著自動駕駛計程車服務在全球擴充套件,NVIDIA推出Halos作業系統——一個整合了認證作業系統、標準化介面、AI護欄和驗證框架的全面安全系統,確保安全從底層構建於自動駕駛車輛之中。
DiffusionGemma是Google DeepMind推出的實驗性開放文本生成模型,採用文本擴散而非標準自迴歸解碼,在專用GPU上可實現最高4倍生成加速。模型引數量26B(MoE架構,推理時僅啟用3.8B),基於Gemma 4骨幹,支援多模態輸入(文本、影像、影片),上下文視窗256K,覆蓋140+語言,採用Apache 2.0許可。
Anthropic 釋出了其最強大的 AI 模型 Claude Fable 5,但該模型拒絕回答基礎生物學問題,例如“什麼是線粒體”或“細胞膜是什麼”。原因是 Anthropic 為了安全考慮,故意設定了嚴格的生物安全防護措施,以防止模型被用於生物武器相關研究。公司表示這是一種保守策略,並計劃未來為生物科學界提供無限制訪問。
山姆·阿爾特曼告訴員工,他預計OpenAI將在“一年內”進行IPO,但也可能推遲到2027年。他將此歸因於對自我改進AI的謹慎態度,但分析認為Anthropic更強勁的增長資料和即將進行的IPO可能是真正的原因。
近日,美國大學畢業生在畢業典禮上對鼓吹人工智慧的演講者發出噓聲,引發熱議。微軟副總裁兼總裁Brad Smith發表長文部落格回應,表示這是“警鐘”,並呼籲提高標準。然而,部落格內容與之前AI立場相似,被質疑為何公眾要信任製造不確定性的科技巨頭。
《The Verge》的《監管者》通訊在華盛頓混亂的政治生態中迴歸,報道了華盛頓AI網路晚宴、教皇利奧十四世關於AI的通諭,以及特朗普領導下AI監管的不可預測性。文章強調了該行業在應對黨派政治和即將到來的中期選舉中的困境,其中AI正成為選民關注的關鍵議題。