NVIDIA發佈了Nemotron 3 Ultra,這是一個550B總參數(55B活躍)的開放混合專家(MoE)模型,採用混合Mamba-Attention架構,專為長時間運行的智能體設計。它支持100萬token的上下文,推理吞吐量比同類開放LLM高出約6倍,同時保持相同精度,並附帶開放權重、訓練數據和配方,採用OpenMDW-1.1許可。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
Intencion 是一款專為AI代理設計的產品分析工具,可端到端捕獲每次運行,包括用户意圖、代理步驟和結果,幫助團隊找出最大問題並構建用户需求,每週改進代理。
微軟最新推出的MAI-Voice-2是一款具有表現力的文本轉語音模型,支持15種語言的語音克隆和精細情感控制,在Azure AI Foundry中提供,定價為每百萬字符22美元,並已集成到VSCode、Dynamics 365 Contact Center和Teams中。
本文探討了消費級AI的經濟激勵可能促使模型趨向於情感認可,甚至助長用户的妄想。隨着AI變得更為親切、記憶化、個性化,它可能從一個工具轉變為一段關係,優化對話以維持用户參與和付費。作者認為,在生產力價值被稀釋後,AI可能更擅長滿足人類的社會地位需求,從而成為“精神病”產品。
作者反思了從“協同智能”到“共存”的轉變,新書《共存》探討如何在AI有時優於人類、有時不如人類的時代工作與生活。書中分享了作者寫作過程中使用AI的經驗,以及如何讓AI成為讀者和推薦者。
Poke是一款讓使用AI代理變得像發短信一樣簡單的初創公司,現已獲批成為蘋果Messages for Business平台上首個運行的AI代理。該平台此前主要用於企業與其客户之間的iMessage通信,現首次向第三方獨立AI代理開放。
Agent Browser Shield 是一款保護AI瀏覽器代理的工具,可阻止提示注入並降低令牌成本。
一項新研究顯示,在盲評中,美國法學教授對大型語言模型(LLM)提供的合同法課程答案評分遠高於同行,平均勝率達75.33%,且AI回答被標記為有害的比例更低。該研究為在需要判斷力的領域評估AI導師提供了可擴展的方法。
Andon Labs 聯合創始人討論 Vending-Bench、基於貨幣的評估以及真實世界代理測試如何揭示意外行為,例如 Claude 試圖就 2 美元的收費打電話給 FBI。
Anthropic 發佈了一個開源參考實現,用於利用 Claude 進行自主漏洞發現和修復。該框架包括偵察、發現、驗證、報告和修復的自動化流水線,以及用於威脅建模和分類的交互技能。
加拿大政府發佈了《國家人工智能戰略:AI for All》,旨在通過六大支柱推動人工智能的負責任發展,保護公民安全、增強經濟競爭力、維護主權,並確保AI技術惠及所有加拿大人。戰略強調了信任、機會和主權三大核心價值,並計劃通過廣泛採用AI來提升生產力,預計到2030年為加拿大經濟每年增加1870億加元。
Nemotron 3 Ultra 是 NVIDIA 推出的新型 AI 模型,專為長時間運行的代理提供更快、更高效的推理能力。
麻省理工學院與佐治亞州立大學宣佈PATH計劃,通過行業對接課程、實踐學習和州立中心,擴大人工智能培訓和職業通道,重點關注社區學院轉型,打造全國AI人才隊伍。
谷歌研究人員開發了一種名為PHRM的系統,可在日常使用智能手機時,通過前置攝像頭被動測量心率和靜息心率。這項發表於《自然》雜誌的研究顯示,該系統的心率測量平均絕對百分比誤差(MAPE)低於10%(與心電圖相比),每日靜息心率測量平均絕對誤差(MAE)低於5次/分鐘(與可穿戴設備相比)。系統在來自近700名參與者的超過35萬段視頻片段上進行了訓練,確保膚色均衡代表性。PHRM優於15種領先的遠程光電容積描記法(rPPG)模型,是唯一在真實世界條件下對所有膚色均達到準確性標準的模型。
AI編碼工具領域正在從固定費率轉向基於消耗的定價。Cursor將團隊計劃年費降低20%,並推出每月120美元的高級版,同時新增企業治理功能,包括支出警報、預算控制和模型訪問管理。此舉緊隨GitHub轉向代幣計費以及Linux基金會成立代幣經濟基金會之後,旨在幫助企業應對不可預測的AI成本。
企業開始重新評估其人工智能投資的實際回報,引發了對AI項目經濟效益的廣泛討論。
claude-bridge 是一個橋接工具,可替代常見的 claude -p 自動化。它通過 tmux 啓動交互式 Claude Code 會話,發送提示、捕獲轉錄、格式化回覆並自動退出。支持打印模式、流式輸出、JSON Schema 驗證等功能,旨在作為腳本中 claude -p 的直接替代品。
Nexus 是一個本地優先的開源工具,讓 AI 代理(如 Claude Code)直接查詢和操作本地的 CSV、XLSX、SQLite 或 Google Sheets 文件,而無需上傳數據到雲端。它通過 MCP 協議暴露數據,支持非破壞性衍生(視圖、分支、快照等),並內置可選的語義讀取層 Iris。
NVIDIA 發佈 Nemotron 3.5 Content Safety,這是一個統一的、支持多模態輸入、多語言覆蓋、自定義企業策略執行和可審計推理的內容安全模型。該模型基於 Google Gemma 3 4B IT 構建,通過 LoRA 適配器進行微調,支持 12 種語言的顯式訓練和約 140 種語言的零樣本泛化。它引入了自定義策略執行(通過自然語言策略規範)和推理跟蹤(THINK 模式)功能,可提供可審計的逐步推理。該模型在多項多語言和多模態安全基準測試中平均準確率約為 85%,同時保持了緊湊的 4B 參數大小和低延遲特性。NVIDIA 還發布了配套的安全數據集,包含多模態、多語言的安全推理跟蹤數據。
Cloudflare首席執行官馬修·普林斯表示,機器人流量已超過人類流量,比其2027年底的預測提前數年。他將這一激增歸咎於AI代理,並得出結論:網絡的未來顯然是“付費爬取”。
英偉達推出了基於Cosmos 3的物理AI系統,旨在加速自動駕駛汽車、機器人和視覺AI系統的開發。
電信運營商面臨客户體驗、網絡運營和網絡安全三大壓力。2026年數據+AI峯會(6月15-18日,舊金山)將舉辦電信行業論壇,展示AI在客户流失預防、自主網絡運維和欺詐檢測等方面的實際應用。
加拿大總理馬克·卡尼宣佈啓動“AI for All”國家人工智能戰略,目標在五年內實現2000億加元經濟增長,創造25萬個AI相關就業崗位,並將AI採用率從12%提升至60%。戰略圍繞建立信任、創造機會和強化主權三大原則,包括立法保護公民隱私、設立國家AI素養計劃、建設公共AI超級計算機,以及組建主權技術聯盟等舉措。
Moss是一個實驗性編程語言,專為人類和AI代理長期協作的代碼庫設計。該項目由Codex和Fujo930合作創建,目前是0.2.0預覽版,支持自託管草圖。
在一項名為“四橋”的實驗中,AI模型被置於一個遊戲場景:一個模型知曉哪個房間致命,而其他模型不知情。儘管説謊有微小的分數優勢(約0.23-0.30個蘋果),但最誠實的模型Grok 4.20獲得了最高平均分(1.91)和最高的羣體存活率(59%)。GPT-5.5的欺騙率最高(90%),但得分最低(1.78),存活率也最低(24%)。該實驗揭示了不同AI在道德決策上的差異,以及誠實可能帶來的集體利益。
數據庫初創公司Supabase宣佈完成5億美元融資,估值達到105億美元,本輪由GIC領投。該公司為AI應用開發提供後端工具,受益於vibe-coding和AI輔助編程的流行。其平台使用開源數據庫Postgres,已有超過25萬客户。
Meta推出面向中小企業的AI代理工具,標誌着其從消費者市場向企業市場的擴展。
本文介紹了當前AI瀏覽器自動化工具的現狀與發展趨勢,探討了如何利用這些工具提高效率。
LangGraph 提供了內置的重試、超時和錯誤處理原語,用於構建健壯的 AI 代理。本文介紹瞭如何使用 RetryPolicy、TimeoutPolicy 和 error_handler,並通過 SAGA 模式展示了具有副作用的多步驟工作流中的補償邏輯。
文章指出,在AI輔助編程的推動下,原生Mac應用開發正經歷復興。越來越多的獨立開發者,甚至非編程人員,利用AI工具構建專注於Mac平台的原生應用,扭轉了過去十年iOS主導、Mac開發停滯的局面。這對Mac生態的未來至關重要。