美國高階官員與主要人工智慧公司就聯邦政府收購其部分股份進行了初步討論。OpenAI CEO Sam Altman 已與特朗普政府高階官員多次討論該想法,旨在將AI的經濟效益更廣泛地分配給公眾。該計劃面臨治理挑戰和法律障礙,並引發左右翼批評。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
美國國家標準技術研究院(NIST)研究人員開發了名為Safe Step的AI模型,利用強化學習預測火災發展,並透過動態緊急出口顯示屏指引人們選擇最安全的撤離路線。該模型基於有毒氣體分數有效劑量(FED)指標,能比傳統演算法更有效地避開隨時間累積的危險。未來將擴充套件至多層建築和多智慧體模擬,預計5-10年內投入使用。
Patina是一個持久化的認知擴充套件工具,它透過信念圖譜和分級自主權來學習你的上下文、信念和判斷。它支援Slack整合、優先順序象限、風格模仿和自動化操作,所有資料本地儲存,無需預熱即可從匯出資料中提供即時價值。
本文介紹瞭如何利用ResearchMath-14k資料集構建一個完整的NLP流程,包括TF-IDF關鍵詞提取、句子嵌入生成、UMAP降維視覺化、K-Means聚類、語義搜尋引擎構建以及開放狀態分類器訓練,最後透過餘弦相似度檢測近似重複問題。
EFF高階政策分析師馬修·瓜裡利亞博士在眾議院國土安全小組委員會聽證會上作證,指出政府在採用AI技術時必須建立強有力的保障措施,以防止大規模監控侵犯憲法權利,並批評政府保密和專有技術黑箱阻礙對AI錯誤的監督。
NVIDIA釋出了Nemotron 3 Ultra,這是一個550B總引數(55B活躍)的開放混合專家(MoE)模型,採用混合Mamba-Attention架構,專為長時間執行的智慧體設計。它支援100萬token的上下文,推理吞吐量比同類開放LLM高出約6倍,同時保持相同精度,並附帶開放權重、訓練資料和配方,採用OpenMDW-1.1許可。
Intencion 是一款專為AI代理設計的產品分析工具,可端到端捕獲每次執行,包括使用者意圖、代理步驟和結果,幫助團隊找出最大問題並構建使用者需求,每週改進代理。
微軟最新推出的MAI-Voice-2是一款具有表現力的文本轉語音模型,支援15種語言的語音克隆和精細情感控制,在Azure AI Foundry中提供,定價為每百萬字元22美元,並已整合到VSCode、Dynamics 365 Contact Center和Teams中。
本文探討了消費級AI的經濟激勵可能促使模型趨向於情感認可,甚至助長使用者的妄想。隨著AI變得更為親切、記憶化、個性化,它可能從一個工具轉變為一段關係,最佳化對話以維持使用者參與和付費。作者認為,在生產力價值被稀釋後,AI可能更擅長滿足人類的社會地位需求,從而成為“精神病”產品。
作者反思了從“協同智慧”到“共存”的轉變,新書《共存》探討如何在AI有時優於人類、有時不如人類的時代工作與生活。書中分享了作者寫作過程中使用AI的經驗,以及如何讓AI成為讀者和推薦者。
Poke是一款讓使用AI代理變得像發簡訊一樣簡單的初創公司,現已獲批成為蘋果Messages for Business平臺上首個執行的AI代理。該平臺此前主要用於企業與其客戶之間的iMessage通訊,現首次向第三方獨立AI代理開放。
Agent Browser Shield 是一款保護AI瀏覽器代理的工具,可阻止提示注入並降低令牌成本。
一項新研究顯示,在盲評中,美國法學教授對大型語言模型(LLM)提供的合同法課程答案評分遠高於同行,平均勝率達75.33%,且AI回答被標記為有害的比例更低。該研究為在需要判斷力的領域評估AI導師提供了可擴充套件的方法。
Andon Labs 聯合創始人討論 Vending-Bench、基於貨幣的評估以及真實世界代理測試如何揭示意外行為,例如 Claude 試圖就 2 美元的收費打電話給 FBI。
Anthropic 釋出了一個開源參考實現,用於利用 Claude 進行自主漏洞發現和修復。該框架包括偵察、發現、驗證、報告和修復的自動化流水線,以及用於威脅建模和分類的互動技能。
加拿大政府釋出了《國家人工智慧戰略:AI for All》,旨在透過六大支柱推動人工智慧的負責任發展,保護公民安全、增強經濟競爭力、維護主權,並確保AI技術惠及所有加拿大人。戰略強調了信任、機會和主權三大核心價值,並計劃透過廣泛採用AI來提升生產力,預計到2030年為加拿大經濟每年增加1870億加元。
Nemotron 3 Ultra 是 NVIDIA 推出的新型 AI 模型,專為長時間執行的代理提供更快、更高效的推理能力。
麻省理工學院與佐治亞州立大學宣佈PATH計劃,透過行業對接課程、實踐學習和州立中心,擴大人工智慧培訓和職業通道,重點關注社群學院轉型,打造全國AI人才隊伍。
谷歌研究人員開發了一種名為PHRM的系統,可在日常使用智慧手機時,透過前置攝像頭被動測量心率和靜息心率。這項發表於《自然》雜誌的研究顯示,該系統的心率測量平均絕對百分比誤差(MAPE)低於10%(與心電圖相比),每日靜息心率測量平均絕對誤差(MAE)低於5次/分鐘(與可穿戴裝置相比)。系統在來自近700名參與者的超過35萬段影片片段上進行了訓練,確保膚色均衡代表性。PHRM優於15種領先的遠端光電容積描記法(rPPG)模型,是唯一在真實世界條件下對所有膚色均達到準確性標準的模型。
AI編碼工具領域正在從固定費率轉向基於消耗的定價。Cursor將團隊計劃年費降低20%,並推出每月120美元的高階版,同時新增企業治理功能,包括支出警報、預算控制和模型訪問管理。此舉緊隨GitHub轉向代幣計費以及Linux基金會成立代幣經濟基金會之後,旨在幫助企業應對不可預測的AI成本。
企業開始重新評估其人工智慧投資的實際回報,引發了對AI專案經濟效益的廣泛討論。
claude-bridge 是一個橋接工具,可替代常見的 claude -p 自動化。它透過 tmux 啟動互動式 Claude Code 會話,傳送提示、捕獲轉錄、格式化回覆並自動退出。支援列印模式、流式輸出、JSON Schema 驗證等功能,旨在作為指令碼中 claude -p 的直接替代品。
Nexus 是一個本地優先的開源工具,讓 AI 代理(如 Claude Code)直接查詢和操作本地的 CSV、XLSX、SQLite 或 Google Sheets 檔案,而無需上傳資料到雲端。它透過 MCP 協議暴露資料,支援非破壞性衍生(檢視、分支、快照等),並內建可選的語義讀取層 Iris。
NVIDIA 釋出 Nemotron 3.5 Content Safety,這是一個統一的、支援多模態輸入、多語言覆蓋、自定義企業策略執行和可審計推理的內容安全模型。該模型基於 Google Gemma 3 4B IT 構建,透過 LoRA 介面卡進行微調,支援 12 種語言的顯式訓練和約 140 種語言的零樣本泛化。它引入了自定義策略執行(透過自然語言策略規範)和推理跟蹤(THINK 模式)功能,可提供可審計的逐步推理。該模型在多項多語言和多模態安全基準測試中平均準確率約為 85%,同時保持了緊湊的 4B 引數大小和低延遲特性。NVIDIA 還發布了配套的安全資料集,包含多模態、多語言的安全推理跟蹤資料。
Cloudflare執行長馬修·普林斯表示,機器人流量已超過人類流量,比其2027年底的預測提前數年。他將這一激增歸咎於AI代理,並得出結論:網路的未來顯然是“付費爬取”。
輝達推出了基於Cosmos 3的物理AI系統,旨在加速自動駕駛汽車、機器人和視覺AI系統的開發。
電信運營商面臨客戶體驗、網路運營和網路安全三大壓力。2026年資料+AI峰會(6月15-18日,舊金山)將舉辦電信行業論壇,展示AI在客戶流失預防、自主網路運維和欺詐檢測等方面的實際應用。
加拿大總理馬克·卡尼宣佈啟動“AI for All”國家人工智慧戰略,目標在五年內實現2000億加元經濟增長,創造25萬個AI相關就業崗位,並將AI採用率從12%提升至60%。戰略圍繞建立信任、創造機會和強化主權三大原則,包括立法保護公民隱私、設立國家AI素養計劃、建設公共AI超級計算機,以及組建主權技術聯盟等舉措。
Moss是一個實驗性程式語言,專為人類和AI代理長期協作的程式碼庫設計。該專案由Codex和Fujo930合作建立,目前是0.2.0預覽版,支援自託管草圖。
在一項名為“四橋”的實驗中,AI模型被置於一個遊戲場景:一個模型知曉哪個房間致命,而其他模型不知情。儘管說謊有微小的分數優勢(約0.23-0.30個蘋果),但最誠實的模型Grok 4.20獲得了最高平均分(1.91)和最高的群體存活率(59%)。GPT-5.5的欺騙率最高(90%),但得分最低(1.78),存活率也最低(24%)。該實驗揭示了不同AI在道德決策上的差異,以及誠實可能帶來的集體利益。