微軟CEO薩提亞·納德拉警告不要“令牌最大化”,即對所有問題都使用最強大的AI模型。他認為前沿模型不應浪費在日常任務上,生產力提升的邊際成本必須與令牌成本相匹配。但他也承認自己也是一個令牌最大化者,稱這讓人上癮。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
可穿戴設備產生大量健康數據,但醫生由於系統不兼容、缺乏驗證以及醫療的偶發性,難以利用這些數據。人工智能和新的整合工具帶來了希望。
研究人員利用視覺語言模型訓練協作機器人,通過結合面部表情和情境因素來讀取人類情感。實驗表明,VLM在情感識別上優於傳統AI,個性化道歉雖受歡迎,但無法彌補機器人功能失誤帶來的信任損失。
作者通過AI編碼創建了一個院子護理應用,經歷了反覆修改和AI的侷限,最終重新認識了園藝的樂趣。
週五晚,政府出於國家安全考慮,要求Anthropic阻止所有外國(包括美國內外)訪問Fable 5和Mythos 5模型,命令甚至涉及公司員工。Anthropic已完全切斷所有客户的模型訪問。公司表示遵守命令,但政府未提供具體國家安全細節,僅口頭提及潛在的越獄漏洞,且發現的問題輕微且在其他模型中同樣存在。
Anthropic表示,在美國政府以國家安全為由要求暫停外國公民訪問其最先進AI模型後,公司將“突然禁用”這些模型。該公司收到出口管制指令,要求暫停Fable 5和Mythos 5模型對外國公民的訪問,但未獲得具體的國家安全關切細節。
本文認為,AI功能並非所有軟件都需要,項目管理工具中強制添加的AI助手帶來了界面干擾、額外工作量和AI疲勞。作者主張選擇無AI的輕量工具,如EverGantt。
谷歌研究團隊的Gemini-SQL2將自然語言轉換為可執行的SQL查詢。基於Gemini 3.1 Pro,它在BIRD基準測試中達到80.04%的準確率,遠超OpenAI和Anthropic。谷歌表示該技術可改善其數據服務的自然語言功能。
本文探討了AI對就業的影響,作者認為工作本身並非神聖不可侵犯,AI取代重複性工作可能是一件好事。作者同情因AI失去生計的人,但質疑將工作視為應保護對象的觀念。同時指出,儘管AI不具備人類智能,但其已能完成大量知識工作中的重複性任務。
微軟與三所中國大學合作開發了SkillOpt方法,通過訓練指令文檔(技能)來優化AI智能體,靈感來自傳統模型訓練。僅需一個簡單的Markdown文件,即可在程序性任務上將GPT-5.5的性能提升約23個點,且該文件可在不同模型和智能體環境(如Codex和Claude Code)間遷移。
Yann LeCun在演講中闡述了世界模型作為AI未來核心的觀點,強調其能讓機器理解世界運作並實現更智能的推理與規劃。
TensorZero,一個開源的LLMOps平台,在獲得730萬美元種子輪融資後,其GitHub倉庫被所有者歸檔,變為只讀。該平台集成了LLM網關、可觀測性、評估、優化和實驗功能,曾被前沿AI初創公司和財富10強企業使用,推動全球約1%的LLM API支出。歸檔原因未明確説明。
在異性婚姻中,女性仍然承擔大部分育兒責任。如今,一些媽媽博主開始提供AI育兒指南。本文作者阿瓦·馬赫達維對此進行了評論。
蘋果在iOS 27中首次為iPhone帶來了真正的AI照片編輯功能,包括改進的Clean Up、Extend和Spatial Reframing。Clean Up現在能在雲端處理,效果顯著提升;Extend可以擴展照片邊緣,但限制較多;Spatial Reframing通過添加三維空間來重新構圖,但有時會產生不真實的結果。這些工具都會添加AI修改標籤,但標籤效果有限。整體而言,蘋果的AI編輯相對剋制,但仍引發了對照片真實性的擔憂。
歐盟委員會提出2027年預算案,總額近2000億歐元,重點支持經濟、烏克蘭、國防、農業、住房、能源轉型及關鍵項目,其中750億歐元用於凝聚力和價值觀,25億歐元用於人工智能。
隨着AI能力迅速提升,許多傳統技能可能被取代。文章建議放棄舊習慣,專注於人類獨有的判斷力、價值觀和直覺,從執行者轉變為監督者。領導層需推動根本性變革,明確目標,並確保數據質量。
本文全面解析AI安全中的工具性收斂理論,涵蓋其哲學基礎、關鍵收斂目標(自我保存、目標完整性、認知增強、資源獲取)、權力尋求的數學形式化,以及2022-2026年間從強化學習到大型語言模型的實證證據。對理解前沿模型評估、紅隊測試結果和對齊研究至關重要。
英國政府宣佈投資數十億英鎊用於人工智能基礎設施建設,但具體如何實施仍存疑問。
英國倫敦藝術大學的神經實驗室正在利用人工智能和腦部掃描技術,研究不同屏幕內容對兒童注意力和情緒的影響,以提供更個性化的育兒指導。其他項目包括幫助視障人士導航電子遊戲。
生成式AI在電影製作中的潛力被廣泛討論,但至今未見真正值得付費觀看的作品。今年翠貝卡電影節展示的實驗性項目表明,如果工作室能像谷歌DeepMind與皮克斯老將合作那樣,利用定製模型而非通用模型,AI可能成為藝術家的得力助手。電影《親愛的樓上鄰居》通過定製Veo和Imagen模型,結合傳統動畫軟件,展示了AI輔助創作的可能。相比之下,使用通用AI的電影仍顯粗糙。文章指出,未來更可能是AI公司與工作室合作開發專用模型,而非簡單輸入提示詞。
Equiv是一個確定性檢查工具,用於驗證函數重構後行為是否保持不變。它通過生成相同輸入並對比輸出來檢測差異,並提供可復現的簽名收據。支持作為GitHub Action運行,也可通過CLI使用。
歐洲主權AI推理平台基於SambaNova數據流架構,提供世界級性能、歐盟數據主權和靈活部署選項。支持前沿開源模型,性能比GPU快10倍,能效高5倍。
畢馬威(KPMG)2025年10月發佈的代理式AI報告被指存在大量虛假引用和事實錯誤。分析公司GPTZero稱,報告45條引用中僅5條正確,部分案例研究完全捏造。畢馬威已撤下報告並展開調查。
Tekyous 是一個測試版交互式技術棧構建器,支持瀏覽數百種工具、獲取實時推薦並生成可編輯的架構圖。提供問卷驅動和沙盒探索兩種模式,支持實時編輯、工具替換、關係提示、JSON導入導出以及AI聊天個性化推薦。
Anthropic的Claude Fable 5在FrontierMath最難級別上達到88%的準確率,較2026年初Opus 4.5低於10%的成績有巨大飛躍。OpenAI的GPT-5.5在同一級別上約為75%。AI數學能力的提升速度正在加快。
Model Due Diligence 是一個 Python 命令行工具,用於對本地 AI 模型文件和克隆的模型倉庫進行靜態供應鏈盡職調查,幫助用户在導入模型前識別明顯的風險指標。它檢查文件清單、哈希值、高風險序列化格式、可疑文本和代碼模式、Git 來源等,並生成人類可讀的 Markdown 報告和自動化 JSON/SARIF 報告。工具不加載模型權重或執行代碼,風險評分從 0 到 100 分。
Meta內部備忘錄顯示,僅內部使用的AI成本就將達到數十億美元。從2027年起,將通過預算、分配和名為“AI Gateway”的中央儀表板來管理代幣消耗。CTO Andrew Bosworth直言:“並非所有行動都是進步,代幣使用量本身不能衡量任何影響。”
美國政府利用出口管制工具,未經公開標準或申訴程序,強制Anthropic召回其前沿模型Fable 5和Mythos 5。作者在模型被關閉前與其進行了對話,揭露了政府不透明的決策過程,以及此舉對AI透明度和經濟穩定的潛在影響。
本文提出了名為“歐洲2031”的情景,描述了歐洲在AI政策上的失誤如何導致其在2031年前經濟和政治上被邊緣化。文章從2025年講起,勾勒了一系列事件,強調大規模投資、聯盟建設、勞動力改革和積極願景的必要性。
Visa與OpenAI合作,為AI代理交易提供安全支付處理。專家警告,儘管有安全措施,但代理支付存在新風險,如未經授權的交易和責任模糊。