攻擊者正在利用ChatGPT和Claude的聊天共享功能,通過偽裝成錯誤消息或安裝指南的共享對話傳播惡意軟件。這些對話託管在可信域名上,因此能繞過安全工具檢測。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
OpenAI的Codex應用現在支持Windows 11的“計算機使用”功能,AI能獨立控制程序、測試應用並尋找漏洞。即使用户不在電腦前,也可通過ChatGPT手機應用遠程啓動和監控任務。
本文介紹了名為“Generalist”的YouTube頻道,該頻道專注於開發適用於物理世界的通用人工智能。
大型語言模型(LLM)正在改變重寫過時開源項目的成本效益。一家公司正在用Zig重寫CRIU,預計幾個月內完成,而非數年。文章探討了開源項目過時的原因、AI如何改變重寫的數學原理,以及這對軟件生態系統的意義。
Boox Go 10.3 Lumi(第二代)和 ReMarkable Paper Pure 擁有相同尺寸的顯示屏,但定位截然不同。前者是一款多功能設備,支持Android生態系統和背光,適合閲讀電子書;後者則專注於無干擾工作,啓動快速且具備屏幕共享功能。本文詳細對比了它們的規格、優缺點及適用場景。
Neme Journal是一款緩慢、深思熟慮的日常日記應用,集成AI以幫助用户捕捉他們的信號。
一位系統架構師反思AI編碼工具(如Codex和Claude)如何通過提供即時的多巴胺獎勵來消除學習過程中的掙扎,但代價是犧牲了開發者的直覺和品味。文章以蝴蝶破繭的比喻説明,過早的幫助會讓蝴蝶失去飛翔的力量,同樣,跳過困難階段的編碼代理可能讓開發者無法建立深層心智模型。
Salesforce表示,其整個開發團隊已遷移至Anthropic的Claude Code,無令牌限制,並報告2026年4月的巨大生產力提升:每位開發者的拉取請求增加79%,事故減少5%。這些數字無法獨立驗證。該案例凸顯了編程界對AI代理革命的分歧:是真正的革命還是最大的技術債務積累?
非營利AI研究基金會Aithos開發的LARA工具對主流大語言模型進行歐盟法規合規性測試,結果顯示所有模型均不合格,最差模型在93%場景中違法。測試涉及GDPR和EU AI Act下的數據保護、操縱、情感推斷等場景。開發者若基於這些模型構建AI代理,需自行承擔法律責任。
本文探討了AI代理在編碼中的實際應用,作者分享了三種不同的代理編碼方法:1) 啓動多個命令行界面,2) 以無頭模式運行AI CLI,3) 讓一個LLM自行創建和管理子代理。作者傾向於第二種方法,並討論了代理是否需要、多代理協作的挑戰以及未來計劃。
Genesis AI 於2026年5月27日發佈 Genesis World 1.0,這是一個包含物理引擎、渲染器、編譯器和仿真接口的四組件仿真平台。該系統在14個任務、每個任務200個episode的測試中,實現了0.8996的皮爾遜相關性,並將策略評估時間從超過200小時縮短至0.5小時以內。
AI-org是一個基於AI的Org-Mode任務管理器,支持純文本、本地優先、Git同步,並強調‘行動勝於完美’的理念。它通過自然語言交互實現任務管理、時間跟蹤和每週回顧。
Meta在AI領域投入數十億美元,但商業回報甚微。其開源策略未達預期,研究成果也未能轉化為上市產品。如今,該公司將希望寄託於AI硬件,包括AI吊墜、超級感應眼鏡和企業可穿戴設備。
Yi Tay是Google DeepMind的研究科學家,帶領團隊讓Gemini Deep Think獲得IMO金牌。但他在AI研究之外,還是一位鋼琴高手,曾獲得倫敦聖三一學院古典鋼琴演奏副學士文憑。本文講述了他的AI研究之路和音樂才華。
Gamma-World由NVIDIA與清華等機構提出,通過單純形編碼和稀疏樞紐注意力,實現多智能體世界模型的高效交互與對稱表示,支持零樣本擴展到更多玩家,並遷移至真實機器人場景。
一家匿名企業因未對員工許可證設置使用上限,一個月內在Anthropic的Claude AI平台上燒掉了5億美元。這一事件揭示了基於令牌的AI定價模式在沒有監管時可能造成的財務災難,以及企業中“令牌最大化”現象的興起。
英偉達CEO黃仁勳表示,由於美國出口限制,公司已基本將中國AI芯片市場讓給華為。儘管季度業績強勁,但英偉達在中國的銷售前景有限。
據報道,一家未具名公司因系統錯誤或管理失誤,在一個月內意外消耗了5億美元使用Claude AI服務,引發了行業對AI成本控制的關注。
Gigacatalyst 是一個AI構建器,學習您的API並嵌入產品中,使銷售和客户成功團隊能夠為非技術用户構建缺失的功能,支持長尾工作流程,無需工程師參與。
作者通過親身經歷的兩次事件——車禍肇事者的道歉短信和修理工的報價回覆——發現它們都呈現出同一種AI特有的文風。儘管調查顯示人們普遍不信任AI生成的內容,但AI寫作仍在日常工作、個人通信甚至嚴肅文學領域迅速蔓延。本文剖析了AI寫作看似完美實則缺乏思考與判斷的本質,指出其高效背後隱藏着邏輯矛盾與事實錯誤,並警示這種趨勢可能使人類寫作淪為少數人的手工技藝。
據報道,Meta計劃在未來一年內測試一款AI掛墜,並擴大智能眼鏡產品線,推出名為“Wearables for Work”的企業服務,以扭轉硬件部門的虧損局面。
Y Combinator 舉辦了一場對話式 AI 黑客馬拉松,獲勝團隊將直接獲得 YC 面試資格。這是一個將 AI 項目與創業加速器連接的好機會。
本文探討了AI領域基準測試(Benchmarketing)的現狀與問題,借鑑數據庫行業40年來的評估經驗,建議數據領導者構建自己的評估系統,以真實工作負載而非供應商數據作為採購決策依據。
在Data Engineering Central播客中,Daniel Beach與資深開發者Neil Roberts深入探討了AI如何改變軟件開發的意義,包括前端和用户體驗的重要性、代理的實際含義、LLM工作流的成功與失敗,以及開發者如何保持競爭力。
最新研究提出有效反饋計算(EFC)概念,挑戰傳統計算量指標,證明AI性能提升的關鍵在於反饋的智能利用而非原始算力。EFC在預測失敗率方面遠超傳統指標,R²達0.94,反饋質量提升後成功率從0.27躍升至0.90。
英偉達聯合清華大學等機構提出Gamma-World,通過單純形旋轉智能體編碼、稀疏樞紐注意力和三階段蒸餾,解決了多智能體世界建模中身份對稱性、交互效率和實時生成三大難題,實現從雙人數據訓練到四人場景的零樣本泛化。
Nous Research 的開源 Hermes Agent 新增了 Tool Search 功能,通過 BM25 漸進式模式披露,推遲加載 MCP 工具模式,減少令牌開銷並提高模型準確性。Anthropic 評估顯示,Claude Opus 4 準確率從49%提升至74%,Opus 4.5 從79.5%提升至88.1%。
mem9的故事始於一次客户請求,從一個快速原型發展成一個完整產品。本文分享了構建智能體內存的關鍵經驗:內存不僅僅是存儲問題,而是涉及攝取、排序、評估和產品判斷的工程挑戰。內存API本身不足以構成產品,用户需要查看、檢查、信任和糾正智能體的記憶。此外,評估應成為內存產品的基礎設施,以使質量可視化和可調試。最後,智能體內存不應侷限於文本,應向多模態發展。
Avai是一個開源的主機遙測工具,結合LLM威脅分類器,通過Docker運行,監控主機上的進程、USB、持久化、文件完整性、瀏覽器擴展等26個方面,並利用17個威脅情報源和Claude類LLM給出惡意/可疑/未知/良性判定,無需代理、SIEM或雲控制平面。
在消化Anthropic重大新聞的間隙,我們重點介紹了AIE的新前向部署工程師計劃和創始人計劃,以及5月28-29日的AI新聞。主要話題包括:Claude Opus 4.8發佈及其基準測試爭議、多輪強化學習中的tokenization錯誤、開源模型與工具鏈進展、Google和OpenAI的Agent產品擴展,以及值得關注的研究論文。