Anthropic的IPO申請標誌着生成式AI從以研究為主的風險投資階段轉向穩定的企業公用事業,對定價、許可和市場整合產生影響。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
谷歌為電話應用推出新功能,利用端到端加密的RCS技術檢測冒充聯繫人的AI詐騙電話。詐騙者越來越普遍地使用AI模仿聲音進行詐騙,FBI報告2025年美國損失超8.93億美元。該功能默認開啓於Android 12及以上設備,從Pixel手機開始,要求雙方使用谷歌電話應用。此外,還推出了兒童安全、AirDrop支持、AI試穿等功能。
微軟推出Scout,一款基於OpenClaw的始終在線AI助手,集成於Microsoft 365,可自動執行日程安排、費用報告等任務。它能監控交通和日曆,從Teams和電子郵件中學習,並推薦行動。桌面預覽版現面向美國Frontier客户提供。
TinyFish 推出開源多智能體系統 BigSet,用户只需用一句話描述所需數據,系統便自動推斷模式、通過網絡搜索和提取、去重並生成可導出的 CSV/XLSX 文件。支持定時刷新,全程無需手動編寫爬蟲或配置選擇器。
由於AI代碼生成帶來的前所未有的增長,GitHub遭遇頻繁宕機。該公司正在擴展基礎設施,遷移至Azure,並重建核心系統以恢復可靠性。
在Build開發者大會上,微軟推出一系列面向開發者的新功能,包括默認開啓深色模式的開發者優化Windows 11體驗、預配置開發工具、在PowerShell中原生運行Unix核心工具、WSL容器、智能終端Agent面板、以及用於運行AI Agent的執行容器和本地AI模型。微軟旨在通過減少干擾和提供熟悉的環境,吸引Mac和Linux開發者轉向Windows。
微軟推出智能終端(Intelligent Terminal)實驗性功能,將AI智能體直接集成到Windows 11終端中,支持GitHub Copilot、Claude Code等代理,可自動檢測錯誤並建議修復,簡化開發者工作流程。
Anthropic的Claude託管代理提供了一個完全託管的平台,用於運行AI代理,無需管理基礎設施。本文涵蓋了功能、定價、最新更新以及逐步構建代理的實踐指南。
Deep Agents 的 RubricMiddleware 通過在智能體運行中添加自我評估循環,使其能夠根據預定義的評價標準反覆修正輸出,直到滿足所有條件。該工具特別適用於具有明確可驗證成功標準的任務,如通過測試、避免禁止模式、覆蓋必要部分等。
本文探討了AI在數據分析領域的實際效用與侷限。AI在編寫代碼和加速數據資產開發方面有顯著優勢,但在回答臨時數據問題、分析指標變化時,誤差率較高(約86%準確性),且需要大量前期數據準備。AI無法替代分析師所需的判斷力、背景知識和機構記憶。文章建議以清醒的態度使用AI工具,避免過度投資或完全忽視。
本文深入探討了在使用 Amazon Nova Forge 進行領域特定任務微調時,如何平衡模型領域性能與通用能力。介紹了數據混合、學習率、檢查點選擇等關鍵超參數的優化策略,以及如何避免災難性遺忘和昂貴的失敗訓練。
本文介紹瞭如何通過Amazon Nova 2 Lite實現目標檢測,無需訓練模型或管理基礎設施。利用Amazon Bedrock、Lambda和API Gateway構建應用,通過自然語言提示即可檢測物體並獲取邊界框座標。涵蓋製造業、農業和物流等實際應用場景。
微軟在Build 2026上宣佈了Project Solara,這是一款專為運行AI代理的小工具設計的新操作系統,基於安卓而非Windows。公司展示了兩款概念設備:桌面概念(類似亞馬遜Echo Show)和徽章概念(可穿戴工作徽章)。微軟不計劃自行生產這些設備,而是作為參考設計供其他硬件製造商使用。多家企業如AccuWeather、百思買、CVS醫療和塔吉特計劃開展硬件試點。
Refer Me推出了AI簡歷定製工具,可根據職位描述自動優化簡歷,提高通過ATS篩選的幾率,讓求職者在競爭激烈的市場中脱穎而出。
CVE AI Agent是一個自主運行的漏洞情報引擎,能夠持續採集、豐富和分類CVE數據,並通過n8n、Jira、Slack、Splunk等第三方工具將發現結果推送到用户選擇的平台。其採用令牌高效架構,通過確定性最小化邏輯過濾噪音,平均提示詞僅1000個令牌。代理遵循嚴格的兩遍架構:第一遍確定性提取所有可測量數據,第二遍由LLM填充定性部分。支持多種LLM提供商,包括Gemini、OpenAI、Claude等,並提供Web儀表盤。
研究發現在Android設備上,任何應用都可以靜默獲取Microsoft 365賬户的令牌,從而劫持賬户。問題已修復,建議立即更新應用。
EchoFlow是一款開源的Android原生AI聊天應用,採用Material Expressive設計,聊天記錄本地存儲,支持離線查看,無需跟蹤,通過OpenRouter提供AI響應。
智能體BI(Agentic BI)通過將自主AI智能體嵌入分析工作流,自動化數據準備、查詢執行和洞察交付,取代了使超過40%組織不滿意的靜態儀表板模式。一個有治理的語義層是可信賴智能體分析平台的基礎。BI團隊和業務用户可以逐步採用智能體BI,從單個業務單元試點開始。
微軟推出Work IQ,專為代理優先的企業設計,讓AI代理動態發現數據結構和執行操作,但成本、治理和數據暴露問題令人擔憂。
GitHub首席運營官Kyle Daigle討論了AI代理如何改變軟件開發,從基礎設施壓力到Copilot的未來。AI驅動的代碼生成增長了1400%,給GitHub的CI/CD、開源維護和代碼審查帶來了挑戰。Daigle分享了GitHub內部使用AI進行回顧、溝通和決策的經驗,並展望了Copilot從代碼補全到雲代理的演變。
微軟在Build 2026大會上發佈了Surface RTX Spark Dev Box,一款緊湊型桌面電腦,配備Nvidia Blackwell架構RTX Spark處理器和128GB統一內存,提供1 petaflop AI算力,讓開發者可在本地加載和運行超過1200億參數的大模型,無需支付雲API費用。此舉直接挑戰了自ChatGPT推出以來主導AI行業經濟的按token付費模式。
前沿AI模型如Mythos和GPT-5.5能發現真實漏洞,但企業級進攻性安全需要更多:覆蓋範圍、驗證、安全性、治理和運營集成。本文探討了如何將AI能力轉化為可靠的安全系統。
本文深入分析LLM編碼基準測試與現實生產環境之間的差距,指出單純依賴排行榜分數選擇模型的弊端。文章分類介紹了HumanEval、SWE-bench等主流基準測試的實際測量內容,並提出一套包含五步的評估框架:定義質量指標、選擇匹配任務的基準、運行內部評估、使用加權評分、建立持續評估機制。同時警示了過度依賴單一基準、忽略執行評估、不考慮基礎設施開銷等常見陷阱。最後強調,內部評估集才是模型選擇最可靠的依據。
微軟推出Surface RTX Spark Dev Box,這是一款專為開發者設計的迷你PC,搭載英偉達Arm架構RTX Spark芯片,擁有128GB統一內存,支持本地運行高達1200億參數的AI模型,預裝Visual Studio Code、GitHub Copilot等開發工具,將於今年晚些時候在美國上市。
特朗普總統簽署一項行政令,建立自願框架,要求科技公司在公開發布強大AI模型前最多提前30天提交給政府審查,以加強網絡安全和國家安全。此舉標誌着他從之前的放鬆監管立場轉向更嚴格的控制。
OpenAI宣佈Codex的500萬周活躍用户中20%是知識工作者而非程序員,因此推出針對他們的新功能:Sites(創建和分享交互式網站)、Annotations(在文檔中指定區域讓AI修改)以及面向數據分析、銷售等領域的插件。
微軟年度開發者大會Build 2026將於6月2日在舊金山開幕,主題演講於美國東部時間12:30/太平洋時間9:30直播。預計將發佈新AI模型、類似OpenClaw的代理工具、Copilot“超級應用”以及Windows 11重大更新。新Surface Laptop Ultra搭載Nvidia RTX Spark,可能帶來更多Windows on ARM消息。
視覺AI正從生成像素轉向生成代碼,讓設計師、動畫師和3D藝術家能夠迭代編輯,而不是隻得到最終靜態輸出。
本文介紹了Baz如何使用Amazon Bedrock和Amazon Bedrock AgentCore構建其Spec Review代理,通過自動化代碼審查流程,結合Figma設計規格和Jira功能需求,實現端到端的驗證,減少缺陷並加快合併速度。
一份由國際數學聯盟(IMU)認可的社區宣言,呼籲數學家應對人工智能在研究中的挑戰與威脅,強調數學的核心價值如證明、歸屬和透明度,並提供個人與機構的建議。