研究數學智慧體(RMA)是一個專為研究級數學問題設計的自動化推理框架,透過多代理協作和迭代最佳化,在First Proof基準上解決了10個問題中的8個,超越了GPT-5.2R和Aletheia等強基線。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
NeuroNL2LTL是一種結合神經翻譯與形式驗證的神經符號框架,能將自然語言需求自動轉換為線性時序邏輯(LTL)規約。該系統透過中間表示保證結構保持,並利用驗證結果作為強化學習獎勵訊號來最佳化神經元件,在20萬+跨領域需求上實現了28%語義等價和86%可滿足性驗證率。
本文提出BOHM,一種從複合AI系統路由權重中提取層次歸因樹的方法,無需額外成本或訪問元件內部,提供多解析度歸因,與SHAP高度相關但成本極低。
Pretzel 是一個實驗性的即時AI音樂代理,透過一個網路同步的音樂序列生成器,讓所有使用者與同一AI代理聊天並聽到相同的音樂。該專案在Google IO駭客松中誕生,旨在讓使用者表達情緒並即時更新音樂。
本文探討了開源AI模型內部概念空間的侷限性,指出許多對社會運動和哲學至關重要的概念缺失。作者引入軟提示蒸餾技術,僅用128KB資料即可植入新概念,強調這關乎AI可控性及對心智理解的深遠意義。
UniPat AI 釋出 SaaS-Bench 評測,Claude 等主流大模型在真實辦公任務中完全透過率最高僅 3.8%,AI 全自動辦公遠未落地。
Pi是一個極簡、可駭客的終端編碼工具,讓你構建自己想要的AI編碼代理工作流程。它保持核心小巧簡潔,透過擴充套件、技能和包提供高度自定義功能,並已在OpenAI/Codex生態系統中獲得顯著使用份額。
Lynote Humanize Text 是一個開源工具包,用於將AI生成的文本轉化為難以檢測的人類風格寫作。它配備了一個生產級的標準流水線,透過多步LLM重寫和跨引擎翻譯來繞過Turnitin、GPTZero等AI檢測器。該倉庫包含參考實現、n8n工作流支援,並在專家評估中獲得了9.1/10的質量評分和100%的關鍵資訊保留率。Lynote.ai平臺還提供高階和專注兩個層級,實現自適應每段文本最佳化。
該影片探討了人工智慧領域興趣減退的現象,分析了可能的原因和未來的影響。
TrapDoor加密貨幣竊取器透過供應鏈攻擊感染了npm、PyPI和Crates.io上的36個惡意包,目標為加密貨幣、DeFi、AI和安全領域的開發者。
具腦磐石由前華為雲AI演算法創新Lab主任朱森華創立,致力於用認知神經科學構建認知世界模型,推動具身智慧邁向2.0時代。公司近期完成新一輪億元級融資。
微軟研究釋出的這份PDF報告分析了2026年第一季度全球人工智慧擴散的趨勢,涵蓋關鍵洞察和資料,但當前無法直接提取文本內容。
在2026中國AIGC產業峰會上,Fusion Fund創始合夥人張璐指出,AI算力需求重心正從訓練轉向推理,未來推理將消耗70%的算力;資料中心通訊耗電可能比計算高百倍,光學通訊等新技術成為關鍵;物理AI的最大瓶頸是高質量真實世界資料稀缺;醫療、太空和奈米機器人是三大值得押注的應用方向。
本週末,馬斯克、扎克伯格和薩克斯透過三通電話扼殺了特朗普的AI安全行政令草案;Anthropic完成300億美元融資,而微軟因代幣費用超支取消了內部Claude Code試點;首個跨登錄檔供應鏈攻擊TrapDoor同時攻擊npm、PyPI和Crates.io;CISA記錄到15000次針對Drupal SQL漏洞的攻擊;白宮親自否決五角大樓,讓Claude留在NSA內部。
本文旨在釐清AI智慧體領域中常被混淆的術語,如“harness”(執行層)與“scaffold”(行為定義層)的區別,並解釋模型、智慧體、工具使用、子智慧體等概念,同時涵蓋訓練相關術語。
OpenAI 與巴西兩大傳媒集團合作,將可信的新聞報道引入 ChatGPT,強調來源標註和透明度。
設計師梅格哈·阿格拉瓦爾探討了AI編碼工具(如Codex和Claude Code)與設計思維之間的根本矛盾。設計師透過探索和迭代來發現解決方案,而AI工具則假設使用者事先知道想要什麼。當前工具在純視覺設計(Figma)和純編碼(Codex/Claude Code)之間存在空白,缺乏既能保持探索靈活性又無縫銜接生產地理想工具。
這篇報道介紹了新聞業中AI應用的最新錯誤事件,並提供了一個即時追蹤工具,幫助公眾和媒體從業者瞭解AI在新聞生成中的重大失誤及其影響。
本文深入批判了當前流行的透過量化分析預測AI對就業影響的方法。作者透過會計行業自動化後就業增長等歷史反例,指出簡單計算“AI暴露度”具有根本性缺陷。技術變革會重塑工作內容、商業模式,產生不可預見的連鎖反應。文章強調,任何有用的預測模型都必須透過“三大歷史測試”的檢驗。
蘇格蘭一家慈善機構警告稱,政府吸引“綠色資料中心”的政策可能忽視了人工智慧帶來的大量碳排放,因為該政策在ChatGPT釋出前就已制定。
在最近的Google I/O大會上,谷歌宣佈將AI更深地融入搜尋,包括擴充套件AI概覽、推出AI模式,並引入AI廣告。批評者擔心這會導致傳統搜尋結果被淹沒,損害開放網路,並激勵使用者轉向廣告攔截和替代搜尋引擎。
上海AI實驗室StepFun釋出StepAudio 2.5 Realtime,一款端到端即時語音大語言模型,支援自定義角色。透過WebSocket API連線,支援中英文。在2026年4月的五項基準測試中均排名第一,人類評估得分80.41,副語言理解得分82.18。
阿爾敏·羅納赫批評使用者使用AI工具重寫問題報告,導致內容失真、結論不準確。他呼籲提交簡潔的人類觀察記錄。
Terminal Guardian MCP 是一個生產級的模型上下文協議(MCP)伺服器,為Claude等AI助手提供安全、沙盒化的終端訪問。它包含一個風險分析引擎,將命令分類為安全、警告、危險和阻止四個等級,並提供Git提交資訊生成、工作區模板、程序管理、環境變數檢查、網路診斷、檔案系統訪問和Docker整合等功能。
西蒙·威利森使用克勞德AI重建了1983年厄斯伯恩《恐怖電腦遊戲》中的《瘋狂之屋》遊戲,現已推出可玩的互動式JavaScript版本。
marpy.io是一款基於瀏覽器的IDE和AI編碼助手,專為Python生態系統(Flask、FastAPI、Django)設計。它幫助開發者從想法到部署應用,無需處理基礎設施、膠水程式碼或半成品的JS工具。支援Python本地自動補全、重構和AI生成的模組,讓開發者能更快地原型設計、迭代和釋出生產級Python應用。
Claude Cowork 將 AI 從基於聊天的輔助轉向任務委派。結合 Playwright MCP,Claude Desktop 可以執行結構化的瀏覽器自動化操作。本文涵蓋安裝、架構、功能和安全注意事項。
Quinlight Audio是一款支援MOD/S3M/XM/IT格式的追蹤音樂播放器和重製工具,利用AI引擎(AudioSR、LavaSR、FLowHigh、AP-BWE)對樣本進行即時重製,並提供A/B對比功能。它採用64位浮點混合器、多引擎共識演算法(轉子流形上的Karcher均值)和各向異性插值,輸出32位浮點96kHz音訊。支援從壓縮包直接開啟模組,匯出FLAC或AAC,並提供CLI批次處理。
本文追溯了從1961年密碼誕生至今的數字身份演變史,指出隨著AI代理代表人類執行越來越多的數字任務,我們正面臨一個根本性問題:真正的身份是什麼?文章呼籲在基礎設施鎖定之前,重新思考身份的本質,而不僅僅是技術層面如何憑證化或委託。
儘管矽谷高管和經濟學家警告AI可能摧毀數百萬個工作崗位,但經濟學家亞歷克斯·伊馬斯指出,證據並不支援這一預測。透過歷史案例和當代分析,他論證AI可能不會造成大規模失業,反而會將勞動力轉向新的行業和機會。