Ruby創建者Yukihiro Matsumoto(Matz)正在Anthropic的Claude協助下構建Spinel,一個實驗性的Ruby提前編譯(AOT)編譯器。Spinel將Ruby代碼轉換為C語言,性能提升顯著,但存在諸多限制,包括不支持eval、線程等特性。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
文章探討了“一次性軟件時代”的概念,認為AI生成的代碼應被視為可丟棄的,就像工業革命中的傢俱一樣。作者通過一個實際案例展示瞭如何用AI重構代碼,並提出了“一次性代碼宣言”,強調代碼需滿足意圖、要求和安全性。
OpenAI 推出 Rosalind Biodefense,為經過審查的開發者及美國政府合作伙伴提供 GPT-Rosalind 的受信訪問,助力生物防禦、公共衞生與大流行病防範。
清華系創業公司是石科技通過自主研發的並行優化技術,構建異構算力資源池與推理優化引擎,實現單位Token成本降低40%,旨在打造國產Token調優工廠,降低AI落地門檻。
repo-brain 是一款開源工具,能將整個代碼庫壓縮成單個Markdown上下文文件,實現高達96%的壓縮率,大幅減少AI令牌使用量。它支持多種編程語言的靜態分析、架構分析和語義關係發現,併兼容多家AI提供商。
Anthropic以9650億美元估值完成650億美元H輪融資,同時披露470億美元年化收入,併發布Claude Opus 4.8更新(提升判斷力、誠實度和長時自主工作能力)以及Claude Code的Dynamic Workflows功能(支持數百個並行子代理)。
ReadyToTalk是一款專為小企業設計的AI前台接待員,能在2秒內接聽所有來電,提供24/7全天候服務,支持30多種語言,並自動學習企業信息。每月僅需39美元,無需技術知識即可在幾分鐘內完成設置。
Overline 是一款 Chrome 擴展,可為任何瀏覽器視頻提供實時 AI 字幕和實時翻譯,延遲低於一秒,無需字幕。
StudySong是一款AI工具,能夠將學習筆記或任何文本轉化為完整的歌曲,支持PDF上傳,所有處理在本地完成,保護隱私。
一位研究人員製造了一種假疾病來測試AI,結果AI聊天機器人完全被騙了。這個實驗揭示了AI醫療建議的潛在風險,以及訓練數據缺乏人工審查的問題。
Anthropic在65億美元H輪融資公告中透露,其年化收入已超過470億美元,較4月份的300億美元大幅增長。該公司此前在2025年底為90億美元,2026年2月為140億美元,顯示出驚人的增長速度。文章還提到了一家客户因未設置使用限制而單月花費5億美元的軼事。
Dis Dat 是一個讓AI編程代理能夠“看到”你所展示內容的工具,通過簡單的交互提升代碼生成效率。
本文分析了AI演示工具Genspark的侷限性,並介紹了2026年六大替代方案,包括Smallppt、Plus AI、Prezi、Vector Shift、Beautiful.ai和ClickUp,各自具有獨特的優勢,幫助用户根據需求選擇合適的工具。
theta-spec 是一個聲明式的、與任何AI編碼智能體框架無關的配置標準。它通過一個單一的 theta.toml 文件定義完整的配置表面(指令、規則、工具、技能、子智能體),並規定了配置文件的聲明週期協議。任何符合規範的實現都可以解析、鎖定並將配置轉換為任何支持的框架。該項目還提供了參考實現 theta CLI(Rust 編寫)。
對沖基金巨頭Citadel的創始人Ken Griffin對AI的態度從蔑視到沮喪,因為AI代理在數小時內完成之前需要數週或數月的工作。這引發了對經濟增長與就業脱鈎的擔憂,可能挑戰傳統GDP作為經濟健康指標的可靠性。
Trelk 是一款一次性購買、無需訂閲的知識管理應用。它利用設備端 AI 保存、組織並連接文章、論文和筆記,提供混合搜索、知識圖譜、RAG 聊天、閃卡間隔重複和社區集合等功能,注重隱私且可離線工作。
Together AI通過將語音識別視為端到端系統問題,而非單純的GPU推理問題,在Artificial Analysis榜單上實現了最快的語音轉文本速度。本文詳細介紹了其優化策略:包括針對真實音頻形狀的TensorRT多配置文件引擎、條件CUDA圖消除CPU往返、共享內存減少數據拷貝、事件驅動I/O處理流式傳輸,以及通過gc.freeze()消除垃圾回收尾延遲。
本週,AI與工作的衝突在四個司法管轄區同時爆發:維基百科編輯因裁員組織罷工,亞馬遜員工將內部AI評級系統玩壞,中國法院開始執行禁止以AI為由裁員的規定,英國智庫呼籲員工在AI部署中擁有發言權。同時,前沿實驗室繼續深入政府合作。
OpenAI分享了第三方AI評估指南,涵蓋如何評估前沿系統的模型能力、安全措施和有效性。
本文探討了強化學習在大型語言模型後訓練中的實際應用,指出當前的瓶頸並非算法而是基礎設施。Modal分享了大規模運行RL後訓練的經驗,介紹了其開源庫如何幫助團隊解決多節點訓練、環境管理和GPU利用率等關鍵問題。
本文是 PyTorch 性能分析系列的第一篇,從最簡單的矩陣乘加操作開始,引導讀者學習如何使用 torch.profiler 進行性能分析,包括設置分析器、解讀分析表和追蹤數據,以及理解 CPU 和 GPU 活動之間的時間關係。文章還討論了預熱和優化開銷等問題。
Anthropic發佈了Claude Opus 4.8,定位為對前代產品的適度但切實改進。主要亮點包括誠實性提升(減少無依據斷言,代碼錯誤遺漏率降低四倍),以及支持對話中修改系統提示等新功能。定價未變,但快速模式價格顯著降低。
Claude最新旗艦Opus 4.8發佈,部分能力超過Mythos,支持動態工作流,可拆解任務給數百個子智能體並行執行,人類無需頻繁檢查。誠實性大幅提升,代碼缺陷漏報率降至前代四分之一。
llm-anthropic 0.25.1 版本新增對Claude Opus 4.8模型的支持,為有權限的組織提供快速模式選項,並調整了各模型的默認最大令牌數為模型最大輸出而非8192。
Serenity 是一個開源、本地的AI代理,採用受大腦啓發的神經節點網絡(NNN)記憶架構。它能記住因果關係,跨領域推理,自主運行,且完全在本地機器上運行,無需雲依賴。
Liquid AI 推出了 LFM2.5-8B-A1B,這是一款面向設備的混合專家(MoE)模型,專為工具調用設計。該模型總參數量為 8.3B,但每個 token 僅激活 1.5B 參數,從而能夠在消費級硬件上運行。它支持 128K 上下文窗口、推理能力,並覆蓋九種語言。相比前代 LFM2-8B-A1B,該模型在非幻覺率、指令遵循、數學推理等基準測試中均有顯著提升。
介紹一款集AI、WordPress、合規與廣告跟蹤於一體的軟件,提供免費的聯盟營銷作弊表。
在 Open House 活動中,ClickHouse 社區發佈了三項可觀測性重大更新:ClickStack Cloud(完全託管的無服務器可觀測性平台)進入私有預覽,Managed ClickStack 正式可用,AI Notebooks 進入 Beta 階段,以及 ClickStack MCP 服務器開放源碼。AI Notebooks 是一種持久化的調查工作空間,支持分支探索;MCP 服務器則允許外部代理使用可觀測性原語,提升調查效率。
AI驅動的編碼工具已實現高度自主,讓任何人都能開發軟件,但底層基礎設施卻依然陳舊,導致效率低下。我們需要一個全新的AI原生操作系統。
新研究發現,大型語言模型在訓練過程中會吸收明確標記為假的陳述,即使它們被明確警告為假。這種現象被稱為“否定忽視”,可能導致模型產生幻覺。實驗表明,在合成文檔微調後,模型對虛假聲明的“信念率”從2.5%飆升至92.4%。