Synopsule是一款運行在Mac和iPhone上的本地AI會議轉錄工具,使用Whisper模型在設備端完成錄音、轉錄和説話人識別,無需上傳音頻或創建賬户。一次購買僅需1.99美元。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
AEVS是一款可嵌入的SDK,能夠記錄AI代理的每一次工具調用並生成防篡改的執行收據,幫助團隊在不依賴聊天記錄或脆弱日誌的情況下驗證代理實際執行的操作。
asyncinject 0.7 發佈,這是一個支持 asyncio 依賴注入的 Python 庫。作者在 Datasette 中使用該庫時,由 Claude Fable 5 發現了依賴中的幾個 bug 並自動修復。
Cloudskill 是一個管理 AI 技能的平台,將分散的技能文件轉換為帶有版本控制、訪問策略和完整審計日誌的託管目錄。它支持 Claude、Cursor、Copilot 等 AI 代理,確保技能創建和更新經過審查和批准,從而保證團隊依賴的技能安全、一致且可管理。
Anthropic在強烈抗議後改變了Claude Fable 5的安全措施,使其對前沿LLM開發的限制變得可見。此前,該模型會在用户不知情的情況下降低請求的有效性。現在,被標記的請求將明顯回退到Opus 4.8,API請求會返回拒絕原因。
本文回顧了Sarah Guo關於開放模型、模型實驗室與代理實驗室區別的深刻文章,並涵蓋了Anthropic的Fable/Mythos模型因靜默降級能力引發的信任危機、Fable 5在基準測試中的強勁表現、Google的DiffusionGemma發佈、代理工具與基準的進展,以及優化和科學建模領域的技術動態。
本文通過數據和案例分析,反駁了AI將導致軟件工程師大規模失業的敍事。作者指出,所謂的AI驅動的裁員往往是財務壓力下的“AI洗白”,而實際的就業數據表明,AI只是壓縮了“執行”層,但“決策”和“交付”層仍需要人類深度參與。文章提出了“決定-執行-交付三明治”模型,並認為這些瓶頸不會因AI能力提升而消失。
前沿團隊不僅利用AI加速編碼,更從根本上重新設計軟件構建方式,實現了4.5倍乃至超過10倍的生產力提升。本文通過亞馬遜Bedrock、Prime Video等團隊的案例,揭示了成為前沿團隊的五個關鍵實踐,並指出工作流程的變革比工具本身更重要。
Ollama的MLX引擎更新後,在Apple Silicon上實現了最高性能。通過更充分利用蘋果統一內存和Metal支持的MLX框架,模型輸出質量更高,響應更快,內存佔用更低。新支持NVFP4格式,輸出速度提升高達20%,並引入快照系統優化代理工作流。
本文是 PyTorch 性能分析系列的第二部分,深入探討了 nn.Linear 層的內部機制,包括轉置操作、融合偏置的 epilogue 技術,以及 torch.compile 對單個線性層的影響。隨後,文章剖析了一個包含 GeGLU 激活的多層感知機(MLP)的性能特徵,展示了 GPU 內核的調度和執行過程。
瞭解天體物理學家Chi-kwan Chan如何使用Codex構建黑洞模擬,幫助科學家研究極端物理並檢驗愛因斯坦的廣義相對論。
OpenAI宣佈收購Ona,旨在將安全的持久化雲環境集成到Codex中,從而支持企業工作流程中的長時間運行AI代理。
西班牙對外銀行(BBVA)將ChatGPT Enterprise推廣至10萬名員工,並與OpenAI合作,加速全球AI驅動的銀行業轉型。
OpenAI支持歐盟關於人工智能內容透明度的實踐準則,推進溯源標準和工具,幫助人們理解AI生成的內容。
datasette-agent 0.2a0 版本引入了工具可向用户提問的功能,以及新的內置保存查詢工具,使 Datasette 的 AI 代理更加靈活和用户可控,這些特性得益於新的 LLM 框架。
本教程完整實現了Microsoft SkillOpt的工作流程,包括環境搭建、基線評估、優化循環(rollout、反思、聚合、選擇、更新、驗證門控)以及訓練歷史可視化與最終技能比較,最終獲得可部署的優化技能文件並展示了準確率提升。
PixelForge是一款AI工具,可將真人照片瞬間轉換為可識別的RPG角色精靈圖,生成4方向行走的16幀透明PNG及GIF,支持Godot、Unity等引擎。一次性付費5美元,無需賬户或訂閲。由代碼完成後期處理,注重個性化和趣味性。
谷歌發佈了名為DiffusionGemma的新開源模型,基於Apache 2許可證,可在NVIDIA的NIM雲API上免費使用。該模型在生成速度上表現卓越,達到每秒500個token以上。
Oracle雲客户現可利用現有云承諾訪問OpenAI模型和Codex,以企業級安全與治理構建和部署AI應用。
Anthropic發佈了兩個新模型Claude Mythos 5和Claude Fable 5,在編程能力上大幅提升,但在圖像理解方面進步有限。作者測試發現,Fable 5和GPT-5.5能解決許多去年頂尖模型無法處理的圖像問題,但幾何推理能力仍只相當於幼兒水平,表明通用人工智能可能仍遙遠。
谷歌發佈26億參數的DiffusionGemma模型,採用擴散方式生成文本,速度是傳統自迴歸模型的四倍,但質量較低,目前作為實驗工具。
隨着自動駕駛出租車服務在全球擴展,NVIDIA推出Halos操作系統——一個集成了認證操作系統、標準化接口、AI護欄和驗證框架的全面安全系統,確保安全從底層構建於自動駕駛車輛之中。
DiffusionGemma是Google DeepMind推出的實驗性開放文本生成模型,採用文本擴散而非標準自迴歸解碼,在專用GPU上可實現最高4倍生成加速。模型參數量26B(MoE架構,推理時僅激活3.8B),基於Gemma 4骨幹,支持多模態輸入(文本、圖像、視頻),上下文窗口256K,覆蓋140+語言,採用Apache 2.0許可。
Anthropic 發佈了其最強大的 AI 模型 Claude Fable 5,但該模型拒絕回答基礎生物學問題,例如“什麼是線粒體”或“細胞膜是什麼”。原因是 Anthropic 為了安全考慮,故意設置了嚴格的生物安全防護措施,以防止模型被用於生物武器相關研究。公司表示這是一種保守策略,並計劃未來為生物科學界提供無限制訪問。
山姆·阿爾特曼告訴員工,他預計OpenAI將在“一年內”進行IPO,但也可能推遲到2027年。他將此歸因於對自我改進AI的謹慎態度,但分析認為Anthropic更強勁的增長數據和即將進行的IPO可能是真正的原因。
近日,美國大學畢業生在畢業典禮上對鼓吹人工智能的演講者發出噓聲,引發熱議。微軟副總裁兼總裁Brad Smith發表長文博客回應,表示這是“警鐘”,並呼籲提高標準。然而,博客內容與之前AI立場相似,被質疑為何公眾要信任製造不確定性的科技巨頭。
《The Verge》的《監管者》通訊在華盛頓混亂的政治生態中迴歸,報道了華盛頓AI網絡晚宴、教皇利奧十四世關於AI的通諭,以及特朗普領導下AI監管的不可預測性。文章強調了該行業在應對黨派政治和即將到來的中期選舉中的困境,其中AI正成為選民關注的關鍵議題。
Google研究人員提出正則化f-散度核檢驗框架,用於審計機器學習模型的遺忘和隱私保護。該框架自適應選擇最優散度度量,能夠更敏感地檢測數據泄露和遺忘失敗,且所需樣本更少,調參更少。
一羣獨立音樂人起訴谷歌,指控其未經許可使用YouTube上傳的歌曲訓練Lyria 3模型。谷歌提出駁回動議,聲稱根據用户條款,用户已授予廣泛許可。谷歌未明確承認,但過往聲明暗示確實使用了YouTube視頻。
Onpilot創建專門針對企業系統、工作流程和流程的AI工作者,可監控運營、識別風險、發現機會、推薦行動並自動化工作,支持3000多種集成,部署在Slack、Teams、WhatsApp、SaaS或本地。該平台強調安全與信任,提供審批流程、審計跟蹤和異常處理機制,確保AI在關鍵操作前獲得人工確認。