JetBrains 發佈了 Mellum,一系列快速語言模型,專為超低延遲和高性能推理而設計。該模型家族旨在提升開發效率,作為 JetBrains 智能開發工具套件的一部分。
AI 新聞即時情報
即時監測
即時更新
即時追蹤可信來源,保留出處、權限和站內閱讀模式,把噪音壓成可讀情報。
即時更新
我們聽到的關於人工智能的一切都相互矛盾,且無法迴避。AI既可怕又美妙,既可能摧毀世界也能變革未來。有人呼籲必須擁抱它,也有人認為不使用它是一種道德義務。文章指出,AI絕對主義——無論是極端樂觀還是極端悲觀——都在扭曲我們的思考,而真正的未來並非如此單一。
本文指出,雖然AI高管宣稱效率提升將讓人們迴歸健康生活,但歷史經驗表明節省勞力的技術很少促進健康習慣。過去的便利(如外賣、微波爐、自動扶梯)悄悄減少了我們的身體活動,長期損害健康。
Nous Research 為其開源自改進代理 Hermes Agent 推出了個人資料構建器,該構建器集成在本地 Web 儀表板中,將原先需要多個 CLI 步驟的代理設置流程簡化為一個引導式界面,支持定義身份、選擇模型和提供商、啓用技能、安裝中心技能以及附加 MCP 服務器,並生成隔離的個人資料目錄。
在本次專訪中,AAAI會士Tanya Berger-Wolf分享了她在人工智能與生態學交叉領域的開創性工作,包括開發生命之樹基礎模型BioCLIP,該模型在物種分類、新性狀發現以及實際應用(如通過圖像識別蜱蟲)方面取得了顯著成果,並展望了AI驅動的科學發現未來。
隨着企業通過收購快速擴張以及AI代理消費模式的興起,傳統的數據產品模式變得笨重。Howden集團首席數據官Barry Panayi主張轉向數據服務層,將數據治理和質量檢查左移,減少洞察延遲,並採用統一的數據模型和會話式分析,以應對更快的業務節奏。
Cohere 發佈了其首個面向開發者的編碼模型 North Mini Code。這是一款 30B 總參數、3B 活躍參數的混合專家模型,可在單張 H100 GPU 上運行,支持 256K 上下文長度。模型專注於代碼生成、智能體軟件工程和終端任務,權重採用 Apache 2.0 許可發佈。
SmithDB支持對代理追蹤進行全文搜索和JSON過濾,中位延遲僅為400毫秒,儘管底層數據是存儲在對象存儲中的大型嵌套JSON文檔。本文詳細介紹了為對象存儲和大型代理追蹤負載量身定製的倒排索引設計,包括面臨的獨特挑戰(大型負載、Zipfian分佈、多種查詢模式、對象存儲約束)、為何不採用Tantivy,以及兩次設計迭代的經驗教訓。
大多數AI代理工具運行在服務器上,限制了瀏覽器API、設備功能和前端狀態的訪問。瞭解LangChain的無頭工具如何為現代代理應用啓用安全的客户端工具執行。
Anthropic撤銷了一項會暗中損害AI研究人員的政策,但另一個爭議點仍然存在。
Deezer現在可以掃描用户在其他流媒體平台上的播放列表,以檢測AI生成的音樂。Deezer是首個開始標記AI音樂的大型流媒體服務,也曾向其他平台提供技術,但似乎買家不多。現在,Deezer直接向大眾推出檢測工具,支持20個平台。
Synopsule是一款運行在Mac和iPhone上的本地AI會議轉錄工具,使用Whisper模型在設備端完成錄音、轉錄和説話人識別,無需上傳音頻或創建賬户。一次購買僅需1.99美元。
AEVS是一款可嵌入的SDK,能夠記錄AI代理的每一次工具調用並生成防篡改的執行收據,幫助團隊在不依賴聊天記錄或脆弱日誌的情況下驗證代理實際執行的操作。
asyncinject 0.7 發佈,這是一個支持 asyncio 依賴注入的 Python 庫。作者在 Datasette 中使用該庫時,由 Claude Fable 5 發現了依賴中的幾個 bug 並自動修復。
Cloudskill 是一個管理 AI 技能的平台,將分散的技能文件轉換為帶有版本控制、訪問策略和完整審計日誌的託管目錄。它支持 Claude、Cursor、Copilot 等 AI 代理,確保技能創建和更新經過審查和批准,從而保證團隊依賴的技能安全、一致且可管理。
Anthropic在強烈抗議後改變了Claude Fable 5的安全措施,使其對前沿LLM開發的限制變得可見。此前,該模型會在用户不知情的情況下降低請求的有效性。現在,被標記的請求將明顯回退到Opus 4.8,API請求會返回拒絕原因。
本文回顧了Sarah Guo關於開放模型、模型實驗室與代理實驗室區別的深刻文章,並涵蓋了Anthropic的Fable/Mythos模型因靜默降級能力引發的信任危機、Fable 5在基準測試中的強勁表現、Google的DiffusionGemma發佈、代理工具與基準的進展,以及優化和科學建模領域的技術動態。
本文通過數據和案例分析,反駁了AI將導致軟件工程師大規模失業的敍事。作者指出,所謂的AI驅動的裁員往往是財務壓力下的“AI洗白”,而實際的就業數據表明,AI只是壓縮了“執行”層,但“決策”和“交付”層仍需要人類深度參與。文章提出了“決定-執行-交付三明治”模型,並認為這些瓶頸不會因AI能力提升而消失。
前沿團隊不僅利用AI加速編碼,更從根本上重新設計軟件構建方式,實現了4.5倍乃至超過10倍的生產力提升。本文通過亞馬遜Bedrock、Prime Video等團隊的案例,揭示了成為前沿團隊的五個關鍵實踐,並指出工作流程的變革比工具本身更重要。
Ollama的MLX引擎更新後,在Apple Silicon上實現了最高性能。通過更充分利用蘋果統一內存和Metal支持的MLX框架,模型輸出質量更高,響應更快,內存佔用更低。新支持NVFP4格式,輸出速度提升高達20%,並引入快照系統優化代理工作流。
本文是 PyTorch 性能分析系列的第二部分,深入探討了 nn.Linear 層的內部機制,包括轉置操作、融合偏置的 epilogue 技術,以及 torch.compile 對單個線性層的影響。隨後,文章剖析了一個包含 GeGLU 激活的多層感知機(MLP)的性能特徵,展示了 GPU 內核的調度和執行過程。
瞭解天體物理學家Chi-kwan Chan如何使用Codex構建黑洞模擬,幫助科學家研究極端物理並檢驗愛因斯坦的廣義相對論。
OpenAI宣佈收購Ona,旨在將安全的持久化雲環境集成到Codex中,從而支持企業工作流程中的長時間運行AI代理。
西班牙對外銀行(BBVA)將ChatGPT Enterprise推廣至10萬名員工,並與OpenAI合作,加速全球AI驅動的銀行業轉型。
OpenAI支持歐盟關於人工智能內容透明度的實踐準則,推進溯源標準和工具,幫助人們理解AI生成的內容。
datasette-agent 0.2a0 版本引入了工具可向用户提問的功能,以及新的內置保存查詢工具,使 Datasette 的 AI 代理更加靈活和用户可控,這些特性得益於新的 LLM 框架。
本教程完整實現了Microsoft SkillOpt的工作流程,包括環境搭建、基線評估、優化循環(rollout、反思、聚合、選擇、更新、驗證門控)以及訓練歷史可視化與最終技能比較,最終獲得可部署的優化技能文件並展示了準確率提升。
PixelForge是一款AI工具,可將真人照片瞬間轉換為可識別的RPG角色精靈圖,生成4方向行走的16幀透明PNG及GIF,支持Godot、Unity等引擎。一次性付費5美元,無需賬户或訂閲。由代碼完成後期處理,注重個性化和趣味性。
谷歌發佈了名為DiffusionGemma的新開源模型,基於Apache 2許可證,可在NVIDIA的NIM雲API上免費使用。該模型在生成速度上表現卓越,達到每秒500個token以上。
Oracle雲客户現可利用現有云承諾訪問OpenAI模型和Codex,以企業級安全與治理構建和部署AI應用。