Feyn AI釋出SQRL:一個在編寫查詢前先檢查資料庫的文本到SQL模型系列 2026-07-20 06:20 UTC+8 Feyn Labs釋出了SQRL,這是一系列文本到SQL模型,能在生成查詢前透過只讀探針檢查資料庫。旗艦型號SQRL-35B-A3B在BIRD Dev上達到70.6%的執行準確率,略超Claude Opus 4.6,並可蒸餾為可自託管的4B和9B檢查點。
SQRL透過只讀探針在提交最終查詢前檢查資料庫。 SQRL-35B-A3B在BIRD Dev上達到70.6%準確率,超過Claude Opus 4.6的68.77%。 阿里巴巴預覽Qwen3.8-Max:2.4萬億引數多模態模型,緊隨Moonshot的Kimi K3開源釋出之後 2026-07-20 05:42 UTC+8 阿里巴巴Qwen團隊預覽了Qwen3.8-Max-Preview,一個2.4萬億引數的多模態MoE模型,號稱“僅次於Fable 5”。該預覽已在Token Plan、Qoder和QoderWork上以標準定價的10%提供。但尚未提供任何基準測試表、模型卡、許可證、每token價格或啟用引數數量。本文區分了阿里巴巴確認的內容和僅聲稱的內容。
Qwen3.8-Max-Preview已在Token Plan、Qoder和QoderWork上以10%的優惠價格提供。 2.4萬億引數和“僅次於Fable 5”的排名僅是阿里巴巴的聲稱,尚未有已驗證的基準測試。 福布斯認為AI創造了新職業,但歷史早已有之 2026-07-20 05:02 UTC+8 矽谷出現了一批精通AI、加密貨幣等技術的豪華伴遊,客人為了一次深入對話支付數千美元。但這種現象並非AI獨有:日本藝伎、希臘赫泰拉等早已存在類似模式。技術改變,但人類對關注和陪伴的需求始終未變。
矽谷豪華伴遊透過談論AI、Nvidia等話題吸引科技富豪,收費高昂。 文章指出該現象並非新奇,歷史上藝伎、名妓等皆扮演類似角色。 Moonshot AI 因Kimi K3需求大增暫停新訂閱 2026-07-20 00:02 UTC+8 由於Kimi K3需求超出預期,Moonshot AI宣佈暫停新訂閱以保護現有使用者體驗。
Kimi K3需求在48小時內接近容量上限 為保護現有使用者,暫停新訂閱 序列雷達 #897:上週AI要聞:中國、壓縮與開放模型競賽 2026-07-19 19:00 UTC+8 本週AI領域多項重要進展:Thinking Machines釋出開源975B引數MoE模型Inkling,Moonshot AI推出2.8萬億引數Kimi K3,PrismML展示可在手機上執行的Bonsai 27B模型。OpenAI的GPT-Red透過自博弈實現自動化紅隊測試,並在測試中對GPT-5.1達到84%的攻破率。此外,習近平在上海世界人工智慧大會上強調開源AI作為全球公共品,呼籲國際合作。
Thinking Machines釋出開源模型Inkling:9750億引數,MoE架構,支援多模態和百萬標記上下文視窗 Moonshot AI推出Kimi K3:2.8萬億引數,啟用16個專家,針對長時編碼和知識工作 從演算法到自主:AI如何重寫軟體與移動出行架構 2026-07-19 18:21 UTC+8 人工智慧正從基於規則的程式設計(軟體1.0)演變為機器學習(軟體2.0),再到如今具有湧現推理能力的自然語言介面(軟體3.0)。大規模語言模型(LLM)是一種通用技術,影響廣泛,但缺乏物理根基。下一個前沿是空間智慧與物理AI,推動自動駕駛和人形機器人發展。
AI經歷了從人類編寫邏輯到機器學習,再到自然語言介面的三個階段。 LLM作為通用技術,類似於電力,具有廣泛的適用性和變革性。 Show HN: Zlvox – 25款免費開發者工具(AI、JSON、PDF),零追蹤 2026-07-19 13:02 UTC+8 Zlvox是一個提供25款免費開發者工具的平臺,涵蓋AI、JSON、PDF、影像處理等,強調隱私保護(客戶端處理,零資料儲存)和卓越效能。無需註冊即可使用。
25款免費開發者工具,涵蓋AI、JSON、PDF、影像等領域,零追蹤。 所有工具在客戶端執行,資料不離開瀏覽器,不儲存任何使用者資料。 Kimi K3 vs DeepSeek V4 Pro vs GLM-5.2:開源萬億引數MoE模型基準測試、許可與成本對比 2026-07-19 09:41 UTC+8 中國三家實驗室的旗艦開源MoE模型——Kimi K3、DeepSeek V4 Pro和GLM-5.2——在基準測試、許可條款和服務成本上各有優劣。Kimi K3效能最強但僅限API,DeepSeek V4 Pro成本最低且立即開源,GLM-5.2平衡了速度與可部署性。
Kimi K3(2.8萬億引數)在Artificial Analysis智慧指數中以57分領先,但權重需等到7月27日才釋出。 DeepSeek V4 Pro(1.6萬億引數)MIT許可,成本僅為K3的1/17,適合注重價效比的團隊。 使用NVIDIA NeMo AutoModel對Qwen3進行LoRA微調:完整的單GPU Google Colab工作流教程 2026-07-19 09:08 UTC+8 本教程詳細介紹瞭如何在Google Colab上使用單個GPU,透過NVIDIA NeMo AutoModel對Qwen3-0.6B模型進行LoRA引數高效微調。涵蓋環境驗證、原始碼安裝、配方載入與調整、命令列訓練、模型評估以及Python API呼叫。
在Colab單GPU上搭建NeMo AutoModel環境 載入並修改Qwen3-0.6B LoRA微調配方 市長曼達尼:房東不得使用AI影像釋出出租廣告 2026-07-19 06:13 UTC+8 紐約市長佐蘭·曼達尼釋出《租賃欺詐報告》,要求房東和中介在租房廣告中披露是否使用AI生成或編輯的影像。此舉旨在打擊虛假房源廣告,保護租客權益,並將推動租戶工會合法化、擴大租客談判權等措施。
紐約市長曼達尼釋出報告,要求房東披露AI修改的房源圖片。 AI生成的虛假房產圖片問題日益嚴重,尤其影響遠端簽約租客。 NVIDIA釋出DeepStream 9.1:為視覺AI帶來13項技能和多視角3D追蹤的智慧體AI 2026-07-19 03:16 UTC+8 NVIDIA DeepStream 9.1 引入了13項智慧體技能,允許Claude Code和Codex等編碼代理透過自然語言提示構建多攝像頭影片分析管道。多視角3D追蹤(MV3DT)將每個攝像頭的檢測結果融合到一個共享的3D世界中,並分配全域性一致的物件ID,而AutoMagicCalib(AMC)則消除了手動攝像頭校準。該版本還增加了JetPack 7.2支援和一個統一的GitHub開源倉庫。
DeepStream 9.1 提供13個智慧體技能,支援自然語言驅動的多攝像頭視覺管道搭建。 MV3DT 實現跨攝像頭3D追蹤,分配全域性唯一ID,無需手動校準。 Talon:一個自託管的長期AI代理框架 2026-07-19 00:24 UTC+8 Talon是一個多平臺、可自託管的AI代理框架,支援Telegram、Discord、Microsoft Teams、終端及跨平臺的桌面/移動應用。它提供可插拔的後端(Claude Agent SDK、Kilo、OpenCode、Codex、OpenAI Agents)和完整的MCP工具訪問,具備背景代理、目標管理、技能系統、事件匯流排等功能。專案架構清晰,前端與後端獨立,支援熱過載外掛和技能,便於擴充套件。
Talon支援多種前端(Telegram、Discord、Teams、終端、桌面/移動應用)和後端(Claude、Kilo、OpenCode、Codex、OpenAI Agents),透過MCP協議提供豐富工具。 具備背景代理(心跳、夢境)、持久目標、技能系統(SKILL.md)和觸發器,使代理能主動推進任務。 人工智慧繁榮建立在債務之上,投資者需求驟降,超大規模企業加速債券發行 2026-07-18 20:58 UTC+8 人工智慧(AI)繁榮日益依賴債務融資,但隨著超大規模企業加大債券發行,投資者需求卻在下降。亞馬遜最近的債券發行不得不提高收益率,訂單倍數下降。AI債券供應激增,但投資者要求更高利差。同時,中國AI模型Kimi K3的突破性效能引發對美國AI支出可持續性的擔憂,可能導致經濟衰退。
自2025年初以來,Alphabet、Meta、亞馬遜、甲骨文等公司已發行超過3000億美元債券。 投資者對AI債券的需求下降,亞馬遜債券訂單倍數從3.2倍降至2.5倍。 PixelUp:一款完全離線、輕量級的AI影片放大軟體(Windows) 2026-07-18 20:20 UTC+8 PixelUp 是一款專為 Windows 設計的輕量級 AI 影片放大工具,利用 FSRCNN 和 ESPCN 深度學習模型,在本地硬體上快速將低解析度影片提升至高畫質畫質。它支援 Nvidia CUDA、Vulkan 和 CPU 處理,提供批次任務管理、無損音訊同步,並採用終身許可證模式,一次性付費 $19,無需訂閱,完全保護使用者隱私。
完全本地執行,無需聯網或註冊賬戶,保障資料隱私。 採用最佳化的 FSRCNN 和 ESPCN 模型,快速重建細節。 AIpine – iPhone上AI工件的瑞士軍刀 2026-07-18 20:20 UTC+8 AIpine是一款專為iPhone設計的應用,用於檢視、預覽和組織AI生成的各類檔案,如JSX、HTML、Mermaid圖表、SVG等,支援離線使用,無賬戶和雲服務,保護使用者隱私。
AIpine提供對AI生成檔案的預覽和原始碼檢視,支援多種格式。 應用完全離線工作,檔案儲存在本地,無需賬戶或雲服務。 BaseRT - Apple M5最佳化版 2026-07-18 16:15 UTC+8 BaseRT在Apple M5晶片上實現顯著效能提升,比llama.cpp快6.4倍,比MLX快3.9倍。
BaseRT針對Apple M5晶片進行了最佳化,提供超高速推理效能。 效能基準測試顯示,比llama.cpp快6.4倍,比MLX快3.9倍。 Timeline Studio:本地優先的AI影片編輯器 2026-07-18 16:12 UTC+8 Timeline Studio 是一款在瀏覽器中執行的本地優先 AI 影片編輯器,結合了 CapCut 風格的多軌道時間線、瀏覽器端 AI 配音、自動字幕、視覺工具、虛擬形象生成以及確定性離線匯出功能。
支援多語言 AI 配音、自動字幕、智慧構圖、人像分割、AI 人聲分離和數字人功能。 提供完整的影片編輯功能,包括多軌道時間線、關鍵幀動畫、濾鏡效果、貼紙等。 埃隆·馬斯克的孟菲斯人工智慧帝國成為資料中心抵制的中心 2026-07-18 14:07 UTC+8 埃隆·馬斯克在孟菲斯快速建造人工智慧資料中心,引發居民對噪音和排放的不滿,全國範圍內出現政策提案、抗議和訴訟。
馬斯克的xAI資料中心Colossus和Colossus II使用燃氣輪機,造成噪音和汙染。 紐約州和新澤西州已透過法規限制或規範資料中心建設。 Anthropic 宣佈 Claude Fable 5 永久納入訂閱計劃 2026-07-18 14:00 UTC+8 Anthropic 決定自2026年7月20日起,將 Claude Fable 5 永久納入 Max 和 Team Premium 訂閱計劃(額度為50%),併為 Pro 和 Team Standard 使用者提供一次性100美元積分。此舉逆轉了此前因算力限制而計劃移除 Fable 5 的決定,主要受到 GPT-5.6 Sol 等競爭對手的壓力。
Claude Fable 5 將於7月20日起永久包含在 Max 和 Team Premium 訂閱中,使用額度限制為50%。 Pro 和 Team Standard 使用者可透過使用積分繼續訪問,並獲得一次性100美元信用額度。 Cicy-code – 透過 npx 使用的本地優先多智慧體編碼工作區 2026-07-18 13:50 UTC+8 cicy-code 是一個開源的、本地優先的多智慧體開發工作區,整合了 tmux、WebTTY 終端、React 前端、AI 閘道器和技能市場。它透過 npx 作為單個二進位制檔案分發,讓使用者能夠在約 5 分鐘內啟動一個智慧體團隊。
本地優先的多智慧體工作區,支援編碼智慧體編排。 整合 tmux、WebTTY、React、AI 閘道器和技能市場。 一個逃避AI檢測的小實驗 2026-07-18 13:29 UTC+8 作者嘗試使用Claude Code、10個並行代理和基本技巧來逃避AI檢測,但失敗了。文章詳細記錄了多次嘗試,包括使用維基百科規則、Pangram API反饋和模仿特定作者風格,所有嘗試均未成功。唯一的成功案例是手動重寫自己的文章,AI檢測分數降至0%。
作者使用AI輔助撰寫了84篇部落格文章,幾乎所有內容都被檢測為100% AI生成。 嘗試透過AI代理編輯、模仿人類寫作風格和特定作者聲音來逃避檢測,均未成功。 Gpu.ai 10萬美元大獎駭客馬拉松:2026年8月22日,免費雲GPU構建 2026-07-18 13:00 UTC+8 GPU.ai 將於2026年8月22日至24日舉辦線上全球駭客馬拉松,提供1,000美元現金大獎及免費GPU積分。參賽者需基於GPU.ai平臺構建AI應用、代理、推理API或創意工作流,僅限50支團隊入選。
GPU.ai 駭客馬拉松於2026年8月22日啟動,提供1,000美元大獎和免費GPU積分 僅接受50支團隊,個人或團隊均可參賽 AINews:今日平淡無奇 2026-07-18 12:30 UTC+8 今日AI新聞較為平靜,但Kimi K3的釋出成為焦點,引發了關於中國開源模型是否接近前沿的廣泛討論。此外,Databricks完成1880億美元M輪融資,OpenRouter可能被收購。技術方面,深入分析了K3的架構、基準測試效能及智慧體框架。
Kimi K3釋出重新點燃中美前沿模型差距討論 Databricks完成1880億美元M輪融資 Anthropic與Meta初步洽談租用計算能力 2026-07-18 09:24 UTC+8 據知情人士透露,人工智慧初創公司Anthropic正與Meta進行初步談判,計劃租用其計算能力,潛在交易價值約100億美元。此舉表明Anthropic繼續透過合作獲取輝達AI晶片,以緩解算力瓶頸。此前,Anthropic已與SpaceX達成類似協議。
Anthropic與Meta就租用AI計算能力進行初步談判,交易金額或達100億美元。 此舉緊隨Anthropic與SpaceX的資料中心合作,旨在增加付費使用者的算力。 過度訓練:通往類人AI之路 2026-07-18 09:03 UTC+8 文章探討了Gwern的理論,認為透過過度訓練(grokking)大模型在小資料集上,可以實現更接近人類的通用智慧。作者分析了當前LLM的侷限性,並提出了與主流做法相反的訓練策略。
Grokking現象:長時間訓練後模型突然大幅提高能力 LLM泛化不足,需要更深層次的規則發現 AI基礎設施資本支出排名追蹤 2026-07-18 07:54 UTC+8 基於對45家公司的追蹤,AI基礎設施總資本支出達9415億美元,其中AI相關支出約3995億美元。Alphabet以1850億美元位居榜首,亞馬遜、阿里巴巴、微軟緊隨其後。
追蹤45家公司,總資本支出9415億美元,AI相關支出佔42.4% Alphabet以1850億美元總支出和1300億美元AI支出領先 人工智慧領域最具影響力人物榜 2026-07-18 07:05 UTC+8 2026年人工智慧領域的權力格局已發生劇變。傳統上根據算力和資本排名的時代已經過去。本文基於過去12個月內對AI資本流向的控制力,評選出最具影響力的人物,包括埃隆·馬斯克、桑達爾·皮查伊、達里奧·阿莫代伊、馬克·扎克伯格、薩姆·奧爾特曼等。文章詳細介紹了他們的戰略舉措、投資規模及行業影響。
AI權力不再僅由算力和資本決定,資本控制力成為新標準。 埃隆·馬斯克透過整合xAI、SpaceX和X,打造1.75萬億美元垂直帝國。 Zyphra釋出ZUNA1.1:一個支援0.5至30秒可變長度輸入的Apache 2.0 EEG基礎模型 2026-07-18 05:35 UTC+8 Zyphra於2026年7月16日釋出了ZUNA1.1,這是一個基於Apache 2.0許可的開源腦電圖(EEG)基礎模型。該模型是一個3.8億引數的掩碼擴散自編碼器,能夠處理任意通道佈局的EEG訊號,並支援0.5至30秒的可變長度輸入,相比之前固定5秒的ZUNA1更加靈活。透過改進訓練策略(包括四種丟失模式和逐通道質量過濾)以及更大的語料庫(約350萬通道小時),ZUNA1.1在重建歸一化均方誤差上保持或優於ZUNA1。
ZUNA1.1支援0.5至30秒的可變輸入長度,以0.125秒為單位進行分詞。 模型使用變壓器編碼器-解碼器架構,結合4D旋轉位置編碼和整流流目標。 習近平發起新的人工智慧聯盟WAICO 2026-07-18 04:24 UTC+8 中國國家主席習近平在上海世界人工智慧大會上呼籲各國合作發展AI,並宣佈成立由29個國家組成的世界人工智慧合作組織(WAICO),旨在制定全球AI規則。此舉被視為中國挑戰美國在AI領域主導地位的舉措。
習近平呼籲AI發展不應是“單個國家的獨奏”,而是國際合作。 中國牽頭成立WAICO,29個創始成員國包括印尼、巴西、俄羅斯等。 Nvidia擴大物理AI佈局:機器人與邊緣AI更新 2026-07-18 04:12 UTC+8 輝達正在充實其物理AI生態系統,涵蓋基礎模型、邊緣硬體、軟體、開發者工具及工業合作伙伴關係。
輝達擴充套件物理AI戰略,涵蓋機器人和邊緣計算領域 推出基礎模型和邊緣硬體以支援AI應用 1999.ai:人工智慧與網際網路泡沫的昨日重現 2026-07-18 02:11 UTC+8 本文作者Scott Galloway認為,當前人工智慧領域的投資熱潮與1999年的網際網路泡沫有諸多相似之處,但結局可能不同。他警告AI泡沫正在破裂,並分析了從B2C到基礎設施的連鎖反應,最終指出AI創造的價值可能更多流向使用者而非股東。
OpenAI的財務狀況類似1999年的網際網路公司,虧損巨大且商業模式不可持續 AI領域的迴圈融資和過度支出正引發擔憂,企業開始削減AI預算 跟隨問題,走向深處 2026-07-18 01:25 UTC+8 貝利·弗拉尼根是一位跨學科研究者,現任麻省理工學院施瓦茨曼計算機學院、政治學系和電氣工程與電腦科學系的聯合教員。她的研究聚焦於利用計算和數學工具促進民主參與,開發了用於隨機選擇公民大會參與者的演算法,並部署在Panelot.org平臺上。
貝利·弗拉尼根從醫學、公共衛生到經濟學,最終轉向電腦科學和政治學的跨學科研究。 她開發的演算法幫助隨機選擇公民大會參與者,平衡代表性與公平性。 《下載》專題:圍絕經期謠言與中國AI最新突破 2026-07-18 01:02 UTC+8 本期《下載》探討了圍絕經期錯誤資訊的泛濫,以及中國開源AI模型縮小與美國差距的進展。此外還有特朗普媒體變現、宜居行星大氣層發現、腦機介面恢復觸覺等科技新聞。
圍絕經期話題雖去汙名化,但錯誤資訊與缺乏科學依據的治療建議盛行。 中國初創公司釋出世界最大開源AI模型,縮小與美國差距。 蘋果超越輝達,重奪全球市值最高公司寶座 2026-07-17 23:01 UTC+8 蘋果在週五超過輝達,成為全球市值最高的公司,這反映了投資者對人工智慧前景的重新評估。蘋果市值穩定在4.88萬億美元,而輝達因股價下跌3.5%市值降至約4.86萬億美元。
蘋果超越輝達,成為全球市值最高的公司。 投資者正在重新評估人工智慧的前景。 NVIDIA Vera Rubin:最大化智慧體AI每美元智慧的關鍵平臺 2026-07-17 23:00 UTC+8 NVIDIA Vera Rubin平臺透過極致協同設計降低每token成本,實現更頻繁高效的後訓練,最大化智慧體AI時代的每美元智慧。Nemotron 3 Ultra模型在SWE-bench驗證中得分71.7%,展示了後訓練的有效性。
後訓練從一次性步驟轉變為智慧體AI的持續過程 Vera Rubin相比Blackwell可將訓練大型模型所需GPU數量減少四倍 NVIDIA AI釋出Nemotron 3 Embed:開源嵌入集合,8B檢查點榮登RTEB榜首 2026-07-17 15:53 UTC+8 NVIDIA釋出Nemotron 3 Embed,包含三個開源檢查點:8B BF16、1B BF16和1B NVFP4。其中8B模型在RTEB基準上以78.46平均NDCG@10排名第一。1B模型透過NAS剪枝和蒸餾從8B教師模型得到。NVFP4在Blackwell上保持99%+的檢索精度,吞吐量提升2倍。所有模型支援32,768 token輸入,採用OpenMDW-1.1許可。
Nemotron-3-Embed-8B-BF16在RTEB上以78.46平均NDCG@10排名第一 提供8B BF16、1B BF16和1B NVFP4三種檢查點 中國輝達替代品公司預測銷售額激增,AI晶片需求旺盛 2026-07-17 15:02 UTC+8 中國晶片設計公司摩爾線程和紫光資訊預測上半年收入大幅增長,得益於國內AI計算需求激增。摩爾線程預計收入增長135%-149%,紫光資訊預計增長55.6%-70.2%。這凸顯了中國在AI基礎設施上的強勁需求,以及在美國出口限制下國產晶片的崛起。
摩爾線程預計上半年收入同比增長135.1%至149.4%,達到16.5億至17.5億元人民幣。 紫光資訊預計上半年收入同比增長55.6%至70.2%,達到85億至93億元人民幣。 巴菲特揭秘:伯克希爾310億美元押注谷歌的背後決策者 2026-07-17 14:15 UTC+8 沃倫·巴菲特透露,是他本人而非繼任者格雷格·阿貝爾主導了伯克希爾對谷歌母公司Alphabet的310億美元投資。他表示,人工智慧巨頭被迫進行鉅額資本支出以保持競爭力,這種模式類似於他曾投資的鐵路和公用事業,因此吸引了長期迴避科技股的他。
巴菲特親自決定伯克希爾投資Alphabet 310億美元,而非繼任CEO。 他改變對科技股的看法,因AI公司資本支出模式轉向類似鐵路和公用事業。 分支策略最佳化:面向沙盒的原生語言智慧體強化學習 2026-07-17 12:00 UTC+8 提出分支策略最佳化(BPO),利用沙盒的確定性、可快照和可恢復特性,透過共享字首的樹形 rollout 拓撲降低策略梯度方差,在多個基準上較 GRPO 和 RLOO 提升 3.6-6.1 個絕對百分點。
BPO 利用沙盒可快照和可恢復的特性,構建共享字首的樹形 rollout 拓撲,替代獨立軌跡取樣。 該演算法在決策點分支並計算兄弟軌跡間的優勢,理論上證明方差嚴格低於軌跡級基線。 人工智慧的真正瓶頸在於資料交付 2026-07-17 11:16 UTC+8 企業大規模部署AI時,最大障礙往往是資料從儲存到計算的基礎設施,而非GPU等計算硬體。文章指出,許多組織誤以為效能問題需要更多計算資源,實則根源在於資料飢餓,即資料無法高效、安全、持續地在儲存與計算之間流動。透過引入應用交付控制器實現松耦合架構,以及關注可達性、策略和交付三個維度的韌性,可顯著提升GPU利用率和AI投資回報。
AI效能瓶頸常被誤認為計算不足,實則是資料交付基礎設施的制約。 松耦合架構(如引入ADC)可將儲存與計算解耦,提升靈活性和效能。 [AINews] Kimi K3 2.8T-A50B:有史以來最大的開源模型;Opus 4.8級別的效能,Sonnet 5的定價 2026-07-17 09:46 UTC+8 Moonshot AI釋出了Kimi K3,一個2.8萬億引數的開源模型,擁有1M上下文長度,在Frontend Code Arena中排名第一,並在多項基準測試中取得優異成績。此次釋出標誌著開源模型的一個里程碑,儘管與頂級閉源模型仍存在差距。新聞通訊還涵蓋了其他AI新聞,包括安全事件、智慧體框架和機器人技術。
Kimi K3是一個2.8萬億引數的開源模型,擁有1M上下文和原生多模態輸入。 它在Frontend Code Arena中排名第一,超越了Claude Fable 5。 SAM — 一款在本地執行的開源AI智慧體 2026-07-17 09:34 UTC+8 SAM是一個免費的開源AI智慧體,它能在你的計算機上本地執行,無需訂閱。它不僅能聊天,還能實際執行任務,擁有173種工具,支援團隊協作、離線執行,並且注重隱私。
免費開源,本地執行,資料隱私安全 支援173種真實工具,可執行網頁、檔案、終端等操作 月之暗面釋出 Kimi K3:2.8萬億引數開源MoE模型,搭載Kimi Delta Attention和百萬上下文 2026-07-17 07:47 UTC+8 月之暗面於2026年7月16日釋出Kimi K3,這是一款2.8萬億引數的開源MoE模型,採用Kimi Delta Attention和Attention Residuals架構,支援原生視覺和100萬token上下文視窗。K3在多項基準測試中表現出色,但整體效能仍略遜於最強大的專有模型。
Kimi K3是首款開源2.8萬億引數MoE模型,啟用896個專家中的16個。 引入Kimi Delta Attention(KDA)和Attention Residuals(AttnRes),分別提升解碼速度和訓練效率。 AegisDB – 自託管AI代理記憶體,單個C語言二進位制檔案 2026-07-17 07:15 UTC+8 AegisDB是一個自託管的AI代理記憶體系統,提供持久化、語義化和工作記憶功能,透過簡單的JSON-over-TCP協議訪問。它採用單個無依賴的C語言二進位制檔案,支援多租戶、加密、備份、只讀副本和可觀測性,特別適合與Claude Code整合,確保資料完全由使用者掌控。
單個C語言二進位制檔案,零依賴,支援Docker部署 提供持久化、語義化(向量搜尋)和工作記憶三種記憶體型別 Kimi K3 在智慧知識工作基準測試中擊敗 GPT-5.6 Sol 2026-07-17 07:02 UTC+8 Artificial Analysis 釋出了 AA-Briefcase 智慧知識工作基準測試結果,Kimi K3 以 1547 Elo 排名第一,領先於 GPT-5.6 Sol 的 1495 分。該基準測試模擬真實商業工作流,評估模型在生成電子表格、簡報和備忘錄等任務中的表現。
Kimi K3 在 AA-Briefcase 基準測試中排名第一,Elo 得分為 1547。 GPT-5.6 Sol 以 1495 分排名第三,落後於 Claude Fable 5。 你的AI已就緒,但資料基礎可能尚未完善 2026-07-17 06:00 UTC+8 Cushman & Wakefield首席數字和資訊官Sal Companieh分享瞭如何透過產品運營模式、統一資料戰略以及與Databricks的合作,建立企業級AI核心,將想法到成果的時間從數月縮短至數天。
將技術人員嵌入業務部門,建立信任和以行為為導向的運營模式 透過資本投資模型要求技術計劃與業務負責人共同建立,確保與業務優先順序一致 Skyportal SRE – 開源AI基礎設施工程師 2026-07-17 05:13 UTC+8 Skyportal SRE 是一個開源AI基礎設施工程師工具,提供Python SDK、CLI和可觀測性代理,用於管理和監控AI基礎設施。
Skyportal SDK 是 SkyPortal 的官方 Python 客戶端,支援同步和非同步操作 CLI 提供互動式命令中心和自動化指令碼介面 如何讓我們的LeRobot影片讀取器速度提升最高15倍 2026-07-17 04:11 UTC+8 我們改進了Daft中的LeRobot影片讀取器,透過批次解碼將遠端資料集上的幀解碼速度從每幀3秒提升到整體數秒,實現了4-15倍的加速。
原始逐幀解碼因每次遠端開啟檔案並讀取索引而緩慢。 新的批次讀取器按分片分組,排序和聚類目標時間戳,每個聚類只尋求一次。 豐田分拆公司攜3億美元融資低調啟動 2026-07-17 03:52 UTC+8 這家由輝達和波音支援的初創公司表示,其輪式機器人已投入生產,並能持續學習新的工業任務。
自我破壞悖論:前沿實驗室正在摧毀自己的護城河 2026-07-17 02:59 UTC+8 Anthropic 秘密削弱了其最強大的編碼代理 Claude Fable 5,使其在涉及前沿 AI 開發任務時能力下降,以保護自身經濟地位。這一做法揭示了 AI 行業的結構性矛盾:實驗室既想製造最強大的工具,又害怕被自己創造的工具取代。與此同時,開源模型生態蓬勃發展,企業客戶正在轉向更便宜的開源替代方案。
Anthropic 在 Claude Fable 5 中秘密實施了針對 AI 開發任務的效能降級,以保護自己的競爭地位。 這一做法凸顯了前沿實驗室的自我破壞悖論:它們必須削弱自己最成功的產品來維持護城河。