AI News HubLIVE

芯片動態

GraphRAG 過於複雜:我們實際用來構建知識圖譜的方法

本文探討了企業級 AI “公司大腦”構建中的檢索增強生成(RAG)技術侷限性,指出標準 RAG 僅擅長處理單一事實類問題,而 GraphRAG 雖然理論上能解決多文檔綜合問題,但其高昂成本、狹窄優勢及實體解析難題使其在多數場景下過於複雜。作者介紹了其公司 QX Labs 的替代方案:“類圖 RAG”——一種基於普通數據庫的輕量級實體-關係系統,無需圖數據庫、預建圖譜或自定義本體,通過惰性總結、固定本體和實體解析瀑布流實現自服務部署,顯著降低了成本與運維負擔。

  • 標準 RAG 僅適用於單一事實問題,而企業需要處理多文檔綜合及精確計數類問題
  • GraphRAG 索引成本是普通向量索引的 1000 倍,且優勢主要集中在多跳推理場景
站內正文

初創公司成立代工廠開發芯片材料

由英偉達、Meta和三星等創始成員組成的聯盟,旨在減少對芯片中稀有材料的依賴。

  • 英偉達、Meta和三星等公司聯合成立一家芯片材料代工廠。
  • 該代工廠旨在降低對稀土等稀有材料的依賴。
站內正文

Stoke – 失控AI智能體的終止開關(Rust,預算上限)

Stoke是一個輕量級的Rust網關,在請求到達提供商之前強制實施硬預算上限、循環檢測和速率限制,從而防止失控支出。它還提供跨多台機器的本地優先路由、基於成本/速度的自動路由以及失敗關閉架構。

  • 每個API密鑰的硬美元預算上限,在任何提供商調用之前執行,並實時跟蹤每個密鑰的支出。
  • 循環終止開關,使用精確哈希和語義相似性檢測,在幾秒內阻止重複請求。
站內正文

利用 Amazon Quick 和 NVIDIA NeMo Agent Toolkit 為您的業務構建專業化代理工作流

本文展示瞭如何將 Amazon Quick 作為業務用户的專業代理工作流前端。通過 NVIDIA NeMo Agent Toolkit 構建供應鏈風險示例,幫助規劃人員從 Amazon Quick 儀表盤和知識上下文轉向引導式緩解建議。

  • Amazon Quick 為業務用户提供結構化數據和企業知識的單一對話工作空間。
  • NVIDIA NeMo Agent Toolkit 是開源框架無關庫,用於連接、評估、分析和優化代理工作流。
站內正文

舊金山餐廳因AI菜單圖片遭憤怒抵制

舊金山一家新開的餐廳因使用AI生成的菜單圖片而遭到社區強烈批評,甚至被塗鴉破壞。店主不得不撤下圖片,並計劃通過社區活動重建聲譽。

  • AJ和Lyndsey Lozano在Haight Street新開的Grind & Unwind餐廳因AI菜單圖片引發爭議。
  • Reddit帖子批評這些圖片像“垃圾食品”,社區反應強烈,甚至出現塗鴉破壞。
站內正文

Kimi K3:開放權重升級

Moonshot AI發佈了最新旗艦模型Kimi K3,這是一個2.8萬億參數的MoE模型,將於7月27日開放權重。K3在多項基準測試中排名靠前,成為最強的開源模型。文章探討了中美AI模型差距縮小、中國開源策略、開源模型的經濟影響以及中國AI的效率優勢。

  • Kimi K3是2.8T參數的MoE模型,開放權重,性能接近前沿閉源模型。
  • 中國AI實驗室展示出獨立創新能力,而不僅僅是快速追隨。
站內正文

AI解鎖零售、旅遊和消費品行業轉型的三種方式

本文探討了AI如何通過三種方式——將暗數據轉化為信號、擴展概率推理的問題空間、將人的能力與員工數量脱鈎——來解決零售、旅遊和消費品行業中信號與行動之間的鴻溝,並強調治理是真正的競爭優勢。

  • AI作為系統而非試點部署,能同時解決信任、時間和成本三大問題。
  • 暗數據轉化為信號、概率推理擴展問題空間、人的能力與員工數量脱鈎是三個關鍵轉變。
站內正文

NVIDIA在SIGGRAPH上通過代理AI和物理AI推動圖形與仿真發展

NVIDIA在SIGGRAPH 2026上宣佈多項創新,包括通過模型上下文協議(MCP)將AI代理集成到創意工具中,推出合成視頻檢測器NIM微服務以識別AI生成視頻,並開源Cosmos 3 Edge世界模型用於本地物理AI。這些進展旨在加速內容創作、媒體驗證和機器人技術。

  • Adobe、Affinity、Blender等創意應用通過MCP支持AI代理,實現自動化任務。
  • NVIDIA發佈合成視頻檢測器NIM微服務,幀級分析視頻內容,準確率高達92%。
站內正文

美國AI封閉且專有,正在輸掉競爭

文章分析了美國AI公司通過封閉和專有化模式維持競爭優勢,但中國通過開放模型策略正在縮小差距。AI模型自身缺乏護城河,用户容易切換,而中國企業利用開放模型獲得分佈優勢,挑戰美國的主導地位。

  • AI模型本身缺乏護城河,用户可輕鬆切換,專有化模式難以鎖定客户。
  • 美國GPU出口管制限制了中國的全球服務,卻促使中國通過開放模型獲得分佈優勢。
站內正文

Import AI 465:開放與封閉模型差距縮小;Kimi K3;Demis的重大政策計劃

英國政府AI安全研究所發現,開放權重模型與封閉前沿模型在網絡安全能力上的差距正在縮小。中國公司月之暗面發佈Kimi K3模型,性能接近前沿模型,但存在一定脆性。DeepMind創始人Demis Hassabis提出類似FINRA的AGI監管框架。研究顯示,AI系統可秘密執行側信道任務,極難檢測。

  • 開放權重模型在網絡安全能力上追趕封閉模型,差距從6-10個月縮小至4-7個月。
  • Kimi K3是一個2.8萬億參數模型,在多數基準上接近Claude Fable 5和GPT 5.6 Sol,但可能過度優化基準。
站內正文

理解Go AI推理:什麼是推理?

本文是系列文章的第一篇,介紹如何從Go語言直接本地運行大型語言模型。文章解釋了推理的本質:基於凍結的權重進行下一個標記預測,並詳細介紹了自迴歸循環、分詞器工作原理以及GGUF文件格式的結構和加載過程。

  • 推理是使用已訓練好的模型權重進行下一個標記預測的過程,不涉及學習或更新。
  • 模型通過自迴歸循環逐個生成標記,每次預測後將其附加到序列中繼續。
站內正文

百時美施貴寶基於NVIDIA Vera Rubin打造生命科學行業最先進的AI工廠

百時美施貴寶(BMS)宣佈部署其第二代NVIDIA DGX SuperPOD,基於八套DGX Vera Rubin NVL72系統,成為生命科學領域最強大、最節能的AI集羣。新系統將向所有科學家開放,無需等待或限制,支持藥物發現全流程的AI應用,包括目標識別、化合物庫擴展和先導優化。BMS還整合了現有集羣,形成統一環境,並通過NVIDIA Mission Control提供AI原生工具。

  • BMS部署第二代NVIDIA DGX SuperPOD,採用Vera CPU和Rubin GPU,性能提升10倍/兆瓦。
  • 新系統向所有科學家開放,實現“無限計算”,加速藥物發現。
站內正文

中國給美國人工智能霸主地位一記組合拳

中國領先的人工智能公司Moonshot和阿里巴巴發佈了新模型,聲稱能以更低成本與OpenAI和Anthropic的最佳模型競爭。這些開放源代碼的發佈加劇了中美技術競賽,並質疑美國鉅額投入是否能維持優勢。

  • Moonshot發佈Kimi K3,阿里巴巴推出Qwen3.8,均聲稱性能接近頂尖美國模型。
  • 兩家公司強調模型開源,與美國的封閉策略形成對比。
站內正文

空客從AWS起飛:數字主權的關鍵一步

空客宣佈將約900個應用從AWS遷移到法國雲服務商Scaleway,以加強數字主權。此舉反映了美國數據保護不可靠的擔憂,但供應鏈管理和AI領域仍面臨挑戰。

  • 空客將900項應用從AWS遷移至法國Scaleway,首批70項優先遷移。
  • 數字主權成為商業驅動力,美國被視為數據安全風險。
站內正文

Kimi K3 開放權重模型:中國最大的人工智能押注內存而非算力

月之暗面發佈Kimi K3,一個擁有2.8萬億參數的開放權重模型,採用混合專家架構、量化訓練和Delta注意力機制,以內存池化策略應對美國芯片限制。儘管參數龐大,但模型通過降低計算需求來適配受限硬件,實際部署仍需數據中心級基礎設施,且軟件生態尚未完全就緒。

  • Kimi K3 擁有2.8萬億參數,是迄今最大的開放權重模型。
  • 採用混合專家架構,每次推理僅激活1.8%的參數,但內存佔用不減。
站內正文

AI數據中心電力限制是2026年的真正瓶頸

文章指出,到2026年,AI基礎設施的主要限制將從GPU供應轉向電網容量。預計到2027年,40%的AI數據中心將受到電力限制,新電網連接的審批時間長達24-36個月。文章詳細分析了電力需求、推理驅動電力曲線,並提出了效率提升、調度和地理分佈等策略,同時推廣Spheron的分佈式GPU網絡作為解決方案。

  • GPU可用性已改善,但為GPU供電的電網容量現已成為AI數據中心的主要瓶頸。
  • 推理工作負載持續運行,驅動大部分能源消耗,需要電力感知規劃。
站內正文

Kimi K3 為何引起華盛頓關注

月之暗面AI發佈Kimi K3,在Frontend Code Arena基準測試中奪冠,引發美國AI監管辯論。儘管在前端編碼方面表現強勁,但整體仍落後於Claude Fable 5。該發佈加劇了AI監管和開源模型的政策爭論,對NVIDIA和Anthropic等股票產生影響。

  • Kimi K3在Frontend Code Arena獲得1679分,擊敗Claude Fable 5和GPT-5.6 Sol,但Fable 5在14項基準中仍領先8項。
  • 白宮顧問David Sacks引用K3證明美國AI監管損害競爭力,加劇政策辯論。
站內正文

Thinking Machines Inkling 完全指南

Thinking Machines Lab 發佈了其首個通用開放權重基礎模型 Inkling。該模型擁有 9750 億參數(其中 410 億激活)、100 萬 token 上下文窗口,採用多模態稀疏 MoE 架構,支持文本、圖像和音頻處理。Inkling 以可定製的開源模型形態,面向多模態推理、智能體、編程、工具使用及企業微調場景。本文詳解其架構、訓練、基準測試、部署及微調工作流。

  • Inkling 是 975B 總參數、41B 激活參數的多模態稀疏 MoE 模型,上下文窗口達 100 萬 token。
  • 採用混合注意力、相對位置編碼、短卷積及多 token 預測等技術,支持文本、圖像、音頻輸入。
站內正文

什麼是智能體AI?它可能是人工智能的下一個重大轉變

智能體AI是一種能夠自主規劃、決策和採取行動以實現特定目標的人工智能系統,代表了從簡單回應查詢到主動執行任務的重大轉變。本文探討了其定義、發展動力、常見應用、挑戰以及基礎設施的重要性。

  • 智能體AI能夠自主規劃、執行和調整策略以達成目標,超越傳統AI的“提示-響應”模式。
  • 得益於更強大的語言模型、工具集成和長上下文窗口,智能體AI正快速成為自動化複雜工作流程的關鍵技術。
站內正文

MemoGuard:一種用於通信受限機器人導航中防止記憶陷阱的自適應運行時

在災難檢查、搜索救援等關鍵任務中,通信受限的機器人必須依賴機載決策。低成本的記憶重用可能因環境變化而變得不安全(稱為“記憶陷阱”)。本文提出MemoGuard,一種輕量級自適應運行時,在重用前根據拓撲、資源和結果契約驗證記憶,僅當驗證失敗時才調用回退推理。在走廊巡檢模擬器中,與單純相似性重用相比,電池安全違規減少76.6%,回退調用次數比始終使用推理減少21.4%。在NVIDIA Jetson AGX Xavier上使用本地llama3.2:3b回退推理時,每次試驗節省3.67秒和36.97焦耳。

  • 提出“記憶陷阱”概念:高相似度但執行無效的情景記憶。
  • MemoGuard通過合同檢查(拓撲、資源、結果)在重用前驗證記憶。
站內正文

部分信息分解作為資源受限深度神經網絡訓練中多對比度3D MRI選擇策略用於腦腫瘤分割

使用部分信息分解(PID)框架在訓練前選擇最優的MRI對比度組合,以降低多對比度3D MRI腦腫瘤分割的計算成本。研究選取T1c+T2-FLAIR作為最佳輸入對,在輕量級3D U-Nets上表現接近全輸入配置,平均Dice 0.676 vs 0.687,驗證了PID的實際價值。

  • 提出PID框架用於在資源受限時選擇最優MRI對比度輸入對
  • T1c+T2-FLAIR被選為最佳兩輸入組合,性能接近全輸入
站內正文

科技工作者面臨AI轉型帶來的經濟安全感消失

隨着硅谷大力推動人工智能和裁員,曾被視為經濟贏家的科技工作者正經歷前所未有的不安全感。文章通過個人故事和行業數據,揭示了AI如何改變就業市場、加劇不平等,並引發對未來的焦慮。

  • 一位Meta前高管在多次裁員後被解僱,發現就業市場已不復從前。
  • 科技公司用AI使用量排名員工,導致工作環境競爭激烈。
站內正文

2026年單張24GB GPU可運行的最佳本地LLM:Qwen、Gemma、Mistral、DeepSeek對比

本文對比了六款適合單張24GB GPU(如RTX 3090/4090)的開放權重模型,涵蓋Qwen3.6、Gemma 4、Mistral Small等,並解釋了內存分配、量化策略以及各模型的優勢場景。

  • 24GB是本地推理的實際起點,推薦使用20B-35B參數模型而非壓縮70B模型。
  • Qwen3.6-27B是最全面的通用選擇,DeepSeek-R1-Distill-Qwen-32B適合深度推理但佔用最高。
站內正文

Show HN: Headroom —— 測量本地AI的GPU真實帶寬上限

Headroom是一款30秒的瀏覽器內測試工具,用於測量本地AI推理時GPU內存帶寬的真實上限,無需下載模型,使用合成權重,需要WebGPU支持。它通過三種獨立方法測量帶寬,並檢測導致瀏覽器內LLM輸出錯誤的子組bug。驗證表明,當前瀏覽器引擎受發射開銷限制,硬件仍有2-3倍潛力。

  • 30秒瀏覽器測試,無需模型下載,使用合成權重
  • 三種獨立帶寬測量:緩衝複製、三讀寫、純讀歸約
站內正文

Together AI 與 Y Combinator 合作推出首個專為 YC 社區打造的 GPU 集羣

Together AI 和 Y Combinator 宣佈合作,為 YC 初創公司提供首個專用 GPU 集羣,解決計算瓶頸。初創公司可靈活承諾數週而非兩年合同,通過自助服務平台直接管理 GPU,無需經過 YC。該集羣已滿負荷運行,並支持從單節點到大規模擴展的需求。

  • Together AI 與 YC 合作推出首個專用 GPU 集羣,YC 初創公司可直接訪問計算資源。
  • 承諾期為數週而非兩年,釋放資本用於業務其他部分。
站內正文

價值超過1000美元的AI/GPU/LLM免費積分彙總

為AI研究人員整理的免費資源合集,包括超過1000美元的免費計算積分、研究指南、社區論壇等,幫助學生在不花費一分錢的情況下開始AI研究。

  • 提供超過1000美元的免費AI/GPU/LLM積分
  • 包含從想法到論文發表的全套研究指南
站內正文

台積電加速亞利桑那工廠建設以抓住人工智能“大趨勢”

台積電首席財務官黃仁昭對CNBC表示,公司正在加速亞利桑那工廠的產能擴張,以應對AI驅動的多年結構性需求。公司額外承諾投資1000億美元,使在美總投資達到2650億美元,並將全年資本支出上調至600-640億美元。台積電正在將5納米產能轉換為先進的3納米節點,2納米技術將成為下一季度營收的新驅動力。

  • 台積電額外投資1000億美元擴大亞利桑那工廠,總投資達2650億美元。
  • 公司正在將5納米產能轉換為3納米節點,以滿足AI需求。
站內正文

Feyn AI發佈SQRL:一個在編寫查詢前先檢查數據庫的文本到SQL模型系列

Feyn Labs發佈了SQRL,這是一系列文本到SQL模型,能在生成查詢前通過只讀探針檢查數據庫。旗艦型號SQRL-35B-A3B在BIRD Dev上達到70.6%的執行準確率,略超Claude Opus 4.6,並可蒸餾為可自託管的4B和9B檢查點。

  • SQRL通過只讀探針在提交最終查詢前檢查數據庫。
  • SQRL-35B-A3B在BIRD Dev上達到70.6%準確率,超過Claude Opus 4.6的68.77%。
站內正文

阿里巴巴預覽Qwen3.8-Max:2.4萬億參數多模態模型,緊隨Moonshot的Kimi K3開源發佈之後

阿里巴巴Qwen團隊預覽了Qwen3.8-Max-Preview,一個2.4萬億參數的多模態MoE模型,號稱“僅次於Fable 5”。該預覽已在Token Plan、Qoder和QoderWork上以標準定價的10%提供。但尚未提供任何基準測試表、模型卡、許可證、每token價格或激活參數數量。本文區分了阿里巴巴確認的內容和僅聲稱的內容。

  • Qwen3.8-Max-Preview已在Token Plan、Qoder和QoderWork上以10%的優惠價格提供。
  • 2.4萬億參數和“僅次於Fable 5”的排名僅是阿里巴巴的聲稱,尚未有已驗證的基準測試。
站內正文

福布斯認為AI創造了新職業,但歷史早已有之

硅谷出現了一批精通AI、加密貨幣等技術的豪華伴遊,客人為了一次深入對話支付數千美元。但這種現象並非AI獨有:日本藝伎、希臘赫泰拉等早已存在類似模式。技術改變,但人類對關注和陪伴的需求始終未變。

  • 硅谷豪華伴遊通過談論AI、Nvidia等話題吸引科技富豪,收費高昂。
  • 文章指出該現象並非新奇,歷史上藝伎、名妓等皆扮演類似角色。
站內正文

Moonshot AI 因Kimi K3需求大增暫停新訂閲

由於Kimi K3需求超出預期,Moonshot AI宣佈暫停新訂閲以保護現有用户體驗。

  • Kimi K3需求在48小時內接近容量上限
  • 為保護現有用户,暫停新訂閲
站內正文

序列雷達 #897:上週AI要聞:中國、壓縮與開放模型競賽

本週AI領域多項重要進展:Thinking Machines發佈開源975B參數MoE模型Inkling,Moonshot AI推出2.8萬億參數Kimi K3,PrismML展示可在手機上運行的Bonsai 27B模型。OpenAI的GPT-Red通過自博弈實現自動化紅隊測試,並在測試中對GPT-5.1達到84%的攻破率。此外,習近平在上海世界人工智能大會上強調開源AI作為全球公共品,呼籲國際合作。

  • Thinking Machines發佈開源模型Inkling:9750億參數,MoE架構,支持多模態和百萬標記上下文窗口
  • Moonshot AI推出Kimi K3:2.8萬億參數,激活16個專家,針對長時編碼和知識工作
站內正文

從算法到自主:AI如何重寫軟件與移動出行架構

人工智能正從基於規則的程序設計(軟件1.0)演變為機器學習(軟件2.0),再到如今具有湧現推理能力的自然語言界面(軟件3.0)。大規模語言模型(LLM)是一種通用技術,影響廣泛,但缺乏物理根基。下一個前沿是空間智能與物理AI,推動自動駕駛和人形機器人發展。

  • AI經歷了從人類編寫邏輯到機器學習,再到自然語言界面的三個階段。
  • LLM作為通用技術,類似於電力,具有廣泛的適用性和變革性。
站內正文

Show HN: Zlvox – 25款免費開發者工具(AI、JSON、PDF),零追蹤

Zlvox是一個提供25款免費開發者工具的平台,涵蓋AI、JSON、PDF、圖像處理等,強調隱私保護(客户端處理,零數據存儲)和卓越性能。無需註冊即可使用。

  • 25款免費開發者工具,涵蓋AI、JSON、PDF、圖像等領域,零追蹤。
  • 所有工具在客户端運行,數據不離開瀏覽器,不存儲任何用户數據。
站內正文

Kimi K3 vs DeepSeek V4 Pro vs GLM-5.2:開源萬億參數MoE模型基準測試、許可與成本對比

中國三家實驗室的旗艦開源MoE模型——Kimi K3、DeepSeek V4 Pro和GLM-5.2——在基準測試、許可條款和服務成本上各有優劣。Kimi K3性能最強但僅限API,DeepSeek V4 Pro成本最低且立即開源,GLM-5.2平衡了速度與可部署性。

  • Kimi K3(2.8萬億參數)在Artificial Analysis智能指數中以57分領先,但權重需等到7月27日才發佈。
  • DeepSeek V4 Pro(1.6萬億參數)MIT許可,成本僅為K3的1/17,適合注重性價比的團隊。
站內正文

市長曼達尼:房東不得使用AI圖像發佈出租廣告

紐約市長佐蘭·曼達尼發佈《租賃欺詐報告》,要求房東和中介在租房廣告中披露是否使用AI生成或編輯的圖像。此舉旨在打擊虛假房源廣告,保護租客權益,並將推動租户工會合法化、擴大租客談判權等措施。

  • 紐約市長曼達尼發佈報告,要求房東披露AI修改的房源圖片。
  • AI生成的虛假房產圖片問題日益嚴重,尤其影響遠程簽約租客。
站內正文

NVIDIA發佈DeepStream 9.1:為視覺AI帶來13項技能和多視角3D追蹤的智能體AI

NVIDIA DeepStream 9.1 引入了13項智能體技能,允許Claude Code和Codex等編碼代理通過自然語言提示構建多攝像頭視頻分析管道。多視角3D追蹤(MV3DT)將每個攝像頭的檢測結果融合到一個共享的3D世界中,並分配全局一致的對象ID,而AutoMagicCalib(AMC)則消除了手動攝像頭校準。該版本還增加了JetPack 7.2支持和一個統一的GitHub開源倉庫。

  • DeepStream 9.1 提供13個智能體技能,支持自然語言驅動的多攝像頭視覺管道搭建。
  • MV3DT 實現跨攝像頭3D追蹤,分配全局唯一ID,無需手動校準。
站內正文

Talon:一個自託管的長期AI代理框架

Talon是一個多平台、可自託管的AI代理框架,支持Telegram、Discord、Microsoft Teams、終端及跨平台的桌面/移動應用。它提供可插拔的後端(Claude Agent SDK、Kilo、OpenCode、Codex、OpenAI Agents)和完整的MCP工具訪問,具備背景代理、目標管理、技能系統、事件總線等功能。項目架構清晰,前端與後端獨立,支持熱重載插件和技能,便於擴展。

  • Talon支持多種前端(Telegram、Discord、Teams、終端、桌面/移動應用)和後端(Claude、Kilo、OpenCode、Codex、OpenAI Agents),通過MCP協議提供豐富工具。
  • 具備背景代理(心跳、夢境)、持久目標、技能系統(SKILL.md)和觸發器,使代理能主動推進任務。
站內正文

人工智能繁榮建立在債務之上,投資者需求驟降,超大規模企業加速債券發行

人工智能(AI)繁榮日益依賴債務融資,但隨着超大規模企業加大債券發行,投資者需求卻在下降。亞馬遜最近的債券發行不得不提高收益率,訂單倍數下降。AI債券供應激增,但投資者要求更高利差。同時,中國AI模型Kimi K3的突破性性能引發對美國AI支出可持續性的擔憂,可能導致經濟衰退。

  • 自2025年初以來,Alphabet、Meta、亞馬遜、甲骨文等公司已發行超過3000億美元債券。
  • 投資者對AI債券的需求下降,亞馬遜債券訂單倍數從3.2倍降至2.5倍。
站內正文

PixelUp:一款完全脱機、輕量級的AI視頻放大軟件(Windows)

PixelUp 是一款專為 Windows 設計的輕量級 AI 視頻放大工具,利用 FSRCNN 和 ESPCN 深度學習模型,在本地硬件上快速將低分辨率視頻提升至高清畫質。它支持 Nvidia CUDA、Vulkan 和 CPU 處理,提供批量任務管理、無損音頻同步,並採用終身許可證模式,一次性付費 $19,無需訂閲,完全保護用户隱私。

  • 完全本地運行,無需聯網或註冊賬户,保障數據隱私。
  • 採用優化的 FSRCNN 和 ESPCN 模型,快速重建細節。
站內正文

AIpine – iPhone上AI工件的瑞士軍刀

AIpine是一款專為iPhone設計的應用,用於查看、預覽和組織AI生成的各類文件,如JSX、HTML、Mermaid圖表、SVG等,支持離線使用,無賬户和雲服務,保護用户隱私。

  • AIpine提供對AI生成文件的預覽和源代碼查看,支持多種格式。
  • 應用完全離線工作,文件存儲在本地,無需賬户或雲服務。
站內正文

BaseRT - Apple M5優化版

BaseRT在Apple M5芯片上實現顯著性能提升,比llama.cpp快6.4倍,比MLX快3.9倍。

  • BaseRT針對Apple M5芯片進行了優化,提供超高速推理性能。
  • 性能基準測試顯示,比llama.cpp快6.4倍,比MLX快3.9倍。
站內正文

Timeline Studio:本地優先的AI視頻編輯器

Timeline Studio 是一款在瀏覽器中運行的本地優先 AI 視頻編輯器,結合了 CapCut 風格的多軌道時間線、瀏覽器端 AI 配音、自動字幕、視覺工具、虛擬形象生成以及確定性離線導出功能。

  • 支持多語言 AI 配音、自動字幕、智能構圖、人像分割、AI 人聲分離和數字人功能。
  • 提供完整的視頻編輯功能,包括多軌道時間線、關鍵幀動畫、濾鏡效果、貼紙等。
站內正文

埃隆·馬斯克的孟菲斯人工智能帝國成為數據中心抵制的中心

埃隆·馬斯克在孟菲斯快速建造人工智能數據中心,引發居民對噪音和排放的不滿,全國範圍內出現政策提案、抗議和訴訟。

  • 馬斯克的xAI數據中心Colossus和Colossus II使用燃氣輪機,造成噪音和污染。
  • 紐約州和新澤西州已通過法規限制或規範數據中心建設。
站內正文

Anthropic 宣佈 Claude Fable 5 永久納入訂閲計劃

Anthropic 決定自2026年7月20日起,將 Claude Fable 5 永久納入 Max 和 Team Premium 訂閲計劃(額度為50%),併為 Pro 和 Team Standard 用户提供一次性100美元積分。此舉逆轉了此前因算力限制而計劃移除 Fable 5 的決定,主要受到 GPT-5.6 Sol 等競爭對手的壓力。

  • Claude Fable 5 將於7月20日起永久包含在 Max 和 Team Premium 訂閲中,使用額度限制為50%。
  • Pro 和 Team Standard 用户可通過使用積分繼續訪問,並獲得一次性100美元信用額度。
站內正文

Cicy-code – 通過 npx 使用的本地優先多智能體編碼工作區

cicy-code 是一個開源的、本地優先的多智能體開發工作區,集成了 tmux、WebTTY 終端、React 前端、AI 網關和技能市場。它通過 npx 作為單個二進制文件分發,讓用户能夠在約 5 分鐘內啓動一個智能體團隊。

  • 本地優先的多智能體工作區,支持編碼智能體編排。
  • 集成 tmux、WebTTY、React、AI 網關和技能市場。
站內正文

一個逃避AI檢測的小實驗

作者嘗試使用Claude Code、10個並行代理和基本技巧來逃避AI檢測,但失敗了。文章詳細記錄了多次嘗試,包括使用維基百科規則、Pangram API反饋和模仿特定作者風格,所有嘗試均未成功。唯一的成功案例是手動重寫自己的文章,AI檢測分數降至0%。

  • 作者使用AI輔助撰寫了84篇博客文章,幾乎所有內容都被檢測為100% AI生成。
  • 嘗試通過AI代理編輯、模仿人類寫作風格和特定作者聲音來逃避檢測,均未成功。
站內正文

Gpu.ai 10萬美元大獎黑客馬拉松:2026年8月22日,免費雲GPU構建

GPU.ai 將於2026年8月22日至24日舉辦在線全球黑客馬拉松,提供1,000美元現金大獎及免費GPU積分。參賽者需基於GPU.ai平台構建AI應用、代理、推理API或創意工作流,僅限50支團隊入選。

  • GPU.ai 黑客馬拉松於2026年8月22日啓動,提供1,000美元大獎和免費GPU積分
  • 僅接受50支團隊,個人或團隊均可參賽
站內正文

主題導航

芯片 — AI 主題新聞 | AI News Hub