AI News HubLIVE

今日必讀

政策

兩個可供選擇的人工智慧未來

文章探討了人工智慧安全的兩種願景:單例(Singleton)與多元(Plural)。單例世界由一個超級AI集中控制,安全依賴於完美設計;多元世界則透過廣泛民主化的AI訪問實現安全,依靠分散式系統的韌性與制衡。作者基於歷史證據,主張多元世界更能保障人類福祉與自由,儘管它可能混亂不完美,但避免了權力過度集中的風險。

  • 單例未來:單一超強ASI,由最可信之人設計,安全源自完美對齊。
  • 多元未來:多數人可訪問多種AI模型,安全來自分散化與制衡。
站內正文
晶片

Kimi K3並不便宜

基於Moonshot AI開源模型Kimi K3的效能與成本分析,指出其並非如外界所說的便宜,實際成本高於中國其他模型,但質量接近美國頂尖模型。

  • Kimi K3是Moonshot AI釋出的開源大語言模型,效能強大但引發爭議。
  • 部分評論誤認為K3成本低,實際其在基準測試中每任務成本接近OpenAI頂級模型。
站內正文
模型

揭秘驅動代幣轉售與欺詐的轉發市場

馬特·倫哈德的一項調查揭示了圍繞轉售大語言模型(LLM)代幣而興起的市場,該市場主要透過濫用免費試用、利用未受保護的支援機器人或使用被盜信用卡與拒付攻擊等手段,以顯著折扣提供API訪問。這種現象主要發生在中國,轉售商使用開源代理軟體如one-api和new-api來整合多個API金鑰。買家尋求廉價代幣、規避地理限制,或收集資料用於模型蒸餾。

  • 轉售商透過濫用免費試用、未受保護的支援機器人或盜刷信用卡等方式,以折扣價提供LLM API訪問。
  • 開源代理軟體one-api及其分支new-api被用於整合API金鑰池。
站內正文

黑森林實驗室釋出FLUX 3:用於影像、影片、音訊和機器人動作預測的多模態流模型

黑森林實驗室(BFL)釋出了FLUX 3,這是一個多模態基礎模型,能夠在單一架構中學習影像、影片和音訊。它是首個從同一權重集輸出影片、音訊和動作預測的FLUX模型。FLUX 3基於Self-Flow方法,該方法結合了流匹配目標和自監督特徵重建目標。該模型在影片生成方面表現出色,能夠生成長達20秒的片段並自帶音訊。在人類偏好測試中,FLUX 3在多個對比中勝出。此外,同一骨幹網路還驅動了FLUX-mimic機器人策略,響應時間低於80毫秒。

  • FLUX 3是一個多模態基礎模型,統一處理影像、影片和音訊。
  • 它可以生成長達20秒的影片片段,自帶音訊,並在人類偏好評估中領先。
站內正文
Agent

請提供API,而非AI

作者呼籲公司優先設計併發布功能完善的API,而不是專注於構建產品特定的AI聊天介面或助手。他認為,透過API暴露核心功能,能為AI代理提供更好的工具基礎,儘管這可能會削弱公司的市場地位。

  • 公司應優先設計易訪問、許可權精細的API。
  • API應支援令牌效率、人工稽核及文件完善。
站內正文

HART OS:開源AI作業系統,讓前沿AI無需資料中心

HART OS 是一款開源的AI原生作業系統,可本地執行於任何裝置(從筆記型電腦到機器人),將AI推理作為系統服務提供。它具備自我改進、跨節點聯邦以及OpenAI相容API等特性,徹底消除了對資料中心的需求。

  • HART OS 是AI原生作業系統,支援本地優先執行在任何裝置上。
  • 它透過Model Bus將AI推理作為系統服務,應用無需自帶模型或API金鑰。
站內正文

「Grill Me」技能

grill-me 技能會對你的計劃或設計進行反覆盤問,一次只問一個問題,並給出推薦答案。Matt Pocock 現在推薦使用 domain-model 而非 grill-me 進行大多數規劃工作,但 grill-me 仍適用於更區域性的壓力測試。在編寫 PRD、實現功能或確定資料模型之前使用它。推薦的工作流程以 domain-model 開始,然後依次為 to-prd、to-issues 和 tdd。

  • grill-me 是一種對計劃或設計進行反覆盤問的技能,用於解析決策樹。
  • Matt 現在推薦將 domain-model 作為預設規劃技能,grill-me 作為特定場景下的輕量選項。
站內正文

Show HN:ModelFuzz – AI代理的開源執行時防護欄

ModelFuzz 是一個開源工具,透過紅隊掃描器和防護裝飾器,幫助檢測和阻止 AI 代理的提示注入攻擊,保護基礎設施和敏感資料。

  • 提示注入可讓攻擊者劫持 LLM 代理,執行任意命令或竊取資料。
  • ModelFuzz 提供掃描器對任何 OpenAI 相容端點進行紅隊測試,發現漏洞。
站內正文
工具

Illume Labs – 您的24/7個性化健康伴侶

Illume Labs 提供全天候個性化健康追蹤服務,透過AI技術幫助使用者最佳化長壽策略。

  • Illume Labs 推出24/7健康伴侶服務
  • 利用AI技術實現個性化健康監測
站內正文
研究

美國人對全球人工智慧競賽的看法

皮尤研究中心調查顯示,36%的美國人認為中國在人工智慧領域比美國更先進,僅12%認為美國領先。43%認為美國成為AI全球領導者極其或非常重要,51%預計AI會加劇富國與窮國之間的差距。

  • 36%的美國人認為中國在AI發展上領先,12%認為美國領先,33%不確定
  • 43%認為美國應成為AI全球領導者,22%認為不重要
站內正文
其餘更新(5 條)
Agent

SP/1.0:為AI智慧體決策提供確定性、可復現的裁決

SHACKLE是一個針對自主AI智慧體的執行時斷路器協議,透過9個數學不變性、Ed25519簽名審計日誌和Redis分散式狀態引擎,提供確定性、可驗證的決策。

  • SHACKLE是首個開源AI智慧體執行時斷路器,具有加密審計鏈
  • 決策函式是純函式,包含8層保護,可在10分鐘內審計
站內正文

Boffin:AI編碼代理的工程師控制層

Boffin 是一個為 AI 編碼代理提供架構約束的工具,能按需路由相關規則並強制驗證,避免代理進行不必要的重寫。它透過為每個檔案提供精確的約束,確保小修復保持小範圍,同時支援多種主流編碼代理平臺。

  • Boffin 根據當前編輯路由相關的架構約束。
  • 要求與變更成比例的驗證。
站內正文

MCP 最大更新:移除眾多伺服器圍繞構建的機制

模型上下文協議(MCP)迎來發布以來最大更新,移除會話狀態和初始化握手,以簡化遠端伺服器操作。候選版本已於5月21日凍結,最終規範將於7月28日釋出。部分核心功能被棄用,並提供遷移指南。

  • MCP 更新消除會話親和性,使請求無狀態化,降低運維複雜度。
  • 功能和協議版本現透過 _meta 在每次呼叫中傳遞,支援快取和路由。
站內正文
政策

我的論文寫作AI使用政策

本文概述了在論文寫作中如何負責任地使用AI工具,強調透明度和倫理準則。

  • 提出個人使用AI寫作的明確政策
  • 強調保持原創性和學術誠信
站內正文

今年7月,我被Simple AI解僱了(一家深度YC公司)

作者Andy Trattner講述了他被Simple AI解僱的經歷,儘管入職僅三週,但他對公司和創始人仍持積極態度,並尋求新機會。

  • Andy Trattner在入職Simple AI三週後被解僱,Slack賬號在週二下午6點被刪除。
  • 他從未申請職位,而是被創始人Cat和Zach招募。