AI News HubLIVE

今日必讀

政策

兩個可供選擇的人工智能未來

文章探討了人工智能安全的兩種願景:單例(Singleton)與多元(Plural)。單例世界由一個超級AI集中控制,安全依賴於完美設計;多元世界則通過廣泛民主化的AI訪問實現安全,依靠分佈式系統的韌性與制衡。作者基於歷史證據,主張多元世界更能保障人類福祉與自由,儘管它可能混亂不完美,但避免了權力過度集中的風險。

  • 單例未來:單一超強ASI,由最可信之人設計,安全源自完美對齊。
  • 多元未來:多數人可訪問多種AI模型,安全來自分散化與制衡。
站內正文
芯片

Kimi K3並不便宜

基於Moonshot AI開源模型Kimi K3的性能與成本分析,指出其並非如外界所説的便宜,實際成本高於中國其他模型,但質量接近美國頂尖模型。

  • Kimi K3是Moonshot AI發佈的開源大語言模型,性能強大但引發爭議。
  • 部分評論誤認為K3成本低,實際其在基準測試中每任務成本接近OpenAI頂級模型。
站內正文
模型

揭秘驅動代幣轉售與欺詐的轉發市場

馬特·倫哈德的一項調查揭示了圍繞轉售大語言模型(LLM)代幣而興起的市場,該市場主要通過濫用免費試用、利用未受保護的支持機器人或使用被盜信用卡與拒付攻擊等手段,以顯著折扣提供API訪問。這種現象主要發生在中國,轉售商使用開源代理軟件如one-api和new-api來整合多個API密鑰。買家尋求廉價代幣、規避地理限制,或收集數據用於模型蒸餾。

  • 轉售商通過濫用免費試用、未受保護的支持機器人或盜刷信用卡等方式,以折扣價提供LLM API訪問。
  • 開源代理軟件one-api及其分支new-api被用於整合API密鑰池。
站內正文

黑森林實驗室發佈FLUX 3:用於圖像、視頻、音頻和機器人動作預測的多模態流模型

黑森林實驗室(BFL)發佈了FLUX 3,這是一個多模態基礎模型,能夠在單一架構中學習圖像、視頻和音頻。它是首個從同一權重集輸出視頻、音頻和動作預測的FLUX模型。FLUX 3基於Self-Flow方法,該方法結合了流匹配目標和自監督特徵重建目標。該模型在視頻生成方面表現出色,能夠生成長達20秒的片段並自帶音頻。在人類偏好測試中,FLUX 3在多個對比中勝出。此外,同一骨幹網絡還驅動了FLUX-mimic機器人策略,響應時間低於80毫秒。

  • FLUX 3是一個多模態基礎模型,統一處理圖像、視頻和音頻。
  • 它可以生成長達20秒的視頻片段,自帶音頻,並在人類偏好評估中領先。
站內正文
Agent

請提供API,而非AI

作者呼籲公司優先設計併發布功能完善的API,而不是專注於構建產品特定的AI聊天界面或助手。他認為,通過API暴露核心功能,能為AI代理提供更好的工具基礎,儘管這可能會削弱公司的市場地位。

  • 公司應優先設計易訪問、權限精細的API。
  • API應支持令牌效率、人工審核及文檔完善。
站內正文

HART OS:開源AI操作系統,讓前沿AI無需數據中心

HART OS 是一款開源的AI原生操作系統,可本地運行於任何設備(從筆記本電腦到機器人),將AI推理作為系統服務提供。它具備自我改進、跨節點聯邦以及OpenAI兼容API等特性,徹底消除了對數據中心的需求。

  • HART OS 是AI原生操作系統,支持本地優先運行在任何設備上。
  • 它通過Model Bus將AI推理作為系統服務,應用無需自帶模型或API密鑰。
站內正文

「Grill Me」技能

grill-me 技能會對你的計劃或設計進行反覆盤問,一次只問一個問題,並給出推薦答案。Matt Pocock 現在推薦使用 domain-model 而非 grill-me 進行大多數規劃工作,但 grill-me 仍適用於更局部的壓力測試。在編寫 PRD、實現功能或確定數據模型之前使用它。推薦的工作流程以 domain-model 開始,然後依次為 to-prd、to-issues 和 tdd。

  • grill-me 是一種對計劃或設計進行反覆盤問的技能,用於解析決策樹。
  • Matt 現在推薦將 domain-model 作為默認規劃技能,grill-me 作為特定場景下的輕量選項。
站內正文

Show HN:ModelFuzz – AI代理的開源運行時防護欄

ModelFuzz 是一個開源工具,通過紅隊掃描器和防護裝飾器,幫助檢測和阻止 AI 代理的提示注入攻擊,保護基礎設施和敏感數據。

  • 提示注入可讓攻擊者劫持 LLM 代理,執行任意命令或竊取數據。
  • ModelFuzz 提供掃描器對任何 OpenAI 兼容端點進行紅隊測試,發現漏洞。
站內正文
工具

Illume Labs – 您的24/7個性化健康伴侶

Illume Labs 提供全天候個性化健康追蹤服務,通過AI技術幫助用户優化長壽策略。

  • Illume Labs 推出24/7健康伴侶服務
  • 利用AI技術實現個性化健康監測
站內正文
研究

美國人對全球人工智能競賽的看法

皮尤研究中心調查顯示,36%的美國人認為中國在人工智能領域比美國更先進,僅12%認為美國領先。43%認為美國成為AI全球領導者極其或非常重要,51%預計AI會加劇富國與窮國之間的差距。

  • 36%的美國人認為中國在AI發展上領先,12%認為美國領先,33%不確定
  • 43%認為美國應成為AI全球領導者,22%認為不重要
站內正文
其餘更新(5 條)
Agent

SP/1.0:為AI智能體決策提供確定性、可復現的裁決

SHACKLE是一個針對自主AI智能體的運行時斷路器協議,通過9個數學不變性、Ed25519簽名審計日誌和Redis分佈式狀態引擎,提供確定性、可驗證的決策。

  • SHACKLE是首個開源AI智能體運行時斷路器,具有加密審計鏈
  • 決策函數是純函數,包含8層保護,可在10分鐘內審計
站內正文

Boffin:AI編碼代理的工程師控制層

Boffin 是一個為 AI 編碼代理提供架構約束的工具,能按需路由相關規則並強制驗證,避免代理進行不必要的重寫。它通過為每個文件提供精確的約束,確保小修復保持小範圍,同時支持多種主流編碼代理平台。

  • Boffin 根據當前編輯路由相關的架構約束。
  • 要求與變更成比例的驗證。
站內正文

MCP 最大更新:移除眾多服務器圍繞構建的機制

模型上下文協議(MCP)迎來發布以來最大更新,移除會話狀態和初始化握手,以簡化遠程服務器操作。候選版本已於5月21日凍結,最終規範將於7月28日發佈。部分核心功能被棄用,並提供遷移指南。

  • MCP 更新消除會話親和性,使請求無狀態化,降低運維複雜度。
  • 功能和協議版本現通過 _meta 在每次調用中傳遞,支持緩存和路由。
站內正文
政策

我的論文寫作AI使用政策

本文概述了在論文寫作中如何負責任地使用AI工具,強調透明度和倫理準則。

  • 提出個人使用AI寫作的明確政策
  • 強調保持原創性和學術誠信
站內正文

今年7月,我被Simple AI解僱了(一家深度YC公司)

作者Andy Trattner講述了他被Simple AI解僱的經歷,儘管入職僅三週,但他對公司和創始人仍持積極態度,並尋求新機會。

  • Andy Trattner在入職Simple AI三週後被解僱,Slack賬號在週二下午6點被刪除。
  • 他從未申請職位,而是被創始人Cat和Zach招募。