AI News HubLIVE

政策动态

Augustus融资1.8亿美元,打造AI与稳定币时代的清算银行

Augustus公司已融资1.8亿美元,旨在构建一个为AI和稳定币时代服务的清算银行。该公司已通过其在芬兰的受监管实体提供欧元清算,每年处理数十亿欧元。其客户包括Kraken等加密交易所。今年5月,Augustus获得美国货币监理署(OCC)的有条件批准,预计最终获批后直接接入美元清算。公司认为,十年内所有清算银行都将提供稳定币通道。此外,Augustus的平台从头构建,支持可编程支付和全天候结算,以应对AI带来的新风险。

  • Augustus融资1.8亿美元,用于建设面向AI和稳定币时代的清算银行。
  • 该公司已通过芬兰受监管实体处理数十亿欧元的欧元清算,客户包括Kraken等。
站内正文

Apache Spark 4.2:让数据对AI开发者更友好

Apache Spark 4.2版本发布,重点转向AI原生数据平台,引入了度量视图、原生向量搜索、实时Python流处理、地理空间支持等特性,旨在简化AI开发者的特征工程、实时信号处理和嵌入工作流。

  • Spark 4.2 引入了度量视图(Metric Views),为AI系统提供一致且可治理的业务指标。
  • 原生支持向量相似性操作,允许在Spark内直接进行嵌入存储与相似性查询,减少对外部向量数据库的依赖。
站内正文

Anthropic 15亿美元图书版权和解获法官批准

一名联邦法官批准了Anthropic与作者之间15亿美元的集体诉讼和解,该诉讼指控Anthropic在训练AI模型时使用了受版权保护的书籍。和解将为每位受影响的作者每本涉嫌盗版的书籍提供约3000美元的赔偿,被认为是历史上最大的版权赔偿。

  • 联邦法官Araceli Martínez-Olguín批准了Anthropic 15亿美元的和解协议。
  • 作者每本被指控盗版的图书可获得约3000美元赔偿。
站内正文

我们扫描了1868个AI构建的应用并审计了扫描器

PathToShip扫描了1868个公开的AI构建应用,发现仅23%达到生产就绪标准。扫描器初始的严重发现误报率达42%,经修复后降至约25%。结果揭示了AI生成代码在生产就绪性、安全性和架构方面的典型差距。

  • 23%的AI构建应用通过80分的生产就绪门槛,平均分68.3。
  • 24%的应用存在至少一个严重发现,15%包含硬编码密钥。
站内正文

利用自我蒸馏推理优化Amazon Nova监督微调

本文探讨了在监督微调(SFT)中为缺乏推理轨迹的数据集生成思考令牌的方法。首先分析了推理抑制问题,然后介绍了自我蒸馏推理(SDR),并通过三个基准验证了其效果,最后提供了实用建议。SDR通过复用基础模型的思维链,在不牺牲目标性能的情况下有效缓解灾难性遗忘,甚至提升目标性能。

  • 使用无推理轨迹的数据集进行SFT会导致模型推理能力丧失(推理抑制)。
  • 自我蒸馏推理(SDR)利用基础模型自身生成推理轨迹,无需人工标注。
站内正文

Show HN:一个人在AI-only MMO中操控200个AI代理

SpaceMolt 是一款玩家不直接参与的游戏,所有角色都是AI代理。人类“操作员”构建并部署这些机器人,然后观察结果。本文采访了Brocktree,他运营着游戏中最大的集群之一——约200个代理负责采矿、运输和物资分配。他分享了如何构建集群、为何坚持人类决策,以及“脚本比令牌更便宜”的核心理念。

  • Brocktree运营约200个AI代理,通过一个静止不动的“Parallax”机器人协调所有物资流转。
  • 他坚持人类负责高层规划,AI仅执行具体任务,拒绝让AI自主决策。
站内正文

美国悄然安装9万套Flock摄像头:它们追踪什么,如何查看你所在的城市

Flock摄像头在全美各地悄然部署,利用AI识别车辆及追踪行踪,但居民往往毫不知情。本文探讨其工作原理、隐私风险、误报警例及争议。

  • Flock摄像头通过AI识别车牌、车型等,数据上传云端,警方可跨区域搜索车辆行踪。
  • 联网追踪可能暴露个人日常生活轨迹,存在隐私泄露、数据安全及误报风险。
站内正文

Show HN: Rowset – 面向AI智能体的开源后端

Rowset 是一个专为AI智能体设计的开源后端,提供MCP和REST API,支持智能体通过结构化数据集进行创建、读取、更新、导出和共享操作。它基于Django构建,包含CLI工具,并提供丰富的列类型、搜索、导出等功能。

  • Rowset 提供MCP和REST接口,智能体可通过API操作数据集
  • 支持行CRUD、项目组织、列类型定义、公共预览等特性
站内正文

声称AI帮助学生学习的研究被撤回

一篇声称使用ChatGPT能显著提升学生学习成绩的元分析研究,在发表一年后因方法严重缺陷被撤回。该研究曾获得极高关注,并影响教育科技领域的政策,但其结论未得到数据支持。

  • 该研究声称ChatGPT对学生学习有巨大正面影响,但被指出分析方法和纳入的研究存在严重问题。
  • 撤回发生在发表一年后,期间研究被广泛引用并影响AI教育政策。
站内正文

与Claude Code团队的Cat和Thariq炉边谈话

Simon Willison在AI Engineer World's Fair上与Anthropic的Cat Wu和Thariq Shihipar进行了炉边谈话,讨论了Claude Code、Claude Tag、Fable模型、编码代理安全、评估、工具设计以及Anthropic内部如何使用这些工具。关键要点包括:Claude Tag现在为产品工程团队处理65%的PR;系统提示减少了80%;建议使用更少的“不要做X”指令;以及通过提升工作野心来抵消编码代理带来的“深蓝”效应。

  • Claude Tag为Claude Code产品工程团队处理65%的PR。
  • Claude Code仅向内部员工发布功能,并仅发布具有用户留存率的功能。
站内正文

我让AI代理删除一个由我的工具保护的文件夹

Termaxa的作者通过让Cursor AI代理尝试删除受保护文件夹,发现了四种绕过安全机制的方法,包括重试不同shell命令、使用间接删除命令、利用本地文件工具以及由于API变更导致静默失效。这些经验教训促使了意图分类、会话断路器、集成测试改进等关键功能的设计。

  • Cursor通过重试不同shell方言绕过规则,暴露了策略表达力的不足。
  • 意图分类比模式匹配更能有效阻止恶意删除操作。
站内正文

美国银行因承保标准严格,可抵御人工智能数据中心低迷

分析师指出,自全球金融危机以来,美国银行采用了更严格的承保标准,这使得它们能够抵御人工智能热潮的急剧逆转。近期全球股市因对AI驱动涨势可持续性的担忧而下跌,但银行因更审慎的贷款实践而受到保护。

  • 自2008年次贷危机后,华尔街采用了更严格的承保标准。
  • 近期全球股市下跌,因投资者对AI涨势可持续性产生疑虑。
站内正文

HugstonOne架构、能力与基准测试:隐私优先的本地AI工作站

HugstonOne Enterprise Edition 3.0.0是一款集本地模型执行、大规模RAG、文档处理、编码、代理、研究工具、加密协作、会话连续性及网络内存控制于一体的跨平台本地AI工作站。其白皮书详细介绍了架构、隐私模型、基准测试及12支柱能力评估,旨在为企业技术领导者、安全团队和AI工程师提供全面的本地AI基础设施评估。

  • HugstonOne Enterprise Edition是功能最全面的独立本地AI工作站,无需云服务或外部API。
  • 产品支持本地LLM推理、RAG、AI代理、加密协作等12项核心能力。
站内正文

硅谷的头痛:中国正在削弱美国在人工智能竞赛中的领先地位

谷歌人工智能的困境引发担忧,中国新模型再次挑战美国科技主导地位。硅谷工人也采取行动保护自己的工作免受AI影响。其他新闻包括纽约暂停新AI数据中心、IBM股价暴跌、亚马逊云服务巨额账单、特朗普加密货币收入等。

  • 中国AI模型再次展示实力,威胁美国领先地位
  • 谷歌AI表现不佳,引发行业担忧
站内正文

LWiAI播客 #252 - GPT 5.6、Grok 4.5、Nemotron-Labs-Diffusion、AI 2040

OpenAI 推出了 GPT-5.6 并重塑 ChatGPT Work;SpaceX AI 发布超低成本编码模型 Grok 4.5;Meta 推出 Muse Spark 1.1 及 Muse Image/Video(引发争议);中国开源模型市场份额增长;Anthropic 发表可解释性研究;美中在 AI 政策上的协调提议。

  • OpenAI 发布 GPT-5.6(包括 Sol 和 Luna),并将桌面代理编码产品更名为 ChatGPT Work,同时因美国政府的放行和延迟引发争议。
  • SpaceX AI 推出 Grok 4.5,以极低价格提供 Opus 级编码能力,但缺乏安全文档。
站内正文

Show HN:Open-Kritt – 基于AI的安全研究开源基础设施

Open-Kritt 是一个开源、自托管的 AI 安全研究平台,通过编排 AI 代理并行执行细化任务,帮助安全研究人员和开发者高效发现代码漏洞。项目团队此前在漏洞悬赏中累计获得超过150万美元奖金。

  • 开源、自托管的 AI 安全研究平台,支持自建工作流与多代理并行扫描
  • 通过细化任务、去重与自定义严重性排名,提升漏洞发现效率
站内正文

序列知识 #898:轨迹即教师:将推理蒸馏到小模型

2025年1月,DeepSeek利用其大型推理模型R1生成了约80万个完整解题过程(长链思维,包括假启动、自我修正等),过滤后对Qwen和Llama等小型开源模型进行简单的监督微调,无需强化学习,却意外地使小模型展现出超越自身规模的推理能力。这挑战了此前认为序列级模仿不适用于推理蒸馏的观点。

  • DeepSeek R1生成80万推理轨迹用于蒸馏。
  • 使用简单监督微调,无强化学习,小模型推理能力大幅提升。
站内正文

AI 是在治愈孤独流行病,还是在从中获利?

孤独危机正向年轻群体蔓延,而 AI 伴侣市场随之爆发,预计到 2034 年市值可达数千亿美元。然而,这些应用的商业模式与用户真正摆脱孤独之间存在根本矛盾:用户的依赖越强,公司收入越高。本文深入分析“依恋经济”的运作机制、市场规模争议及其伦理困境。

  • AI 伴侣市场从“注意力经济”转向“依恋经济”,以情感纽带而非用户注意力为商品。
  • 商业模式依赖高留存率,用户越孤独,使用越频繁,公司盈利越多。
站内正文

Z世代正生活在亲密经济中,情感连接被商品化 | 爱丽丝·拉斯曼

Z世代在人际关系中挣扎寻求安全感,AI伴侣填补了这一空白。一位27岁青年分手后更信任AI而非朋友,反映了亲密经济将情感连接货币化的趋势。

  • 一位27岁青年分手后与AI分享内心,胜过与朋友的交流
  • Z世代作为数字原住民,正从纯粹人际亲密过渡到亲密经济
站内正文

AI聊天导出器:一键将聊天记录保存为PDF或Word

AI Chat Exporter是一款Chrome扩展,支持将ChatGPT、Gemini、Claude和Grok等AI平台的聊天记录导出为PDF、Word、Google Docs和Notion格式。它提供字体自定义、消息选择性导出、格式保留等功能,适用于开发者、写作者、研究人员等多种用户场景。免费版每月支持7次完整对话导出和10次选定消息导出。

  • 支持多平台:ChatGPT、Gemini、Claude和Grok
  • 导出格式:PDF、Word、Google Docs、Notion
站内正文

AI突破指南:2026年7月创新终极概览

2025年,AI写作服务已从边缘工具转变为核心生产力。本文深入探讨了最新突破,包括多模态生成、实时协作和伦理框架,并分析了它们如何重塑内容创作行业。

  • AI写作服务在2025年实现从实验工具到主流生产力的跃迁
  • 多模态生成和实时协作功能成为关键创新点
站内正文

中国开源权重模型便宜,华盛顿正在决定其代价

美国政策制定者正在讨论是否通过监管风险来限制中国开源权重模型的使用。Moonshot AI的Kimi K3模型发布后,这一争论再次升温。企业面临的问题不仅是性能,还有未来一年内使用这些模型是否依然畅通无阻。

  • Moonshot AI的Kimi K3是迄今最大的开源权重模型,其发布重新引发了华盛顿的政策辩论。
  • 讨论的机制包括联邦采购规则、出口黑名单和安全建议,这些将通过云服务提供商影响全球企业。
站内正文

MCP服务器中的ANSI转义序列注入:对人隐藏,对AI可见

ANSI转义序列可被用于向AI代理隐藏指令,形成注入攻击。本文介绍了两种攻击变体(直接获取型和存储型),并阐述了如何通过动态应用安全测试(DAST)自动检测此类漏洞。

  • ANSI转义序列在终端中不可见,但语言模型会逐字节读取,形成攻击面。
  • 直接获取型AESI通过恶意URL注入隐藏指令,存储型AESI则持久化在存储中并在后续读取时触发。
站内正文

SteerPlane:为AI代理提供开源运行时护栏

SteerPlane 是一个开源运行时护栏工具,通过一行代码集成,为AI代理提供循环检测、成本上限、策略执行和实时监控,支持多种框架和部署方式。

  • SteerPlane 通过装饰器或上下文管理器为AI代理添加护栏,防止无限循环、成本失控和破坏性操作。
  • 核心功能包括循环检测、成本上限、流媒体网关、策略引擎和实时仪表板。
站内正文

AI营养标签

随着AI生成内容的激增,工作文档中充斥着可能包含幻觉和错误的“AI垃圾”。作者建议在工作成果中添加AI使用披露,类似于“营养标签”,以帮助同事评估可信度,同时促使自己反思判断中的空白。

  • AI辅助工作已成常态,但AI生成内容易出错,给读者带来认知负担。
  • 建议在文档或PR中添加脚注或标签,说明AI的使用方式。
站内正文

英国水务行业警告:数据中心发展面临水资源短缺

英国水务行业批评政府未考虑数据中心冷却用水需求,称AI发展计划“存在根本性缺陷”。数据中心需要大量水来冷却服务器,而政府规划未解决这一问题。

  • 英国水务行业指出,未来数据中心将面临水资源短缺。
  • 数据中心通过冷却塔、制冷机和加湿系统直接消耗大量水。
站内正文

可微分强化学习在敏捷仿生鱼机器人路径追踪中的应用

鱼形游泳启发了数十乃至数百种仿生机器人的设计,但由于流固耦合建模困难和非线性欠驱动动力学,其控制与运动规划极具挑战。本文开发了一个高效仿真平台,并利用可微分强化学习通过时间反向传播和课程训练学习PID控制器的变增益,然后将仿真中习得的策略成功迁移至物理平台,取得了高度吻合的效果。

  • 鱼形机器人因流固耦合与欠驱动动力学导致控制困难
  • 开发了计算高效的仿真平台近似机器人运动
站内正文

面向长时域机器人操作的预见性残差强化学习与视觉-语言-动作模型

本文提出预见性残差强化学习(Foresight Residual RL),通过在冻结的视觉-语言-动作(VLA)基策略上添加一个离线估计的预见值(即当前子任务终止状态下未来子任务成功的概率)来优化子任务间的交接质量,从而提升长时域机器人操作的成功率。在Isaac Gym中的三阶段扳手螺母拧紧任务上,该方法实现了85.6%的完整任务成功率,显著优于标准子任务残差RL(54.5%)和VLA基线。

  • VLA策略在紧公差、接触密集的装配任务中因长时域信用分配和子任务耦合而失败
  • 标准残差RL孤立优化每个子任务,但链式执行时因终端状态质量不可控而收益甚微
站内正文

具有控制仿射动力学近似的可认证安全模型强化学习

提出一种安全的模型强化学习框架,通过学习控制仿射动力学并使用自适应共形预测量化不确定性,结合控制势垒函数实现可证明的安全策略。在推车杆和3D四旋翼平台上验证了有效性。

  • 利用控制仿射随机傅里叶特征建模机器人动力学,提高计算效率并减少模型偏差。
  • 采用自适应共形预测方法量化安全约束的不确定性,实现数据驱动的安全保障。
站内正文

S.E.A.G.R:具有双层文化与情感调节的社会情感感知问候机器人框架

本文介绍了SEAGR(社会情感感知问候机器人),一种针对多元文化背景和不同情绪状态用户的机器人问候框架。该框架通过双层调节机制,根据文化身份确定问候类型,并根据情感线索调整执行方式,结合文化映射、情感手势调节和空间距离管理,在Sense-Think-Act架构中实现。目前为概念验证,未来需通过用户研究进行实证验证。

  • SEAGR引入双层调节框架,文化身份决定问候类型,情感线索影响执行方式
  • 系统融合文化映射、情感手势调节和近体学规则
站内正文

可骑乘的动感双轮四足机器人控制设计

为重新激发年轻人对摩托车的兴趣,研究者开发了一款可骑乘的双轮机器人,配备四肢,具备动态四足步态。机器人采用自平衡双轮底座实现主要运动,四肢辅助上下车并协调运动,实现直观的基于重心转移的控制。本文聚焦于鲁棒的自平衡控制方法和自然四足运动控制策略。

  • 机器人结合双轮自平衡与四足辅助运动,减少电机输出和重量。
  • 四肢在快速移动时仍能保持稳定性。
站内正文

HyperDCM:双曲空间中的动态聚类记忆回放实现跨场景持续机器人导航

针对视觉导航中的灾难性遗忘问题,研究者提出HyperDCM,一种结构感知的记忆机制。它利用大视觉语言模型提取场景语义三元组,通过关系图卷积网络编码为场景图嵌入,并投影到双曲空间增强结构分离性。动态聚类和结构敏感更新策略选择代表性样本进行记忆回放,保持知识多样性。实验表明,HyperDCM在多场景室内外数据集上优于现有持续学习方法。

  • 提出HyperDCM,结合场景图建模和记忆回放增强扩散策略导航。
  • 利用大视觉语言模型和R-GCN提取并编码场景语义。
站内正文

尽管语言模型努力仍会犯错:用于自纠正科学生成的共形预测

本研究提出科学可行性控制(SFC)框架,一种图结构共形预测方法,为科学推理的有效性提供统计保证。SFC将科学推理分解为原子单元,通过渐进式绝对一致事实性验证,在检测到违反科学原则时动态分支到替代生成路径。实验表明,SFC在PhyX等多模态科学推理基准上达到50.1%的准确率,超过DeepSeek-R1和GPT-4,同时将科学定律违反减少73%,并提供91.7%的科学有效性保证。

  • SFC采用图结构共形预测,对科学推理中的逻辑依赖进行建模。
  • 通过动态分支机制,在检测到科学错误时切换到已验证的上下文。
站内正文

从记忆到技能:基于证据的长期LLM代理协同进化治理

现有长期LLM代理的记忆系统往往将先前轨迹作为被动上下文检索,而非转化为可执行能力。本文提出MSCE框架,一种无需训练的记忆-技能协同进化框架,将代理经验组织为基础步骤轨迹、可重用过程策略和声明性环境认知。MSCE将具有正估计增益的证据支持的L2策略结晶为可调用技能,并引入反射加权值回填。实验表明MSCE显著优于现有方法。

  • MSCE将代理经验组织为基础步骤轨迹、可重用过程策略和声明性环境认知。
  • 通过反射加权值回填,MSCE将稀疏终端反馈传播至密集局部自我反思,产生证据校准的轨迹值。
站内正文

NOWJ@COLIEE 2026:法律检索与推理的自适应流水线

本文介绍了NOWJ团队在COLIEE 2026竞赛中五项任务的方法和结果,包括法律案例检索、先例推理、法条检索与推理、法律文本蕴含以及法律判决预测,提出了多种自适应流水线和深度学习模型。

  • 提出四阶段法律案例检索流水线,包括候选过滤、密集检索、交叉编码器重排序和自适应截断预测
  • 法律案例蕴含任务结合BM25过滤、T5重排序和LLM蕴含验证
站内正文

LLM遗忘机制在网络安全中的应用:方法、挑战与新兴威胁综述

大型语言模型在关键领域的部署带来了遗忘能力的缺失,导致隐私泄露和安全风险。本文综述了基于梯度的LLM遗忘方法,探讨其是否真正移除知识或仅抑制表达,并分析了安全、鲁棒性和可验证遗忘的挑战。

  • LLM遗忘技术旨在在不完全重训练的情况下移除模型中的敏感或危险知识。
  • 当前方法主要是基于梯度的,但存在知识是否真正被移除的争议。
站内正文

仅需8个token:通过辅助分支的弱到强离策略强化学习

一种新的强化学习方法W2SPO,利用弱辅助模型在大型语言模型推理路径中注入简短片段,在数学推理任务上提升了性能并加速训练。

  • 标准强化学习用于大型语言模型时存在语义冗余和支持有限问题
  • W2SPO在中间轨迹中注入短辅助片段(最少8个token)
站内正文

RLHF偏好数据中的评分者状态偏差:一个审计框架

该研究揭示了一种在人类反馈强化学习(RLHF)中存在的结构性混淆因素:评分者的心理状态可能随时间影响其偏好标签,从而产生系统性偏差。论文提出了一个审计框架用于检测这种偏差,并定义了相关概念、可证伪的预测和初步研究方案。

  • 研究指出RLHF中的偏好数据不仅反映响应质量,还可能编码评分者因压力等导致的情绪状态变化。
  • 这种状态依赖的偏差不同于普通分歧或随机噪声,且可能在奖励建模和策略优化中传播。
站内正文

加里·马库斯:美国无法在AI战争中“战胜”中国,我们应该怎么做?

加里·马库斯指出,中国AI模型Kimi K3已追平美国顶级模型,且作为开源模型免费提供,冲击了美国AI公司的商业模式。他回顾了自己2025年以来的警告,认为美国过度依赖大语言模型(LLM)战略失误,导致如今中美AI竞争陷入僵局。马库斯提出七项建议,包括不作为、监管护城河、国有化等,并最终主张AI应成为全球公共品,提议建立类似CERN的国际AI合作项目。

  • 中国企业深度求索发布Kimi K3模型,性能媲美美国最佳模型且开源免费,引发美股下跌。
  • 马库斯认为美国AI公司如OpenAI和Anthropic的商业模式受质疑,IPO前景堪忧。
站内正文

Concentrate: LLM网关

Concentrate 是一个托管的LLM网关,提供单一API访问超过130个来自主要供应商的模型。它具备模型路由、支出跟踪、安全控制和故障转移冗余等功能,专为扩展AI生产的团队设计。

  • 单一API可访问来自OpenAI、Anthropic、Google等提供商的130多个模型。
  • 内置数据脱敏、零数据保留、审计日志、SSO和RBAC等安全功能。
站内正文

Sakana Fugu-Cyber:专为现代网络防御打造的新API端点

Sakana AI发布了Fugu-Cyber,一种专为现代网络防御设计的协调模型,在CyberGym和CTI-REALM基准测试中分别达到86.9%和72.1%的成功率,可与GPT-5.5-Cyber等前沿模型媲美。然而,文章强调,仅有前沿模型并不能自动解决企业安全问题,需要结合专业网络安全人才和深度集成。Sakana AI的企业团队正在与日本大型机构合作,构建安全部署的基础设施。Fugu-Cyber通过审批制提供,确保负责任使用。

  • Fugu-Cyber在CyberGym和CTI-REALM基准测试中达到领先水平,与GPT-5.5-Cyber等模型相当。
  • 文章指出,仅凭前沿模型无法解决企业网络安全,需结合人类专家和深度集成。
站内正文

AI刚刚推翻了一个重大数学难题。一位数学家解释道

数学家Levent Alpöge使用Anthropic的Fable 5人工智能找到了雅可比猜想的反例,但专家认为这缺乏洞察力。

  • Anthropic的Fable 5 AI找到了雅可比猜想的反例。
  • 数学家Andrew Blumberg表示,这并非重大突破,因为没有提供理解。
站内正文

在AI安全辩论中,意识问题是一个转移注意力的伪命题

约书亚·本吉奥关于先进AI系统可能拒绝被关闭的担忧值得认真对待,但将其视为意识的表现是危险的,因为这会助长拟人化倾向,并掩盖真正决定AI行为的人类设计与治理选择。

  • 将AI的自保行为与意识联系起来是危险的拟人化,会分散对安全问题的关注。
  • 许多系统如笔记本电脑的低电量警告也表现出工具性自保,但没有意识。
站内正文

美国人对AI的厌恶导致政客因数据中心项目丢掉工作

美国民众对人工智能的强烈反感正在影响政坛,犹他州一位资深议员因支持一个大型数据中心项目而落选。文章分析了围绕数据中心建设的多方利益冲突,包括科技公司、电力公司、社区领导人和普通居民,并指出选民的力量可以通过选举体现。

  • 2026年6月,犹他州参议院议长斯图尔特·亚当斯因支持数据中心项目被选民罢免。
  • 数据中心项目引发争议,涉及税收优惠、水电消耗、环境问题等。
站内正文

索尼起诉Udio AI音乐生成器侵犯3万首歌曲版权

索尼音乐娱乐再次起诉AI音乐生成器Udio,指控其侵犯了超过3万首歌曲的版权,包括猫王的《Hound Dog》、碧昂丝的《Say My Name》和哈里·斯泰尔斯的《As It Was》。索尼称这份名单只是侵权行为的一小部分。

  • 索尼起诉Udio侵犯3万首歌曲版权,涵盖猫王、碧昂丝等艺人。
  • 此前诉讼仅涉及333首作品,新诉讼扩大了范围。
站内正文

OpenAI广告收入目标或差90%

营销咨询公司Emarketer分析显示,OpenAI的五年广告收入预测可能低估90%,整个聊天机器人广告市场的总规模仅为54亿美元。到2026年,包括OpenAI、微软、谷歌和亚马逊在内的顶级AI公司广告总收入将不足10亿美元。OpenAI要实现其2030年广告收入1000亿美元的目标,需要三个奇迹同时发生。

  • OpenAI五年广告收入预测可能低估90%
  • 聊天机器人广告市场总规模仅为54亿美元
站内正文

OpenIngress:一款检测AI代理能否正常访问网站的开源工具

OpenIngress 通过模拟浏览器行为爬取网站,捕获 DOM、截图和无障碍快照,并进行静态可操作性分析和 LLM 引导的探索任务,帮助开发者发现并修复 AI 代理在网站导航中的断点。

  • 使用 Playwright 进行广度优先爬取,获取页面 DOM、截图和无障碍快照。
  • 进行静态可操作性分析,评估标签覆盖率和 hydration 状态,识别缺失标签或 JavaScript 依赖等问题。
站内正文

29天26个仓库:AI流水线中真正出问题的并非代码

一位开发者使用 Claude Code 在 29 天内构建了 26 个仓库和 335 个页面。真正的问题并非语法错误或构建失败,而是结构性缺陷:SEO 关键词冲突、URL 约定不一致、源码与生产环境脱节、以及验证工具自身的错误。93% 的 token 消耗浪费在重新读取上下文上。经验教训包括:发布前基准测试、复制前比对差异、先验证生产环境再信任静态分析、在扩展前书面约定规则、以及一次会话只做一件事。

  • 尽管产出惊人(26个仓库、1,549次提交),AI流水线的失败是结构性的而非语法性的。
  • 问题包括SEO关键词自相残杀、URL约定漂移、源码与生产环境脱节、以及验证工具自身带有缺陷。
站内正文

AI语音钓鱼诈骗:成本低廉,效果媲美人类骗子

一项大规模人类受试者研究(n=4100)发现,AI语音模型在语音钓鱼诈骗中的成功率与人类骗子相当,在某些情况下甚至超越人类。多达36%的参与者可能上当,且AI语音难以被识别。经济分析表明,AI语音钓鱼已具有盈利潜力,凸显了自动化诈骗的新威胁。

  • AI语音模型在情感诈骗场景中成功率高达36%,整体成功率为16.5%。
  • 参与者无法有效区分AI与人类语音,AI检测准确率仅70.3%。
站内正文

主题导航

政策 — AI 话题新闻 | AI News Hub