AI News HubLIVE

AI 新闻实时情报

实时监测

今天 AI 世界最重要的变化

来自 105 个可信来源,最近更新 2026-06-02 15:00 UTC+8。

实时监测

实时更新

实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。

实时更新

重置
Alphabet计划通过股票销售筹集800亿美元用于AI支出热潮——商业直播

Alphabet宣布计划通过股票销售筹集高达800亿美元,用于扩建AI基础设施,其中包括向伯克希尔·哈撒韦出售100亿美元股票。此举是史上最大规模股权融资之一,标志着AI投资进入资本密集新阶段。同时,Anthropic秘密提交美国IPO申请,估值达9650亿美元。

The Guardian AI创业融资站内正文
为什么金融机构正在汇聚于交易基础模型以构建自身智能

金融机构长期依赖碎片化的AI模型(如欺诈检测、信贷评估等),但这些模型受限于孤立系统,无法形成统一的消费者金融行为理解。NVIDIA报告显示65%的机构已采用AI,但模型复杂度成为瓶颈。领先企业正转向基于Transformer的交易基础模型,通过统一表示学习提升跨任务性能,如Revolut的PRAGMA模型在信贷、欺诈等领域超越专门模型。NVIDIA推出“构建自有交易基础模型”开发者示例,助力机构利用专有数据开发智能。

NVIDIA Blog模型 / Agent / 芯片站内正文
关于AI与真相的书竟包含人工智能生成的虚假引用

史蒂文·罗森鲍姆的《真相的未来》因包含多个由AI生成的虚假或错误归属的引用而陷入丑闻,书中引用了卡拉·斯威舍、丽莎·费尔德曼·巴雷特等人的不实言论,作者承认使用ChatGPT和Claude,承诺修正但表示将继续使用AI。此事件凸显了非虚构写作中依赖AI而不加验证的风险。

Hacker News AIAgent / 研究站内正文
面向开发者的AI工程实践指南

本文为有经验的软件工程师提供AI工程化指南,涵盖基础模型、应用层开发、模型适配、规划与维护,并强调成本与评估的重要性。

Hacker News AIAgent / 芯片站内正文
周二简报:Palantir的崛起——以及为何很多人反对其在英国政府中的角色

美国数据分析公司Palantir自疫情以来迅速扩张,其AI软件被用于NHS患者记录分析及美军目标锁定,公司市值达3750亿美元。但其引发的争议和批评导致人们质疑其权力过大。简报还涵盖彼得·曼德尔森安全审查、乌克兰空袭、英国绿色经济、特朗普基金计划及邮局丑闻补偿等新闻。

The Guardian AI研究站内正文
我们构建了自己的云代理基础设施

Harvey在过去一年从聊天产品转向云代理,以实现端到端的法律任务。由于现有托管运行时无法满足多模型、零数据保留和成本控制的要求,Harvey自建了代理基础设施。文章详细阐述了这三个关键需求及其对法律行业的重要性。

Hacker News AIAgent / 政策站内正文
架构即政策:将治理编译到AI堆栈中

本文介绍了Riddhi Mohan Sharma如何通过三层自动化治理框架,将性能指标视为物理定律,并使用AI代理进行主动修复,从而在其个人网站上实现“道德超高速”的架构理念。该框架包括结构护栏、代理修复循环和集成工作流,确保每次部署都符合严格的性能标准。

Hacker News AIAgent / 政策站内正文
你能靠AI垃圾内容快速致富吗?

本文探讨了通过AI生成的‘垃圾内容’(slop)在社交媒体上快速获利的现象。以Tung Tung Tung Sahur等角色为例,展示了内容创作者如何利用AI工具批量生产低质但吸睛的视频,通过广告网络联盟(Affiliate Network)赚取收入。文章采访了多位创作者和平台创始人,揭示了AI slop产业的运作模式、伦理争议以及巨大流量背后的经济逻辑。

Hacker News AI研究站内正文
Anthropic 扩大对 Claude Mythos AI 模型的公开访问

Anthropic 宣布将通过 Project Glasswing 扩大对 Claude Mythos 模型的访问,预计在 6-12 个月内实现广泛可用。该模型能发现漏洞并生成利用链,但目前仅限合作伙伴使用。

Hacker News AI模型 / Agent / 政策站内正文
通过筛选AI模型找到最佳模型的应用程序

开发者在众多AI模型中难以选择,而WhichLLMModel应用允许用户根据推理能力、速度和成本等优先级,对顶级模型进行排名和比较,以找到最适合其应用需求的模型。

Hacker News AI模型 / 研究站内正文
ShadowProtect:AI 代理的 Wireshark

ShadowProtect 是一款专为 AI 代理设计的网络分析工具,类似于 Wireshark 对传统网络的作用,帮助开发者监控、调试和优化代理行为。

Hacker News AIAgent站内正文
Mellum2 开源:适用于 AI 工作流的快速模型

JetBrains 开源了 Mellum2,一个 12B 参数的 MoE 模型,专为快速、高效的 AI 工作流设计,用于路由、问答、子代理等。由于采用 MoE 架构,每 token 仅激活 2.5B 参数,降低了推理成本和延迟。

Hacker News AIAgent / 研究站内正文
粘贴文件编辑器

西蒙·威利森开发了一款原型工具,可将大量文本粘贴自动转换为文件附件,支持直接打开文件、拖拽上传,灵感来自Claude的粘贴检测功能。

Simon Willison's Weblog工具站内正文
RocketSmith:用于高功率火箭设计与制造的代理系统

一种名为RocketSmith的新型代理系统能够自动化高功率火箭的设计、制造与优化流程,通过子代理和技能实现飞行参数的迭代优化。四枚火箭采用FDM打印机制造并进行了飞行测试,全部稳定发射,两枚成功回收。飞行仿真与实际数据对比显示远地点预测准确率达84%。

arXiv RoboticsAgent / 研究 / 机器人站内正文
物理AI中的静默故障:自主系统运行时动作授权的文献综述

本文综述了物理AI系统中新兴的安全问题——'静默故障',即黑盒模型看似自信且语义对齐,但产生物理上无效的动作。文章提出了有界问题形式化,定义了静默物理动作失败,并给出了运行时护栏功能的分类法。

arXiv Robotics模型 / 政策 / 研究站内正文
预测动力学能在物理世界中存在吗?

本文提出物理可接受性作为预测控制接口,通过在执行前评估预测动力学是否满足运动学、动力学和直接到组合水平条件,来验证物理可执行性。实验表明,完整门控在Hugging Face LeRobot PushT数据集上达到0.957的AUC,并有效阻止87-89%的无效提议。

arXiv Robotics研究 / 机器人站内正文
基于图扩散的全身逆运动学

GraphDiff-IK提出了一种结构感知的图扩散逆运动学框架,能够在多种机器人形态下准确、稳定地生成关节配置,并支持多解输出。

arXiv Robotics模型 / 研究 / 机器人站内正文
平衡精度与效率:用于模型预测控制的自适应动力学编排

提出自适应动力学编排(ADO)框架,用于自动驾驶导航中的模型预测控制。ADO动态选择最适合当前导航上下文的动力学模型,通过在线反事实推演优化模型选择,从而在保持低延迟的同时接近高保真模型的精度。野外实验验证了其在复杂地形中的有效性。

arXiv Robotics政策 / 研究站内正文
非线性粘性流体中的线性运动映射

研究表明,在低雷诺数流体中,线性运动映射扩展到任何幂律粘度流体,而卡拉-安田流体的非线性特性允许通过往复运动实现净位移,甚至可通过改变速度切换运动方向。

arXiv Robotics政策 / 研究站内正文
强化学习在机电系统参数辨识中的最优实验设计

该论文提出一种强化学习代理,用于为机电系统的系统辨识生成最优激励信号,并在Quanser Aero 2测试平台上验证,实现了高估计精度且仅0.75%的安全违规。

arXiv RoboticsAgent / 政策 / 研究站内正文
从人类视频到机器人操作:基于人类中心数据的可扩展视觉-语言-动作学习综述

本综述系统梳理了利用人类视频数据训练视觉-语言-动作(VLA)模型的方法,将其分为潜在动作表示、预测世界模型、显式2D监督和显式3D重建四类,并指出视频结构化、跨实体动作接地和评估协议设计三大挑战,旨在降低对昂贵机器人演示数据的依赖。

arXiv Robotics模型 / 研究 / 创业融资站内正文
多样性重于频率:重新思考视觉思维链代理中的工具使用

本文研究了视觉代理在复杂推理任务中工具使用的现象,发现“工具使用崩塌”——模型随着训练逐渐停止使用工具但准确性却提高。作者提出通过熵正则化鼓励多样化探索,获得最佳性能,表明工具应作为训练时的支架而非最终依赖。

arXiv Computer VisionAgent / 研究站内正文
通过显式建模数据流形几何的扩散图像生成

研究人员提出了MIND(数据流形感知图像扩散模型),通过将离散补丁标记化集成到连续扩散模型的得分函数中,显式建模流形几何。该方法在ImageNet 256×256上实现了FID 2.06(MIND-B,1.3亿参数),优于LlamaGen-3B(31亿参数)的FID。

arXiv Computer Vision模型 / 研究站内正文