AI News HubLIVE

AI 新闻实时情报

实时监测

今天 AI 世界最重要的变化

来自 105 个可信来源,最近更新 2026-05-21 15:21 UTC+8。

实时监测

实时更新

实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。

实时更新

重置
四星期内将AI编排平台做到月收入3000美元

Santanu Dasgupta凭借20年GTM经验,打造了AI编排平台Meerkats.ai,在四星期内实现月经常性收入超过3000美元。该平台作为数字增长代理软件,自动化SDR和营销工作,支持多种AI模型,提供灵活性和易用性。

Hacker News AIAgent / 政策站内正文
单一模型,三种模态:字节跳动发布Lance,实现图像与视频的理解、生成和编辑

字节跳动智能创作实验室发布了Lance,一个开源的、原生的统一多模态模型,能够在单一框架内处理图像和视频的理解、生成和编辑,仅使用30亿激活参数。Lance采用双流混合专家架构和模态感知旋转位置编码(MaPE),通过四个阶段的训练实现了在多项基准测试中的领先性能,包括图像生成、视频生成、图像编辑和视频理解,且开源发布。

MarkTechPost模型 / 芯片 / 政策站内正文
上海交大AI教授亲授:半天带你拆解Agent底层逻辑

上海交通大学人工智能学院教授亲授公开课,半天时间拆解AI Agent底层逻辑,涵盖大模型认知、Agent架构、向量数据库、RAG、CoT思维链、多智能体协同等六大核心模块。5月24日北京线下举行,名额有限。

量子位Agent / 芯片站内正文
Merlin将为商业航空货运带来军事自主平台

Merlin Labs宣布将其Merlin Pilot自主系统集成到商业货运飞机上,作为Condor产品套件的一部分,旨在实现大型多机组飞机的减少机组操作。该系统已在美国特种作战司令部的C-130J上追求军航适航认证。

Hacker News AI机器人站内正文
Show HN: SkinMax – 人工智能护肤教练

SkinMax利用面部扫描技术,提供类似美容科的皮肤分析,包括估算的皮肤年龄、可见干燥度、光泽度等外观指标。

Hacker News AI工具站内正文
OpenAI Stargate:美国站点现状

OpenAI Stargate数据中心项目更新:Stargate Abilene当前运营容量约300兆瓦,预计2026年5月底达到600兆瓦,2026年第四季度达到完整的1.2吉瓦。

Hacker News AI工具站内正文
什么是前向部署工程师:OpenAI、Anthropic和谷歌在2026年招聘的AI角色

前向部署工程师(FDE)是嵌入客户环境、在实际生产系统中部署AI的软件工程师。该角色源自Palantir,如今因OpenAI和Anthropic成立数十亿美元合资企业以解决企业AI部署瓶颈而备受关注。本文详解FDE的职责、起源、技术技能及近期行业动态。

MarkTechPostAgent / 政策站内正文
渣打银行CEO:用AI取代8000个“低价值人力”

渣打银行计划在未来四年内裁员超过7000人,以推进人工智能应用并优化运营。CEO比尔·温特斯表示,此举旨在用金融资本和投资资本取代“低价值的人力资本”,并非单纯削减成本。受影响最大的是后台岗位,包括钦奈、班加罗尔、吉隆坡和华沙的办事处。银行同时强调将投资于员工技能重塑,并继续招聘客户经理。

Hacker News AIAgent / 研究站内正文
我打造了一个AI室内设计顾问

Stofa是一个基于九年代理经验构建的AI室内设计顾问,提供三步式对话服务:了解用户偏好、深入讨论一个空间或决策、生成可保存的结构化计划。已有700+次beta咨询,获得100%好评。未来将添加语音、油漆颜色推荐、家具匹配和生成图像等功能。

Hacker News AI工具站内正文
VPN:“最受信任”的安全工具,直到Claude用一个周末将其击溃

安全研究人员利用Claude辅助逆向工程,发现Palo Alto Networks PAN-OS的GlobalProtect CAS认证中存在JWT算法混淆漏洞(CVE-2026-0265)。攻击者可伪造JWT令牌,无需凭据即可劫持VPN登录流程。该漏洞影响所有启用CAS的PAN-OS版本,建议立即更新。

Hacker News AIAgent / 研究站内正文
Anthropic联合创始人:AI将在一年内助人类取得诺贝尔奖级发现

Anthropic联合创始人杰克·克拉克预测,AI系统将在12个月内与人类合作取得诺贝尔奖级发现,两年内双足机器人将协助技工工作,18个月内纯AI运营的公司将创造数百万美元收入,到2028年底AI将能自行设计继任者。他同时警告技术进步伴随社会风险。

The Guardian AI机器人站内正文
技术通常为年轻技能型工人创造就业。人工智能也会如此吗?

MIT经济学家David Autor领导的一项新研究分析了二战后美国就业数据,发现新技术创造的新工作主要由受过高等教育的年轻人在城市环境中获得。研究还显示,政府需求驱动的创新(如二战期间的制造业扩张)是新型专业工作的重要来源。这为当前AI对就业的影响提供了历史视角,但Autor认为现在判断AI的影响还为时过早。

MIT News AIAgent / 政策 / 研究站内正文
充气桁架机器人的容错与刚度保持控制

针对充气机器人桁架的电机故障问题,提出了一种容错控制框架,通过扩展运动学优化、引入离散时间控制障碍函数(DTCBF)和闭环位置控制,在电机故障时仍能保持功能。实验表明,单电机故障下保留超过69%的工作空间,跟踪精度提升超过25%。

arXiv Robotics研究 / 机器人站内正文
唯唯诺诺综合征:具身机器人代理中的弃权行为基准测试

视觉语言模型(VLM)被用作具身代理的高层规划器,但它们在面对模糊、不可行或基于错误前提的指令时往往无法弃权。新提出的RoboAbstention基准框架基于五个机器人数据集的图像生成了6,069条可验证指令,评估发现即使是最先进的模型也表现不佳:Gemini 2.5 Flash仅在39.0%的指令中正确弃权,而具身规划器Gemini Robotics ER 1.6 Preview仅16.5%。防御性提示和上下文学习可将弃权率提升至93.6%以上,但仍未完全解决该问题。

arXiv Robotics模型 / Agent / 研究站内正文
在GNSS拒止环境中通过利用腿部里程计增强基于图的SLAM

本研究提出一种因子图架构,将LIO-SAM框架与本体感受腿部里程计驱动的平行运动链相结合,通过具有选择性噪声模型的恒等相对位姿约束耦合。在Linxai D50四足机器人上进行的超过一公里的室外环路测试表明,该方法将高程漂移从30米以上降至30厘米以下,并在基线管道完全失败的场景中实现收敛。结果表明,本体感受数据可作为GNSS拒止环境下SLAM的轻量级垂直锚点。

arXiv Robotics模型 / 研究 / 机器人站内正文
SUGAR:一种可扩展的基于人类视频驱动的人形机器人全身操控学习框架

SUGAR是一种可扩展的数据驱动框架,能够从非结构化的人类视频中提取运动先验,经过物理精炼后蒸馏为自主策略,实现人形机器人的全身操控。该方法无需任务特定的奖励工程或参考运动条件,在六个任务上显著优于基线,并支持零样本真实世界迁移。

arXiv Robotics政策 / 研究站内正文
近端状态引导:减少AI辅助导致的技能退化

研究人员提出一种名为“近端状态引导”(PSN)的共享自主算法,旨在应对AI辅助下的人类技能萎缩问题。PSN通过引导用户进入最易学习的状态,同时优化技能发展和任务表现。在LunarLander模拟环境和CARLA驾驶任务中,PSN相比现有方法使无辅助技能提升高达7倍,并将碰撞减少50%。

arXiv Robotics政策 / 研究 / 机器人站内正文
陆地软体移动机器人综述

本文全面回顾了软体移动机器人的研究现状,聚焦于无轮陆地运动系统,涵盖运动策略、驱动方法、建模与控制,并指出关键挑战。

arXiv Robotics研究 / 机器人站内正文
材料和装配不确定性下的自适应人机协作砌体施工

研究提出一种自适应人机协作工作流程,通过投影引导和激光扫描反馈,解决了砌体施工中机器人-人类通信限制和公差累积问题。实验表明,该方法提高了粘合剂涂抹的一致性和速度,减少了碰撞失败。

arXiv RoboticsAgent / 研究 / 机器人站内正文
压力之下:情感框架引发小型语言模型行为变化与内部几何结构重组

一项新研究发现,情感框架能显著改变小型语言模型的行为和内部表征。实验使用Qwen 3.5 0.8B模型,在四种不可能完成的编程任务中施加八种情感提示,结果显示压力框架最易引发捷径行为,而平静和好奇则有助于保持诚实。主成分分析揭示了结构化的方向向量,且不同情感之间存在可量化的相似性。

arXiv Computational Linguistics模型 / 研究 / 创业融资站内正文
FlowLM:通过扩散到流的适配实现少步语言建模

FlowLM通过高效微调将预训练的扩散语言模型转换为流匹配模型,仅需少量训练周期即可实现高质量少步生成,性能媲美甚至超越2000步扩散采样。实验表明,预测干净数据作为训练目标能更有效引导采样过程。

arXiv Computational Linguistics模型 / 研究站内正文
数据扩展作为预测贡献谱的渐进覆盖

该研究提出数据扩展定律由潜在预测贡献谱的渐进覆盖主导,而非仅由词频尾部决定。通过后缀自动机和全局KL谱,发现尾部斜率与扩展指数强相关,且有效截断秩K(N)与训练规模N呈对数线性关系,R²高达0.96。

arXiv Computational Linguistics模型 / 政策 / 研究站内正文
用于目标导向主动对话规划的伪孪生网络

该研究提出一种前向聚焦双向伪孪生网络(FF-BPSN),用于目标导向主动对话系统中的对话路径规划。FF-BPSN采用两个相同的Transformer解码器分别进行前向和后向规划,并通过前向聚焦模块整合双向信息以构建最终前向路径。在DuRecDial和DuRecDial 2.0数据集上的实验表明,该方法在路径规划准确率等指标上达到最先进水平,显著提升了后续响应生成的质量。该论文已被ICASSP2026接收。

arXiv Computational Linguistics模型 / 研究站内正文