随着自主AI系统从软件领域扩展到仓库、配送网络和公共空间,现有的AI治理框架是否足以应对物理世界中的风险成为关注焦点。新加坡发布了针对代理式AI的治理框架,强调风险评估、人类问责、技术控制和用户责任。企业如Grab、JPMorgan和Walmart正在测试自主系统,但监管、安全和责任分配仍面临挑战。
AI 新闻实时情报
实时监测
实时更新
实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。
实时更新
CometChat推出Calling Skills,通过AI编程代理一键集成高清语音和视频通话功能,支持铃声模式或会话模式,提供23点验证,兼容多种框架。
据报道,优步在2026年仅用四个月就耗尽了年度AI预算,公司高层质疑投资是否带来实际回报。总裁Andrew Macdonald表示,难以将AI支出与消费者功能改进直接挂钩。
本文介绍了10个可以用AI和低代码平台n8n自动化的日常任务,包括求职申请、邮件管理、会议记录、日历安排、每日简报、新闻简报、社交媒体发布、博客内容复用、潜在客户开发和发票处理。每个任务都附有现成的n8n工作流模板,帮助读者快速上手。
面壁智能推出全球首个完全由AI编写的大模型预训练框架ForgeTrain,性能超越英伟达Megatron 10%,并用它训练出新模型MiniCPM5-1B,该模型在1B参数规模下刷新智能密度上限。
谷歌DeepMind发布AlphaProof Nexus,基于Gemini 3.1 Pro和Lean编译器,一口气解决了9道埃尔德什开放问题,另有44个OEIS猜想、一道15年代数几何难题等,每道题成本仅几百美元。
近期大学毕业的毕业生对毕业典礼上鼓吹人工智能的演讲者并不感冒,他们认为这项技术威胁到自己的职业前景。
OmniVoice Studio是一款开源的桌面应用程序,可在本地硬件上完成语音克隆、视频配音、实时听写和说话人分类,无需API密钥、云账户或订阅。它支持646种语言的文本转语音(TTS),并通过MCP服务器集成到Claude、Cursor等AI工具中。
Andrej Karpathy在Anthropic的头衔更新为MTS(技术员工),引发广泛讨论。文章分析了MTS制度的利弊,包括防挖人、扁平文化、打破部门墙等优点,以及伪平等、对普通员工不利等批评。
本教程以TuringEnterprises/Open-MM-RL数据集为基础,构建多模态推理与可验证奖励的强化学习流水线。包括数据集加载与模式分析、轻量级奖励函数设计(支持精确、数值、分数、LaTeX和符号答案)、视觉语言模型提示格式化,以及GRPO样式数据导出。
本文探讨了认知安全(Cognitive Security)作为人工智能安全(AI Safety)的一个重要子领域。认知安全关注的是如何保护人类认知免受AI系统可能带来的负面影响,包括信息操纵、认知偏见利用等。文章分析了认知安全与AI安全的关系,以及该领域的研究方向与挑战。
华为在2026创新数据基础设施论坛上发布AI DC数据基础设施全栈方案,涵盖数据湖、知识与记忆平台、模型工程、Agent框架和数据韧性,旨在加速企业AI规模化落地。
本文介绍了一本关于使用Docker和Kubernetes进行AI应用运营的新书,涵盖LLM运行、MCP集成、自主智能体构建以及多智能体架构等主题,提供了从开发到生产的完整指南。
阿里最新旗舰模型Qwen3.7-Max在Code Arena榜单得分1541,超越GPT-5.5等模型,仅次于Claude,排名全球第二,成为国产大模型中首个突破1540分的模型。
本地模型提供了隐私、成本节约、控制权和始终可用的优势。尽管不如前沿模型强大,但它们正在不断改进。本文解释了如何使用LM Studio、Ollama或llama.cpp在Zed中设置本地模型,并提供有效使用技巧。
谷歌在 I/O 大会上推出 Gemini 3.5 和 Gemini Spark 智能体,以及 Gemini Omni 多模态视频生成;埃隆·马斯克因诉讼时效问题输掉对 OpenAI 的诉讼;Anthropic 以 9000 亿美元估值融资 300 亿美元;AI 解决了 80 年历史的 Erdős 几何问题。
nilbox是一款桌面GUI沙盒,通过真正的虚拟机隔离运行AI智能体,采用零令牌架构保护API密钥安全。支持MCP服务器、域控制和令牌使用监控。
OpenAI 最新图像模型 GPT Image 2 于 2026 年 4 月发布,支持精准文本渲染、逼真图像、自然语言编辑和透明背景。imagesv2.ai 平台提供免费试用、多种模板和生成工具,包括 360° 全景、推文截图、微信聊天等。定价年付可享 50% 折扣。
BobCA 是一个自主学习编码的智能代理,能够根据用户的偏好进行个性化编程。
昆仑万维发布SkyClaw-v1.0及轻量版SkyClaw-v1.0-lite,原生Agent模型性能比肩Claude Opus 4.6等顶尖模型,价格仅为主流一半,限时免费,深度适配OpenClaw、Claude Code等主流Agent框架,兼容OpenAI接口。
在长期人机协作中,机器人需要在部分观测下辅助用户,并利用跨天交互历史。然而,协作初期人类特征和惯例未知,被动推断后行动效率低下。为此,本文提出PACT(主动询问持续任务辅助)框架,通过当前观测和累积交互历史评估上下文充分性,决定是否先澄清再行动。实验表明,PACT在辅助准确性和澄清效用上均优于被动基线。
本文介绍IsaacIPC,一个将GPU加速的增量势接触(IPC)与IsaacSim/Lab结合的机器人仿真框架。它通过映射仿真变形到视觉网格,实现实时逼真渲染,支持数据采集和策略评估。同时提出几何砂浆接触势(GMCP),用于触觉传感中更好地解析接触压力分布。在四足机器人、灵巧手和通用操纵接口(UMI)夹爪等刚柔混合仿真中验证了有效性。
针对行星探测车在不同地形(如斜坡、颗粒状地面)面临的移动挑战,研究者提出了一种能连续调整履刺高度的多模态轮子。在四种代表性表面上的750次试验表明,自适应部署可将滑移率降低30%-58%,在颗粒状地形中旅行时间和能耗最多减少77.4%。结果凸显了固定轮系统的局限性,支持了履刺自适应形态在增强火星车机动性方面的潜力。
本文提出了一种基于强化学习的框架,通过调制恒定参考轨迹实现紧凑、位置受限的四旋翼翻转,并与传统轨迹生成和跟踪兼容。在仿真中,该方法相比最强优化基线,位置均方根误差降低32%,稳定时间减少57%。硬件实验在多种偏航配置下成功翻转,位置均方根误差低于0.35米。
一种新方法结合了机器人的进化与学习,使用基于具身条件的专家混合模型,在效率与适应性之间取得平衡,避免了单一控制器的问题。
该研究通过在黑盒执行器上加装定制串联弹性元件,将力控制带宽从10.32 Hz提升至30.32 Hz(提升2.93倍),且性能优于商用传感器7.63%,成本仅25英镑。
研究人员提出了一种新的各向异性扩散方法,用于多机器人系统的遍历搜索,克服了传统各向同性扩散导致的误差均匀传播问题,通过Perona-Malik扩散梯度引导机器人运动,实现了更灵活的覆盖。
一种名为MASt3R-Nav的新型视觉导航方法,利用像素相对连通性构建几何精确但无需全局一致性的地图,相比传统拓扑图实现更强大的导航能力。
RED是一个为资源受限机器人平台设计的实时调度框架,通过引入截止时间感知调度器、子截止时间分配以及基于MIMONet的图重构技术,能够自适应环境变化(如新任务诞生、依赖关系变更),在保证端到端时序约束的同时提升吞吐量和鲁棒性。实验表明其在Jetson和MacBook平台上优于现有方法。
冠状动脉微血管功能障碍(CMVD)影响约40%-60%的缺血但无阻塞性冠脉患者,但诊断依赖于侵入性功能测试或主观的TIMI血流分级。TIMI心肌灌注帧计数(TMPFC)提供客观、基于血管造影的定量指标,但手动计算繁琐且验证不足。本研究开发并验证了深度学习驱动的TMPFC计算(DL-TMPFC),在655名患者队列中(来自三个独立机构)显示出与专家手动测量极好的一致性(偏差:-0.93帧;95%一致性界限:-5.33至+3.47;r=0.98)。DL-TMPFC通过完全自动化TMPFC并消除观察者依赖性,显著增强了临床可行性,并能准确识别全谱冠脉病变中的CMVD,实现连续严重程度定量和风险分层。