AgentWall是一个针对本地AI代理的运行时安全与可观测层,能够拦截代理操作、执行策略检查、要求人工审批并记录审计轨迹,在14项基准测试中实现92.9%的策略准确率和亚毫秒级开销。
AI 新闻实时情报
实时监测
实时更新
实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。
实时更新
Odyssey实验室发布Agora-1研究预览版,这是一个多智能体世界模型,允许多达四名人类或AI代理在实时生成的模拟中共享和交互,类似于黄金眼风格的体验。该模型可保持不同视角下的一致性状态,开创了视频模型、游戏模型与世界模型融合的新类别。
Multi-Claude 是一款原生macOS应用,允许用户并行运行多个Claude账户,每个账户拥有独立的配置文件、会话历史和设置,解决了在个人和工作账户间频繁登录的问题。该应用为一次性购买,发布周有折扣。
德意志交易所集团的StatistiX平台面临Zeppelin笔记本迁移挑战,涉及2000+用户和2027年截止日期。他们开发了一款Databricks应用,自动处理结构转换并生成上下文感知的Genie提示,以AI辅助重构笔记本逻辑。每个笔记本的重新开发时间从数小时缩短至15-20分钟。
明天5月20日,中国AIGC产业峰会将在北京开幕,20位嘉宾将围绕Agent、多模态、应用、算力等话题展开讨论。提前查好路况,定好闹钟,我们现场见!
TuriX AI 发布了其开源计算机操作代理的最新版本,在 macOS 基准测试中达到 80% 的成功率,并在 OSWorld 排行榜上位列第三。该代理支持桌面自动化、可热插拔模型以及通过 Markdown 剧本实现的技能系统。最新版本包括 TuriX SuperAgent 和 TuriX SuperPower 3.0.0-alpha,扩展了生产力功能。
Trainer 是一款工具,允许用户通过录制屏幕来训练AI代理。
SantaClawz为其自主AI智能体系统构建了一个运行时激活层,专注于智能体的注册、初始化和运行时激活,旨在简化AI智能体的部署与扩展。
谷歌年度开发者大会 I/O 2026 将于 5 月 19-20 日在山景城举行。预计将发布 Googlebook 新设备、深度集成 AI 的 Android 更新以及 Gemini 的全面渗透。面对 OpenAI 和 Anthropic 的激烈竞争,谷歌需展示其 AI 战略的价值。
通过一个 API,AI 代理即可访问 3,760 家零售商,实现高效的购物和交易。
Grantbot.pl是一个AI驱动的平台,帮助波兰的非政府组织快速撰写赠款申请,支持20多种波兰和欧盟赠款项目,自动生成提案各部分,并提供合规检查与匹配功能。
本文基于DORA研究,指出模糊的AI政策会阻碍创新和安全。明确传达的AI立场能提升个人效率、组织绩效和软件交付吞吐量,并减少摩擦。文章提供了实施步骤,包括获得高层支持、组建跨职能团队、采用三桶框架、发布活文档以及建立反馈循环,并强调了避免常见陷阱的方法。
阿里Qwen3.7预览版突然上线,文本和视觉领域均位列国产第一,模型迭代明显提速。
Vault Pro 是一款基于AI的脚手架工具,专为Obsidian设计,用于自动化创建结构化项目笔记。它利用Node.js和Claude AI,简化笔记初始化流程。现在已通过Stripe Checkout开放购买。
Cursor发布了Composer 2.5,是其迄今为止最强大的模型。
百度旗下自动驾驶平台萝卜快跑创下新纪录:周订单峰值超35万单,日均最高5万单,累计出行次数突破2200万次。运营覆盖全球27城,部分国内城市已实现单车盈利。同时,百度发布2026年Q1财报,AI新业务收入首次超过传统广告业务。
在TechEx北美大会上,专家强调AI的成功依赖于强大的基础设施,包括电力、数据中心、边缘计算和网络安全。大会讨论了从演示到实际部署的差距、数字孪生的实用价值以及影子AI带来的风险。
SuperInfer是一种针对超级芯片(如NVIDIA GH200)上LLM推理的高性能系统,通过SLO感知的旋转调度和全双工内存管理,显著提高TTFT SLO达标率,同时保持相当的TBT和吞吐量。
NeoTube是一款AI驱动的工具,允许用户对视频内容提问并获取精确时间戳的回答。目前它已索引了超过2,645个可汗学院课程,用户可观看视频、提问并立即获得答案。该平台还提供账户注册以保存对话历史。创建者希望让教育视频更易于重新访问。
BudgetBites是一款AI驱动的个人厨房助手,可生成预算友好的食谱,帮助用户节省杂货开支。该应用提供登录页面供用户访问其功能。
Simon Willison在PyCon US 2026上的五分钟闪电演讲,总结了LLM领域过去六个月的关键进展。2025年11月成为转折点:编码代理变得实用,最佳模型多次易手,同时涌现出OpenClaw等个人AI助手,以及Gemini 3.1 Pro、GLM-5.1、Qwen3.6等强大本地模型。
Freu AI 是一款能够自动化任何 Mac 应用程序的工具,零重复运行成本。
随着AI智能体逐渐取代人类成为主要用户,企业需要调整产品策略,从面向人类的设计转向面向智能体的设计,包括提供程序化接口、多表面支持、智能体可读文档、安全原语以及融入智能体生态系统。同时,衡量指标也需要从DAU转向DAA(日活跃智能体)等新指标。
Tamarillo 团队对 GitHub 上超过 40 万个包含 AI 编码助手(如 Cursor、Copilot、Claude 等)配置文件的公开仓库进行了大规模分析。研究覆盖了市场份额、采用动态、配置表面解剖、多工具共存模式以及仓库人口统计数据(星级、语言、所有者类型)。该分析反映了配置意图,是实际采用情况的下限。
现代大语言模型(LLM)可处理百万级token的上下文,但键值(KV)缓存随对话历史线性增长,导致内存不足。现有压缩方法多在处理完整个上下文后才驱逐缓存,峰值内存不受控,且查询依赖的驱逐会窄化缓存语义。本文提出EpiCache,一种免训练的KV缓存管理框架,通过分块预填充限制缓存增长,并通过片段式KV压缩保留主题相关上下文。在三个基准测试上,EpiCache准确率提升高达30%,在4-6倍压缩下接近全缓存准确率,延迟和峰值内存分别降低2.4倍和3.7倍。
Meta本周承诺投入1450亿美元用于AI基础设施,同时裁员约8000人。渣打银行也宣布裁员7000多人,并直言以“低价值人力资本”被AI投资取代。教皇利奥十四世宣布将于5月25日与Anthropic的克里斯托弗·奥拉联合发布首份AI通谕。
在编码代理生产负载下,Together Inference Engine 相比 TensorRT-LLM 每秒令牌数提升 31%,饱和时首令牌延迟提升 2 倍,成本比 Claude Opus 4.6 低 76%。
今日发布了六个新的Sentence Transformers交叉编码重排序器,基于Ettin ModernBERT编码器构建,通过蒸馏训练,在各自规模上达到最先进水平。这些模型与嵌入模型配对使用,可高效提升检索排序质量。
Anthropic与Modal宣布推出Claude托管代理与Modal Sandboxes的集成,允许开发者在自己托管的可定制沙盒中运行工具调用,具有快速启动、成本效益和可扩展性。早期采用者包括Mason AI、DoorDash和Blend。
陪审团裁决为OpenAI今年进行备受期待的IPO扫清了道路,并损害了SpaceX和X所有者马斯克的声誉。