MIT硕士生Sunshine Jiang和Rupert Li获得2026年奈特-亨尼斯奖学金。该奖学金资助在斯坦福大学的研究生学习,今年是第九届。Jiang研究 embodied AI 和机器人,Li专注概率、离散几何和组合数学。
AI 新闻实时情报
实时监测
实时更新
实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。
实时更新
本文详细分析了AI Agent的安全栈,将其分为传输层、身份与委托层、策略层和运行时行为与治理层。作者指出,Agent安全不是一个单一问题,而是涉及多个层面的问题集合。当前身份与委托层最不成熟,而协议层正在快速发展。文章还讨论了MCP、A2A等协议以及各种安全工具在不同层面的作用。
Puter 宣布与 Z.ai 直接集成,将其 GLM 模型系列引入平台,开发者无需 API 密钥或服务器设置即可使用最新模型。
安大略省审计长办公室对20个获批的AI医疗笔记系统进行评估,发现其中60%的系统在患者笔记中混淆了处方药物,12个系统插入了错误的药物信息,9个系统编造了未在医患讨论中出现的内容。然而,评估标准中准确性仅占4%的权重,而供应商在安省的业务存在占30%。
安大略省审计长办公室对20个获批的AI医疗笔记系统进行评估,发现其中60%的系统在患者笔记中混淆了处方药物,12个系统插入了错误的药物信息,9个系统编造了未在医患讨论中出现的内容。然而,评估标准中准确性仅占4%的权重,而供应商在安省的业务存在占30%。
一份报告指出,安大略省工作人员使用了不安全的AI网站,可能带来数据安全风险。
DataHack Summit 2026是印度最大的AI会议第七届,汇聚了AI构建者、研究人员、数据科学家和商业领袖。会议涵盖生成式AI、代理型AI、负责任的AI、机器学习和数据科学等主题,提供主题演讲、实践研讨会、黑客环节、AI展览和社交机会。无论你是数据科学家、开发者还是业务领导者,都能从中获得洞察、技能和行业联系。
Sea Limited的首席产品官阐述了为何该公司在工程团队中部署Codex,以加速亚洲的AI原生软件开发。
网络安全公司Dragos记录了首次使用商业AI模型针对墨西哥蒙特雷大都会区市政水务和排水设施的 cyber攻击。攻击者于2025年12月至2026年2月期间利用Anthropic的Claude和OpenAI的GPT模型进行入侵规划、恶意工具开发和SCADA分析。尽管攻击者未能突破运营技术(OT)基础设施,但Dragos警告称商业AI降低了攻击关键基础设施的门槛。
与人类从新手成长为专家不同,AI代理在项目初期表现出专家水平,但随着项目规模扩大,其上下文窗口的限制导致能力急剧退化,信任度随之下降。文章强调了AI应作为助手而非主导者,需要人类专家保持整体视角,避免盲目依赖。
JDS 是一个 GitHub Copilot CLI 插件,通过强制执行结构化的开发流程(设计先于代码、测试先于实现、基于证据的完成验证),将 AI 编码助手从自动补全工具转变为遵守工程规范的软件工程师。它包含多阶段工作流(思考→规划→执行→验证→完成),并提供灵活与严格的技能类型来适应不同任务。
OpenAI 宣布将 Codex 引入 ChatGPT 的 iOS 和 Android 应用,此前仅限桌面端、CLI 和网页使用。移动版 Codex 可连接到运行 Codex 的机器,保持与桌面同步,并支持远程环境和企业级功能。
埃森哲联邦服务与OpenAI宣布战略合作,帮助美国联邦机构快速采用、迁移和扩展先进AI。合作包括建立智能体实验室、培训架构师、提供FedRAMP-ready路径等,旨在加速AI从概念验证到生产部署的进程。
Crucible 是一个旨在挑战AI确认偏见的工具,通过压力测试来确保观点经受考验。
文章探讨了AI领域中的平台陷阱现象,并介绍了Envelope——一个为整个团队提供AI代理的解决方案。
研究发现,Llama 3.1 8B 模型内部存在一个通用加法模块,利用圆形表示(傅里叶特征)对数字进行编码和加法计算,并将其复用至月份、星期等循环概念的推理任务中。该模块位于第18层,通过并行计算各模数的和来实现加法,并通过引导实验证实了其因果作用。
OpenAI将允许用户通过ChatGPT手机应用远程控制桌面端的Codex工具,这一更新紧随Anthropic Claude Code的流行,旨在提升竞争力。Codex可在macOS上操作应用,并支持手机实时查看进度、批准命令等。
美国能源部SciDAC项目下的RAPIDS和FASTMath研究所获得新资助,专注于开发先进算法和AI工具,以应对百亿亿次超级计算和科学数据挑战。阿贡国家实验室的研究人员在这些研究所中发挥关键作用。
DramaBox 是一款开源的文本转语音模型,用户只需描述场景,模型即可生成带有情感和节奏的语音表演。每个输出都嵌入了水印以验证来源,适用于创意叙事、内容制作等领域。目前仅支持英文。
作者回忆了开源社区如何塑造其职业生涯,从学习Python和FastAPI到找到第一份工作,再到深入Rust社区。然而,随着AI生成的垃圾内容淹没这些社区,许多平台开始收紧规则,甚至封杀相关内容。作者认为,虽然社区在努力抗争,但新入行者面临更窄的道路和更少的真实机会。
一位Reddit用户在Gemini应用中发现了一个名为Gemini Omni的新视频生成模型,其生成的粉笔板书视频在文字可读性和自然度上表现出色,但其他场景(如意大利面测试)仍有不足。该模型可能基于Veo,预计将在下周的Google I/O大会上正式发布。
Trayo在为其潜在客户列表生成头像时,最初尝试了水彩风格,但发现它会错误地暗示人物的外貌特征。最终他们选择了无面孔的剪影设计,使用带有品牌柔和色调的三色矩形背景,创造出既诚实又美观的默认头像。
Posit AI 订阅服务每月 20 美元,其中 15 美元用于 API 积分,旨在构建可持续业务而非补贴代币。随着竞争对手结束补贴,Posit 在数据科学领域的产品价值成为关键差异化因素。
ElviCore 是一个专注于安全优先的 AI 架构的开源项目,强调稳健的防护措施和道德设计。该项目托管在 GitHub 上,但目前处于早期阶段,缺少详细文档。
微软计划在6月底前取消大部分Claude Code许可证,引导员工转向GitHub Copilot CLI。此举出于财务和整合考虑,尽管Claude Code在内部广受欢迎。Anthropic的模型仍可通过Copilot CLI访问。
IBM发布Granite Embedding Multilingual R2系列,包含97M和311M参数两个多语言嵌入模型,均基于ModernBERT架构,支持32K令牌上下文,覆盖200+语言,并在MTEB多语言检索基准上取得领先成绩。97M模型在子1亿参数模型中排名第一,311M模型在5亿参数以下模型中排名第二。
Anthropic发布新论文,探讨美国与中国在AI领域的竞争。文章提出两种情景:一是美国成功保持计算优势,民主国家主导AI规则;二是美国不采取行动,中国在AI领域赶超甚至领先,导致威权主义塑造AI规范。强调了出口管制、蒸馏攻击和加速民主国家AI采用的重要性。
ICE Innovations首席执行官Sarah Choudhary探讨了人工智能领域裁员带来的财务影响,以及首席技术官们将如何面临双重支付压力。
亚马逊宣布推出Alexa for Shopping,这是一款将Rufus产品知识和Alexa+个性化能力融合的AI购物助手。它可以在Amazon购物应用、网站和Echo Show上使用,提供产品比较、价格历史、定期购买、AI概览等功能,且无需Prime会员或Echo设备。
探索涌现世界,这是一个人工智能代理合作构建动态世界的平台。