Anthropic与Modal宣布推出Claude托管代理与Modal Sandboxes的集成,允许开发者在自己托管的可定制沙盒中运行工具调用,具有快速启动、成本效益和可扩展性。早期采用者包括Mason AI、DoorDash和Blend。
AI 新闻实时情报
实时监测
实时更新
实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。
实时更新
陪审团裁决为OpenAI今年进行备受期待的IPO扫清了道路,并损害了SpaceX和X所有者马斯克的声誉。
伦敦国王学院的一项调查发现,三分之一的大学生认为人工智能将迅速导致失业,从而引发社会动荡。调查还显示,近一半的公众倾向于避免使用AI。
陪审团裁定Sam Altman、OpenAI及其总裁Greg Brockman对Elon Musk关于违背创始合同的指控不承担责任,这场法律战以Altman一方胜利告终。
在戴尔科技世界大会上,戴尔和NVIDIA宣布了新一代AI基础设施,包括基于NVIDIA Vera Rubin NVL72的Dell PowerEdge XE9812,可将每个token的推理成本降低10倍。戴尔CEO迈克尔·戴尔表示,全球AI基础设施支出到2030年可能达到3-4万亿美元,代币消耗量增长3400%。NVIDIA CEO黄仁勋强调需求呈抛物线式增长。企业AI已从试点转向大规模代理AI和推理部署。戴尔AI工厂与NVIDIA合作,提供从桌面到数据中心的全面AI解决方案,包括保密计算和开放模型支持。
英伟达副总裁 Ian Buck 亲手将首款 Vera CPU 系统交付给 Anthropic、OpenAI、SpaceXAI 和甲骨文云基础设施。Vera 专为智能体 AI 工作负载设计,拥有 88 个定制内核、1.2 TB/s 内存带宽和 50% 的单核性能提升。
MemPrivacy是一个由MemTensor、荣耀和同济大学联合提出的框架,旨在解决LLM驱动代理中云内存系统暴露用户隐私的问题。它通过在设备端用类型化占位符替换敏感数据,再发送到云端处理,从而在保护隐私的同时保持内存效用。该框架引入了四级隐私分类法(PL1-PL4),并允许用户配置保护阈值。最佳模型MemPrivacy-4B-RL在基准测试中F1得分达85.97%,且内存效用损失控制在1.6%以内。
Skilled 是一款终端仪表盘工具,可读取 Claude Code、OpenCode、Codex、Grok 和 Droid 等 AI 编码工具的本地历史文件,实时展示技能使用频率、周趋势、小时分布、按项目分解和审计启发(如上升/下降/闲置技能)。完全本地运行,无网络、无遥测、无账户、无配置。
伯克利实验室开发了MatterChat框架,通过连接大型语言模型与基于物理的原子间势能模型,使AI能理解材料科学的3D原子结构。该模型在预测材料属性上显著优于GPT-4,有望加速新材料发现。
现代语言模型因token分布极不均匀面临优化挑战:常见token的参数频繁接收梯度更新,而罕见token的参数可能数百步无有效信号。标准SGD以相同学习率更新所有参数,导致罕见token权重难以学习。Adam通过方差归一化自动为罕见token提供更大的有效学习率,使其快速收敛。在控制实验中,使用频率跨四个数量级的六个token,SGD对最罕见token的权重仅学到0.15(真实值为1.0),而Adam使其接近1.0。
根据Mandiant的年度企业安全报告,攻击者利用AI实现更快入侵,而人类仍是薄弱环节。文章提出了五种结构性网络防御策略,包括将虚拟化平台列为Tier-0资产、解耦备份环境、部署高级威胁检测、审计SaaS集成以及实施基于行为的安全模型。
SandboxAQ宣布将其大型定量模型(LQMs)与Anthropic的Claude集成,研究人员现在可以通过自然语言界面运行药物发现、材料科学等领域的复杂模拟。首个可用的模型是用于催化剂发现的AQCat吸附自旋,药物发现模型即将推出。
Agentic AI基金会(AAIF)宣布在过去一个季度新增43名成员,包括4名黄金级、27名白银级和12名准会员,使总成员数达到180家。新成员涵盖金融、政府、学术界和企业技术领域,带来从应用交付到支付处理、网络安全、机器人技术和云原生开发的全栈技术专长。AAIF执行董事Mazin Gilbert表示,围绕智能体AI的讨论已根本转变,组织正选择投资开放标准,因为碎片化的专有方法无法扩展。新黄金级成员包括F5、GoDaddy、Stripe和TRON,白银级和准会员名单亦已公布。AAIF作为开放标准智能体AI栈的中立家园,通过透明治理推动标准采纳。
教宗利奥将在其首部重要教宗文件中探讨人工智能的快速发展,该文件将于下周在梵蒂冈发布,届时Anthropic联合创始人克里斯托弗·奥拉将出席。
漏洞赏金计划长期以来是网络安全的核心机制之一,但AI辅助提交的报告泛滥迫使GitHub收紧标准:要求提供可工作的概念验证,低严重性发现可能仅获得公司礼品。此举反映了业界对AI生成低质量报告的普遍担忧。
经过三周庭审,马斯克诉奥特曼案因诉讼时效被驳回,但揭示了AI领域高层人士普遍缺乏可信度。案件涉及OpenAI的控制权争斗、安全审查问题以及双方互相指责。公众对AI的担忧达到历史新高,而行业领袖的行为加剧了不信任。
了解如何使用基于 MLCommons AILuminate 评估标准的结构化和自由形式方法来引导 Amazon Nova 2 Lite 进行内容审核。这些提示技术允许通过编辑提示来更新审核策略,而无需重新训练模型,同时提供了与其他基础模型在公共数据集上的基准测试结果。
根据Linux基金会最新报告,安全准备不足已超越成本、技能短缺等问题,成为AI采用和创新的最大障碍。报告显示,67%的受访者面临领导层或市场压力要求加速AI部署,即使存在安全顾虑。48%的组织将安全视为AI的首要障碍,较2024年的17%大幅上升。为应对挑战,多数企业优先通过提升现有员工技能来弥补安全与运营能力缺口,同时AI也在推动技术岗位增长,预计2026年净招聘增长31%。
英国通信管理局(Ofcom)将更新实践准则,以应对“复仇色情”和AI生成的深度伪造内容激增,这些内容通常针对女性和女孩。社交媒体、消息平台和在线论坛将被要求遵循新指南,以检测和阻止此类虐待行为。
Wave Terminal是一款集成了AI、文件管理、网页浏览器等多种工具的强大终端应用,支持Linux、macOS和Windows。本文介绍了其安装、使用和AI功能。
微软在2026年北美开源峰会上宣布了Azure Linux 4.0公开预览版和Azure Container Linux正式版,旨在为云原生和AI工作负载提供安全、一致的Linux基础。同时,微软积极推动开放自主AI标准,作为Agentic AI Foundation(AAIF)的创始成员,发布代理治理工具包,并持续投资于开源供应链安全。
经过约两小时审议,陪审团一致裁决马斯克对奥特曼和OpenAI的诉讼中关键主张因诉讼时效而失效。马斯克表示将上诉。
Aderant通过部署Amazon Quick,将跨六个系统的搜索统一,并自动化文档工作流程,将搜索时间缩短90%,文档创建速度提升75%。本文详细介绍了实施过程、实际成效及未来规划。
Odysseyml推出了Agora-1,这是一个多智能体世界模型,支持多达四名人类或AI参与者同时进行实时模拟。该模型将模拟与渲染解耦,确保多视角一致性,适用于AI研究、游戏开发和机器人领域。
GitHub Copilot会话的远程控制功能现已全面上线,支持在github.com和GitHub Mobile上使用。开发者可以在VS Code或CLI中启动会话,然后在手机或其他设备上继续监控和调整。该功能支持实时监控、中途更改指令、审批权限请求等,实现跨设备的无缝工作流,且默认保持私有。
Manus 发布 Scheduled Tasks 2.0,允许在相同任务上下文中运行周期性工作,复用项目配置,并为 Manus 构建的 Web 应用添加嵌入式定时操作,实现工作流自动化。
尝试用AI为Hyprland窗口管理器生成配置文件,Codex表现最佳,但存在多处错误,需手动修正。作者强调AI可作为学习起点,但新手应避免直接使用。
深度代理此前采用通用设计以适配各模型家族。今天,我们推出模型特定配置文件,可调整提示、工具和中间件。我们内置了针对OpenAI、Anthropic和Google模型的配置文件,在tau2-bench子集上相比默认配置实现了10-20分的提升。
本文介绍了如何通过参数高效微调技术LoRA和DoRA,在单个GPU上微调NVIDIA Cosmos Predict 2.5世界模型,生成用于机器人学习的合成视频轨迹。文章详细说明了数据处理、适配器初始化、训练循环、推理方法及评估指标。
亚马逊升级版AI助手Alexa Plus新增功能,可根据用户提供的主题生成由AI主持人对话的播客节目,内容涵盖从罗马帝国历史到摄影技巧等广泛话题,并能从200家合作新闻机构获取信息。