谷歌将AI能力扩展到广告领域,使用Gemini模型生成产品推荐和解释,并推出内置聊天机器人的广告,同时在AI模式中测试新的广告格式。
AI 新闻实时情报
实时监测
实时更新
实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。
实时更新
谷歌在I/O大会上推出Universal Cart,利用Gemini AI代理整合多零售商购物车,自动完成购买、预测消费行为。
Simon Willison 分析了 Google I/O 2026 发布的 Gemini Spark 个人 AI 代理,该代理原生集成 Google 应用,但 FAQ 中提到的 Antigravity 平台引发困惑。文章详细讨论了 Spark 的安全措施(隔离 VM、DLP)以及作者对 prompt injection 风险的担忧,并提及开源 Gemini CLI 将被闭源 Antigravity CLI 取代。
乔纳森·弗兰克尔因其彩票假说获得2023年AAAI/ACM博士论文奖。在访谈中,他讨论了经验主义与理论证明的对比、计算机科学研究方法的变化、年轻研究者对影响力的追求,以及当前AI研究的关键问题:如何判断AI是否有效。
智囊团Demos的调查发现,AI服务在苏格兰选举期间对34%的问题提供了错误信息,包括编造丑闻、虚构候选人和提供错误日期。选举委员会呼吁对AI聊天机器人实施新的法律控制。
datasette-agent-charts 0.1a1 版本发布,为 Datasette Agent 带来了 Observable Plot 图表支持,包括改进的配色方案、权限检查、交互式工具提示和错误修复。
Canonical发布了Ubuntu Core 26,一个面向物联网和边缘设备的极简、不可变Linux发行版,提供15年支持。其增强的安全特性旨在满足欧盟《网络弹性法案》(CRA)的要求,包括经过签名的snap组件、改进的全盘加密和Chisel构建系统。新版本还优化了OTA更新,尺寸缩小50%-90%,并增加了ARM64的Livepatch支持。
谷歌DeepMind同意与英国工会进行正式谈判,此前员工签署请愿书,抗议其AI技术被美国和以色列政府用于国防和情报领域。这标志着科技巨头首次可能成立工会。
研究表明,近半数美国专业人士认为AI生成的“低质产出”(workslop)使他们更加谨慎。低质量AI输出导致信任度下降(57%)、生产力降低(51%)和声誉受损(46%)。应对策略包括重新思考AI生产力:采取“AI优先,人类第二”的工作模式,以及坚持使用AI工具,通过持续努力和学习实现价值。
我们即将检验SynthID和C2PA等系统能否有效打击深度伪造。谷歌将SynthID验证扩展到Chrome和搜索,同时检查C2PA元数据。OpenAI为其图像添加SynthID。Meta将在Instagram上使用C2PA标记相机拍摄的照片。但挑战依然存在:元数据易被剥离、开源模型不采用、谷歌身兼AI创作者与解决方案提供者的双重角色。
智象未来在首届开放日发布超2000亿参数的原生全模态图像大模型HiDream-O1-Image-Pro,基于Unified Transformer架构,刷新多项SOTA。同时完成新一轮亿级融资,深创投等机构参与。公司推出“模型+智能体”战略,三大智能体产品落地,并与多家企业达成合作,向世界模型迈进。
这些交易涉及生成式人工智能领域一些最著名的品牌,再次证明了该市场的火爆程度。
作者再次体验谷歌Android XR眼镜和Project Aura,展示了Gemini驱动的多模态AI能力,包括日历添加、图像编辑和跨应用集成,认为环境AI是智能穿戴的未来。
多年来,科技公司承诺AI将带来能干的个人助理,但实际更像无知的实习生。近六个月,开源AI代理平台OpenClaw的流行改变了这一状况。在I/O 2026大会上,谷歌推出了新的AI代理,用于信息收集、活动策划、收件箱和日历总结等。这些代理可在后台持续运行,并深度整合谷歌生态。同时,谷歌扩展了开发者工具,并借助Gemini Spark等产品,试图在AI代理领域取得大规模成功。
在Token经济加速到来的背景下,国产AI算力面临新机遇。太初元碁首席产品官洪源指出,未来算力需要解决大规模集群服务能力、计算效率和生态适配三大关键问题,异构协同将成为AI算力基础设施的重要方向。
本文探讨了如何通过Unity Catalog和Unity AI Gateway实现AI代理的治理。文章提出AI治理本质上是数据治理,并介绍了四大支柱:委托访问、以数据为中心的AI治理、成本智能以及开放互操作性。这些方法帮助企业平衡创新与风险,确保安全合规。
AutoSubtitles 2.0 是一款基于浏览器的AI字幕生成器,可生成20多种语言的准确字幕,提供时间线编辑、画布编辑、病毒式字幕预设以及AI增强功能(如自动表情符号)。所有处理均在客户端完成,无需上传视频或使用复杂软件,专为创作者、播客、在线课程和社交媒体视频设计。
OpenAI 宣布启动“OpenAI for Singapore”项目,这是一项多年期人工智能合作计划,旨在扩大AI部署、培养本地人才,并利用AI支持企业和公共服务。
电信首席财务官在做网络资本分配决策时常忽略现有运营数据。Databricks Genie通过自然语言查询统一财务、网络和商业数据,帮助CFO基于实际投资回报历史做出更明智的决策。
Thinking Machines的交互模型将实时对话、视觉、音频和工具使用融合为一个持续学习的系统。
牛津大学教授迈克尔·伍尔德里奇在访谈中分享了他对人工智能的乐观态度,但警示大科技公司对AI的滥用。他热爱教学,并通过博弈论解释硅谷企业家的行为模式。
当前生产环境中的智能体缺乏身份、上下文持久性和平台支持,导致治理和可靠性问题。文章提出了四个关键架构方向:智能体需要独立身份、通用上下文、持久化执行和平台化基础设施。
NVIDIA推出Nemotron-Labs-Diffusion模型家族,在单一架构中统一自回归解码、扩散并行解码和自推测解码。支持3B、8B和14B参数规模,包含基础、指令和视觉语言变体。自推测模式通过扩散生成候选令牌,再由自回归验证,无需辅助模型。在8B规模下,线性自推测较Qwen3-8B实现6倍前向令牌数,准确率63.61%,优于Qwen3-8B的62.75%。布署灵活,适用于不同并发场景。
袋袋(Profy)让专家像聊天一样输入经验,系统自动封装成数字专家,实现24小时自动服务。
美国司法部与埃隆·马斯克的xAI联手起诉科罗拉多州,试图推翻其AI反歧视法。这不仅是科罗拉多州的问题,而是关乎所有人的权益。
阿里巴巴发布了专为AI智能体设计的Zhenwu M890芯片,并公布了多芯片路线图及Qwen 3.7-Max大语言模型,表明其正在构建集成AI堆栈。
Databricks Genie是一款数据代理工具,通过自然语言查询使CX领导者能够即时获取客户洞察,无需等待分析师处理,从而加速零售个性化决策。
美德基金会与Databricks for Good合作,利用AI提升全球医疗成果。双方共同构建了一个生产级平台,通过大语言模型从72个低收入和中低收入国家提取医疗设施数据,并利用实体解析技术整合信息,最终通过VF Agent实现自然语言查询,帮助医疗专业人员快速找到匹配的志愿机会。
人们越来越多地使用AI聊天机器人寻求个人和社交生活建议,但研究人员和AI公司担心用户过度依赖。我们想听听那些因采纳AI建议而后悔的人的经历。
阿里巴巴Qwen团队发布了Qwen3.5-LiveTranslate-Flash,这是一款实时多模态翻译模型,可同时处理音频和视频。该模型支持60种输入语言,并以2.8秒的延迟输出29种语言的语音。相比上一版本,新增了实时说话人声音克隆、通过唇形和屏幕文本增强视觉理解,以及动态关键词配置以处理领域特定术语。在FLEURS和CoVoST2基准测试中,该模型表现优于主要商业替代品。该模型通过阿里云百炼平台以API形式提供,使用WebSocket协议。