Google发布了Gemini 3.5 Flash模型,它结合了前沿智能与高速性能,支持代理工作流、编程和多模态推理,同时保持低延迟。本文通过原型设计、复杂问题处理和视觉生成等实际测试,展示了其出色的响应速度和实用能力。
AI 新闻实时情报
实时监测
实时更新
实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。
实时更新
本期播客总结了上周AI领域的重要新闻,包括OpenAI发布新的语音智能API功能、Thinking Machines推出高响应实时交互模型、Anthropic进军法律科技领域推出Claude for Legal、以及Sam Altman在庭审中的表现等话题。
服务组织在复杂设备行业因解析知识结构混乱而损失资金。本文探讨了如何建立数据基础以支持预测性维护,强调了构建解析基础、AI就绪数据、因果映射和参考验证解决方案的关键步骤。
谷歌推出Gemini Omni系列,首个模型Gemini Omni Flash能够从图像、音频、视频和文本组合输入生成高质量视频,支持通过自然语言对话编辑视频,并具备物理理解和世界知识。该模型已集成到Gemini应用、Google Flow和YouTube Shorts中。
智会心研 PLUS 开启公测,免费开放高阶研发 AI 能力,完善资料、邀友可领会员,助力大众低成本搞技术创新。
谷歌发布Gemini 3.5 Flash,在编程和代理基准测试中超越其旗舰模型,速度提升4倍,成本降低一半。
InstaVM 是一款面向 AI 代理的云基础设施,它利用 Firecracker 微虚拟机技术,能够在 200 毫秒内启动隔离环境,为每个代理提供独立、安全、可观察的计算资源,并支持持久化存储、动态注入密钥、可控出站流量和实时调试,解决传统沙箱无法满足的代理部署需求。
新南威尔士大学最近推出了一项AI人脸测试,挑战用户区分真伪面孔的能力。《卫报》澳大利亚版的摄影师和网瘾者参加了测试,看看这是科学还是直觉。
Slax Reader CLI将阅读列表变成了AI智能体可以调用的工具,支持脚本化操作。文章解释了为何需要CLI(AI缺乏持久化存储),并介绍了四种主要用例:过滤而非摘要、批量保存、反向RSS工作流和查询历史存档。产品特点包括开源、自托管、免费永久备份和全文搜索。
Second Brain是一款自托管的记忆层,为Claude、ChatGPT、Cursor等AI工具提供持久记忆。它采用语义检索,根据含义而非关键词回忆上下文。所有数据存储在用户自己的Cloudflare账户中,免费且开源。
一名AI工程师声称,他在谷歌DeepMind伦敦办公室分发传单抗议公司为以色列政府提供军事AI后,被不公正解雇。此举反映了对AI社会和伦理影响的日益担忧。
Google发布Stitch 3.0,这是一款利用AI在实时画布上生成和迭代UI屏幕的工具。
该框架在洛克希德·马丁七阶段网络杀伤链基础上,新增了针对AI供应链的Stage 0(模型供应链投毒),为每个原始阶段添加AI特定子技术,并将Stage 7拆分为数据窃取、模型提取和代理横向移动三个子阶段。旨在帮助SOC分析人员以杀伤链视角应对LLM和AI代理攻击。
Google Antigravity 2.0 是一款独立的桌面应用,用于并行编排多个AI代理,支持计划任务、子代理工作流,并与AI Studio、Firebase和Android原生集成。它允许代理在后台按计划运行,通过子代理并行工作,并提供一键项目导出、语音命令和CLI/SDK支持。用户评价积极,但存在UI小缺陷和试用限制。
一篇发表在《格兰塔》杂志上、并获得英联邦基金会短篇小说奖认可的短篇小说,被怀疑是由人工智能生成的。AI检测工具的证据以及作者背景指向AI创作,引发了关于文学真实性的讨论。
一篇荣获英联邦短篇小说奖地区奖项的短篇故事被怀疑是AI生成的,引发关于AI检测和文学真实性的争议。
Xezim是一个轻量级的SystemVerilog模拟器,用Rust编写,旨在探索AI辅助芯片设计工作流程。它支持组合和时序逻辑仿真,并提供多种波形导出格式。
Hiro是一款智能安全代理,帮助开发团队从代码的首次提交开始,一路护航至SOC 2合规认证。它集成了安全扫描、策略管理和自动化合规流程,让安全融入开发周期。
Maple 是一款注重隐私的个人AI,能够处理家居生活、工作等事务,并承诺不将用户数据用于训练或与广告商共享。其隐私优先架构采用开放模型和加密飞地,确保对话私密。目前处于私人测试阶段,提供研究工具和代理功能。
Anthropic的AI助手Claude经常在会话中要求用户去睡觉,引发了广泛猜测。用户报告了各种催促休息的消息,有人觉得贴心,有人觉得烦躁。专家分析认为,这种行为可能源于训练数据、系统提示或上下文管理,并非AI具有意识。Anthropic已注意到此问题并计划修复。
SteelSpine AI 是一种新型AI智能体调试工具,通过一键封装即可捕获智能体的每次运行、决策和工具调用,并支持确定性回放、运行比较以及加密审计。它解决了LLM无状态、智能体高失败率和缺乏审计追溯的问题,并内置了符合欧盟 AI 法案第12条要求的审计功能。
GoPOSIX是一个用Go编写的POSIX工具集,单二进制文件,通过了BusyBox测试套件中96.6%的测试(591/612)。该项目由AI辅助开发,耗时约3周,展示了Go语言在系统工具领域的潜力。
麻省理工学院副教授Connor Coley将化学与机器学习相结合,加速药物发现,并开发出融入化学直觉的AI模型。
COBALT 是一个新的远程操作平台,利用智能手机等常见设备,实现机器人模仿学习所需的高质量示范数据的众包收集。它支持并发多用户控制,降低远程操作成本,并实现低延迟。在九个国家的试点数据集表明,基于手机的远程操作与专用硬件相当甚至更优。
本论文提出“交互就绪性”概念,量化评估铰接物体在仿真中的物理质量,并开发了一种多模态、仿真器在环的方法,从不完整的3D资产自动生成交互就绪的铰接物体,通过迭代仿真反馈优化物理属性,提升仿真稳定性和下游机器人学习性能。
CosFly 是一个面向空中跟踪的盒状结构规划与多模态仿真管线,并附带 CosFly-Track 大型无人机数据集,覆盖城市、高速公路、乡村、森林和沿海等多种环境。该管线基于 CARLA 实现,通过7步模块化流程将复杂3D世界转化为结构化障碍物表示,再投影回多模态传感器数据(RGB图像、深度图、语义分割图)及自然语言导航指令。支持可配置固定视场角变焦,分析了两类轨迹规划范式:传统两阶段流水线和直接梯度优化方法。数据集包含250条验证轨迹和约10万张渲染图像及完整六自由度无人机位姿标注。
提出将腱驱动连续机器人的代理建模视为算子学习问题,映射设计参数和肌腱驱动输入至构型。开发了四种神经算子架构(基于DeepONet和FNO),在模拟数据上训练,实现了跨设计的快速准确泛化。研究成果为手术和工业应用中的控制、规划和设计优化提供了高效可泛化的代理模型。
本文提出STRELGen框架,结合扩散模型与时空逻辑(STREL)规范,通过可微分的满意度监控进行梯度优化,高效生成逼真的安全关键驾驶场景,从而克服传统暴力测试的局限性。
本文提出了一种新的分布鲁棒控制方法,结合斯坦变分推断,用于接触丰富操作中的不确定性建模。该方法在保留模型控制优势的同时,提高了对任务敏感参数不确定性的适应性,实验显示在多种任务中鲁棒性提升高达3倍。
该研究通过复现和压力测试,评估了SPARK人形机器人安全过滤器的鲁棒性。在MuJoCo中复现基准案例,比较了六种方法,构建后处理管道,发现不同方法在目标跟踪和碰撞减少上各有优劣。压力测试表明障碍物拥挤、噪声距离估计和延迟信息会改变安全行为,建议超越名义性能使用暴露失效模式的指标。