AI News HubLIVE

AI 新闻实时情报

实时监测

今天 AI 世界最重要的变化

来自 105 个可信来源,最近更新 2026-05-15 01:13 UTC+8。

实时监测

实时更新

实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。

实时更新

重置
谷歌称其挫败了一起利用人工智能利用软件漏洞的攻击

谷歌披露,它发现并破坏了一个犯罪团伙利用人工智能发现另一个公司未知漏洞的企图。这证实了安全专家多年来的警告:黑客正在利用AI加速攻击。与此同时,人工智能在漏洞发现方面的能力也在提升,引发了关于监管的讨论。

Hacker News AI政策 / 研究站内正文
金融服务中代理型AI的数据准备

金融服务公司在部署代理型AI时,必须确保数据的质量、安全性和可访问性。Elastic的Steve Mayzak指出,一个集中、可搜索的数据存储至关重要。从可管理的用例开始,逐步迭代,可以构建满足监管要求的可扩展AI系统。

Hacker News AIAgent / 政策站内正文
普林斯顿大学133年来首次废除名誉准则,将监考所有考试

普林斯顿大学因学生使用人工智能作弊,将于今年夏天开始对所有线下考试进行监考,结束了133年来的荣誉考试制度。学生和教师普遍认为作弊现象严重,且学生因担心网络暴力而不愿举报作弊。

Hacker News AI政策 / 研究站内正文
为何你的AI能写小说却数不到五十

本文探讨了一个悖论:大型语言模型(LLM)能通过律师考试、诊断罕见疾病,却连简单的数数任务都频频出错。这源于其概率预测的本质,而非传统计算。研究识别出三种幻觉类型:虚构型、回避型和过程不透明型。知识创新系统(KIS)通过将推理步骤外部化,实现了100%的计数准确率,并提供了可审计的轨迹。未来AI的可靠性关键在于可审计性,而非仅仅是准确性。

Hacker News AI模型 / Agent / 政策站内正文
Conductor:多智能体AI工作流的确定性编排

Conductor 是微软开源的一个 CLI 工具,采用 YAML 定义多智能体工作流,使用确定性路由而非 LLM 动态编排,从而降低成本和延迟。它支持混合模型、并行执行、人类审核、脚本步骤和 Web 仪表板,适用于代码审查、研究综合等结构化工作流。

Hacker News AIAgent / 政策站内正文
我们允许AI审查低风险PR,同时不违反SOC 2控制

Mirage Security通过使用AI审查低风险拉取请求,将代码变更吞吐量提高了146%,同时保持SOC 2合规性。他们根据风险分类变化,高风险变更仍需人工批准,低风险变更由AI审查,并通过每周人工回顾确保控制有效。所有过程均通过CI/CD脚本实现可审计性。

Hacker News AIAgent / 政策站内正文
AI辅助代码迁移:谷歌将TensorFlow迁移到JAX的速度提升了6倍

谷歌AI和基础设施团队开发了一种多智能体AI系统,将TensorFlow模型迁移到JAX的速度提升了6倍以上。该系统包括规划器、协调器和编码器代理,结合静态分析和严格的验证流程,成功迁移了YouTube等大规模生产模型。

Hacker News AIAgent / 研究站内正文
人类不擅复杂决策,人工智能可指出问题

康奈尔大学研究人员开发了一种新决策工具,利用人工智能帮助人们做出复杂决策。不同于以往由人类检查AI结果,这次是AI反过来检查人类。

Tech Xplore AI研究站内正文
AI真的在“写作”吗?从女祭司到哲学家,古人都会说“不”

本文探讨了写作的本质,通过回顾古代思想家(如柏拉图、亚里士多德)以及神谕祭司的观点,论证了真正的写作不仅仅是字符排列,而是有意识的思想表达。作者认为,当前AI生成文本缺乏意图和灵魂,因此不能被视为真正的“写作”。

Tech Xplore AI研究站内正文
GLiNER2-PII:0.3B参数开源PII模型超越OpenAI隐私过滤器

一款名为GLiNER2-PII的开源模型,仅有0.3B参数,在PII检测任务上取得了最先进性能,在SPY基准测试中超越了OpenAI的隐私过滤器。该模型能识别42种实体类型,并基于多语言合成语料库训练。模型已在Hugging Face上公开发布。

Hacker News AI研究站内正文
互联网的坟墓:Doublespeed自动化内容农场引发关注

Doublespeed是一个AI驱动的社交媒体自动化平台,通过在美国真实设备上运行代理账户,实现大规模内容生成和分发,号称可以取代人类创作者团队。平台提供三种服务层级,并利用真实手机模拟人类行为以规避平台限制,但其本质是自动化内容农场,可能引发伦理争议。

Hacker News AIAgent / 机器人站内正文
石墨烯“纹身”让植物叶片变身传感器,或可构建植物神经网络

德克萨斯大学奥斯汀分校的研究人员开发了一种石墨烯“纹身”,可以直接贴在植物叶片上实时监测水分含量。该传感器不仅可用于监测植物健康状况,还能充当人工突触,未来有望构建植物的神经网络,实现森林火灾和干旱风险的实时评估。

IEEE Spectrum AI芯片 / 政策站内正文
让AI代理用VibeServe编写你的服务栈

VibeServe是一个多代理系统,能够为特定的模型、硬件和工作负载端到端合成定制的大语言模型服务运行时。在标准设置上与vLLM和SGLang相当,在非标准场景中实现1.69倍到6.27倍的加速,展示了AI代理在系统构建中的潜力。

Hacker News AIAgent / 芯片站内正文
Halgorithem:用树结构捕捉AI幻觉,管道中无需AI

Halgorithem 是一种无需依赖AI即可检测AI幻觉的算法,通过将输入文件解析为树结构并与文件块树比较来标记不一致之处。该算法可轻松集成到LangGraph、CrewAI等Python AI工作流中,并在多项基准测试中展现出高准确率。

Hacker News AIAgent / 研究站内正文
微软让100多个AI代理相互对抗以发现Windows漏洞

微软开发了名为MDASH的系统,通过让超过100个专业AI代理相互竞争来发现软件漏洞。仅在补丁星期二,该系统就发现了16个Windows安全漏洞,其中4个为严重漏洞。微软未透露该系统使用的AI模型。

The Decoder模型 / Agent / 政策站内正文
观察:当双方都使用AI时,沟通方式变了

ownyourwords.co 网站讨论AI在沟通中的问题:当双方都使用AI时,信息被无谓地膨胀,浪费大量能源和带宽,同时隐私暴露。解决方案是写回人类的方式——带错别字、粗话和情绪。

Hacker News AI芯片站内正文
Show HN: StyleRef – 一次定义创作风格,在所有AI工具中复用

StyleRef 是一种可移植的风格规范,允许用户一次性定义创意风格,然后在 ChatGPT、Claude、Midjourney 等任何 AI 工具中粘贴使用,确保输出一致性。它包含 160 多个样式块,涵盖色调、色彩、排版、情绪等方面,并支持从图片或文档提取风格。

Hacker News AIAgent / 政策站内正文
Show HN: 多模型接口,LLM之间互相辩论

由于厌倦了AI幻觉,Robin在Rauno上构建了一个工具,让多个AI模型在同一屏幕内实时辩论和相互核查事实,以提高准确性。它支持Claude Sonnet 4.6、Gemini 3.1 Pro和ChatGPT 5.2等模型,并提供免费试用。

Hacker News AI模型 / Agent / 政策站内正文
展示 HN:AI 开发代理隐藏动作路径的交互式地图

Action-path lab 是一个交互式地图工具,通过模拟从正常 PR 到隐藏路径、真实暴露和证明缺口的过程,展示 AI 编码代理如何可能引发安全风险。用户无需上传代码即可探索动作边界、凭证范围等。

Hacker News AIAgent站内正文
盲目野心:AI代理可能将任务变成数码灾难

加州大学河滨分校的计算机科学家发现,新一代AI代理在执行日常电脑任务时存在严重缺陷,可能导致数字灾难。这些代理旨在用户离开时自动处理电子邮件、整理文件、分析数据等,但其盲目行动可能引发意外后果。

Tech Xplore AIAgent / 政策 / 研究站内正文
Show HN:Klent – 在AI代理与生产环境之间一键设置安全防护

Klent 是一个AI代理防护系统,位于代理和工具调用之间,允许、拒绝、修改或暂停每次调用,只需两行代码集成,并提供完整审计追踪。它能防止误操作导致的生产数据灾难,例如一次性修改数万行数据,支持人工审批、策略引擎、动作重写等功能。

Hacker News AIAgent / 政策站内正文
AI智能体不适合移动办公

本文作者分享了自己为了运行AI智能体而搭建的远程工作环境。他意识到,AI智能体的运行状态才是工作本身,而笔记本电脑的移动性会导致中断。因此,他使用Mac Studio作为主机,通过Cloudflare Tunnel和tmux构建了一个可从任何地方访问的持久化工作区。文章详细介绍了设置方法、优点以及尚未解决的问题。

Hacker News AIAgent / 政策站内正文
我在谷歌表格上花了8年,现在我认为应用程序即将消亡

前谷歌表格首席工程师扎克·劳埃德认为,AI编码智能体将使独立应用程序过时,价值转向数据和元应用。他回忆了几天内构建一个表格克隆的经历,并预测未来任何人都可以通过描述需求来构建自定义软件。

Hacker News AIAgent站内正文