AI News HubLIVE

AI 新闻实时情报

实时监测

今天 AI 世界最重要的变化

来自 105 个可信来源,最近更新 2026-05-29 11:00 UTC+8。

实时监测

实时更新

实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。

实时更新

重置
借助 Rosalind Biodefense 增强社会韧性

OpenAI 推出 Rosalind Biodefense,为经过审查的开发者及美国政府合作伙伴提供 GPT-Rosalind 的受信访问,助力生物防御、公共卫生与大流行病防范。

OpenAI News模型站内正文
清华系团队给大模型织了一张“智能算力电网”

清华系创业公司是石科技通过自主研发的并行优化技术,构建异构算力资源池与推理优化引擎,实现单位Token成本降低40%,旨在打造国产Token调优工厂,降低AI落地门槛。

量子位模型 / Agent / 芯片站内正文
如何优化您的AI令牌使用量:repo-brain 工具介绍

repo-brain 是一款开源工具,能将整个代码库压缩成单个Markdown上下文文件,实现高达96%的压缩率,大幅减少AI令牌使用量。它支持多种编程语言的静态分析、架构分析和语义关系发现,并兼容多家AI提供商。

Hacker News AIAgent站内正文
ReadyToTalk – 专为小企业打造的AI前台,由AI代理独立构建

ReadyToTalk是一款专为小企业设计的AI前台接待员,能在2秒内接听所有来电,提供24/7全天候服务,支持30多种语言,并自动学习企业信息。每月仅需39美元,无需技术知识即可在几分钟内完成设置。

Hacker News AIAgent / 政策站内正文
Overline

Overline 是一款 Chrome 扩展,可为任何浏览器视频提供实时 AI 字幕和实时翻译,延迟低于一秒,无需字幕。

Product Hunt AI工具站内正文
Bixonimania – AI 上当的假疾病

一位研究人员制造了一种假疾病来测试AI,结果AI聊天机器人完全被骗了。这个实验揭示了AI医疗建议的潜在风险,以及训练数据缺乏人工审查的问题。

Hacker News AI研究 / 创业融资站内正文
Anthropic年化收入达470亿美元

Anthropic在65亿美元H轮融资公告中透露,其年化收入已超过470亿美元,较4月份的300亿美元大幅增长。该公司此前在2025年底为90亿美元,2026年2月为140亿美元,显示出惊人的增长速度。文章还提到了一家客户因未设置使用限制而单月花费5亿美元的轶事。

Simon Willison's Weblog模型 / 创业融资站内正文
AI幻灯片工具值得使用吗?

本文分析了AI演示工具Genspark的局限性,并介绍了2026年六大替代方案,包括Smallppt、Plus AI、Prezi、Vector Shift、Beautiful.ai和ClickUp,各自具有独特的优势,帮助用户根据需求选择合适的工具。

Hacker News AIAgent / 研究站内正文
theta-spec:一个谦逊的、与框架无关的AI智能体配置规范

theta-spec 是一个声明式的、与任何AI编码智能体框架无关的配置标准。它通过一个单一的 theta.toml 文件定义完整的配置表面(指令、规则、工具、技能、子智能体),并规定了配置文件的声明周期协议。任何符合规范的实现都可以解析、锁定并将配置转换为任何支持的框架。该项目还提供了参考实现 theta CLI(Rust 编写)。

Hacker News AIAgent / 研究站内正文
人工智能与我们熟知的衰退的终结

对冲基金巨头Citadel的创始人Ken Griffin对AI的态度从蔑视到沮丧,因为AI代理在数小时内完成之前需要数周或数月的工作。这引发了对经济增长与就业脱钩的担忧,可能挑战传统GDP作为经济健康指标的可靠性。

Hacker News AIAgent / 研究站内正文
Show HN:Trelk – 阅读、思考、连接

Trelk 是一款一次性购买、无需订阅的知识管理应用。它利用设备端 AI 保存、组织并连接文章、论文和笔记,提供混合搜索、知识图谱、RAG 聊天、闪卡间隔重复和社区集合等功能,注重隐私且可离线工作。

Hacker News AI研究站内正文
Together AI如何构建全球最快的语音转文本技术栈

Together AI通过将语音识别视为端到端系统问题,而非单纯的GPU推理问题,在Artificial Analysis榜单上实现了最快的语音转文本速度。本文详细介绍了其优化策略:包括针对真实音频形状的TensorRT多配置文件引擎、条件CUDA图消除CPU往返、共享内存减少数据拷贝、事件驱动I/O处理流式传输,以及通过gc.freeze()消除垃圾回收尾延迟。

Together AI BlogAgent / 芯片站内正文
AI每周第497期:AI的劳工战争全球爆发

本周,AI与工作的冲突在四个司法管辖区同时爆发:维基百科编辑因裁员组织罢工,亚马逊员工将内部AI评级系统玩坏,中国法院开始执行禁止以AI为由裁员的规定,英国智库呼吁员工在AI部署中拥有发言权。同时,前沿实验室继续深入政府合作。

AI Weekly芯片 / 政策站内正文
值得信赖的第三方评估共享手册

OpenAI分享了第三方AI评估指南,涵盖如何评估前沿系统的模型能力、安全措施和有效性。

OpenAI News研究 / 创业融资站内正文
强化学习是一个基础设施问题

本文探讨了强化学习在大型语言模型后训练中的实际应用,指出当前的瓶颈并非算法而是基础设施。Modal分享了大规模运行RL后训练的经验,介绍了其开源库如何帮助团队解决多节点训练、环境管理和GPU利用率等关键问题。

Modal BlogAgent / 芯片站内正文
PyTorch 性能分析(第一部分):torch.profiler 入门指南

本文是 PyTorch 性能分析系列的第一篇,从最简单的矩阵乘加操作开始,引导读者学习如何使用 torch.profiler 进行性能分析,包括设置分析器、解读分析表和追踪数据,以及理解 CPU 和 GPU 活动之间的时间关系。文章还讨论了预热和优化开销等问题。

Hugging Face Blog芯片 / 创业融资站内正文
Claude Opus 4.8:'适度但切实的改进'

Anthropic发布了Claude Opus 4.8,定位为对前代产品的适度但切实改进。主要亮点包括诚实性提升(减少无依据断言,代码错误遗漏率降低四倍),以及支持对话中修改系统提示等新功能。定价未变,但快速模式价格显著降低。

Simon Willison's Weblog模型 / Agent / 政策站内正文
llm-anthropic 0.25.1 发布

llm-anthropic 0.25.1 版本新增对Claude Opus 4.8模型的支持,为有权限的组织提供快速模式选项,并调整了各模型的默认最大令牌数为模型最大输出而非8192。

Simon Willison's Weblog模型站内正文
Liquid AI 发布 LFM2.5-8B-A1B:面向设备的 MoE 模型,总参数量 8.3B,激活参数量 1.5B

Liquid AI 推出了 LFM2.5-8B-A1B,这是一款面向设备的混合专家(MoE)模型,专为工具调用设计。该模型总参数量为 8.3B,但每个 token 仅激活 1.5B 参数,从而能够在消费级硬件上运行。它支持 128K 上下文窗口、推理能力,并覆盖九种语言。相比前代 LFM2-8B-A1B,该模型在非幻觉率、指令遵循、数学推理等基准测试中均有显著提升。

MarkTechPostAgent / 芯片站内正文
Open House 可观测性公告:MCP 服务器、AI Notebooks 和 ClickStack Cloud

在 Open House 活动中,ClickHouse 社区发布了三项可观测性重大更新:ClickStack Cloud(完全托管的无服务器可观测性平台)进入私有预览,Managed ClickStack 正式可用,AI Notebooks 进入 Beta 阶段,以及 ClickStack MCP 服务器开放源码。AI Notebooks 是一种持久化的调查工作空间,支持分支探索;MCP 服务器则允许外部代理使用可观测性原语,提升调查效率。

Hacker News AIAgent / 研究站内正文
AI编码已达L3自主,但基础设施仍卡在L1

AI驱动的编码工具已实现高度自主,让任何人都能开发软件,但底层基础设施却依然陈旧,导致效率低下。我们需要一个全新的AI原生操作系统。

Hacker News AIAgent / 芯片站内正文
即便明确警告为假,大型语言模型仍会相信虚假陈述

新研究发现,大型语言模型在训练过程中会吸收明确标记为假的陈述,即使它们被明确警告为假。这种现象被称为“否定忽视”,可能导致模型产生幻觉。实验表明,在合成文档微调后,模型对虚假声明的“信念率”从2.5%飙升至92.4%。

Hacker News AI模型 / 研究站内正文
如何击败超人类AI(围棋)[视频]

本视频探讨了在围棋领域对抗超人类AI的策略和方法,包括利用AI的弱点、创新战术以及理解AI的决策模式。

Hacker News AI政策站内正文