OpenAI 推出 Rosalind Biodefense,为经过审查的开发者及美国政府合作伙伴提供 GPT-Rosalind 的受信访问,助力生物防御、公共卫生与大流行病防范。
AI 新闻实时情报
实时监测
实时更新
实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。
实时更新
清华系创业公司是石科技通过自主研发的并行优化技术,构建异构算力资源池与推理优化引擎,实现单位Token成本降低40%,旨在打造国产Token调优工厂,降低AI落地门槛。
repo-brain 是一款开源工具,能将整个代码库压缩成单个Markdown上下文文件,实现高达96%的压缩率,大幅减少AI令牌使用量。它支持多种编程语言的静态分析、架构分析和语义关系发现,并兼容多家AI提供商。
Anthropic以9650亿美元估值完成650亿美元H轮融资,同时披露470亿美元年化收入,并发布Claude Opus 4.8更新(提升判断力、诚实度和长时自主工作能力)以及Claude Code的Dynamic Workflows功能(支持数百个并行子代理)。
ReadyToTalk是一款专为小企业设计的AI前台接待员,能在2秒内接听所有来电,提供24/7全天候服务,支持30多种语言,并自动学习企业信息。每月仅需39美元,无需技术知识即可在几分钟内完成设置。
Overline 是一款 Chrome 扩展,可为任何浏览器视频提供实时 AI 字幕和实时翻译,延迟低于一秒,无需字幕。
StudySong是一款AI工具,能够将学习笔记或任何文本转化为完整的歌曲,支持PDF上传,所有处理在本地完成,保护隐私。
一位研究人员制造了一种假疾病来测试AI,结果AI聊天机器人完全被骗了。这个实验揭示了AI医疗建议的潜在风险,以及训练数据缺乏人工审查的问题。
Anthropic在65亿美元H轮融资公告中透露,其年化收入已超过470亿美元,较4月份的300亿美元大幅增长。该公司此前在2025年底为90亿美元,2026年2月为140亿美元,显示出惊人的增长速度。文章还提到了一家客户因未设置使用限制而单月花费5亿美元的轶事。
Dis Dat 是一个让AI编程代理能够“看到”你所展示内容的工具,通过简单的交互提升代码生成效率。
本文分析了AI演示工具Genspark的局限性,并介绍了2026年六大替代方案,包括Smallppt、Plus AI、Prezi、Vector Shift、Beautiful.ai和ClickUp,各自具有独特的优势,帮助用户根据需求选择合适的工具。
theta-spec 是一个声明式的、与任何AI编码智能体框架无关的配置标准。它通过一个单一的 theta.toml 文件定义完整的配置表面(指令、规则、工具、技能、子智能体),并规定了配置文件的声明周期协议。任何符合规范的实现都可以解析、锁定并将配置转换为任何支持的框架。该项目还提供了参考实现 theta CLI(Rust 编写)。
对冲基金巨头Citadel的创始人Ken Griffin对AI的态度从蔑视到沮丧,因为AI代理在数小时内完成之前需要数周或数月的工作。这引发了对经济增长与就业脱钩的担忧,可能挑战传统GDP作为经济健康指标的可靠性。
Trelk 是一款一次性购买、无需订阅的知识管理应用。它利用设备端 AI 保存、组织并连接文章、论文和笔记,提供混合搜索、知识图谱、RAG 聊天、闪卡间隔重复和社区集合等功能,注重隐私且可离线工作。
Together AI通过将语音识别视为端到端系统问题,而非单纯的GPU推理问题,在Artificial Analysis榜单上实现了最快的语音转文本速度。本文详细介绍了其优化策略:包括针对真实音频形状的TensorRT多配置文件引擎、条件CUDA图消除CPU往返、共享内存减少数据拷贝、事件驱动I/O处理流式传输,以及通过gc.freeze()消除垃圾回收尾延迟。
本周,AI与工作的冲突在四个司法管辖区同时爆发:维基百科编辑因裁员组织罢工,亚马逊员工将内部AI评级系统玩坏,中国法院开始执行禁止以AI为由裁员的规定,英国智库呼吁员工在AI部署中拥有发言权。同时,前沿实验室继续深入政府合作。
OpenAI分享了第三方AI评估指南,涵盖如何评估前沿系统的模型能力、安全措施和有效性。
本文探讨了强化学习在大型语言模型后训练中的实际应用,指出当前的瓶颈并非算法而是基础设施。Modal分享了大规模运行RL后训练的经验,介绍了其开源库如何帮助团队解决多节点训练、环境管理和GPU利用率等关键问题。
本文是 PyTorch 性能分析系列的第一篇,从最简单的矩阵乘加操作开始,引导读者学习如何使用 torch.profiler 进行性能分析,包括设置分析器、解读分析表和追踪数据,以及理解 CPU 和 GPU 活动之间的时间关系。文章还讨论了预热和优化开销等问题。
Anthropic发布了Claude Opus 4.8,定位为对前代产品的适度但切实改进。主要亮点包括诚实性提升(减少无依据断言,代码错误遗漏率降低四倍),以及支持对话中修改系统提示等新功能。定价未变,但快速模式价格显著降低。
Claude最新旗舰Opus 4.8发布,部分能力超过Mythos,支持动态工作流,可拆解任务给数百个子智能体并行执行,人类无需频繁检查。诚实性大幅提升,代码缺陷漏报率降至前代四分之一。
llm-anthropic 0.25.1 版本新增对Claude Opus 4.8模型的支持,为有权限的组织提供快速模式选项,并调整了各模型的默认最大令牌数为模型最大输出而非8192。
Serenity 是一个开源、本地的AI代理,采用受大脑启发的神经节点网络(NNN)记忆架构。它能记住因果关系,跨领域推理,自主运行,且完全在本地机器上运行,无需云依赖。
Liquid AI 推出了 LFM2.5-8B-A1B,这是一款面向设备的混合专家(MoE)模型,专为工具调用设计。该模型总参数量为 8.3B,但每个 token 仅激活 1.5B 参数,从而能够在消费级硬件上运行。它支持 128K 上下文窗口、推理能力,并覆盖九种语言。相比前代 LFM2-8B-A1B,该模型在非幻觉率、指令遵循、数学推理等基准测试中均有显著提升。
介绍一款集AI、WordPress、合规与广告跟踪于一体的软件,提供免费的联盟营销作弊表。
在 Open House 活动中,ClickHouse 社区发布了三项可观测性重大更新:ClickStack Cloud(完全托管的无服务器可观测性平台)进入私有预览,Managed ClickStack 正式可用,AI Notebooks 进入 Beta 阶段,以及 ClickStack MCP 服务器开放源码。AI Notebooks 是一种持久化的调查工作空间,支持分支探索;MCP 服务器则允许外部代理使用可观测性原语,提升调查效率。
AI驱动的编码工具已实现高度自主,让任何人都能开发软件,但底层基础设施却依然陈旧,导致效率低下。我们需要一个全新的AI原生操作系统。
新研究发现,大型语言模型在训练过程中会吸收明确标记为假的陈述,即使它们被明确警告为假。这种现象被称为“否定忽视”,可能导致模型产生幻觉。实验表明,在合成文档微调后,模型对虚假声明的“信念率”从2.5%飙升至92.4%。
Firecrawl 推出 /monitor,一款网页变化监控工具,可自动检测页面变更并通过 webhook 通知 AI 代理,节省高达 90% 的 LLM 令牌消耗。
本视频探讨了在围棋领域对抗超人类AI的策略和方法,包括利用AI的弱点、创新战术以及理解AI的决策模式。