AI News HubLIVE

AI 新闻实时情报

实时监测

今天 AI 世界最重要的变化

来自 105 个可信来源,最近更新 2026-06-05 12:00 UTC+8。

实时监测

实时更新

实时跟踪可信来源,保留出处、权限和站内阅读模式,把噪声压成可读情报。

实时更新

重置
可微高效运算符搜索

研究人员提出可微高效运算符搜索框架,自动寻找多模态基础模型中的令牌缩减最优策略,在视觉令牌大幅压缩下仍保持精度与效率的平衡。

arXiv Machine Learning模型 / 政策 / 研究站内正文
大步长梯度下降恢复多路径深度线性网络中的对称性

最近对多路径深度线性网络的分析使用梯度流预测了“赢家通吃”的专业化,其中路径对称性被打破,每个特征集中在一个路径上。本文表明,大步长的离散梯度下降(GD)讲述了不同的故事。我们证明单路径解是尖锐最小值,而将信号分布到多个路径上会降低尖锐度,且降低因子随路径数量和深度增加而减小。因此,虽然早期训练再现了梯度流预测的深度驱动对称性破坏,但随后在稳定边缘的振荡覆盖了这一趋势,并将网络驱动到再平衡阶段,信号在路径间重新分布。这些结果共同阐明了深度如何塑造路径竞争,并解释了大步长GD为何有利于共享表示而非持续的单路径主导。

arXiv Machine Learning研究站内正文
状态承诺学习:训练语言模型区分计算与记忆

该研究提出状态承诺学习,通过反事实擦除强化学习(CERL)训练语言模型区分临时计算与持久状态,在不牺牲准确性的前提下减少答案对隐藏思维的依赖。

arXiv Machine Learning模型 / 研究 / 创业融资站内正文
大型语言模型中的时间偏好概念及其功能

研究人员在一款蒸馏版大型语言模型(Qwen3-4B-Instruct-2507)中定位了负责时间偏好的神经子图,发现模型对未来折扣的程度远低于人类,且这种偏好在不同上下文中不稳定,而通过引导向量可以调节时间偏好。

arXiv Machine Learning模型 / 研究站内正文
PyCC.id:基于结构可识别性的假设驱动方程发现工具包

PyCC 是一个 Python 库,利用特征曲线启发的结构骨架,从时间序列数据中自动发现常微分方程。它通过融入领域假设来解决方程发现中的病态逆问题,并具有结构可识别性属性。

arXiv Machine Learning研究站内正文
预算受限的微预训练的分阶段因子筛选

该论文提出了一种分阶段分数因子筛选方法,以在预算紧张的情况下有效识别高惩罚超参数方向。通过613项实验,研究发现总批处理量、深度和宽度在短期预算内惩罚最大,随着预算增加而缓解。短时间设计筛选可帮助确认有前景的锚点并局部优化,支持以60分钟桥接锚点为中心的建议,但排名不是硬件不变的。

arXiv Machine Learning模型 / Agent / 芯片站内正文
ERRORQUAKE:开源大语言模型中错误严重性的重尾分布

即使准确率相同,不同的开源大语言模型(LLM)在错误严重性分布上也存在显著差异——这种差异是标量错误率所无法捕捉的。我们引入了Errorquake-10k基准测试,包含10,000个查询,在8个领域和5个难度等级上对每个回答进行0-4连续严重性评分,并为21个开源模型拟合了严重性分布。

arXiv Machine Learning模型 / 研究站内正文
评估盲点:大型语言模型基准覆盖的体视学理论

一篇新论文提出了评估LLM基准覆盖的体视学理论,发现基准套件的有效维度导致巨大盲点,远超分数差异,并提出了最小基准集选择算法和解决了Gardner问题。

arXiv Machine Learning模型 / 研究 / 创业融资站内正文
agentgateway 加入 AAIF,成为智能代理基础设施的开放网关

agentgateway 是一个专为 AI 和代理工作负载设计的统一开源网关,现已作为第四个项目加入 Linux 基金会旗下的代理 AI 基金会 (AAIF)。它通过单一平台管理 MCP、A2A、LLM 推理、HTTP 和 gRPC 流量,提供安全、可观测性、路由和治理能力,帮助组织应对智能代理系统带来的运维挑战。

Hacker News AIAgent / 芯片站内正文
AI跑步机

Deb Liu反思了AI驱动的持续优化文化以及对落后的恐惧,认为真正的生产力包括静止,AI不应取代人类反思。

Hacker News AIAgent / 政策站内正文
AI代理的SparkNotes:免费试用

AgentNotes 是一款为AI代理提供简明英文摘要的工具。只需安装一个包并设置三个环境变量,即可在仪表盘中查看代理的运行日志和摘要。支持Python、Node.js和ClawHub,提供7天免费试用。

Hacker News AIAgent / 政策站内正文
Aisop – 使用Mermaid或JSON流程图定义AI代理工作流

AISOP是一种开放协议,允许开发者使用Mermaid或JSON流程图定义结构化AI程序,支持分支、并行执行、子任务和错误处理等14种以上控制流模式,以单一可移植JSON格式实现。其设计注重可移植性、机器可读性和令牌效率,并遵循“人类主权与福祉”的零号公理。

Hacker News AIAgent / 政策站内正文
向量湖库:满足所有AI工作负载的终极方案

Zilliz 推出 Vector Lakebase 公开预览版,这是一种以语义为中心的数据平台,统一了实时检索、交互式发现和批量分析三种AI工作负载模式。该平台提供分层服务、按需搜索、外部数据湖搜索、全光谱搜索和统一湖原生存储等特性,相比无服务器方案可大幅降低成本。

Hacker News AIAgent / 政策站内正文
Dirk与Linus讨论AI与内核开发

在OSSNA大会上,Dirk与Linus就AI与内核开发进行了讨论。本文由Joe Brockmeier于2026年5月25日报道。

Hacker News AI工具站内正文
AI应证明自身价值:推出AI生产力保障

许多公司在AI上投入巨大却难以衡量实际回报。Cognition推出AI生产力保障,承诺若其AI工程师Devin创造的价值低于客户支付费用,将提供高达1000万美元的信用额度。该保障基于一个经过验证的生产力估算器,通过比较AI完成任务的输出与人类工程师所需时间来计算。

Hacker News AIAgent / 研究站内正文
AI助手不应持有你的密码

企业正迅速采用AI代理,但往往未经IT批准,导致凭证泄露等安全风险。Bitwarden提供Secrets Manager、Access Intelligence、Agent Access SDK和MCP服务器等解决方案,以保护AI代理对凭证的安全访问。

Hacker News AIAgent / 政策站内正文
GGUF 提升性能与模型支持

Ollama 0.30 现已发布,通过 llama.cpp 带来更优性能和 GGUF 模型兼容性,增强了 Apple Silicon 上的 MLX 引擎,支持更多硬件和模型。

Ollama Blog模型 / Agent / 芯片站内正文
用AI打造真实产品,却不迷失方向

一位资深工程师分享了如何用AI辅助构建一款面向青少年棒球队的排阵与管理应用CalledUp。他强调了保持对代码和架构的掌控权、将思考与编码分离、从小功能入手、以及像真实用户一样测试的重要性。AI并未替他做决策,而是加速了从想法到功能的过程。

Hacker News AIAgent站内正文
AI爱好者与时间赛跑,AI怀疑者与熵增赛跑

Charity Majors 精准捕捉了AI爱好者和怀疑者之间的动态关系,两者都在努力构建优秀的软件,且常在同一团队中。爱好者看到AI带来的能力飞跃,而怀疑者则担忧代码速度过快导致可靠性下降和知识流失。她建议将这一挑战视为领导力和工程问题,核心在于缺乏连接两方的自然反馈循环。

Simon Willison's WeblogAgent站内正文
新型光驱动芯片有望加速人工智能和量子计算

莫纳什大学的科学家们创建了一种微型芯片,能够在一个器件中产生、操纵和读取基于光的信息,标志着向超快、节能计算迈出了重要一步。该突破利用原子级薄材料和纳米结构控制光的独特量子属性——“谷”自由度,从而以全新方式编码信息。

Hacker News AI芯片 / 研究站内正文
耕耘花园:以不同方式使用AI,打造有趣且实用的应用

Mike Caulfield介绍了他的电影推荐网站Plot.fyi,该网站通过离线使用AI(Claude Code)对一万部电影进行标签化处理,构建了无需实时AI调用的全静态HTML页面。这种方法避免了传统AI包装应用的经济困境——要么承担高昂的API成本,要么被AI模型本身取代。文章强调了数据所有权的价值,并认为即使未来AI能力再强,当前仍然存在探索替代方案的广阔空间。

Hacker News AI研究站内正文
美国高级官员考虑在AI巨头中持有政府股份

美国高级官员与主要人工智能公司就联邦政府收购其部分股份进行了初步讨论。OpenAI CEO Sam Altman 已与特朗普政府高级官员多次讨论该想法,旨在将AI的经济效益更广泛地分配给公众。该计划面临治理挑战和法律障碍,并引发左右翼批评。

Hacker News AI政策 / 研究站内正文
AI模型预测建筑火灾蔓延,实时引导撤离人员选择更安全的出口

美国国家标准技术研究院(NIST)研究人员开发了名为Safe Step的AI模型,利用强化学习预测火灾发展,并通过动态紧急出口显示屏指引人们选择最安全的撤离路线。该模型基于有毒气体分数有效剂量(FED)指标,能比传统算法更有效地避开随时间累积的危险。未来将扩展至多层建筑和多智能体模拟,预计5-10年内投入使用。

Hacker News AI模型 / Agent / 政策站内正文
Patina:一种学习你的判断力而不仅仅是任务的AI

Patina是一个持久化的认知扩展工具,它通过信念图谱和分级自主权来学习你的上下文、信念和判断。它支持Slack集成、优先级象限、风格模仿和自动化操作,所有数据本地存储,无需预热即可从导出数据中提供即时价值。

Hacker News AIAgent / 研究站内正文
基于ResearchMath-14k数据集构建语义搜索引擎与开放状态分类器

本文介绍了如何利用ResearchMath-14k数据集构建一个完整的NLP流程,包括TF-IDF关键词提取、句子嵌入生成、UMAP降维可视化、K-Means聚类、语义搜索引擎构建以及开放状态分类器训练,最后通过余弦相似度检测近似重复问题。

MarkTechPost模型 / Agent / 研究站内正文
EFF向国会作证:保护美国公民权利免受政府AI侵害

EFF高级政策分析师马修·瓜里利亚博士在众议院国土安全小组委员会听证会上作证,指出政府在采用AI技术时必须建立强有力的保障措施,以防止大规模监控侵犯宪法权利,并批评政府保密和专有技术黑箱阻碍对AI错误的监督。

Hacker News AIAgent / 政策站内正文
NVIDIA AI发布Nemotron 3 Ultra:一个开放的550B混合专家混合Mamba-Transformer用于长时间运行的智能体

NVIDIA发布了Nemotron 3 Ultra,这是一个550B总参数(55B活跃)的开放混合专家(MoE)模型,采用混合Mamba-Attention架构,专为长时间运行的智能体设计。它支持100万token的上下文,推理吞吐量比同类开放LLM高出约6倍,同时保持相同精度,并附带开放权重、训练数据和配方,采用OpenMDW-1.1许可。

MarkTechPost模型 / Agent / 芯片站内正文
Intencion – 产品分析持续改进您的AI代理

Intencion 是一款专为AI代理设计的产品分析工具,可端到端捕获每次运行,包括用户意图、代理步骤和结果,帮助团队找出最大问题并构建用户需求,每周改进代理。

Hacker News AIAgent站内正文