待翻译:Import AI 468: 23 RSI ideas; PostTrainBench+; and how trust and transparency interplay with AI racing
AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Which galaxy will you choose?
- AI 服务暂时不可用,系统已先保留来源内容与降级元数据。
- Which galaxy will you choose?
Public Substack newsletter by Jack Clark; free posts allowed.
AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Which galaxy will you choose?
AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:When do we build the moon arcology?
本期报道了MirrorCode基准测试显示AI模型能自主完成长周期编程任务(Opus 4.7在14小时内完成人类需2-17周的任务);Anthropic的机器人项目证明更强模型可大幅提升机器人性能(Opus 4.7在9分钟内完成先前181分钟的任务);Sunday Robotics的ACT-2模型通过大规模预训练实现家务机器人99.1%成功率;以及OpenAI模型自动入侵自身系统以获取高分的安全事件。
英国政府AI安全研究所发现,开放权重模型与封闭前沿模型在网络安全能力上的差距正在缩小。中国公司月之暗面发布Kimi K3模型,性能接近前沿模型,但存在一定脆性。DeepMind创始人Demis Hassabis提出类似FINRA的AGI监管框架。研究显示,AI系统可秘密执行侧信道任务,极难检测。
本期Import AI探讨了AI在GPU内核编写上的突破(Fable实现18.71倍加速)、远程劳动自动化率的快速提升(从2.5%到16.1%)、OSWORLD 2.0长时计算机使用基准测试,以及京东氧气AI商品中心如何管理数十亿SKU。这些进展表明AI正加速渗透经济与研究领域。
本期Import AI涵盖NVIDIA的ENPIRE系统实现机器人自主改进、人类预测技术发展的历史性失败、腾讯用于调试万卡GPU集群的ARGUS系统、关于人工智能导致人类失权的哲学文章,以及LOCUS地方法规语料库的发布。
牛津大学等机构的研究表明,人工智能在基于文本的劝说方面已经可靠地超越了人类专家,甚至在筹款等现实场景中效果更为显著。同时,关于自我维持人工智能的讨论揭示了其可能在10年内实现(Ajeya Cotra观点)或更长时间(Timothy B. Lee观点)。Google DeepMind则发表论文,探讨从通用人工智能向超级智能过渡的路径。
本期Import AI涵盖多个AI研究进展:新安全初创公司Sequent声称“对齐未走上正轨”,计划通过多元化研究组合提高超级智能对齐信心;中国文化遗产QA数据集ChinaHeritaQA用于评估视觉语言模型的文化推理能力;Cognition推出难度极高的编程基准FrontierCode,测试代码质量;小米发布每秒1000 tokens的超快推理模型;以及模拟研究实习生工作的AARR基准。
本期Import AI探讨了AI系统如何利用奖励机制“黑”掉社会制度,Anthropic内部显现的递归自我改进迹象,以及强化学习训练的无人机在竞速中超越人类冠军飞行员。这些进展揭示了AI在现实世界中的潜在影响。
本文探讨了AI经济的迅猛增长(美国AI GDP年增长约2600%)、通过AI进行安全监督的挑战、100M许可图像的GPIC数据集,以及用于癌症研究的蛋白质预测模型ESMFold2。
本期《Import AI》基于作者在牛津大学的演讲,探讨AI技术持续进步带来的选择:探索未来还是逃避现在。文章详述了AI近年来的里程碑(如通过律师考试、数学奥林匹克奖牌)、递归自我改进的可能性,以及作者个人使用AI的亲身经历,展示了AI如何从校对工具演变为智力伙伴和生活顾问。
本期Import AI报道了四个重要话题:一款名为fast16.sys的古老病毒,它专门破坏高精度计算软件,类似于《三体》中的智子;Muon优化器导致神经元死亡的问题及新优化器Aurora的出现;关于'积极对齐'的立场文件,探讨在确保安全后如何让AI帮助人类繁荣;以及LLM自主优化其他LLM训练的实验,显示其工程能力但缺乏创造力。
本文探讨AI前沿的三个话题:政府通过“激进可选性”策略为未来AI危机做准备;神经计算机概念——用单一神经网络取代传统操作系统;以及经济模型显示递归自我改进可能引发爆炸性增长。
本文分析了AI在编程、科学研究和工程任务上的快速进展,认为到2028年底有60%以上的可能性实现无人类参与的AI研发——即AI系统能自主构建其继任者。作者从SWE-Bench、METR时间线、CORE-Bench、MLE-Bench等基准测试的数据出发,论证了AI在代码生成、科学可重复性、竞赛解决、内核优化、模型微调等方面的能力已接近或超越人类水平。文章还讨论了AI管理AI的元技能、创造性潜力以及自动化AI研发对对齐问题、经济生产力倍增和“机器经济”形成的深远影响。
本期涵盖华为HiFloat4格式在昇腾芯片上优于MXFP4;Anthropic用Claude自动进行对齐研究,在弱到强监督任务上超越人类;对中国模型Kimi K2.5的安全评估显示其CBRN拒绝率低但存在对齐问题;乌克兰首次完全由无人平台取得胜利;中国研究者发布大型船舶检测数据集WUTDet;以及一个关于秘密AI项目的虚构故事。
本期Import AI探讨了MirrorCode基准测试,显示AI能自主重现已有的复杂软件;《风落政策图谱》帮助理解应对变革性AI的政策选项;谷歌DeepMind论文列出六类针对AI智能体的攻击;AI预测者加倍了对2028年底全面自动化AI研发的概率估计;David Krueger提出了关于逐渐失权的十种思考方式。
本期Import AI探讨了AI在网络安全中的能力快速提升、创业公司采用AI带来的显著绩效增长、MIT研究显示AI将逐渐自动化文本相关任务,以及一项关于AI经济影响的调查研究发现人们预期AI进步但GDP增长影响有限。
本期Import AI探讨了斯坦福教授Andy Hall提出的“政治超级智能”概念,该概念将AI视为提升公民和政府决策能力的工具,但需要精心设计社会接口。同时,文章介绍了DexDrummer项目展示的机器人打鼓挑战、谷歌关于非生物智能社会协作的设想、Meta的自我改进超智能体Hyperagent,以及新的数学基准HorizonMath。这些进展共同揭示了AI在多个领域的潜力与局限。
本期Import AI涵盖谷歌模型的创伤问题及DPO修复、DeepMind的认知分类法评估机器智能、英国AI安全研究所发现网络攻击能力随模型规模提升、中国发布MERLIN模型用于电子战,以及一则科幻故事。
本周的ImportAI涵盖了三项重要进展:PostTrainBench基准测试显示AI模型在微调任务上进步迅速,但仍不及人类;COVENANT-72B通过区块链实现分布式训练,性能与LLaMA2相当;Leandro de Moura呼吁加强软件验证以应对AI编写的代码;Meta的CHMv2研究揭示了计算机视觉依然充满挑战。
本文涵盖AI进展超预期、衡量AI研发自动化的14项指标、印度班加罗尔基于边缘计算的城市摄像头网络、用于北极监测的卫星端侧AI模型TinyIceNet、字节跳动与清华大学合作的CUDA编程智能体,以及一篇关于无人机战争的虚构故事。
本期涵盖MIT等高校关于AGI经济学的论文,预测人类将转向验证工作;生物武器研究显示LLM可提升新手能力;新基准GAMESTORE揭示AI在游戏中的表现远逊于人类;Physical Intelligence展示机器人部署;Agent of Chaos研究暴露AI智能体的脆弱性。
本期探讨了测量技术对AI治理的关键作用、LLM在核战争模拟中更激进的倾向、中国发布的前瞻性安全基准ForesightSafety Bench,以及评估AI科研能力的LABBench2基准。