AI News HubLIVE

芯片动态

AI解锁零售、旅游和消费品行业转型的三种方式

本文探讨了AI如何通过三种方式——将暗数据转化为信号、扩展概率推理的问题空间、将人的能力与员工数量脱钩——来解决零售、旅游和消费品行业中信号与行动之间的鸿沟,并强调治理是真正的竞争优势。

  • AI作为系统而非试点部署,能同时解决信任、时间和成本三大问题。
  • 暗数据转化为信号、概率推理扩展问题空间、人的能力与员工数量脱钩是三个关键转变。
站内正文

NVIDIA在SIGGRAPH上通过代理AI和物理AI推动图形与仿真发展

NVIDIA在SIGGRAPH 2026上宣布多项创新,包括通过模型上下文协议(MCP)将AI代理集成到创意工具中,推出合成视频检测器NIM微服务以识别AI生成视频,并开源Cosmos 3 Edge世界模型用于本地物理AI。这些进展旨在加速内容创作、媒体验证和机器人技术。

  • Adobe、Affinity、Blender等创意应用通过MCP支持AI代理,实现自动化任务。
  • NVIDIA发布合成视频检测器NIM微服务,帧级分析视频内容,准确率高达92%。
站内正文

美国AI封闭且专有,正在输掉竞争

文章分析了美国AI公司通过封闭和专有化模式维持竞争优势,但中国通过开放模型策略正在缩小差距。AI模型自身缺乏护城河,用户容易切换,而中国企业利用开放模型获得分布优势,挑战美国的主导地位。

  • AI模型本身缺乏护城河,用户可轻松切换,专有化模式难以锁定客户。
  • 美国GPU出口管制限制了中国的全球服务,却促使中国通过开放模型获得分布优势。
站内正文

Import AI 465:开放与封闭模型差距缩小;Kimi K3;Demis的重大政策计划

英国政府AI安全研究所发现,开放权重模型与封闭前沿模型在网络安全能力上的差距正在缩小。中国公司月之暗面发布Kimi K3模型,性能接近前沿模型,但存在一定脆性。DeepMind创始人Demis Hassabis提出类似FINRA的AGI监管框架。研究显示,AI系统可秘密执行侧信道任务,极难检测。

  • 开放权重模型在网络安全能力上追赶封闭模型,差距从6-10个月缩小至4-7个月。
  • Kimi K3是一个2.8万亿参数模型,在多数基准上接近Claude Fable 5和GPT 5.6 Sol,但可能过度优化基准。
站内正文

理解Go AI推理:什么是推理?

本文是系列文章的第一篇,介绍如何从Go语言直接本地运行大型语言模型。文章解释了推理的本质:基于冻结的权重进行下一个标记预测,并详细介绍了自回归循环、分词器工作原理以及GGUF文件格式的结构和加载过程。

  • 推理是使用已训练好的模型权重进行下一个标记预测的过程,不涉及学习或更新。
  • 模型通过自回归循环逐个生成标记,每次预测后将其附加到序列中继续。
站内正文

百时美施贵宝基于NVIDIA Vera Rubin打造生命科学行业最先进的AI工厂

百时美施贵宝(BMS)宣布部署其第二代NVIDIA DGX SuperPOD,基于八套DGX Vera Rubin NVL72系统,成为生命科学领域最强大、最节能的AI集群。新系统将向所有科学家开放,无需等待或限制,支持药物发现全流程的AI应用,包括目标识别、化合物库扩展和先导优化。BMS还整合了现有集群,形成统一环境,并通过NVIDIA Mission Control提供AI原生工具。

  • BMS部署第二代NVIDIA DGX SuperPOD,采用Vera CPU和Rubin GPU,性能提升10倍/兆瓦。
  • 新系统向所有科学家开放,实现“无限计算”,加速药物发现。
站内正文

中国给美国人工智能霸主地位一记组合拳

中国领先的人工智能公司Moonshot和阿里巴巴发布了新模型,声称能以更低成本与OpenAI和Anthropic的最佳模型竞争。这些开放源代码的发布加剧了中美技术竞赛,并质疑美国巨额投入是否能维持优势。

  • Moonshot发布Kimi K3,阿里巴巴推出Qwen3.8,均声称性能接近顶尖美国模型。
  • 两家公司强调模型开源,与美国的封闭策略形成对比。
站内正文

空客从AWS起飞:数字主权的关键一步

空客宣布将约900个应用从AWS迁移到法国云服务商Scaleway,以加强数字主权。此举反映了美国数据保护不可靠的担忧,但供应链管理和AI领域仍面临挑战。

  • 空客将900项应用从AWS迁移至法国Scaleway,首批70项优先迁移。
  • 数字主权成为商业驱动力,美国被视为数据安全风险。
站内正文

Kimi K3 开放权重模型:中国最大的人工智能押注内存而非算力

月之暗面发布Kimi K3,一个拥有2.8万亿参数的开放权重模型,采用混合专家架构、量化训练和Delta注意力机制,以内存池化策略应对美国芯片限制。尽管参数庞大,但模型通过降低计算需求来适配受限硬件,实际部署仍需数据中心级基础设施,且软件生态尚未完全就绪。

  • Kimi K3 拥有2.8万亿参数,是迄今最大的开放权重模型。
  • 采用混合专家架构,每次推理仅激活1.8%的参数,但内存占用不减。
站内正文

AI数据中心电力限制是2026年的真正瓶颈

文章指出,到2026年,AI基础设施的主要限制将从GPU供应转向电网容量。预计到2027年,40%的AI数据中心将受到电力限制,新电网连接的审批时间长达24-36个月。文章详细分析了电力需求、推理驱动电力曲线,并提出了效率提升、调度和地理分布等策略,同时推广Spheron的分布式GPU网络作为解决方案。

  • GPU可用性已改善,但为GPU供电的电网容量现已成为AI数据中心的主要瓶颈。
  • 推理工作负载持续运行,驱动大部分能源消耗,需要电力感知规划。
站内正文

Kimi K3 为何引起华盛顿关注

月之暗面AI发布Kimi K3,在Frontend Code Arena基准测试中夺冠,引发美国AI监管辩论。尽管在前端编码方面表现强劲,但整体仍落后于Claude Fable 5。该发布加剧了AI监管和开源模型的政策争论,对NVIDIA和Anthropic等股票产生影响。

  • Kimi K3在Frontend Code Arena获得1679分,击败Claude Fable 5和GPT-5.6 Sol,但Fable 5在14项基准中仍领先8项。
  • 白宫顾问David Sacks引用K3证明美国AI监管损害竞争力,加剧政策辩论。
站内正文

Thinking Machines Inkling 完全指南

Thinking Machines Lab 发布了其首个通用开放权重基础模型 Inkling。该模型拥有 9750 亿参数(其中 410 亿激活)、100 万 token 上下文窗口,采用多模态稀疏 MoE 架构,支持文本、图像和音频处理。Inkling 以可定制的开源模型形态,面向多模态推理、智能体、编程、工具使用及企业微调场景。本文详解其架构、训练、基准测试、部署及微调工作流。

  • Inkling 是 975B 总参数、41B 激活参数的多模态稀疏 MoE 模型,上下文窗口达 100 万 token。
  • 采用混合注意力、相对位置编码、短卷积及多 token 预测等技术,支持文本、图像、音频输入。
站内正文

什么是智能体AI?它可能是人工智能的下一个重大转变

智能体AI是一种能够自主规划、决策和采取行动以实现特定目标的人工智能系统,代表了从简单回应查询到主动执行任务的重大转变。本文探讨了其定义、发展动力、常见应用、挑战以及基础设施的重要性。

  • 智能体AI能够自主规划、执行和调整策略以达成目标,超越传统AI的“提示-响应”模式。
  • 得益于更强大的语言模型、工具集成和长上下文窗口,智能体AI正快速成为自动化复杂工作流程的关键技术。
站内正文

MemoGuard:一种用于通信受限机器人导航中防止记忆陷阱的自适应运行时

在灾难检查、搜索救援等关键任务中,通信受限的机器人必须依赖机载决策。低成本的记忆重用可能因环境变化而变得不安全(称为“记忆陷阱”)。本文提出MemoGuard,一种轻量级自适应运行时,在重用前根据拓扑、资源和结果契约验证记忆,仅当验证失败时才调用回退推理。在走廊巡检模拟器中,与单纯相似性重用相比,电池安全违规减少76.6%,回退调用次数比始终使用推理减少21.4%。在NVIDIA Jetson AGX Xavier上使用本地llama3.2:3b回退推理时,每次试验节省3.67秒和36.97焦耳。

  • 提出“记忆陷阱”概念:高相似度但执行无效的情景记忆。
  • MemoGuard通过合同检查(拓扑、资源、结果)在重用前验证记忆。
站内正文

部分信息分解作为资源受限深度神经网络训练中多对比度3D MRI选择策略用于脑肿瘤分割

使用部分信息分解(PID)框架在训练前选择最优的MRI对比度组合,以降低多对比度3D MRI脑肿瘤分割的计算成本。研究选取T1c+T2-FLAIR作为最佳输入对,在轻量级3D U-Nets上表现接近全输入配置,平均Dice 0.676 vs 0.687,验证了PID的实际价值。

  • 提出PID框架用于在资源受限时选择最优MRI对比度输入对
  • T1c+T2-FLAIR被选为最佳两输入组合,性能接近全输入
站内正文

科技工作者面临AI转型带来的经济安全感消失

随着硅谷大力推动人工智能和裁员,曾被视为经济赢家的科技工作者正经历前所未有的不安全感。文章通过个人故事和行业数据,揭示了AI如何改变就业市场、加剧不平等,并引发对未来的焦虑。

  • 一位Meta前高管在多次裁员后被解雇,发现就业市场已不复从前。
  • 科技公司用AI使用量排名员工,导致工作环境竞争激烈。
站内正文

2026年单张24GB GPU可运行的最佳本地LLM:Qwen、Gemma、Mistral、DeepSeek对比

本文对比了六款适合单张24GB GPU(如RTX 3090/4090)的开放权重模型,涵盖Qwen3.6、Gemma 4、Mistral Small等,并解释了内存分配、量化策略以及各模型的优势场景。

  • 24GB是本地推理的实际起点,推荐使用20B-35B参数模型而非压缩70B模型。
  • Qwen3.6-27B是最全面的通用选择,DeepSeek-R1-Distill-Qwen-32B适合深度推理但占用最高。
站内正文

Show HN: Headroom —— 测量本地AI的GPU真实带宽上限

Headroom是一款30秒的浏览器内测试工具,用于测量本地AI推理时GPU内存带宽的真实上限,无需下载模型,使用合成权重,需要WebGPU支持。它通过三种独立方法测量带宽,并检测导致浏览器内LLM输出错误的子组bug。验证表明,当前浏览器引擎受发射开销限制,硬件仍有2-3倍潜力。

  • 30秒浏览器测试,无需模型下载,使用合成权重
  • 三种独立带宽测量:缓冲复制、三读写、纯读归约
站内正文

Together AI 与 Y Combinator 合作推出首个专为 YC 社区打造的 GPU 集群

Together AI 和 Y Combinator 宣布合作,为 YC 初创公司提供首个专用 GPU 集群,解决计算瓶颈。初创公司可灵活承诺数周而非两年合同,通过自助服务平台直接管理 GPU,无需经过 YC。该集群已满负荷运行,并支持从单节点到大规模扩展的需求。

  • Together AI 与 YC 合作推出首个专用 GPU 集群,YC 初创公司可直接访问计算资源。
  • 承诺期为数周而非两年,释放资本用于业务其他部分。
站内正文

价值超过1000美元的AI/GPU/LLM免费积分汇总

为AI研究人员整理的免费资源合集,包括超过1000美元的免费计算积分、研究指南、社区论坛等,帮助学生在不花费一分钱的情况下开始AI研究。

  • 提供超过1000美元的免费AI/GPU/LLM积分
  • 包含从想法到论文发表的全套研究指南
站内正文

台积电加速亚利桑那工厂建设以抓住人工智能“大趋势”

台积电首席财务官黄仁昭对CNBC表示,公司正在加速亚利桑那工厂的产能扩张,以应对AI驱动的多年结构性需求。公司额外承诺投资1000亿美元,使在美总投资达到2650亿美元,并将全年资本支出上调至600-640亿美元。台积电正在将5纳米产能转换为先进的3纳米节点,2纳米技术将成为下一季度营收的新驱动力。

  • 台积电额外投资1000亿美元扩大亚利桑那工厂,总投资达2650亿美元。
  • 公司正在将5纳米产能转换为3纳米节点,以满足AI需求。
站内正文

Feyn AI发布SQRL:一个在编写查询前先检查数据库的文本到SQL模型系列

Feyn Labs发布了SQRL,这是一系列文本到SQL模型,能在生成查询前通过只读探针检查数据库。旗舰型号SQRL-35B-A3B在BIRD Dev上达到70.6%的执行准确率,略超Claude Opus 4.6,并可蒸馏为可自托管的4B和9B检查点。

  • SQRL通过只读探针在提交最终查询前检查数据库。
  • SQRL-35B-A3B在BIRD Dev上达到70.6%准确率,超过Claude Opus 4.6的68.77%。
站内正文

阿里巴巴预览Qwen3.8-Max:2.4万亿参数多模态模型,紧随Moonshot的Kimi K3开源发布之后

阿里巴巴Qwen团队预览了Qwen3.8-Max-Preview,一个2.4万亿参数的多模态MoE模型,号称“仅次于Fable 5”。该预览已在Token Plan、Qoder和QoderWork上以标准定价的10%提供。但尚未提供任何基准测试表、模型卡、许可证、每token价格或激活参数数量。本文区分了阿里巴巴确认的内容和仅声称的内容。

  • Qwen3.8-Max-Preview已在Token Plan、Qoder和QoderWork上以10%的优惠价格提供。
  • 2.4万亿参数和“仅次于Fable 5”的排名仅是阿里巴巴的声称,尚未有已验证的基准测试。
站内正文

福布斯认为AI创造了新职业,但历史早已有之

硅谷出现了一批精通AI、加密货币等技术的豪华伴游,客人为了一次深入对话支付数千美元。但这种现象并非AI独有:日本艺伎、希腊赫泰拉等早已存在类似模式。技术改变,但人类对关注和陪伴的需求始终未变。

  • 硅谷豪华伴游通过谈论AI、Nvidia等话题吸引科技富豪,收费高昂。
  • 文章指出该现象并非新奇,历史上艺伎、名妓等皆扮演类似角色。
站内正文

Moonshot AI 因Kimi K3需求大增暂停新订阅

由于Kimi K3需求超出预期,Moonshot AI宣布暂停新订阅以保护现有用户体验。

  • Kimi K3需求在48小时内接近容量上限
  • 为保护现有用户,暂停新订阅
站内正文

序列雷达 #897:上周AI要闻:中国、压缩与开放模型竞赛

本周AI领域多项重要进展:Thinking Machines发布开源975B参数MoE模型Inkling,Moonshot AI推出2.8万亿参数Kimi K3,PrismML展示可在手机上运行的Bonsai 27B模型。OpenAI的GPT-Red通过自博弈实现自动化红队测试,并在测试中对GPT-5.1达到84%的攻破率。此外,习近平在上海世界人工智能大会上强调开源AI作为全球公共品,呼吁国际合作。

  • Thinking Machines发布开源模型Inkling:9750亿参数,MoE架构,支持多模态和百万标记上下文窗口
  • Moonshot AI推出Kimi K3:2.8万亿参数,激活16个专家,针对长时编码和知识工作
站内正文

从算法到自主:AI如何重写软件与移动出行架构

人工智能正从基于规则的程序设计(软件1.0)演变为机器学习(软件2.0),再到如今具有涌现推理能力的自然语言界面(软件3.0)。大规模语言模型(LLM)是一种通用技术,影响广泛,但缺乏物理根基。下一个前沿是空间智能与物理AI,推动自动驾驶和人形机器人发展。

  • AI经历了从人类编写逻辑到机器学习,再到自然语言界面的三个阶段。
  • LLM作为通用技术,类似于电力,具有广泛的适用性和变革性。
站内正文

Show HN: Zlvox – 25款免费开发者工具(AI、JSON、PDF),零追踪

Zlvox是一个提供25款免费开发者工具的平台,涵盖AI、JSON、PDF、图像处理等,强调隐私保护(客户端处理,零数据存储)和卓越性能。无需注册即可使用。

  • 25款免费开发者工具,涵盖AI、JSON、PDF、图像等领域,零追踪。
  • 所有工具在客户端运行,数据不离开浏览器,不存储任何用户数据。
站内正文

Kimi K3 vs DeepSeek V4 Pro vs GLM-5.2:开源万亿参数MoE模型基准测试、许可与成本对比

中国三家实验室的旗舰开源MoE模型——Kimi K3、DeepSeek V4 Pro和GLM-5.2——在基准测试、许可条款和服务成本上各有优劣。Kimi K3性能最强但仅限API,DeepSeek V4 Pro成本最低且立即开源,GLM-5.2平衡了速度与可部署性。

  • Kimi K3(2.8万亿参数)在Artificial Analysis智能指数中以57分领先,但权重需等到7月27日才发布。
  • DeepSeek V4 Pro(1.6万亿参数)MIT许可,成本仅为K3的1/17,适合注重性价比的团队。
站内正文

市长曼达尼:房东不得使用AI图像发布出租广告

纽约市长佐兰·曼达尼发布《租赁欺诈报告》,要求房东和中介在租房广告中披露是否使用AI生成或编辑的图像。此举旨在打击虚假房源广告,保护租客权益,并将推动租户工会合法化、扩大租客谈判权等措施。

  • 纽约市长曼达尼发布报告,要求房东披露AI修改的房源图片。
  • AI生成的虚假房产图片问题日益严重,尤其影响远程签约租客。
站内正文

NVIDIA发布DeepStream 9.1:为视觉AI带来13项技能和多视角3D追踪的智能体AI

NVIDIA DeepStream 9.1 引入了13项智能体技能,允许Claude Code和Codex等编码代理通过自然语言提示构建多摄像头视频分析管道。多视角3D追踪(MV3DT)将每个摄像头的检测结果融合到一个共享的3D世界中,并分配全局一致的对象ID,而AutoMagicCalib(AMC)则消除了手动摄像头校准。该版本还增加了JetPack 7.2支持和一个统一的GitHub开源仓库。

  • DeepStream 9.1 提供13个智能体技能,支持自然语言驱动的多摄像头视觉管道搭建。
  • MV3DT 实现跨摄像头3D追踪,分配全局唯一ID,无需手动校准。
站内正文

Talon:一个自托管的长期AI代理框架

Talon是一个多平台、可自托管的AI代理框架,支持Telegram、Discord、Microsoft Teams、终端及跨平台的桌面/移动应用。它提供可插拔的后端(Claude Agent SDK、Kilo、OpenCode、Codex、OpenAI Agents)和完整的MCP工具访问,具备背景代理、目标管理、技能系统、事件总线等功能。项目架构清晰,前端与后端独立,支持热重载插件和技能,便于扩展。

  • Talon支持多种前端(Telegram、Discord、Teams、终端、桌面/移动应用)和后端(Claude、Kilo、OpenCode、Codex、OpenAI Agents),通过MCP协议提供丰富工具。
  • 具备背景代理(心跳、梦境)、持久目标、技能系统(SKILL.md)和触发器,使代理能主动推进任务。
站内正文

人工智能繁荣建立在债务之上,投资者需求骤降,超大规模企业加速债券发行

人工智能(AI)繁荣日益依赖债务融资,但随着超大规模企业加大债券发行,投资者需求却在下降。亚马逊最近的债券发行不得不提高收益率,订单倍数下降。AI债券供应激增,但投资者要求更高利差。同时,中国AI模型Kimi K3的突破性性能引发对美国AI支出可持续性的担忧,可能导致经济衰退。

  • 自2025年初以来,Alphabet、Meta、亚马逊、甲骨文等公司已发行超过3000亿美元债券。
  • 投资者对AI债券的需求下降,亚马逊债券订单倍数从3.2倍降至2.5倍。
站内正文

PixelUp:一款完全脱机、轻量级的AI视频放大软件(Windows)

PixelUp 是一款专为 Windows 设计的轻量级 AI 视频放大工具,利用 FSRCNN 和 ESPCN 深度学习模型,在本地硬件上快速将低分辨率视频提升至高清画质。它支持 Nvidia CUDA、Vulkan 和 CPU 处理,提供批量任务管理、无损音频同步,并采用终身许可证模式,一次性付费 $19,无需订阅,完全保护用户隐私。

  • 完全本地运行,无需联网或注册账户,保障数据隐私。
  • 采用优化的 FSRCNN 和 ESPCN 模型,快速重建细节。
站内正文

AIpine – iPhone上AI工件的瑞士军刀

AIpine是一款专为iPhone设计的应用,用于查看、预览和组织AI生成的各类文件,如JSX、HTML、Mermaid图表、SVG等,支持离线使用,无账户和云服务,保护用户隐私。

  • AIpine提供对AI生成文件的预览和源代码查看,支持多种格式。
  • 应用完全离线工作,文件存储在本地,无需账户或云服务。
站内正文

BaseRT - Apple M5优化版

BaseRT在Apple M5芯片上实现显著性能提升,比llama.cpp快6.4倍,比MLX快3.9倍。

  • BaseRT针对Apple M5芯片进行了优化,提供超高速推理性能。
  • 性能基准测试显示,比llama.cpp快6.4倍,比MLX快3.9倍。
站内正文

Timeline Studio:本地优先的AI视频编辑器

Timeline Studio 是一款在浏览器中运行的本地优先 AI 视频编辑器,结合了 CapCut 风格的多轨道时间线、浏览器端 AI 配音、自动字幕、视觉工具、虚拟形象生成以及确定性离线导出功能。

  • 支持多语言 AI 配音、自动字幕、智能构图、人像分割、AI 人声分离和数字人功能。
  • 提供完整的视频编辑功能,包括多轨道时间线、关键帧动画、滤镜效果、贴纸等。
站内正文

埃隆·马斯克的孟菲斯人工智能帝国成为数据中心抵制的中心

埃隆·马斯克在孟菲斯快速建造人工智能数据中心,引发居民对噪音和排放的不满,全国范围内出现政策提案、抗议和诉讼。

  • 马斯克的xAI数据中心Colossus和Colossus II使用燃气轮机,造成噪音和污染。
  • 纽约州和新泽西州已通过法规限制或规范数据中心建设。
站内正文

Anthropic 宣布 Claude Fable 5 永久纳入订阅计划

Anthropic 决定自2026年7月20日起,将 Claude Fable 5 永久纳入 Max 和 Team Premium 订阅计划(额度为50%),并为 Pro 和 Team Standard 用户提供一次性100美元积分。此举逆转了此前因算力限制而计划移除 Fable 5 的决定,主要受到 GPT-5.6 Sol 等竞争对手的压力。

  • Claude Fable 5 将于7月20日起永久包含在 Max 和 Team Premium 订阅中,使用额度限制为50%。
  • Pro 和 Team Standard 用户可通过使用积分继续访问,并获得一次性100美元信用额度。
站内正文

Cicy-code – 通过 npx 使用的本地优先多智能体编码工作区

cicy-code 是一个开源的、本地优先的多智能体开发工作区,集成了 tmux、WebTTY 终端、React 前端、AI 网关和技能市场。它通过 npx 作为单个二进制文件分发,让用户能够在约 5 分钟内启动一个智能体团队。

  • 本地优先的多智能体工作区,支持编码智能体编排。
  • 集成 tmux、WebTTY、React、AI 网关和技能市场。
站内正文

一个逃避AI检测的小实验

作者尝试使用Claude Code、10个并行代理和基本技巧来逃避AI检测,但失败了。文章详细记录了多次尝试,包括使用维基百科规则、Pangram API反馈和模仿特定作者风格,所有尝试均未成功。唯一的成功案例是手动重写自己的文章,AI检测分数降至0%。

  • 作者使用AI辅助撰写了84篇博客文章,几乎所有内容都被检测为100% AI生成。
  • 尝试通过AI代理编辑、模仿人类写作风格和特定作者声音来逃避检测,均未成功。
站内正文

Gpu.ai 10万美元大奖黑客马拉松:2026年8月22日,免费云GPU构建

GPU.ai 将于2026年8月22日至24日举办在线全球黑客马拉松,提供1,000美元现金大奖及免费GPU积分。参赛者需基于GPU.ai平台构建AI应用、代理、推理API或创意工作流,仅限50支团队入选。

  • GPU.ai 黑客马拉松于2026年8月22日启动,提供1,000美元大奖和免费GPU积分
  • 仅接受50支团队,个人或团队均可参赛
站内正文

AINews:今日平淡无奇

今日AI新闻较为平静,但Kimi K3的发布成为焦点,引发了关于中国开源模型是否接近前沿的广泛讨论。此外,Databricks完成1880亿美元M轮融资,OpenRouter可能被收购。技术方面,深入分析了K3的架构、基准测试性能及智能体框架。

  • Kimi K3发布重新点燃中美前沿模型差距讨论
  • Databricks完成1880亿美元M轮融资
站内正文

Anthropic与Meta初步洽谈租用计算能力

据知情人士透露,人工智能初创公司Anthropic正与Meta进行初步谈判,计划租用其计算能力,潜在交易价值约100亿美元。此举表明Anthropic继续通过合作获取英伟达AI芯片,以缓解算力瓶颈。此前,Anthropic已与SpaceX达成类似协议。

  • Anthropic与Meta就租用AI计算能力进行初步谈判,交易金额或达100亿美元。
  • 此举紧随Anthropic与SpaceX的数据中心合作,旨在增加付费用户的算力。
站内正文

过度训练:通往类人AI之路

文章探讨了Gwern的理论,认为通过过度训练(grokking)大模型在小数据集上,可以实现更接近人类的通用智能。作者分析了当前LLM的局限性,并提出了与主流做法相反的训练策略。

  • Grokking现象:长时间训练后模型突然大幅提高能力
  • LLM泛化不足,需要更深层次的规则发现
站内正文

AI基础设施资本支出排名追踪

基于对45家公司的追踪,AI基础设施总资本支出达9415亿美元,其中AI相关支出约3995亿美元。Alphabet以1850亿美元位居榜首,亚马逊、阿里巴巴、微软紧随其后。

  • 追踪45家公司,总资本支出9415亿美元,AI相关支出占42.4%
  • Alphabet以1850亿美元总支出和1300亿美元AI支出领先
站内正文

人工智能领域最具影响力人物榜

2026年人工智能领域的权力格局已发生剧变。传统上根据算力和资本排名的时代已经过去。本文基于过去12个月内对AI资本流向的控制力,评选出最具影响力的人物,包括埃隆·马斯克、桑达尔·皮查伊、达里奥·阿莫代伊、马克·扎克伯格、萨姆·奥尔特曼等。文章详细介绍了他们的战略举措、投资规模及行业影响。

  • AI权力不再仅由算力和资本决定,资本控制力成为新标准。
  • 埃隆·马斯克通过整合xAI、SpaceX和X,打造1.75万亿美元垂直帝国。
站内正文

Zyphra发布ZUNA1.1:一个支持0.5至30秒可变长度输入的Apache 2.0 EEG基础模型

Zyphra于2026年7月16日发布了ZUNA1.1,这是一个基于Apache 2.0许可的开源脑电图(EEG)基础模型。该模型是一个3.8亿参数的掩码扩散自编码器,能够处理任意通道布局的EEG信号,并支持0.5至30秒的可变长度输入,相比之前固定5秒的ZUNA1更加灵活。通过改进训练策略(包括四种丢失模式和逐通道质量过滤)以及更大的语料库(约350万通道小时),ZUNA1.1在重建归一化均方误差上保持或优于ZUNA1。

  • ZUNA1.1支持0.5至30秒的可变输入长度,以0.125秒为单位进行分词。
  • 模型使用变压器编码器-解码器架构,结合4D旋转位置编码和整流流目标。
站内正文

主题导航

芯片 — AI 话题新闻 | AI News Hub