AI News HubLIVE
站内改写1 分钟阅读

真正的开源大模型 Apertus 1.5 发布

Apertus 1.5 完全开源,新增图像理解、思考模式、4倍上下文长度、改进的指令遵循和工具使用能力。提供 8B 和 70B 两种规模。

来源Hacker News AI作者: skadge

Apertus 1.5 是 Apertus 1.0 的持续预训练版本,于 2026 年 7 月 24 日正式发布。此次发布的 8B 和 70B 两个模型均保持了完全开源的传统,包括开放权重、开放训练数据、开放价值观以及完整的训练细节。8B 模型额外增加了 4 万亿 token 的文本和多模态数据,70B 模型增加了 2 万亿 token,这使得模型在多项能力上取得突破。

新版本的核心亮点之一是原生图像理解能力。Apertus 1.5 能够接收图像与文本的混合输入,处理文档、图表和照片等视觉内容,甚至可实验性地处理语音。这为需要视觉识别的场景(如技术图纸分析)提供了可能。

思考模式(Thinking Mode)允许模型在回答前进行内部推理,显著提升多步推理问题的准确性。上下文窗口从 65,536 token 扩展到 262,144 token,扩大了四倍,可处理更长文档或对话历史。指令遵循的改进使响应更符合用户意图,工具使用的增强则允许更有效的 API 和外部工具集成。

此外,Apertus 1.5 加强了对 Apertus 宪章的遵守,确保模型价值观透明。团队将在未来几周内发布技术报告、基准测试结果和训练管道细节。模型运行指南可在 Hugging Face 的模型卡中获得。

为促进社区发展,Apertus 鼓励用户通过联系页面分享使用案例,并参与 Hugging Face 和 GitHub 的论坛讨论。瑞士 AI SME Circle 活动为企业提供面对面交流机会。同时,团队在苏黎世联邦理工学院和洛桑联邦理工学院招聘工程师,共同构建开源 AI。