AI News HubLIVE
站内改写2 分钟阅读

开源权重AI的崛起:一篇长卷故事

本文讲述了开源权重AI模型的兴起,以及它们如何可能颠覆OpenAI和Anthropic等领先的前沿实验室。从OpenAI的创立、GPT系列的开发,到Meta的LLaMA意外泄露,再到开源社区的快速发展,文章探讨了AI行业格局的转变。

来源Hacker News AI作者: ColinEberhardt

近年来,人工智能(AI)成为科技和主流媒体头条的常客。OpenAI和ChatGPT这样的名字已家喻户晓。然而,由OpenAI和Anthropic领导的前沿实验室所占据的主导地位,正受到来自所谓“开源权重”模型的威胁——这些模型主要来自中国。

本文讲述了开源权重AI模型的故事:它们是什么,来自哪里,以及为什么它们可能会在那些前沿实验室充分商业化其投入巨资开发的技术之前,就颠覆它们。

为了理解我们是如何走到这一步的——这是一个比你想象中更多曲折、反转和讽刺的故事——我们需要将时间拨回到几年前,在GPT-3和ChatGPT问世之前,当这项技术首次成为头条新闻的时候。

七年的积累

ChatGPT看似一夜成功,但实际上它经历了七年的酝酿。从2015年OpenAI作为非营利组织成立,到2018年发布首个GPT模型,再到2020年GPT-3的推出,每一步都至关重要。2022年,基于GPT-3.5的ChatGPT意外走红,成为史上增长最快的消费应用。

讽刺的是,OpenAI在七年内几乎变成了它最初想法的对立面。它最初是一个非营利组织,但逐渐封闭了每一代模型和产品的细节,最终将技术授权给微软。

转折点

2023年5月,谷歌工程师的一份内部备忘录被泄露,标题为“我们没有护城河,OpenAI也没有”。备忘录指出,虽然OpenAI和谷歌在投入巨资扩大AI规模,但开源社区正基于Meta意外泄露的LLaMA模型迅速追赶。

什么是“开源权重”?

开源在计算领域有着悠久历史,指的是发布应用程序源代码,让其他人可以审查、学习和修改。但AI模型的开源有所不同。大多数“开放”AI模型只共享架构和权重,而不共享训练数据,因此它们被称为“开源权重”模型。即便如此,这仍然允许任何人自行托管和运行模型。

LLaMA泄露

2023年2月,Meta发布了LLaMA 1作为研究版本,权重对学术界开放。值得注意的是,较小的13B参数模型在许多基准测试上击败了更大的175B参数GPT-3。尽管OpenAI几周后就发布了更强大的GPT-4,但LLaMA的泄露成为了开源AI发展的重要催化剂。

未来展望

开源权重模型的崛起可能会改变AI行业的竞争格局。前沿实验室的巨额投资和封闭模式面临挑战,而开源社区通过协作和创新,正逐步缩小差距。这场竞争的结果将影响AI技术的民主化和未来发展方向。