AI News HubLIVE
サイト内リライト2 分で読了

オープンウェイトAIの台頭:長編スクロールストーリー

本記事は、オープンウェイトAIモデルの台頭と、それらがOpenAIやAnthropicなどの先端ラボをどのように混乱させる可能性があるかを探ります。OpenAIの設立、GPTモデルの開発、LLaMAリーク、そしてAI業界に挑戦する成長するオープンソースコミュニティまでの道のりを追跡します。

ソースHacker News AI著者: ColinEberhardt

近年、人工知能(AI)はテクノロジーと主流メディアの見出しを独占してきました。OpenAIやChatGPTのような名前は家庭用語になりました。しかし、OpenAIとAnthropicが率いる先端ラボの支配的地位は、いわゆる「オープンウェイト」モデル——主に中国から発信されている——によって脅かされています。

この物語は、オープンウェイトAIモデルとは何か、どこから来たのか、そしてなぜそれらが先端ラボが開発に巨額を費やした技術を完全に活かす前に混乱させる可能性があるのかを語ります。

ここに至るまでの道のりを理解するために——この物語は予想以上にねじれ、逆転、皮肉に満ちています——数年前、GPT-3とChatGPTに先立つ、この技術が初めて見出しを飾った時期に遡る必要があります。

7年間の蓄積

ChatGPTは一夜の成功のように見えましたが、実際には7年かけて作られました。2015年に非営利団体として設立されたOpenAIは、2018年に最初のGPTモデルを公開し、2020年にはGPT-3をリリースしました。2022年、GPT-3.5をベースにしたChatGPTが予想外の大ヒットとなり、史上最も急速に成長した消費者アプリとなりました。

皮肉なことに、OpenAIは7年で当初の目的とはほぼ逆の存在になりました。非営利として設立されましたが、モデルと製品が公開されるたびに徐々に門戸を閉ざし、最終的にマイクロソフトに技術をライセンス供与しました。

転換点

2023年5月、Googleのエンジニアの内部メモがリークされ、「我々には堀がない、OpenAIにもない」という見出しで話題になりました。メモは、OpenAIとGoogleがAIの規模拡大に資金とリソースを注ぎ込む一方で、オープンソースコミュニティがMetaから漏洩したLLaMAモデルに基づいて急速に勢力を拡大していると指摘しました。

「オープン」の本当の意味

オープンソースはコンピューティングの分野で長い歴史を持ち、アプリケーションのソースコードを公開して誰でもレビュー、学習、修正できるようにする原則です。しかし、AIモデルに適用する場合は異なります。ほとんどの「オープン」AIモデルはアーキテクチャとウェイトのみを共有し、トレーニングデータは共有しないため、「オープンウェイト」モデルと呼ばれます。それでも、誰でもモデルを自己ホストして実行できるという大きな価値があります。

LLaMAリーク

2023年2月、MetaはLLaMA 1を研究用リリースとして公開し、ウェイトを学界に提供しました。特筆すべきは、小規模な13Bパラメータモデルが、より大規模な175BパラメータのGPT-3を多くのベンチマークで上回ったことです。OpenAIは数週間後にはるかに強力なGPT-4をリリースしましたが、LLaMAのリークはオープンウェイト運動の重要な触媒となりました。

将来展望

オープンウェイトモデルの台頭は、AI業界の競争構造を変える可能性があります。先端ラボの巨額投資と閉鎖的なモデルは挑戦を受けており、オープンソースコミュニティは協力と革新によって着実にギャップを縮めています。この競争の結果は、AI技術の民主化と将来の方向性に影響を与えるでしょう。