AI News HubLIVE
サイト内リライト6 分で読了

OpenAI、ChatGPTを患者の健康記録に導入

OpenAIはChatGPTにヘルス機能を導入し、ユーザーがApple Healthデータや医療記録を接続してパーソナライズされた会話を行えるようにしました。この機能は18歳以上の米国ユーザーがWebとiOSで利用可能で、全ティアで提供されます。診断ではなく健康情報の理解を支援することを目的としています。

ソースArtificial Intelligence News著者: Ryan Daws

OpenAIはChatGPT内でヘルス機能を展開しており、ユーザーがApple Healthデータや医療記録をチャットボットに接続するオプションを提供しています。ログイン済みの18歳以上のユーザーは、WebおよびiOS上で、Free、Go、Plus、Proの全ティアでアクセス可能です。

ユーザーはApple Health、および対応する地域では米国の病院システム、One Medical、Function Healthの記録をリンクできます。同期後、ChatGPTは薬剤、検査結果、最近の受診、睡眠データ、アクティビティログをアプリ内の任意の会話に引き出すことができ、そのコンテキストを別のセクションに限定する必要はありません。

OpenAIは以前、このアイデアの初期バージョンを小規模なテストグループで実行しており、その際はユーザーが専用のヘルスエリアを開いて自分のデータに基づいた回答を得る必要がありました。同社は、そのグループでの健康関連の会話の70%以上が、食事計画や無関係な症状の問い合わせの途中など、専用スペース以外の場所で行われたことを発見しました。

このデータが今回の再設計につながりました。ChatGPTは、ユーザーを特定のモードに強制するのではなく、許可が与えられていれば、あらゆる会話で接続された健康情報を活用するようになりました。

例えば、夕食の計画を立てている人は、記録された食事制限を考慮したレストランの提案を受け取るかもしれません。週末の予定を尋ねる人は、同期された記録に最近の怪我が記載されていれば、それに合わせて調整されたアクティビティの提案を得られるでしょう。

サイドバーのヘルスタブは依然として存在しますが、その役割は管理ハブへとシフトしています:アカウントの接続、同期データとトレンドの確認、提案プロンプトの参照、過去の健康関連チャットへの復帰などです。

OpenAIは初期アクセスグループからの多数の報告を公開しており、その詳細は同社自身のツールの位置づけ(診断ではなくサポート)と照らし合わせて検討する価値があります。

テクニカルプログラムマネージャーのBlake氏は、「最も役立ったのは、散在した病歴を実際に理解して説明できるものに変えられたことです。複数の重複する問題があり、ChatGPTはそれらをつなぎ合わせて明確なタイムラインを作成し、医学用語を平易な英語で説明し、理学療法士やトレーナーと共有できる要約を作成するのに役立ちました」と述べています。

ポートフォリオマネージャーのReweti氏は、標準的な検索や一回限りの医師の診察と比較して、長期的な分析が差別化要因であると指摘しました。「私が欲しいのは、明白でないパターンを推測し、自分だけでは気づかなかった関連性を見つけることです。ChatGPTは既存のラボデータにアクセスでき、それを長期にわたって見ることができる——それが大きな利点です。リサーチアナリストがいるようなものです。より積極的になり、自分の健康旅程をより多く所有できるようになります。」

しかし、すべての報告が摩擦のないものではなく、チャットボットインターフェースを介して臨床データを表示することに関わる利害関係を考慮すると、特筆すべきものがあります。看護師のShannon氏は、このツールを通じて自身のカルテに予期しない記述を発見したことを説明しました。

「ヘルス機能を使うことで、AIの最大の強みの一つは医療専門家を代替することではなく、患者が自分の健康情報をよりよく理解し、ナビゲートするのを助けることだという、以前から信じていたことを実際に強化しました。予期しないカルテ記述の発見は、そのことをはっきりと示しました。AIが問題を起こしたのではなく、私が医療提供者に適切にフォローアップできる問題を特定するのに役立ったのです。」

ツールがフォローアップのために何かを表面化させることと、臨床的な判断を下すことの区別は、OpenAIが利用が拡大するにつれて製品が維持すべき線です。

他のテスターは、臨床的な微妙な違いよりも、この機能が置き換えることを意図した手動データ整理の実際の負担に焦点を当てました。コンサルタントのDaniel氏は複数のソースを接続し、組み合わせたビューが孤立したチャットセッションよりも有用であると感じました。「ラボデータを調整し、理解できる言語に翻訳するのに素晴らしかったです。Apple HealthとMyChartを接続することで、洞察はチャットインタラクションだけでなく、私の生活全体で起こっていることに基づいてより具体的になりました。」

長年のフィットネス習慣を仕事のプレッシャーで失った中小企業経営者のKathleen氏は、リスクは低いが具体的なユースケースを説明し、モデルが直接確認できる活動ギャップに基づいて提案を調整しました。「『今日体を動かすための何かが必要』と言うと、ヘルス機能は過去7日間運動していないことを確認し、ウォーキングやストレッチなどゆっくり始めることを提案してくれます。管理しやすくし、合理的な方法で再開するのに役立っています。」

オペレーションマネージャーのCarlton氏は、以前はApple Healthからスプレッドシートをエクスポートし、毎回のチャットの前に手動でアップロードしていましたが、新しい統合によりその回避策が不要になりました。「ヘルス機能以前は、Apple Healthから巨大なスプレッドシートをエクスポートしてChatGPTにインポートしていました。今はずっと効率的になりました。ヘルス機能で何年ものフィットネスの旅を見ることができ、物事を別の視点で——より大きな全体像で——見るのに役立ちました。」

OpenAIは、毎週の健康関連のChatGPTクエリが3億人を超えると推定しており、検査結果の解読から医師の診察の準備まで多岐にわたります。この数字が正確であれば、ChatGPTはほとんどのデジタルヘルスプラットフォームが到達するのに何年もと多大なマーケティング費用を必要とする立場にあります。

同社はHealthを診断ツールではなくサポートツールとして明確に位置づけ、重要なことは実際の医療提供者に確認するようユーザーに伝えています。

OpenAIは、この機能の実現可能性を新しいモデルに帰しています:無料ユーザー向けのGPT-5.5 Instantと、有料ティア向けのGPT-5.6 Solです。同社によると、GPT-5.5 Instantは緊急ケアが必要な場合の認識と不確実性の説明で向上し、最も困難な健康評価において当時の最先端のThinkingモデルに匹敵するパフォーマンスを示しました。GPT-5.6 Solは、これまでで最も強力な健康モデルであり、経時的な検査傾向など複数のデータポイントを横断して推論するために構築されています。

これらの主張を検証するため、OpenAIは数百人の医師と協力して健康シナリオと評価基準を構築し、正確性、安全性、コミュニケーション、文脈認識、完全性、専門家ケアへの適切なエスカレーションを評価しました。同社は、すべてのGPT-5.6モデルがGPT-5.5を上回ったと報告しています。

OpenAIの発表に含まれるチャートは、GPT-5.6 SolがGPT-5.5 InstantおよびGPT-4oを正確性、コミュニケーション、完全性、指示遵守の各カテゴリで上回り、医師が作成した回答を比較ベースラインとして使用していることを示しています。

OpenAIは、医師がリリース前に実際のパフォーマンスと安全性を評価するためにライブのヘルス製品をテストしたと述べていますが、その方法論や結果の詳細は公開されていません。

健康データの取り扱いと許可アーキテクチャに関して、同社によると、接続された医療記録とApple Healthデータ、およびそれらを利用した会話は、ユーザーの広範なChatGPTトレーニング設定に関係なく、基盤モデルのトレーニングや広告ターゲティングから除外されます。健康データに触れない会話は、ユーザーが個別に設定したトレーニング設定に従います。

アクセスはデフォルトで許可が必要です。ChatGPTは接続された健康データを使用して応答をパーソナライズする前に許可を求めますが、ユーザーは「常に許可」に切り替えてプロンプトをオフにすることもできます。その設定は設定 > プラグイン > ヘルスにあり、いつでも元に戻せます。データソースの切断は、OpenAIのシステムから30日以内に削除をトリガーしますが、既にチャット履歴に表示されたものはユーザーが手動で削除するまで残ります。

メモリ作成も狭く範囲が設定されています。健康会話からメモリを作成することはできますが、接続された生の記録やApple Healthデータから直接作成することはできません。メモリ作成を完全に避けたいユーザーは、一時的なチャットを使用するか、設定でメモリを無効にできます。

OpenAIはまた、特定のエッジケースについても言及しています:Apple Healthメトリクスから構築されたトレーニングプランをランニングパートナーに送信するなど、他の接続プラグインを通じて健康データが露出する可能性のあるアクションです。同社は、そのようなアクションが実行される前に追加のチェックが適用され、センシティブなケースではChatGPTが明示的な確認を求める可能性があると述べています。OpenAIはこれらのシナリオを対象としたレッドチーミング演習を実施していると述べていますが、その結果や失敗率は公開されていません。

エッジでの正確性に関して、実際の摩擦点はデータ品質にあります。薬剤は患者の同期記録に長期間リストされ続ける可能性があり、OpenAIはそのようなシナリオを例に、同期データが自動的に最新であるとは限らないことを示しています。ユーザーへのガイダンスは率直です:変更を直接ChatGPTにフラグし、重要なことは元のソースを確認するように。

ウェアラブルやフィットネスアプリのデータにも独自のギャップがあり、各サードパーティアプリがApple Healthと共有することを選択したものに依存するため、一部のフィットネスアプリの独自スコアはまったく転送されない可能性があるとOpenAIは指摘しています。

重要な問題は、ChatGPTがデモで検査結果を正しく要約できるかどうかではなく、ユーザーの同期記録が3ヶ月前のものであり、モデルが矛盾する入力を推論するよう求められた場合に、許可モデル、データ削除のタイムライン、エスカレーションロジックが機能するかどうかです。OpenAIの医師テストはその懸念の一部に対処していますが、制御された評価と、4つの異なるアプリから不完全なデータ同期で複数の慢性疾患を管理するユーザーとの間の距離を埋めるものではありません。

試してみたい方は、この機能は現在、対象となる米国ユーザー向けにサイドバーのヘルスメニューから利用可能です。