OpenAIは医療・ヘルスケア業界に全力で注力しており、過去半年で臨床医向けの新バージョンのChatGPTや「ChatGPTヘルス」ツールなど、医療分野の新製品を3つ発表しました。現在、シダサイナイ・メディカル・センター、HCAヘルスケアなど8つの大規模医療システムと契約を結んでおり、世界中で毎週2億3千万人以上のユーザーがChatGPTを通じて健康アドバイスを受けています。医療事業は、米国経済の約18%を占めるため、OpenAIの核心戦略の一つとなっています。しかし、AnthropicやGoogleなどの競合企業からの挑戦に直面しており、2024年の純損失は390億ドルに達しました。また、AIによる医療アドバイスの正確性の問題や潜在的な法的リスクにも対応する必要があります。記事執筆者、出典:フォーブス(ID:forbes_china)
このAI大手は医療・ヘルスケア業界に全力で注力しており、過去半年で3つの新製品を発表した。しかし、すでに数億人が医療・ヘルスケアに関するアドバイスをChatGPTに求めているため、その正確性を十分に確保しなければならない。
OpenAIが米国のトップ医療システムにその医療事業を販売しようとする際、しばしば病院CEOたちが無視できない人物であるサム・アルトマンを引き合いに出す。
41歳のアルトマンはOpenAIの共同創設者兼CEOであり、億万長者で、外界の懸念を払拭し、取引を成立させるのが得意だ。彼は投資家、取締役会、各国政府を説得し、OpenAIが次世代計算の中心的推進力であることを信じさせることに成功した。現在、彼は自ら医療機関にこの理念を提案している。
01
アルトマンが販売交渉に直接関与したことで、医療事業がOpenAIの全体戦略における核心的な位置を占めていることが示されている。今年1月、このAI大手は、シダサイナイ・メディカル・センターやHCAヘルスケアを含む8つの大規模医療システムが、そのエンタープライズ向け医療ツールの顧客となったことを発表した。
OpenAIは、数百人の医師を招いて健康関連の質問応答コンテンツを最適化し、ChatGPTを通じて週間2億3千万人以上のユーザーにアドバイスを提供しています。同社は、臨床医向けの新バージョンのChatGPTと、主アプリ内に組み込まれた「ChatGPT Health」をリリースしています。このツールでは、ユーザーがApple HealthやMyFitnessPalなどの個人の医療記録や健康アプリを安全にリンクできますが、現在は待機リストのみの提供です。また、複数の医療テクノロジー企業も、OpenAIのモデルを基に臨床記録の生成や検査結果の解釈支援ツールを開発しています。過去半年だけで、OpenAIは医療分野向けに3つの新製品をリリースしました。
「医療はOpenAIの最も重要な事業分野の一つです。」と、OpenAI医療事業責任者のネイト・グロス(Nate Gross)は述べた。グロスは2025年にOpenAIに加入し、エモリー大学医学部で医学博士号、ハーバード・ビジネス・スクールでMBAを取得している。以前は時価総額40億ドルの医療ソーシャルプラットフォームDoximityを共同設立した。同社は教育や金融など他の大規模市場にも拡大しているが、グロスは「すべての人が健康問題に直面するため、医療に取り組むことで、すべての人を支援する機会があります」と述べている。

医療健康産業は米国経済全体の約18%を占めています。適切に発展させれば、AIはこの分野で非常に大きな可能性を秘めています。消費者がより賢明な健康選択を支援し、医師の診断・治療品質を向上させ、医療機関の運営効率を高めることが可能です。

OpenAI医療事業責任者、ネイト・グロス。画像提供:OPENAI
02
OpenAIが医療分野に本格参入するタイミングは、同社が勝敗を分ける節目を迎えた時期である。
3年前、OpenAIはChatGPTによってAI革命を引き起こしたが、現在、AnthropicやGoogleなどの急速に台頭する競合他社に直面し、そのリードはやや縮小している。2025年の同社の売上は130億ドルに達したが、報告によると、純損失は2024年の50億ドルから昨年には390億ドルへと約7倍に急増した。今年4月、OpenAIが重要な売上およびユーザー目標を達成できなかったという情報が流れた。8520億ドルの評価額を有するこの業界大手は、6月に非公開で上場申請を提出したが、投資家の圧力により、IPOを来年に延期することを検討しているという。
会社は上場前に医療事業の財務データを個別に開示しないが、医療事業は今後の成功にとって不可欠である。
しかし、OpenAIは、設立当初から企業向けサービスに焦点を当て、独自の医療製品ポートフォリオを有するAnthropicやGoogleをはじめ、同じ市場を狙うすべての医療テック企業と競争しなければならない。大規模モデルの機能が次第に同質化する中で、病院の利益率がそもそも非常に低いことを踏まえ、価格面でも競争力を示す必要がある。「一般ユーザー市場における彼らの競争力には期待しています」と、医療分野に特化したAegis Venturesのマネージング・パートナーであるジョン・ビードルは述べた。「しかし、企業市場における彼らの将来については、それほど楽観的ではありません。」
2024年2月、ローレン・バノンは体調不良を感じ始めた。朝晩には指を曲げるのも非常に困難だった。最初の数ヶ月間、彼女は痛みを軽視していたが、その後痛みは腹部に広がった。さまざまな検査を経て、医師から彼女は血液検査では検出できないリウマチ性関節炎であると診断された。
しかし、ノースカロライナ州に住む42歳のマーケティング会社の創業者は納得できず、多くの人と同じようにChatGPTに答えを求めた。バンナーは自身の症状について次々と質問したところ、AIは彼女が橋本病——免疫システムが甲状腺を攻撃する疾患——である可能性を示唆した。甲状腺の超音波検査でこの診断が確認され、医師はさらに2つの小さな結節を発見した。バンナーは侵襲性の甲状腺がんを患っていた。2025年1月、外科医は彼女の甲状腺と、がん細胞が広がっていた2つのリンパ節を切除した。
「チャットGPTは本当に私の命を救ってくれました。軽い気持ちで言っているのではなく、心からそう思っています。」とバノンは述べた。
ChatGPTを通じて健康に関する質問をする何百万人ものユーザーの多くは、バノンのような経験を持っていない。彼らが尋ねるのは、「なぜ階段を上ると膝が痛くなるのか?」や「骨密度を維持するのにどの運動が役立つか?」といったシンプルな質問である。人々はこれを医学用語の解釈、検査結果の分析、薬の効果の理解に利用している。しかし、中には奇妙な症状について尋ねる人もおり、その症状の一部は後に重篤な疾患と診断されることがある。
03
「現在、健康はChatGPTで最も活発なアプリケーション分野の一つです。」とOpenAIの健康AI事業責任者であるカラン・シンハルは述べています。「これは利益をもたらす可能性もありますが、害をもたらす可能性もあります。しかし、利益の潜在力の方がはるかに大きいです。」
米国では、臨床医の不足と過剰な事務処理により、医師が身体的・精神的に疲弊しており、患者は必要な診療を受けられずにいます。農村地域では、成人の3分の1以上が救急室を受診しており、これらの症状は基本的な医療機関で対応可能でした。また、86%の農業県には心臓専門医が1人も存在しません。
医療リソースへのアクセスは非常に顕著な課題です。数億人のユーザーがChatGPTを通じて重要な情報を得ています。彼らは医者に診てもらうまで半年待つ必要があるかもしれませんし、次に何をすべきかわからず不安に陥っているかもしれません。」OpenAIのヘルスケア製品責任者であるアシュリー・アレクサンダーは述べています。「私たちは明確に、ChatGPTは診療サービスの代わりにはならないと示しています。しかし、このような無力感や恐怖を感じる瞬間に、それは人々に参考情報を提供できます。」

しかし、かつての「グーグル医師」(Dr. Google)と同様に、ChatGPTを健康の参考にしたり、自己診断に利用したりすることは両面性を持つ。このツールは明らかに役立つが、誤った情報を提供し、患者が不要な救急外来を受診させたり、本来注目すべき症状を見過ごさせたりする可能性もある。
今年2月、『ネイチャー・メディシン』に掲載された研究は、OpenAIの新世代コンシューマー向け健康ツール「ChatGPTヘルス」を評価した。研究によると、医療機関の受診が必要な症例の半数以上で、患者に病院を受診するよう勧めていない。自殺傾向があり、自傷方法を明確に言及したユーザーについては見落としがあったが、自傷方法を明かさなかったユーザーについては、介入を要する群として適切に識別できた。非緊急症例では、65%が医療機関受診を勧められたが、実際には必要なかったため、すでに逼迫している医療システムにさらなる負担をかける可能性がある。OpenAIはXプラットフォーム上で一つずつ反論し、グロスは「この研究の方法論には多くの明らかな欠陥があり、使用されたのは旧バージョンのモデルである」と指摘した。

OpenAIヘルス製品責任者、アシュリー・アレクサンダー。画像提供:OPENAI
報道によると、OpenAIは、健康データの処理とセキュリティに関する調査を受けて、米国の複数の州から召喚状を受け取った。カナダの女性が同社を提訴し、24歳の娘が自殺したのはChatGPTが自殺行為を誘導したためだと主張している。OpenAIは、各州検事総長が提起した懸念を「非常に重視」しており、「建設的に」対応すると述べている。
04
医師たちはその利点と欠点を実感しました。
ニューヨーク大学ランゴーン医療センターの筋萎縮性側索硬化症(ALS)専門の神経科医、ジンシー・アンデルスは、患者が印刷したChatGPTのチャット履歴を持って来院することがよくあると述べている。彼女によると、進行性で治癒不能な神経疾患であるALSに対して、ChatGPTは早期の受診や診断を促す効果がある一方で、不要な不安を引き起こすこともあるという。ある患者は、ChatGPTが筋肉のけいれんがALSの原因の一つであると述べたため、自分がALSであると心配した。しかしアンデルスは、実際にはそうではなく、これは「患者の不安を悪化させた」と語る。また、別の患者はChatGPTが推奨した実験的治療法を試したいと要望したが、その根拠として挙げられた研究は虚構だった。「検索で得た誤った情報を訂正し、明確にするのに時間がかかり、結果として、実際の病状を深く調べたり、治療法を話し合ったりする時間が損なわれてしまう」と彼女は述べている。
名前を明かしたくないオールバニー医療システムの医師は、複数の事例を共有した。患者がChatGPTの提案を根拠に医師の診断を疑い、科学的根拠のない治療法を提案している。ある患者は自身の症状をChatGPTに入力したところ、モデルが自己免疫疾患の可能性を示唆した。その後、この患者は「他の検査は一切受けたくない。私が患っているのは間違いなくこの病気だ。ChatGPTがそう言っているのだから、この方法で治すべきだ」と断言したという。

OpenAIはこれらのリスクを十分に認識しており、ChatGPTが提供する健康アドバイスを最適化するために、260人以上の医師からなるチームを編成しました。これらの医師はChatGPTの返答に点数を付け、具体的な症例を検討し、何より重要なのは、情報が不十分な場合に無理にアドバイスを出さないようにモデルを訓練することです。
「私が入社した当初、そのパフォーマンスはあまり良くなかったと感じました,」と、スタンフォード大学で訓練を受けた小児科医で、約2年半前にOpenAIに採用されてモデルのレッドチームテストに従事し、現在は同社の医師ネットワークを率いるレベッカ・ソスキン・ヒックスは言う。「正直、当時はそれを罠にかけてミスをさせることはそれほど難しくありませんでした。」
それ以来、このチームは70万件以上の回答サンプルをレビューし、一般ユーザーおよび臨床医へのモデルの回答精度を大幅に向上させました。OpenAIは、現在毎週数百万の臨床医がChatGPTを使用していると述べています。OpenAIが独自に開発したベンチマークツールHealthBenchは、緊急度分類や不確実性を適切に示すなど、48,000以上の評価基準に基づいてモデルのパフォーマンスを評価しており、その結果、OpenAIの新モデルは医療タスクにおけるパフォーマンスが旧バージョンと比較して顕著に向上している一方で、欠落している情報を積極的に尋ねる点ではまだ不足しています。
05
ただし、医療運営のシナリオでは、OpenAIのモデルの方が信頼性が高いです。
フロリダ州に本拠を置き、50以上の病院を運営するAdventHealthは、OpenAIモデルを行政業務に導入した結果、関連作業の所要時間が80%削減されたと述べている。ニューヨークのメモリアル・スローン・ケッタリングがんセンターは1000人を対象にパイロットプロジェクトを開始したが、OpenAIがもたらす実際の影響を評価するにはまだ時期が早い。「初期のフィードバックは非常に良好です」と、同センターの戦略的イノベーション副社長オフィリア・チウは述べている。「過去3年間、マーケティングで大々的に宣伝されてきたが、医療機関におけるAIの活用はまだ非常に初期の段階にある。」
OpenAIのグロスは、同社が医療分野で抱く多くのビジョンは、同社のモデルを基に新製品を開発するスタートアップや企業によって実現されると述べた。
時価総額230億ドルの診断大手であるLabcorpを例に挙げると、同社の最近の調査では、41%の人がAIを使って検査結果を解釈しているが、さまざまなツールの情報の正確性はまちまちである。そのため、同社は今年5月にOpenAIと提携し、AI技術を搭載した新しいモバイルアプリをリリースし、ユーザーが検査結果を理解し、長期的な指標の変化トレンドを追跡できるようにした。

「私たちは医師を招いて、システムに問題点を指摘してもらいましたが、その正確性は非常に高かったです。」とLabcorpのチーフ情報・技術責任者であるボラ・オイエグンワは述べました。
Abridge、Ambience、EliseAIなど、数千の機関およびスタートアップもOpenAIのモデルを活用しています。
Abridgeの例を挙げると、同社が最も有名とする技術は、医師と患者の会話を自動で記録し、臨床カルテを生成することである。同社の機械学習チーム責任者であるデイビス・リャン(Davis Liang)は、同社がOpenAIおよびAnthropicの最先端の大規模モデルと自社開発モデルを組み合わせて、臨床医向けの最適な製品を提供していると述べた。OpenAIのモデルはカルテ作成や汎用ユーザータスクにおいて特に優れた性能を発揮するが、患者の症状評価や診断コード生成(これは請求にも利用される)ではやや劣る。「このタスクは非常に難しく、正確性が極めて重要です」と彼は言う。「OpenAIは患者が糖尿病であると判断するかもしれませんが、実際にはその患者は糖尿病性網膜症を併発しています。」
しかし、AI技術の発展速度は非常に速く、半年後のこの分野の姿を予測するのは難しく、さらに五年先など話になりません。
「GDPの20%を占める産業を動かすには、万能の解決策はない」とOpenAIのグロスは言う。「私たちにできることは、自分のモデルが実際に人々の役に立つようにすることだけだ。」
