OpenAI 正全力押注醫療健康行業,過去半年已推出三款醫療領域新產品,包括面向臨床醫生的新版 ChatGPT 及「ChatGPT 健康」工具。目前已獲得西達賽奈醫療中心、HCA Healthcare 等 8 家大型醫療系統客戶,全球每周超過 2.3 億用戶透過 ChatGPT 獲取健康建議。醫療業務已成為 OpenAI 核心戰略之一,因其佔美國經濟約 18%。然而公司面臨 Anthropic、谷歌等競爭對手的挑戰,且 2024 年淨虧損達 390 億美元,同時還需應對 AI 醫療建議準確性問題及潛在法律風險。文章作者、來源:福布斯(ID:forbes_china)
這家 AI 巨頭正全力押注醫療健康行業,過去半年已推出三款新品。但它必須確保 ChatGPT 的準確性足夠有保障,畢竟已有億萬人向它尋求醫療健康方面的建議。
當 OpenAI 想向美國頂級醫療系統推銷其醫療業務規劃時,通常會搬出一位醫院首席執行官們無法忽視的人物:山姆·阿爾特曼。
41歲的阿爾特曼是OpenAI的聯合創始人兼首席執行官,身家億萬,最擅長消除外界疑慮、促成交易。他已成功說服投資者、董事會和各國政府,讓他們相信OpenAI是下一個計算時代的核心動力。如今他正親自向醫院推廣這套理念。
01
阿爾特曼親自參與銷售洽談,凸顯了醫療業務在 OpenAI 整體戰略中的核心地位。今年 1 月,這家 AI 巨頭宣布,包括西達賽奈醫療中心、HCA Healthcare 在內的 8 家大型醫療系統,已成為其企業級醫療工具的客戶。
OpenAI 邀請了數百名醫生優化健康類問答內容,為每週透過 ChatGPT 獲取建議的超過 2.3 億名全球用戶提供服務。公司正在推出面向臨床醫生的新版 ChatGPT,以及內嵌於主應用中的「ChatGPT 健康」(ChatGPT Health)——此工具可讓用戶安全地綁定個人病歷與健康應用,例如 Apple 健康和 MyFitnessPal,但目前僅開放等候名單。此外,多家醫療科技公司也正基於 OpenAI 的模型開發工具,用於生成臨床病歷並協助用戶解讀檢驗報告。僅過去半年,OpenAI 就推出了三款醫療領域的新產品。
「醫療是OpenAI最重要的業務領域之一。」OpenAI醫療業務負責人內特·格羅斯(Nate Gross)表示。格羅斯於2025年加入OpenAI,擁有埃默里大學醫學院醫學博士學位與哈佛商學院MBA學位,此前曾聯合創立市值40億美元的醫療社交平台Doximity。儘管公司也在拓展教育、金融等其他大型市場,但格羅斯稱:「每個人都會遇到健康問題,公司佈局醫療,就有機會幫助所有人。」

畢竟,醫療健康產業佔美國整體經濟的比重約達 18%。如果發展得當,AI 在這一領域潛力十分巨大:既能幫助消費者做出更明智的健康決策,也能輔助醫生提升診療質量,還可以幫助醫療機構提高運營效率。

OpenAI 醫療業務負責人內特·格羅斯。圖片來源:OPENAI
02
OpenAI 正式全面進軍醫療領域之際,正值公司來到一個成敗攸關的節點。
三年前,OpenAI 憑藉 ChatGPT 引發 AI 革命,但如今面對 Anthropic、谷歌等快速崛起的競爭對手,其領先優勢似乎已略有縮水。2025 年公司營收達 130 億美元,但據報導,其淨虧損從 2024 年的 50 億美元飆升至去年的 390 億美元,幾乎增長 7 倍。今年 4 月,有消息稱 OpenAI 未能達成關鍵的營收與用戶目標。這家估值 8520 億美元的行業巨頭已於 6 月秘密提交上市申請,但據傳在投資者壓力下,正考慮將 IPO 推遲至明年。
儘管公司不會在上市前單獨披露醫療業務的財務數據,但醫療業務顯然是其未來成功的關鍵。
但 OpenAI 需要擊敗一群對手,包括從成立之初就專注企業服務、擁有自有醫療產品矩陣的 Anthropic 和谷歌,以及所有瞄準同一片市場的醫療科技公司。隨著大模型功能日趨同質化,它還必須在價格上展現出競爭力——畢竟醫院的利潤空間本就十分微薄。「我很看好他們在普通用戶市場的競爭力,」專注醫療領域的 Aegis Ventures 管理合夥人約翰·比德爾(John Beadle)表示,「但他們在企業端市場的前景,我就沒那麼樂觀了。」
2024年2月,勞倫·班農開始感到身體不適。早晚時分,她連彎曲手指都十分困難。起初幾個月,她沒把疼痛當回事,後來痛感蔓延到了腹部。經過一系列檢查,醫生告訴她,她患上了一種血液檢測無法查出的類風濕性關節炎。
但這位現年42歲、居住在北卡羅來納州的行銷機構創始人並不信服,便像許多人一樣,轉向ChatGPT尋求答案。班農針對自己的症狀提出了一系列問題,AI提示她可能患有橋本氏病,這是一種免疫系統攻擊甲狀腺的疾病。甲狀腺超聲檢查證實了這一判斷,醫生還發現了兩個小結節。班農患的是侵襲性甲狀腺癌。2025年1月,外科醫生切除了她的甲狀腺,以及兩處已出現癌細胞擴散的淋巴結。
“ChatGPT 真的救了我一命。我不是隨口說說,是真心這麼認為。”班農說。
在通過 ChatGPT 咨詢健康相關問題的千萬用戶中,多數人並沒有班農這樣的經歷。他們問的都是些簡單的問題,比如「為什麼我爬樓梯時膝蓋會疼?」或者「哪些運動有助於維持骨密度?」人們用它來解讀醫學術語、分析檢驗報告、了解藥物療效。但也有人會向它諮詢一些異常症狀,而這些症狀有時最終被確診為嚴重疾病。
03
「如今,健康是 ChatGPT 最活躍的應用場景之一。」OpenAI 健康 AI 業務負責人卡蘭·辛哈爾(Karan Singhal)表示,「它既可能帶來益處,也可能造成危害,但利好的潛力要大得多。」
在美國,臨床醫生短缺與行政事務過多,導致醫生身心俱疲,患者也難以預約到所需的診療服務。在農村地區,超過三分之一的成年人會去急診室就診,而這些病症本可在基層醫療機構解決;86%的農業縣更是連一名執業心內科醫生都沒有。
「醫療資源的可及性是一個非常突出的問題。數億用戶正在透過 ChatGPT 獲取關鍵資訊。他們可能要等上六個月才能看醫生,也可能感到驚恐不安,不知道下一步該怎麼做。」OpenAI 健康產品負責人阿什莉·亞歷山大(Ashley Alexander)表示,「我們明確指出,ChatGPT 不能取代診療服務。但在這種無助且恐懼的時刻,它能為人們提供參考資訊。」

但與早年的「谷歌醫生」(Dr. Google)一樣,使用 ChatGPT 作為健康參考甚至自行診斷是一把雙刃劍。這個工具顯然能提供幫助,但也可能提供錯誤資訊,讓患者白跑一趟急診,或是讓他們忽視本該重視的症狀。
一項於今年2月發表於《自然-醫學》的研究,評估了OpenAI最新消費級健康工具ChatGPT健康。研究發現,在超過半數有必要就醫的病例中,它都未建議患者前往醫院。對於有自殺傾向且明確提及自傷方式的用戶,它存在漏判的情況;但對於未透露具體自傷方式的用戶,它反而能識別出這些人需要干預。而在非急症病例中,有65%被它建議就醫,實則並不需要,且可能為本已緊張的醫療系統增添負擔。OpenAI在X平台上逐一駁斥,格羅斯還指出:「這項研究的方法論存在不少明顯缺陷,且使用的是舊版本模型。」

OpenAI 健康產品負責人阿什莉·亞歷山大。圖片來源:OPENAI
據報導,OpenAI 已收到美國數個州的傳票,調查內容涉及健康數據處理與安全問題。一名加拿大女性起訴了该公司,稱其 24 歲的女兒自殺身亡,而 ChatGPT 對其自殺行為起到了誘導作用。OpenAI 表示,公司「十分重視」各州總檢察長提出的擔憂,並將「建設性地」作出回應。
04
Doctors have personally experienced the advantages and disadvantages.
紐約大學朗格尼醫學中心專攻漸凍症(ALS)的神經科醫生金西·安德魯斯(Jinsy Andrews)表示,經常有患者帶著列印出來的 ChatGPT 聊天記錄來就診。她說,對於漸凍症這種進行性、無法治愈的神經系統疾病,ChatGPT 有時確實能促使人們盡早就醫、更早確診,但也可能造成不必要的困擾。有位前來就診的人士擔心自己得了漸凍症,因為 ChatGPT 說肌肉跳動可能是病因之一。安德魯斯說,實際並非如此,但這「加劇了這位求醫者的焦慮」。還有一位患者要求嘗試 ChatGPT 推薦的實驗性療法,但它引用的相關研究根本就是虛構的。「要花工夫糾正、釐清這些搜索來的錯誤資訊,結果就會耽誤深入研究實際病情、討論治療方案的時間。」她說。
一位不願具名的奧爾巴尼醫療健康系統醫生分享了多起案例:患者援引 ChatGPT 的建議,質疑醫生的診斷,並提出毫無科學依據的治療方案。有一名患者將自己的症狀輸入 ChatGPT 後,模型提示他可能患有自體免疫性疾病。「他不願意再做任何其他檢查來明確診斷,還一口咬定:『我得的就是這個病。ChatGPT 說了,我就該用這個方法治。』」這位醫生說。

OpenAI 深知這些隱患,因此組建了一支由 260 多名醫生組成的團隊,以優化 ChatGPT 提供的健康建議。這些醫生會對 ChatGPT 的回覆進行評分、討論具體病例,更重要的是,他們會訓練模型在資訊不足時不隨意提供建議。
「我剛加入時,覺得它的表現並不理想,」史丹佛大學培養的兒科醫生麗貝卡·索斯金·希克斯(Rebecca Soskin Hicks)說,她約兩年半前受聘於 OpenAI 參與模型的紅隊測試,現任公司醫師網絡負責人。「老實說,那時要設陷阱讓它出錯並不容易。」
自那以來,該團隊已審核了超過70萬份回覆樣本,大幅提升了模型回答普通用戶和臨床醫生時的準確率。OpenAI 表示,目前每週有數百萬臨床醫生使用 ChatGPT。OpenAI 自研的基準測試工具 HealthBench 從急症分級、必要時主動表達不確定性等 4.8 萬個評分標準評估模型表現,結果顯示,OpenAI 新款模型在醫療任務上的表現較舊版本有顯著提升,但在主動詢問缺失資訊方面仍有不足。
05
但在醫療運營場景中,OpenAI 的模型可靠性更高。
總部位於佛羅里達州、旗下擁有50多家醫院的 AdventHealth 表示,使用 OpenAI 模型處理行政事務後,相關工作耗時減少了 80%。紐約紀念斯隆·凱特琳癌症中心已面向 1000 人啟動試點項目,但目前評估 OpenAI 帶來的實際影響還為時尚早。「初期反饋很不錯,」該中心戰略創新副總裁奧菲莉亞·邱(Ophelia Chiu,音譯)表示,「儘管過去三年市場營銷炒得熱火朝天,但醫療機構對 AI 的應用還處在非常早期的摸索階段。」
OpenAI 的 格罗斯 表示,公司在醫療領域的很多願景,都將藉由基於其模型開發新產品的創業公司和企業來實現。
以市值230億美元的診斷巨頭Labcorp為例。該公司近期一項調查顯示,已有41%的人會使用AI解讀檢驗報告,但不同工具的資訊準確度參差不齊。因此,今年5月,該公司與OpenAI合作推出了一款搭載AI技術的新移動應用,協助用戶理解檢驗結果、追蹤長期指標變化趨勢。

「我們請了醫生來為它挖坑、挑它的毛病,結果它的準確率非常高。」Labcorp 首席資訊與技術官博拉·奧耶貢瓦(Bola Oyegunwa)表示。
還有數千家機構和創業公司,例如 Abridge、Ambience 和 EliseAI,也都正在使用 OpenAI 的模型。
以 Abridge 為例,這家公司最知名的技术是自動記錄醫患對話並生成臨床病歷。該公司機器學習團隊負責人戴維斯·梁(Davis Liang,音譯)表示,公司同時採用 OpenAI 和 Anthropic 的前沿大模型,搭配自研模型,為臨床醫生打造最優產品。OpenAI 的模型在病歷記錄和通用用戶任務上表現尤其出色,但在評估患者症狀、生成診斷編碼(同時也可用於計費結算)方面表現稍弱。「這項任務難度很大,因為對精確度要求極高,」他說,「OpenAI 可能只會判斷某患者患有糖尿病,但實際上這個患者得的是糖尿病合併近視性視網膜病變。」
Nevertheless, the pace of AI technology development is extremely rapid, making it difficult to predict what this field will look like in six months, let alone five years.
「想要撬動一個佔 GDP 20% 的產業,沒有什麼萬能良方,」OpenAI 的格羅斯說,「我們能做的只有確保自己的模型能切實幫到人們。」
