一家位於布魯克林的初創公司 Pangram Labs 表示,其技術能以近乎完美的精確度判斷某段文字是由人類還是機器撰寫。该公司聲稱,其檢測工具識別 AI 生成文本的準確率超過 99.98%,而對人類撰寫內容的誤報率僅為每 10,000 篇中 1 篇。
由前史丹佛大學研究人員 Max Spero 和 Bradley Emi 於 2023 年創立,Pangram 已將自身定位於數位媒體最重要問題的核心:你能可靠地證明一段內容是由人類所創作的嗎?
Pangram 實際上做什麼
您輸入一段文字,長度從 75 個字到 75,000 個字符不等,它會回覆一個判斷結果:人工撰寫、輕度 AI 協助、中度 AI 協助 或 完全 AI 生成。同時也會提供一個數值化的 AI 協助分數,以進行更細緻的分析。
該工具支援超過 20 種語言,並可與 Canvas 和 Google Classroom 等學習管理系統整合。
獨立測試結果令人鼓舞。芝加哥大學布斯商學院和馬里蘭大學的評估顯示,其在包括 ChatGPT 和 Claude 在內的主要語言模型內容上的準確率介於 99.8% 至 100% 之間。在廣泛使用的檢測工具測試套件 RAID 基準中,Pangram 的準確率達 99.44%,假陽性率為 0.05%。
该公司於 2026 年 1 月 16 日發布了 Pangram 3.1,新增了適用於人類書寫與 AI 輸出混合場景的功能。該更新還帶來了多語言支援以及針對個別 AI 系統的模型特定檢測功能。
在融資方面,Pangram 於 2025 年 6 月完成了一輪約 400 萬美元的種子輪融資,由 ScOp 領投,Script Capital、Cadenza 和 Haystack 參與了前種子輪。
準確性爭議才是有趣之處
截至2026年3月的學術討論指出,Pangram 宣稱的假陽性率與某些第三方評估實際發現的結果之間存在差距。儘管公司宣稱其假陽性率為 1 在 10,000,但某些外部研究記錄的平均假陽性率範圍為 0.48% 至 2%。
Pangram 在學術、新聞和創意寫作數據集上的獨立測試結果顯示,假陽性率介於 0% 至 0.17% 之間。關鍵在於,這些受控基準是否能清晰地轉化到雜亂多樣的現實世界中。
