いいえ、誰かが秘密裏にあなたのChatGPTの応答の20%を手動で入力しているわけではありません。 しかし、「AIは人間なしで動く」と言うのも誤りです。 実際には以下のようなことが起こっています: 人間は、理想的な回答を書き、難しいプロンプトを作成し、複数のAI応答を評価し、幻覚を報告し、有害なコンテンツをラベル付けし、どの回答が優れているかを判断するために報酬を得ています。 OpenAIのInstructGPTの取り組みでは、人間の契約者がデモを作成し、モデルの出力を比較しました。これらの評価が、報酬モデルのトレーニングデータとなりました。 ワークフローは基本的に以下の通りです: 人間の判断 → AIが選択肢を生成 → 人間がそれらをランク付け → モデルが好みを学習 → AIがスケールして繰り返す 今日では、そうした人間の評価者は単なる「データアノテーター」ではなく、プログラマーや博士号取得者、弁護士、医師など、さまざまな分野の専門家です。 したがって、AIが洗練された回答を提供するとき、誰かが画面の向こうでリアルタイムで承認しているわけではありません。 しかし、何千もの人間の判断が、「良い」回答とは何かを機械に教えるために使われました。 AIは人間の層を排除したのではなく、それをシステムに圧縮したのです。 そして今、私たちは人間の評価者さえ、AIの評価者で置き換えつつあります。 この移行は「AIが職業を奪う」という話よりもはるかに重要かもしれません。 #psychepreneur #ai #subhamojha



