Anthropicは、AIアシスタントに手を付与しました。Claudeは、マウスクリック、キーボード入力、画面キャプチャをデスクトップアプリケーションに対して直接制御できるようになり、バックグラウンドで静かに動作するため、ユーザーは自分の作業を続けられます。
この機能は、ProおよびMaxサブスクライバー向けのClaudeデスクトップアプリを通じて利用可能で、作業について話すだけでなく実際に実行するAIエージェントへの、これまでで最も具体的な一歩を示しています。
実際にどのように機能するか
新しい機能はmacOS 15(Sequoia)以降で動作し、デフォルトでバックグラウンドモードで実行されます。マウスやキーボードを占有することなく、Claudeは別ウィンドウで動作し、ご自身でコンピューターを通常通り使用できます。
特定のアプリで従来のAPIコネクターが利用できない場合、Claudeはスクリーンキャプチャと入力シミュレーションに切り替えてタスクを実行します。画面に表示された内容を読み取り、クリックする場所を特定し、フィールドにレスポンスを入力することで、AI統合を想定していないソフトウェアに対して人間が操作するのと同様に動作します。
このシステムは、一般的な生産性タスクを目的としたClaude Coworkと、開発ワークフローに焦点を当てたClaude Codeという2つのコンテキスト内で動作します。両方とも同じ基盤となるコンピュータ制御アーキテクチャを活用していますが、異なる使用ケースに最適化されています。
また、ユーザーがリモートでタスクを割り当てられるモバイルDispatch機能もございます。スマホからジョブを開始すれば、ClaudeがMac上で処理します。
権限とセーフティガードレール
システムは、各セッションの最初のタスク中にClaudeが任何のアクションを実行する前に、明示的なユーザーの許可を必要とします。機密操作前にプライバシー通知が表示され、アプリレベルの権限により、ユーザーはClaudeがアクセスできる範囲を細かく制御できます。
最初のリリースは有料個人プランに限定されています。チームおよびエンタープライズのサブスクリプション階層は、まだ利用できません。
Anthropic自身が認める一つの正直な注意点:Claudeは複雑なデスクトップタスクを実行する際、人間よりも遅い。AIは各インタラクションに対して体系的かつ慎重にアプローチし、画面を読み取り、行動を計画した後、ステップバイステップで実行する。
ベータ実験から製品リリースへ
このローンチは突然訪れたわけではありません。Anthropicは2024年10月に、Claude 3.5 SonnetとバンドルされたComputer Use APIのベータ版として、コンピュータ制御機能を初めて導入しました。そのバージョンは、エージェントワークフローを試したい開発者を主な対象とした、プロトタイプ的なものでした。
これはAIエージェント競争にどのような意味を持つのか
現在の制限は現実です。人間より遅い実行速度のため、これが誰かのワークフローを一夜にして置き換えることはありません。リアルタイムでの対応を必要とするタスクよりも、繰り返しで高ボリュームのタスクにより有用です。バックグラウンドモードの設計により、Claudeはあなたが現在 actively 作業している内容とやり取りすることはできず、自身のウィンドウ内に制限されています。
現在、この機能はmacOS 15以降の個人有料サブスクリプターに限定されており、チームまたはエンタープライズ版での提供時期は未発表です。
