OpenCode 2.0 大規模リライト:APIの見直し、ノード移行、Electronデスクトップへの移行

iconMetaEra
共有
AI summary icon概要
MetaEraがリリースするOpenCode 2.0は、APIの全面的な再設計、BunからNodeへの移行、デスクトップアプリのTauriからElectronへの移行を導入します。新バージョンはマルチタブAIセッションをサポートし、パフォーマンスが向上しています。創設者のDaxは、トークン利用量が5倍に増加したと述べ、チームのオーバーデザイン戦略とオーケストレーターモデルをその要因として挙げました。ベータ版は7月上旬にリリースされ、本リリースはまもなく予定されています。このアップデートは、AIと暗号資産に関する新たなニュースをもたらし、今後の新トークン上場の可能性を示唆しています。
OpenCode 2.0がリリースされ、GitHubで16万以上のスター、毎月750万人の開発者が利用。核心的な再構築には、BunからNodeへの移行によるメモリ問題の解決、デスクトップ版のTauriからElectronへの移行、複数タブでの並列AIセッションの実装が含まれる。創設者のDaxは、AI推論の利益率が約90%であることを明かし、新モデルが可用性において完璧なバランスを見いだしたため、チームのトークン消費量が5倍に急増したと述べた。これにより、本物の信頼性と協働が可能に。チームはリモート開発環境としてベアメタルサーバーを構成し、「贅沢な過剰設計」という方法論を採用し、各意思決定に大量のトークンを投入して研究。モデルルーティングは過大評価されており、実際の有効なのはオーケストレーションパターンだ:メインモデルが「指揮官」としてタスクを安価なサブエージェントに割り当てる。

記事執筆者、出典:極客邦科技InfoQ

2026年、OpenCodeは現象級のオープンソースプロジェクトとなっており、GitHub上で16万以上のスターを獲得し、毎月750万人以上の開発者が利用している。

今月、彼らは2.0をリリースしました。

なぜリライトするのですか?Daxは次のように言っています。「私のキャリア全体で、あらゆるものを三回繰り返してやっと正しくできるようになりました。」OpenCode 0はプロトタイプ、1.xは検証段階であり、2.0は彼らがこの分野を完全に理解した後に、ゼロから徹底的に再構築したものなのです。

今回のリライトの中心的な作業の一つは、以前のように自然に成長したものをではなく、丁寧に設計された全体のAPIを再構築することです。

また、OpenCode と Claude Code の大きな違いの一つは、メモリ使用量の問題を解決するために Bun から Node に移行したことです。初期バージョンのアプリケーションは、サーバーコードが Bun 固有の API に依存していたため、コマンドラインインターフェース(CLI)を依然としてバンドルしていました。移行により、これらのすべての API が削除され、サーバーが Node 環境で実行可能になりました。

ユーザー:OpenCodeはあまりにもメモリを食う。現代のソフトウェアがなぜこんなに膨れ上がったのか、まったく理解できない。なぜ何でも2GB以上のメモリを消費する必要があるのか?
Dax:OpenCode 2を試してみることができますか?パフォーマンスははるかに良くなるはずです。

デスクトップ版も今回のリライトのもう一つの重点です。1.xのデスクトップ版は、当初、Web UIとCLIの軽量ラッパーとしてTauriを選択しました。起動時にバンドルされたCLIがopencode serveを実行し、Web UIにローカルサーバー接続を提供していました。しかし、TauriはmacOSおよびLinux上でWebKitを使用しており、これはOpenCodeアプリのレンダリング時にChromiumよりもパフォーマンスが劣り、一貫した体験にも影響を与えています。

Nodeへの移行後、Electronに組み込まれたNodeプロセス内でサーバーコードを直接実行するという考えは魅力的になった。

このリライトによる直接的な変化は、OpenCode デスクトップ版がAIプログラミングにおける最大の効率ボトルネックである「待ち時間」をついに解消したことです。ほとんどのユーザーは、AIタスクが完全に完了するのを待ってから次のタスクを開始する習慣がありました。しかし、今やその必要はなくなりました。ユーザーは複数のタブで独立したAIセッションを開き、2つの異なるプログラミングタスクを同時に実行できるようになり、各タブに異なるモデルを指定して並列比較も可能になりました。たとえば、一方のモデルでHTMLウェブサイトを構築しながら、もう一方のモデルでメンバーマイニングリストを同時に生成し、2つのモデルが互いに干渉することなく並行して動作します。

過去数ヶ月のOpenCodeのリライト期間中に、OpenCode共同創設者Dax Raadのチームのトークン消費量は5倍に増加しました。

私たちはトークンをどこに使いましたか?私たちの戦略は、あらゆるものを贅沢に過剰設計することです。単純なファイル読み取りAPIを実装する場合でも、考えます:あり得るすべての実装方法は何か?他の製品にはどのような先例があるか?レスポンスをどのように異なる方法で構成できるか?以前は、おそらく一つか二つの案しか思いつかず、その中で最良のものを選んでいたでしょう。しかし、今では非常に贅沢にリソースを投入できます。

OpenCode 2.0のベータ版は今月リリースされ、チームはベータ版リリースから約1か月後に正式版をリリースする予定です。先日、Dax RaadはSyntax.fmポッドキャストで、OpenCode 2.0の再構築ロジック、彼が推論の利益率を90%と見なす理由、モデルルーティングが過大評価されていること、AnthropicとOpenAIが全く異なる道を歩んでいることについて深く議論しました。本記事はそのポッドキャスト動画をもとにInfoQが編集したものです。

要約:

Q:その「言えないモデル」は本当にどれほど優れているのですか?チームは本当にハマっているのですか?

A:チームのトークン消費量は2か月で5倍に増加しました。これはトークンの消費が増えたのではなく、誰もがやめられなくなったからです。あなたはついにそれを信頼できるようになりました。それはあなたの言うことを聞き、あなたが見落としたものを捉えることができます。これはあなたに代わる存在ではなく、より優れたパートナーです。

Q:OpenCode 2.0 はなぜ再構築されたのですか?1.0 との本質的な違いは何ですか?

A:私の人生では、「何事も三回やらないと正しくできない」。0は試し、1は検証、2はその分野を完全に理解した後に一からやり直す。OpenCode 2.0には三つの核心的な変更点がある:APIをすべて再構築、デフォルトでサービスとして常駐実行、デバイス間のエージェントネットワーク。

Q:なぜあなたのソフトウェアは他のものより使いやすいのですか?その方法論は何ですか?

A:「決めるのはあなた次第」、実際のトークンを投入し、基盤の原語に投資する。

Q:モデルルーティングは信頼できますか?

A:モデルルーティングの分野は過大評価されており、中間業者が必死に仕事を探している。効果的な方法は、ルーティングシステムにモデル切り替えを任せることではなく、高価なメインモデルを「指揮官」として機能させ、タスクを安価なサブエージェントに割り振ることである。次世代モデルはこの「オーケストレーションモード」で非常に優れたパフォーマンスを発揮し、1つのセッション内で複数のサブエージェントを並行して管理し、完了後にメインモデルを再起動できる。

Q:AI推論は本当にどれほど利益が大きいのでしょうか?ローカルでモデルを実行すれば費用を抑えられますか?

A:Anthropic と OpenAI の推論利益率は約90%であり、損益分岐点は現在の価格の10分の1まで下がる可能性がある。OpenCode が推論サービスプロバイダーとして、中間業者を介しても、一部のオープンソースモデルでは70%の利益率を達成できる。しかし、ローカルでモデルを実行してもコスト削減にはならない。ローカルでの効率向上によってコストが下がったとしても、クラウドでは10倍安くなる。ローカルモデルの意義はコストではなく、プライバシーにある。

Q:なぜClaude Code MaxのサブスクリプションはOpenCodeで使用できないのですか?

A:AnthropicとOpenAIの企業文化はまったく異なります。OpenAIは消費者志向で、どれだけ資金を費やしても、より多くのユーザーに体験を提供することを重視します。一方、Anthropicは企業志向で、すべてのGPU計算リソースが企業顧客向けに販売を待っています。本質的には「ファネル」のロジックです:AnthropicはユーザーがClaude Codeから入り、最終的にトークン課金の企業プランに到達することを望んでいます。もし途中でOpenCodeにユーザーを奪われると、ユーザーは他のモデルに流れてしまう可能性があります。

Q:音声入力のプロンプトは本気ですか?

A:OpenCodeの全チームはもうキーボードで入力しなくなりました。Discordでのやり取りさえ音声で行っています。LLMは曖昧な表現を自然に理解できるため、最終的な出力の品質はむしろ高くなります。

Q:私たちは最終的に本当に意味のあるベンチマークを得られるでしょうか?

A:私はもうベンチマークをまったく見ません。スコアが上がったところで、実際の開発に何の影響があるでしょうか?私はチームのトークン消費量の変化傾向に注目しています。消費量が増えていれば、そのモデルが本当に使いやすいということです。

リモート開発環境を設定する

ウェス:あなたがツイートで「大規模な裸金属サーバーをレンタルして、それを仮想マシンに分割してチームメンバー全員に割り当てています。これは私がこれまでずっと使用している構成で、特にOpenCodeサーバーを動かすのに非常に適しています」と言いましたが、これは誰かにリモート計算リソースを割り当てているのですか?

ダックス:約2年前から、クラウドサーバーではなく、ベアメタルサーバーをレンタルし始めました。その性能は非常に優れています。以来、ローカルのメインマシンを使わずに、直接SSHで接続して作業しています。複数の永続的なTmuxセッションを起動し、すべての作業をその上で行っています。この方法の利点は明確です:パフォーマンスが高く、新しいハードウェアが登場すればすぐにアップグレードでき、古い機器を手直しする必要がありません。また、複数のデバイス間の切り替えが非常に簡単で、ノートパソコンを閉じてデスクトップに移っても、直前にやっていたところからそのまま作業を再開できます。私はこの方法をずっと気に入っています。

エンコードAgentの登場により、これはマイナーな遊びから必須のツールへと変わったと感じています。多くの人は依然としてローカルPCを使いたがりますが、それは問題ありません。エンコードAgentにとって、常に稼働しているリモートマシンの利点は非常に大きいです。私はVimユーザーですが、リモート作業には全く問題ありません。多くの人にとっては現実的でないかもしれませんが、エンコードAgentがあれば、エディタにそれほどこだわらなくてもよくなり、単にプロンプトを送って会話したいだけになります。そのため、このリモートマシンのアプローチはより多くの人にとって現実的になりました。

チームが拡大するにつれて、私の設定を見た多くの人が「私も欲しい」と言っています。これは確かに理にかなっています。大企業はすでに実用的な理由からリモート開発環境を導入しています。あなたのアプリのビルド方法、依存関係、環境は非常にカスタマイズされているからです。すべての人に事前に設定されたマシンを提供してすぐに使い始められるようにするのは自然な流れであり、私たちもチームのために同じことをしただけです。しかし重要なのは、一般的なクラウドサーバーを使用すると、ディスクは通常遅く、CPUも古くなっていることです。ローカルのMacBookと競争できるパフォーマンスを得ることはできません。高速なNVMeディスクと適切なCPUが必要です。

Wes:それでは、このサーバーの仕様は?価格は?

Dax: 私の個人用マシンは数年使用しており、現在1世代遅れです——AMD 9900X、192GBメモリ、月額約200ドル。私の要件には性能が過剰ですが、複数の仮想マシンを実行できます。私たちのチームメンバーは世界中に散らばっており、レイテンシーが問題になるため、ヨーロッパ、アメリカ、シンガポールにそれぞれサーバーを設置しています。これらはよりプロフェッショナルで、より優れた管理と制御が可能です。それぞれの月額コストは約300~400ドルで、コア数は私のマシンより多いです。本格的な企業にとってはこれほどはかかりません。従業員にノートパソコン1台を支給するだけでも、この金額を超えます。

スコット:これらのベアメタルサーバーはどの企業にホストされていますか?

Dax: 私のマシンは価格だけを見て、CPUの型番を検索して、自分の都市に最も近い、聞いたことのないベンダーでも何でも選んでいます。通常は問題ありません。チーム用のマシンは現在、latitude.shを使用していますが、実はある企業がこのソリューションを製品化しており、それがexe.devです。おそらく皆さんはご存知でしょう。この会社は元Tailscaleの創業者が設立し、製品はすべてをワンストップで利用可能なリモート開発環境にパッケージ化しています。我々はおそらくそちらに移行するつもりですが、まずはオリジナルの構築を試してみたいと思っています。

Wes:あなたは上部でモデルを実行していますか、それとも通常の開発だけですか?

Dax:いいえ、推論はしません。

Wes:それでは、あなたのTmuxはどのように設定していますか?何か特徴はありますか?

Dax:私は各プロジェクトにTmuxセッションを一つずつ設けています。OpenCodeには独自のセッションがあり、その中に複数の関連ウィンドウがあります。プロジェクトごとにセッションを分けることで、素早く切り替えられます。私にとっては、leader-Sで別のプロジェクトに切り替え、そのTmuxセッションに直接入ります。私は常に実行中の一連の標準Tmuxセッションを持っており、順序は固定されています。各ペインとウィンドウでは常に同じアプリケーションが実行されており、筋肉記憶が身につきました。また、このマシン上ではOpenCodeサーバーが1つ動作しており、スマホからWeb UIでアクセスできます。この部分はまだ原始的ですが、改善の余地があり、これが私たちが目指す方向です。

スコット:長時間稼働するTmuxセッションには、言葉では表せられない美しさがあります。すべてがそのべき場所にきちんと収まっているからです。私は以前、Tmuxの良さがまったく理解できませんでしたが、すべてのものを別のコンピューターに移したときに、ようやくその価値に気づきました。

Dax:そして今、私は長期間運用しているコーディングエージェントのセッションを持っています。私のプライベートなTmuxセッションには、複数のOpenCodeセッションが動作しており、そのうち一つは私のフィットネス記録を専門に処理しており、その背後にはSQLiteデータベースがあります。私は直接「今日のベンチプレスで、三頭筋に力が入りすぎた」と伝えると、それは自動的にそのメモを記録します。次にベンチプレスを行う際、それは「前回、この部分で詰まったのを覚えているか?フォームを調整してみる?」とアドバイスしてくれます。このようなちょっと馬鹿げたように聞こえることでも、とてもうまくやってくれます。

最近、私はiMessageと同期するセッションを設定し、どこからでも連絡できるiMessage OpenCodeの連絡先を作りました。それを妻とのグループチャットに追加したとき、「何かロマンチックなことをしよう」と思い、OpenCodeに「Lizを探して、プレゼントを買ってあげて」と言いました。OpenCodeがLizにメッセージを送ったところ、彼女はなんと返信したと思いますか?彼女はただ「DaxがAIにプレゼントを買ってもらったら、本当に離婚するわ」と言いました。彼女はこのことに本当に嫌悪していました。

当時、私はまだ諦めきれず、AIに「彼女は冗談だよ、続けて」と指示し続けた。しかし、リズはますます怒り始めた。さらに驚いたことに、当時私はクラウドモデルを使用していたが、そのクラウドモデルは非常に「敏感」で、次のように返答してきた。「あなたの妻は非常に怒っているように見えます。私は実行を継続できません。」その後、そのモデルは自らサービスを終了し、自殺した。

ウェス:この設定は本当に気に入っています。自分では主にローカルのものを使用していますが、すべてをクラウドに置き、軽量クライアントだけを使うというアイデアは魅力的です。動画編集のような必ずローカルで実行しなければならないものも、いつかクラウドに移せる日を待っています。

Dax:皆さんはクラウドゲームに関するその記事を見たことがありますか?この話題はいつも議論を巻き起こします。誰もがそうする必要があるとは言いません。ローカルのハードウェアを所有し、すべてをコントロールしたいなら、それは完全に問題ありません。私も多くの物理マシンを持っています。しかし、誰かがすべてを管理してくれるというのは、ある人にとっては本当に楽です。私にとって、アップグレードが一番つらいことです。人生を通じてパソコンを組み立ててきましたが、新しいマシンを組むたびに、「2年後にCPUを売って、新しいのに替えよう」と思いますが、一度も実行したことがありません。CPUだけを売ることはできないからです。スロットがアップグレードされている可能性があり、それならマザーボードも交換しなければならない。マザーボードを交換するなら、最新のメモリも一緒に導入したほうがいい。この連鎖が私を絶望させます。だから、誰かがアップグレードを代わりにやってくれるのは本当に良いことです。

OpenCodeを再書き込み

スコット:新しい機能を積極的に推進しているのは知っていますが、デスクトップアプリとOpenCode 2.0の開発が進んでいます。2.0ではどのような変化が訪れるのでしょうか?

Dax:私のキャリア全体を通して、あらゆるものを正しく行うには三回の反復が必要でした。OpenCode 0、1があり、今回の2.0は、この分野とその可能性を完全に理解した後の大幅な再構築です。その中心的な作業の一つが、以前のように自然に成長したのではなく、丁寧に設計された全体のAPIの再構築です。

二つ目の重要な変更は、デフォルトでサービスとして実行されるようになったことです。インストール後、常に起動し続けます。OpenCodeを起動すると、自動的に接続され、デスクトップ版、Webアプリ、または自分で作成したスクリプトやアプリケーションのすべてが同期されます。ご自身のカスタムプログラムでコンピューターを制御したい場合も可能で、甚至そのようなプログラムを自ら作成することもできます。また、新しいプラグインAPIも追加されました。私たちは多数のトークンを消費し、すべての決定を深く検討し、あらゆる可能性を検討しました。このプロセスは苦痛を伴いましたが、非常に興奮するものでもありました。

スコット:全面公開はいつですか?

Dax:今週末にはベータ版が出る予定です(7月初めにベータ版をリリース済み)。実は今すぐリリースすることもできますが、最後の修正と機能追加のために1週間時間を取っています。ベータ版の後、約1か月で正式版としてリリースする予定です。

Dax:OpenCode 2.0 がこれほど時間がかかった理由の一つは、ホットリロードをサポートするために再設計したからです。Skillを自動で作成しても、手動で作成しても、すぐに読み込まれ、キャッシュが無効化されることはありません。

スコット:TauriからのElectronへの移行はバージョン2.0で完了しましたか、それともすでに完了していますか?

Dax: デスクトップ版は実際とても興味深いです。これまで正式リリースされたことはなく、常にベータ状態でした。その間、ベータ版のベータ版まで登場しました。しかし現在ではElectronに移行し、チームは新しい2.0コアAPIへの対応と、多数のパフォーマンス修正および完全に新しくなったUIの開発を進めています。

スコット:新しいバージョンではデフォルトでサービスとして実行されるということは、OpenCodeをインストールすれば、サーバーを別途起動せずにリモートGUIをすぐに使えるという意味ですか?

Dax:サービスはデフォルトでローカルで実行され、あなたのコンピューター上のすべてのプロセスはローカルで動作しますが、リモートに設定することもできます。私の設定では、各マシンにOpenCodeサービスが実行されており、さらに興味深いホストモードを追加しています。たとえば、私のメインのOpenCodeサーバーはリモートマシンで動作し、デスクトップにはMac Studioがあり、メインデスクトップはFramework Desktopです。OpenCodeはこれらのすべてのデバイスを認識しているため、たとえクラウド上のLinuxサーバーと対話している最中でも、「iMessageを送信する」と指示すれば、OpenCodeが私のMac Studioに接続してiMessageを送信します。つまり、すべてのデバイスをOpenCodeサーバーに統合でき、OpenCodeはすべてのデバイスとその場所を把握しています。

Wes:多くの人が複数のターミナルペイン間で通信したり、2つのTmuxペイン同士で会話させたりすることを議論していますが、複数のマシン同士で通信させることこそ、本当の凄さです。

スコット:はい、私も同じように設定しました。デバイス管理において、これにより無限の効率向上がもたらされました。

Dax:興味深いことに、まだこれを完全な機能として実装していません。というのも、私のすべてのデバイスはTailscaleで接続されているからです。Agentが各デバイスの名前と説明を知っているだけで、自動的にSSHして作業を実行します。たとえば、私のリモートサーバーがブラウザを使いたい場合、デスクトップ上のデバイスにSSHして、そこにログインしているすべてのアカウントを使ってブラウザを操作します。特別な設定は一切不要で、デバイス同士が接続されていれば十分です。

Wes:ではモバイル端末についてはどうでしょうか?昨日、CursorがiOSアプリをリリースしたのを見ましたが、Claudeにもリモート制御機能があります。モバイル向けAIアプリについてどのようにお考えですか?

Dax:確かにモバイルアプリを開発する必要があります。このアイデアは長い間私たちのToDoリストに置かれてきましたが、私たちがサポートしたいさまざまなシナリオを支えるのに十分な核心アーキテクチャが整うのを待っていました。今や核心は整ったので、まもなくモバイル開発を開始する予定です。現在、簡易的なモバイルWeb UIがありますが、私もたまに使っていますが、体験はあまり良くありません。すべてのプラットフォームでクライアントを提供し、それらが十分に優れている必要があります。

ソフトウェア工学の方法論

Wes:你们のOpenCode端末アプリは、これまで使ったどのツールよりも明らかに優れています。新しいClaude 2 TUIに切り替えたとき、スクロールすら正しくできず、非常にイライラしました。你们はどのようにして製品の細部や完成度にこれほど集中できるのでしょうか?

ダックス:正直に言うと、私たちもまだ模索中です。私たちのチームも皆と同じように、さまざまなものをバランスよく扱おうとしています。最初のステップは実はとてもシンプルです——自分が気にするかどうかを決めることです。これは些細なように聞こえるかもしれませんが、現実には、気にしないという理性的な理由が無数にあります。「Claude Code がどれほど良くできようが関係ない。彼らは数十億ドルの収入があるんだから、そんなに頑張る必要はない」という議論が無数に見られます。だから、気にしなくても成功できるという論拠がたくさんあります。しかし肝心なのは、あなたが本当に気にするかどうかです。私たちのチームは確かに気にしています。他の人のソフトウェアを見て「ああ、私たちもあんな素晴らしいものをつくれたらいいのに」と思い、その願望が私たちを駆り立てています。

二つ目の点は、私たちのトークン使用量が今や非常に急増していることです。過去数ヶ月で、私たちのチームの月間トークン使用量は5倍に増加しました。これは、私たちがどれほど効率的にトークンを使用しているかを自慢するためではなく、モデルが私たちの会社ですでに製品-マーケットフィットを達成した証拠であり、それゆえに数ヶ月でこのように急成長できたことを示しています。さらに、これらのモデルはまだ限定的なアクセス状態にあるものです。

問題は、私たちがトークンをどこに使ったかです。私たちの戦略は、あらゆるものを贅沢に過剰設計することです。たとえ単純なファイル読み取りAPIを実装する場合でも、可能なすべての実装方法は何か?他の製品にはどのような先例があるか?レスポンスをどのように異なる方法で構成できるか?以前は、たった一つか二つの案しか思いつかず、その中で最良のものを選んでいましたが、今では非常に贅沢にリソースを投入できます。これはかつては決してできなかったことで、この投入は確かに優れたソフトウェアを生み出しています。

第三に、私たちは依然として、Coding Agent が一歩で実現できない基礎的な原語への投資は価値があると考えています。私たちのTUIが使いやすいのは、主にOpenTUIというTUIフレームワークに事前に投資したおかげです。これはZigで書かれており、開発者があらゆるプラットフォームで動作し、極めて優れたパフォーマンスを実現するために、細部にわたる多大な努力を要します。開発プロセスにはCoding Agentが大きく貢献しましたが、それでもこれは専門家レベルの作業であり、一般の人々にはできません。これにより、私のような一般の人々も、豊富な機能を備えた使いやすい製品を構築できるようになります。大規模言語モデルが存在しても、堅牢な原語が基盤として必要であり、それへの投資は価値があります。

ウェス:以前、Pierre Computerのチームに依頼して、シンプルなdiffやシンプルなサイドバートリービューなどのプリミティブを作成してもらいました。それにより、私たちのような素人でも、那些賢い人々が丁寧に設計したプリミティブをそのままアプリに組み込むことができました。

Dax:現在、数百万のCoding AgentのUIがPierreを使用しており、私たちもその一つです。

ウェス:たった二人の賢い人々が、この業界全体を支えるものを構築した。

モデルルーティング

スコット:私たちの番組では、リクエストに応じてタスクを最も適切なモデルにルーティングするモデルルーティングについてよく話しています。この分野は現在どの程度発展していると思いますか?まだ進化の余地はありますか?

Dax:この分野はやや過大評価されていると思います。なぜなら、多くの仲介業者が必死に何かやろうとしているからです。あなたがモデルラボではなく、価値あるものを提供したいのであれば(私たちもその立場にいます。私たちは推論サービスを販売しており、仲介層です。)あなたができることは、顧客に「モデルラボでは、1つのモデルの出力を別のモデルに渡すことはできません。なぜならAnthropicはOpenAIのモデルを提供しないからです。しかし、私たちはできます。」と伝えることだけです。そのため、彼らはモデルルーティングを必死に宣伝しますが、正直、この仲介層ではそれほど多くのことができるとは思えません。

最理想的状況は、リクエストが入ってきた際にシステムがどのモデルを使用すべきかを判断することですが、セッションが開始された後は、コストの問題により途中でモデルを動的に切り替えることはできません。セッション中にモデルを切り替えると、新しいモデルが導入されるたびにキャッシュが完全にリセットされ、そのコストは非常に高くなります。そのため、このレベルでのルーティングは難しいと思います。

私たちが真に注目しているのは、別の方向性、特にオーケストレーターパターンで非常に優れた性能を発揮する新世代モデルです。以前にもこのパターンを試みた人はいましたが、従来のモデルは十分に優れておらず、一般ユーザーには使いづらかったと思います。しかし、私たちのチームの誰かが新しいモデルを使ってこのような設計を実現しました:メインセッションには高価なモデルを使用しますが、そのプロンプトは「決して自ら行動しない」ように設定し、サブエージェントの生成のみを担当させます。サブエージェントには安価なモデルを使用します。これにより、メインモデルの知性は維持されつつ、探索やコード修正などの面倒な作業は安価なモデルに任せることができます。全体としてコストはむしろ削減され、新モデルは並列処理に非常に優れており、1つのセッション内で複数のサブエージェントを同時に実行でき、それらが完了するとメインモデルを呼び起こします。ユーザーは常に1つのセッション内で操作するだけで、体験は非常にスムーズです。这才是真正有意义的模型路由。

言えないモデル

Wes:先ほど、多くのトークンを燃やし、まだリリースされていないモデルを使用したとおっしゃっていましたが、具体的にどれですか?それらはどのチャネルで入手したのですか?

Dax:OpenAIとAnthropicはどちらも大きなプレビュー計画を持っており、一部のユーザーに先行アクセスを提供しているため、我々は外部よりも早くいくつかの情報を確認できます。具体的なラボの名前は挙げませんが、最新のモデルにより、私たちのトークン消費量が5倍に増加しました。

ウェス:これはそれが自体でより多くのトークンを消費するからではなく、それが皆さんの働き方を変えたからですね、正しいですか?

Dax:私たちのことを知っている人は、私たちが非常に保守的なチームであることを理解しています。これまで長年にわたり、AIによるコーディングに対して慎重であり、AIの熱狂的な支持者ではなく、その使用方法や能力の宣伝にも常に自制してきました。しかし、私は言わせていただきますが、私たちのチームは新世代のモデルに完全に夢中になりました。プレビュー期間が終了し、アクセスを失ったその数日間、全員がこのツールを失ったことを嘆きました。「それなら仕事の意味は何か?」と問う声も上がり、多くのAI葬儀の画像が作成されました。あの数日は本当に辛い時期でした。

新しいモデルが急に賢くなったとか、人間を置き換えるようになったというわけではありません。重要なのは、可用性においていくつかの微調整が行われ、完璧なバランスが見つかったことです。今や、あなたは本当にそれらを信頼できるようになりました。它们はあなたの話を真剣に聞き、あなたが見落とした点を捉えることができます。それらが急に人間になったわけではなく、私たちのデータからもわかるように、より良いパートナーになったのです。

スコット:では、トップメーカー以外のモデルは?例えば、你们使用的OpenCode Go之类的?它们有进步吗?

Dax:はい。プレビューモデルへのアクセスを失った後、私たちの半分はGPT 5.5に戻り、もう半分はGLM 5.2を使っています。私もGLM 5.2を利用していますが、GPT 5.5とほぼ同等だと感じています。新しいモデルを試した後、古いモデルはどれも似たようなものに思えるので、今はどれを使っても問題ありません。しかし、GLM 5.2がGPT 5.5に代わることができるという事実自体が、両者が着実に進化し、差が縮まっていることを示しています。

私の個人的な見解では、最先端モデルは常に一定の優位性を保つでしょう。なぜなら、最初に導入した側には複合的な効果が生じるからです。しかし正直に言えば、Go では非常に多くの利用が見られ、一部のユーザーはすべての作業をこれだけで行っています。おそらく私たちは高給のバブルの中にいるのでしょう。通貨価値が高く、最先端モデルを購入する余裕があるのです。しかし、世界の大多数の人々にとっては状況が異なります。アメリカでも、私たちがGoのオープンソースモデル向けの低価格プランをリリースしたとき、これはグローバルユーザー向けの国際版プランだと思っていましたが、結果としてアメリカが依然として最も多くのサブスクリプションを記録する国となりました。開発者やコードを書きたいという人々のグループは非常に広く、月額200ドルのプランですら、その多くにとって手の届かない金額なのです。

ウェス:価格の将来について、毎月会社が従業員一人あたり1000ドル、2000ドルを費やすようになると思いますか?それとも、新しいチップなどが登場することで価格が安定すると思いますか?

Dax:過去1か月のデータがあり、会社の利用量が急増したため、コストを計算し、給与明細と比較しました。私たちにとって、この利用量はすでにかなりの規模で、給与の約15%に相当します。つまり、チームに支払う金額に加えて、さらに15%の「税」を支払わなければ、これらのモデルを利用できません。正直なところ、それほど悪くはありません。私たちのようなテクノロジー企業では、1人当たりの収益が通常非常に高く、15%は全体の大きな枠組みではごくわずかです。しかし、すべての業界がそうであるわけではありません。

しかし、これらの価格は下がり、大幅に下がります。価格に敏感な場合、オープンソースモデルははるかに安価です。私はこれが非常に混乱を招くと思います。なぜなら、多くのヘッドラインがOpenAIとAnthropicが損失を出しており、成功することは決してできないと報じているからです。しかし、実際の推論の利益率は非常に高く、特に現在OpenAIとAnthropicが価格を引き上げている状況ではそうです。私は彼らの推論利益率が約90%だと推測しており、这意味着盈亏平衡点可以再便宜10倍。

ウェス:以前、推論のマージンは70%だと聞きましたので、70%から90%の間ですね。これは明らかにモデルの訓練コストだけではなくて、正しいですよね?

Dax:もちろん、研究開発コストもあります。しかし企業として、あなたは研究開発を停止しても利益を上げることができます。

ウェス:では、ローカルでモデルを動かせると思っている人たちはどうでしょうか?自宅の裏庭でマシンを動かせると思っている人たちに対して、あなたはどう思いますか?

Dax:この話題については、このコミュニティの人がすぐに怒ってしまうため、非常に慎重に話しています。まず明確にしておきます:人々がローカルでモデルを実行したいのには、正当な理由がたくさんあります。自分の家からデータを一切出したくないという気持ちは、まったく理解できます。しかし、コストを気にしているのであれば、ローカルモデルは費用削減には役立ちません。なぜなら、ローカルホスティングを安価にするあらゆるメカニズムは、クラウドホスティングをさらに10倍安価にするからです。モデルがより効率的になったり、より小さなサイズでより強力な能力を発揮できるようになったりすれば、クラウド上の1トークンあたりのコストはさらに下がるだけです。したがって、私はローカルモデルはコストの問題ではなく、プライバシーの問題だと考えています。

私たちは仲介業者を通じてGPUをホスティングしていますが、それでも一部のモデルは定価の70%低いコストでホスティングできます。非常に安価です。つまり、仲介業者を利用しても、定価で販売すれば70%の利益を得られます。もし直接GPUを購入すれば、Anthropicが推定する約90%の利益率に近づく可能性があり、コストは非常に低くなります。もちろん、これはオープンソースモデルに関する話です。オープンソースモデルが今後も改善し続けることに依存していますが、現在のトレンドは確かにこの方向に向かっています。

OpenCodeがClaude Codeに「ブロック」された?

スコット:それでは、Claude Codeについて話しましょう。彼らの立場はいつも曖昧で、OpenCodeのようなプロバイダーはClaude Code Maxプランを利用できるのでしょうか?現在の状況はどのようなものですか?

Dax:この統合に関して、OpenCode内のMaxプランを使用するように促すプラグインは、絶対に許可されていません。私たちはこれについて長く議論しましたが、結局勝てませんでした。もちろん、ユーザーはハッキング手段で制限を回避する方法を見つけるかもしれませんが、私たちはこのような行為を公式にサポートすることはできません。

SDKに関しては、ヘッドレスモードでClaudeを呼び出す方法は現在グレーゾーンにあり、現在は許可されているとされています。そのため、Conductorのような製品やT3 Codeもそれをラッピングできます。しかし、私たちは決してそれをラッピングすることはありません。それはOpenCodeの本来の目的に大きく反するからです。したがって、オーケストレーションツールや代替UIについては、現在のところ利用可能ですが、状況は依然として明確ではありません。

これは根本的に会社の文化の問題です。あなたは消費者向けの企業ですか、それとも企業向けの企業ですか?OpenAIは非常に消費者向けの企業であり、そのため彼らはどれだけの資金を費やしても、どれだけの資金を調達しても、より多くの人々に体験を提供することを優先します。これが、OpenAIのサブスクリプションがOpenCodeで公式にサポートされている理由です。一方、Anthropicは完全に同じ文化を持っているとは思いません。

もし貴社が企業向けの企業である場合、状況はまったく異なり、消費者用途に割り当てる毎回の推論に対して、セールスが「実際の価格で支払う企業クライアントがいます」と言いに来ます。計算リソースが限られている場合、OpenCodeユーザーの利用を社内で正当化するのは難しくなります。ただし、現在の計算リソースは以前より増えているはずです。

スコット:これが彼らがあなたに使わせたくない理由ですか?多くの人が「それってどうでもいいじゃないか?私はサブスクリプション料を払っているのに、どこでも使えない理由は?」と言っています。また、彼らは学習データや支配権を欲しがっているのではという推測もありますが、実際のところ、単に計算リソースが限られているだけなのです。

Dax: 実際、すべての企業は本質的に漏斗です。あなたは漏斗の上部にものを置き、ユーザーを引き付け、理想としては、彼らを底部まで一貫してコンバージョンさせます。

彼らはClaude Codeをフュニールの上部として設計し、非常に消費者向けの製品です。あなたがそれを使用し、次にあなたの会社が使い始め、その後、会社がトークン単位で支払いを開始します。しかし、ユーザーがOpenCodeを通じて使用する場合、この変換チェーンが断たれる可能性があります。なぜなら、OpenCodeでは他のモデルを自由に切り替えられるからです。Claudeが気に入らなければ、いつでも最新の人気モデルに切り替えることができます。

二つ目の理由は、計算能力の競争的需要です。漏斗の上部に投入したものは、すべて最終的に漏斗の下部に戻ってくることを証明できなければなりません。消費者向け企業であれば、この点ではより柔軟に対応できます。

ウェス:APIがなく、アプリでのみ利用できるモデルが将来登場すると思う?例えばElevenLabsは優れたアプリを持っているが、月額サブスクリプションに登録しなければならず、使い放題の課金はできない。このような状況は来ると思う?

Dax:はい、これはまた会社の内部構造を反映しています。プロダクトチームはこのアプローチを非常に支持するでしょう。彼らは「非常に専門的なモデルを作成し、それに基づいて専用のプロダクトを構築し、両者を束ねて、モデルを使いたければ私たちのプロダクトを使う必要がある」と言えるのです。これはプロダクト志向のチームにとって非常に完璧なロックイン戦略です。

しかし、営業組織には収益目標があり、「我们的収益目標は1000億です。あなたのAPI独占または製品独占モデルでは、最良の場合でも500億しか達成できません。残りの500億の穴は誰が埋めるのですか?」と主張します。営業チームは「ダメです、このモデルをAPIに組み込む必要があります。そうすれば目標をより達成しやすくなります」と主張し続けます。このような内部の駆け引きが存在する限り、組織は収益の一部を犠牲にしてでも市場シェアを獲得することの正当性を示すのが難しくなります。

これらのラボが次第に製品層に進出するにつれて、彼らはまるで「不公平なボタン」を手にしたようなものであり、いずれかのタイミングでそのボタンを押すのは驚くべきことではない。そして、彼らは「このモデルは危険すぎるため、私たちのフレームワーク内でのみ使用することが安全であり、他のフレームワークでは使用させられない」といった奇妙な理由で正当化するだろう。これは本当の理由ではないが、おそらく彼らの口実となるはずだ。

Wes:Fableのセキュリティに関する問題について、これらの新しいモデルはすべて安全ではないのでしょうか?政府がそれらを安全でないと述べていますが、これは真実ですか、それとも単なる話題作りですか?

Dax:多くのことが真実であり、それらは互いに矛盾する可能性があります。これらのモデルには大きな被害をもたらす可能性があります。政府が、リリース前に何らかの審査が必要だと主張するのは合理的です。Metaのような大手企業では、アバター画像のアップロード機能をリリースする際、その機能に児童ポルノフィルターが搭載されていることを政府に証明しなければなりません。このような規模では、最も些細なアプリ内機能であっても、異常なレベルの規制に直面します。

しかし、もしこのプロセスが非常に無知または腐敗している場合、最終的な結果はモデルへの包括的な承認や誰もが広くアクセスできる状態ではなく、政府の手続きによってアクセス権に不平等が生じてしまうと、それは非常に悪い状況になります。私はこのような状況が起こらないことを願っています。むしろ、新しいモデルをリリースするたびに、ただ毎回1か月かかる手続きを踏むだけという、より退屈な結果を見たいと思っています。

一方で、これは完全に理性的な問題ではありません。これらの研究所が「核兵器」を保有していると勝手に主張し始めることは、政治的な関心を引き起こすため、避けるべきです。これは爆弾を扱っているようなもので、最終的に退屈な状況になる可能性もあれば、規制の誤りや過剰な対応により、経済全体に悪影響を及ぼすような深刻な状況に発展する可能性もあります。そのため、私はこれらの研究所が公衆の認識に対してより慎重であってほしいと思います。核弾頭を所有しているとどこでも言いふらして、何も起こらないと期待することはできないからです。

AIインタラクションは手動操作のない方向へ向かっています

スコット:MCP、Skill、そしてAIプログラミングで使われるツールについて話しましょう。本当に注目すべきで使えるのは何ですか?皆さんは何を使っていますか?

Dax:私たちの個人的な設定はほとんどが非常に基本的です。本当に興味深いのは、私たちのチーム内にあるDiscordボットで、これは私たちの個人設定よりも多くのMCPとスキルを備えています。Kit Langが考案した「Gang Growth」という仕組みがあり、ビジネス、API設計、実装のいずれかで課題に直面した際、私たちはDiscordボットに音声でプロンプトを入力し、@OpenCodeをメンションします。これにより、それは協力ツールのように機能します。

このボットは会社のすべてのデータレイクに接続されており、「過去1週間で、すべての過剰課金を有効にしたGoサブスクリプションユーザーの合計支出はいくらでしたか?」と質問すれば、すぐに計算してくれます。私たちのチームの習慣の変化は、基本的に誰かを@する必要がなくなったことです。質問があれば、まず@OpenCodeします。他の人が見れば、一緒に取り組みに加わります。しかし、OpenCodeはしばしば自分で対応してくれます。

スコット:では、ロボットがユーザーに情報を返す必要がある場合はどうなるのでしょうか?現在、MCP UIやHTMLファイルの直接生成について多くの人が議論していますが、将来的にエンコードエージェントが情報を表示する方法はどのようになると思いますか?

Dax:私たちはOpenCodeに何らかのアーティファクト機能を追加し、ドキュメントを生成してお届けします。HTMLとSVGを用いたビジュアライゼーションは非常にクールです。これは特別なものを必要とせず、エージェントの機能を活用するだけです。MCP UIについては、まだ深く調査していませんが、非技術者向けに注力し始めた際には、デスクトップアプリでサポートするつもりです。なぜなら、彼らが質問する内容や行うべきタスクは、動的なUIやより豊かなインターフェースによって恩恵を受ける可能性が高いと考えているからです。

私たちのチームは現在、音声プロンプトに夢中になっています。Discordでメッセージを送るときさえ、タイピングが嫌いなので、音声でやり取りしています。あなたが直接話せるなら、多くのUI、特にインタラクティブなUIは、必要なことを大まかに説明するだけで十分です。すべてをタイピングしなければならないとしたら、それは確かに最悪です。しかし、音声を使えば、音声は今や非常に速く、ローカルで動作します。

スコット:音声コマンドが多すぎたので、フットペダルを購入しました。一つは「入力」、もう一つは「音声入力のトリガー」、そしてタブ切り替え用にも一つあります。私はただそこに座ってこれを使っていて、とても気に入っています。

Dax:多くの人がこれに疑問を抱いているのは理解できます。私もKitがこれを行っているのを見てから始めました。他人がこうしているのを見ると、あなたの脳にある何かが解き放たれます。あなたがやったことがなければ、これは恥ずかしいように感じるかもしれません。しかし、これは最も自然なことです。無駄な言葉を並べても、混乱しても、言い間違えても問題ありません。LLMは、あなたが本当に伝えたいことを理解するのが得意だからです。

Wes:あなたはKitのHexアプリを使っていますか?

Dax:私は主力マシンでHandyを使い、MacではHexを使っています。モデルが優れていることが重要です。

ウェス:私のトリガーはとてもシンプルで、マウスの小さなボタンをダブルクリックするだけです。また、タップできるリングを開発している人もいて、彼らが私に送ってくれる予定なので、試してみます。

Dax: 今でもほとんどの時間、指はキーボード上にあるので、ショートカットキーを設定しました。

ウェス:他に私たちが話していないけれど、特に言いたいことはありますか?たとえば、あなたの個人的な見解などは?

Dax:次世代モデルの登場にとてもワクワクしています。通常、新しいモデルがリリースされると、どれも似たような感じで、私はその点について投稿して不満を述べることさえあります。しかし、今回は初めて、これらのモデルが実際に多くの人に使われる可能性があると感じました。技術的にはすでにリリースされていますが、政府が一般ユーザーの利用を許可していないだけです。

Wes:現在さまざまなベンチマークやスコアがありますが、人々は「はるかに良くなった」と言っています。最終的に、本当に意味のあるベンチマークが得られると思いますか?

Dax:正直に言うと、今はベンチマークなんてまったく見ていない。そもそも以前に本当に見たのかさえ分からない。これらのスコアはもう背景ノイズになってしまったと思う。数字は上がっているし、競合より大きく上がっているのは分かっている。でも、競合が発表すると、彼らのスコアはさらに跳ね上がる。それで一体何の意味があるの?

だから、今は定性的フィードバックだけに注目しています。人々がモデルを使って何を実現し、何を構築したかを共有するのを見るのが好きです。百万単位のデータポイント規模ではこのようなフィードバックを得ることはできませんが、これらの製品は本質的に曖昧であり、最終的にはユーザーが満足しているか、不満を感じているかに帰着します。だからこそ、私たちのチームのトークン使用量の推移を見るのが好きです。曲線が上昇しているなら、何かが機能している証拠であり、誰かが何かを気に入っているということです。私たちのチームにはClaudeのファンも、GPTのファンも、オープンソースモデルのファンもいるので、あらゆる方向に十分なカバーができています。

スコット:最近、共有したい特別に楽しんだことはありますか?

Dax:もちろん、私が以前言及したexe.devです。もし「クラウド上のマシン」という概念を体験したいなら、これは非常に賢い製品で、とても良くできています。私の感覚では、Tailscaleのように「まさかこれがちゃんと動くとは」と思えるような製品で、exe.devも同じ雰囲気を持っています。私は的確なニッチを突いた製品が大好きで、この製品は奇妙な真空地带にぴったりとハマっています。AWSや他の場所からサーバーをレンタルすることはできますが、高速で永続的なディスクを備え、かつ価格も手頃なサーバーを簡単に借りるのは難しいです。このニッチは以前、曖昧なVPSプロバイダーだけが埋めていて、現れては消えていきました。

数年前、初めて開発サーバーを構築したとき、最も安価な方案を探していたところ、マイアミのVPSプロバイダーを見つけました。その男は、自らの死を偽装し、結局サーバーがダウンしてしまいました。彼は全員にメールを送り、「医療手術を受けるため、3日間連絡が取れなくなります」と言いましたが、3日後にサーバーは本当に停止しました。私は「やばい、何か起きたのか?」と思いました。1か月が経過しても、誰も彼に連絡が取れませんでした。最終的に、フォーラムで彼が以前にも同様の状況で消えたVPSサービスを運営していたという投稿を見つけました。この安価で高性能なサーバー市場は、信じられないほど信頼できないものでした。今でも私は、これが一体どんな詐欺なのか理解できません。私は彼にサービス代を支払ったのに、なぜ彼は消えてしまったのでしょうか?

ウェス:視聴者に何をおすすめしますか?

Dax:自分自身のプロジェクトであれば、OpenTUIをお勧めします。TUIを構築する際、React、SolidJS、さらにはVueバインディングを使って高性能なTUIを構築できます。OpenCodeはこれで構築されており、現在1.0版に向けて進んでいます。最近、ターミナル製品やアプリケーションに再び注目が集まっています。

スコット:他もこれを使っている?新しいGrokのビルドやxAIのものも?

Dax:GrokのCLIは非常に優れており、実行がスムーズでパフォーマンスも高いですが、これはRustで書かれており、おそらくRatatouilleライブラリを使用しているでしょう。一方、新しいHermesプロキシTUIはOpenTUIで構築されています。コミュニティは急速に拡大しており、今ではタイムラインでTUIを見かけた場合、ほぼ間違いなくOpenTUIです。特に、それが本質的にReactであるため、vibe codingの方式で書けるからです。

免責事項: 本ページの情報はサードパーティからのものであり、必ずしもKuCoinの見解や意見を反映しているわけではありません。この内容は一般的な情報提供のみを目的として提供されており、いかなる種類の表明や保証もなく、金融または投資助言として解釈されるものでもありません。KuCoinは誤記や脱落、またはこの情報の使用に起因するいかなる結果に対しても責任を負いません。 デジタル資産への投資にはリスクが伴います。商品のリスクとリスク許容度をご自身の財務状況に基づいて慎重に評価してください。詳しくは利用規約およびリスク開示を参照してください。