この25年余りの間、私は企業がインターネット、SaaS、そしてクラウドへと移行していく様子を見てきました。そして、それらの移行のたびに私たちは何かを学びましたが、次の移行が訪れる頃には、その教訓をすぐに忘れてしまっていたのです。
今、私たちはまた新たな転換期の真っただ中にありますが、最も心に留めておくべき教訓は、技術的なものではなく、財務的なものです。 人工知能(AI)が企業で失敗するのは、モデル自体の能力が不足しているからではありません。私たちが初期のクラウドを消費したのと同じ方法でAIを消費してしまうからであり、つまり、熱狂的でありながら規律を欠き、組織内で支出に対して真に責任を負う者が誰もいない状態で利用してしまうからです。
AIがこれまでのあらゆる技術の波と異なる点は、それが企業全体にどれほど広範に及ぶかということです。かつて企業がクラウドサービスを購入した際、その用途を十分に把握する前に契約を結び、その契約範囲は主にインフラとエンジニアリングに限定されていました。
しかし、AIはそれよりもはるかに広範なものです。
一度コミットメントを行えば、そのリソースは研究開発、セキュリティ、財務、運用、市場投入――つまり、業務内容をプロンプトとして表現できるあらゆる部門によって活用されることになる。その広範さこそがAIの真の力であり、同時に制御を失いやすい原因でもある。
だからこそ、私は今やすべての企業が、私が「トークン・オペレーティング・モデル」と呼び始めたものを必要としていると確信しています。それはパイロット予算でもなければ、誰かがIT予算の中に隠してしまうようなイノベーションの予算項目でもありません。責任者が明確に定められ、消費予測が立てられ、ガバナンス体制が整備された、真の意味での複数年にわたる「トークン予算」なのです。
私たちに必要なのは、最終的にクラウドに適用されたのと同じ厳格さです。
二度と学ぶ必要のないクラウドの教訓
クラウドの当初の提唱は単純明快で、理論上は説得力のあるものでした。オンプレミスのインフラの利用率は30~40%でした。それらのワークロードをクラウドに移行すれば、80~90%の利用率を達成でき、それに伴いコスト削減も実現するはずでした。
しかし、ほとんどの組織で実際に起きたのは、稼働率が40~50%で頭打ちになり、経済性はほとんど改善されなかったということです。技術的には約束された成果を十分に実現できる能力があったにもかかわらず、組織側がそれを適切に管理できていなかったのです。
一度コミットメントがなされてしまったため、各チームはそれに見合う支出をしなければならないと感じていました。誰でもオンデマンドでサービスをプロビジョニングでき、調達部門には可視性がほとんどなく、意図と消費の間に制御層が存在しなかったのです。 これに対応するため、「FinOps」という新たな分野そのものが生み出されることになり、最終的には相当数のワークロードが完全にオンプレミスに戻ることとなりました。この回帰は、クラウドそのものに対する評決ではありませんでした。それは、私たちがクラウドをどのように管理していたかに対する評決だったのです。
すでにトークンを巡って、同様のパターンが形成されつつあるのを見ます。同じタスクが複数のエージェントによって実行されています。複数の関数が同じソースにクエリを送り、同じデータに繰り返しアクセスしています。なぜなら、最初の人がすでにコストを支払ったものを、2人目が再利用できるようにするキャッシュ層や取得層を、誰も構築していないからです。
これは重複であり、コストもかかる。請求書が届く前、つまり事後ではなく事前に誰かがこの問題に対処すれば、完全に回避できるはずだ。
トークンは地理的制約を無視する
取締役会がまだ十分に理解していない2つ目の考慮事項があり、それはコスト計算を大きく変えるものです。インドであれフィリピンであれ、業務を海外に委託した際、その経済的根拠のすべては労働力の裁定取引に依拠していました。つまり、ある場所では1時間あたり10ドルで済むタスクが、別の場所では25ドルや30ドルかかるというものです。
トークンにはそのような裁定取引は存在しません。トークンを呼び出す人がバンガロール、オースティン、あるいはワルシャワのどこにいても、そのコストは同じです。トークンは、石油と同様に、世界共通の通貨で、単一の価格で取引されます。 したがって、経営幹部から「AIの方がコストが安いのか」と尋ねられたとき、私の率直な答えは、「それは、以前どこで業務を行っていたか、そして現在その消費をどれほど慎重に管理しているかに完全に依存する」というものです。
ロックインではなく、選択肢を確保するために構築せよ
トークン運用モデルの最後の要素は柔軟性であり、この点については私が確固たる見解を持っています。3年あるいは5年の契約を結ぶのは構いませんが、その時点で最高の価値を提供している相手からトークンを購入する自由は確保してください。なぜなら、価値は絶えず変化し続けるからです。
私たちがマルチクラウドに対応したアーキテクチャを構築することを学んだのと同様に、今こそマルチモデルやマルチプロバイダーに対応したアーキテクチャを構築すべきです。3年後の状況がどうなるか、誰にも確かなことは分かりません。これほど急速に変化する市場で10年もの長期契約を結ぶことは、交渉力という唯一の優位性を失うことにつながります。
各部門にトークンの予算を割り当て、結果に対して責任を持たせ、単なる活動量だけでなく、トランザクションの量と質に基づいて評価してください。そうすれば、AIは単なる実験ではなく、成果を生み出し、成功を牽引する運用上の規律となります。
もしそうしなければ、4四半期後にはまた同じ論説を書き直していることになるだろう。ただ、その時はトークンについて、そしていかにして再び考え直すべきかについて、という内容になるだけだ。
LLMは(まだ)世界を救えないのか?">
LLMの重要な役割">