Corcelは、オープンソースの大規模言語モデル向けにサーバーレスGPU推論を提供する人工知能インフラ企業である。同社は、Llama、Mistral、その他のオープンウェイトアーキテクチャなどのモデルを、基盤となるハードウェアを管理することなく実行できるクラウドプラットフォームを運営している。Corcelは、従来のクラウドプロバイダーに代わるコスト効率の高い選択肢として自社を位置づけており、トークン単位の料金設定を提供し、GPU容量の予約を不要にしている。
2023年に設立されたCorcelは、生成AI分野が急速に成長し、推論コンピューティングの需要が供給を上回っていた時期に登場した。同社のプラットフォームは、GPUオーケストレーションの複雑さを抽象化し、ユーザーがシンプルなAPI呼び出しでモデルをデプロイできるようにする。このアプローチは、AIアプリケーションのプロトタイプを開発したい個人開発者と、長期的なインフラ契約を結ぶことなく本番ワークロードを拡張したい大規模組織の両方を対象としている。
歴史と設立
Corcelは、クラウドコンピューティングと機械学習のバックグラウンドを持つチームによって2023年に設立された。創業者たちは、オープンソースモデルの成長するエコシステムを支援できる、柔軟でオンデマンドな推論サービスの市場におけるギャップを特定した。Amazon Web Services、Microsoft Azure、Google Cloudなどの主要なクラウドプロバイダーが、ユーザーに仮想マシンやKubernetesクラスターのプロビジョニングと管理を要求するのとは異なり、Corcelは自動スケーリングを備えた完全マネージドなエクスペリエンスを提供する。
同社は2024年初頭に、非公開のエンジェル投資家数名の参加を得て、初期シード資金を調達した。この資金は、中核となるインフラの構築と、GPUハードウェアプロバイダーとのパートナーシップ確立に使用された。2024年半ばまでに、Corcelはパブリックベータ版を開始し、AI開発者コミュニティから初期導入者を獲得した。
テクノロジーとアーキテクチャ
Corcelのプラットフォームは、受信リクエストトラフィックに基づいてGPUリソースを動的に割り当てるサーバーレスアーキテクチャ上に構築されている。ユーザーがプロンプトを送信すると、システムはリクエストされたモデルを実行している利用可能なGPUインスタンスにリクエストをルーティングする。この設計により、アイドル容量を複数の顧客間で共有できるため、ハードウェアの効率的な利用が可能になる。
同社は、Llamaファミリー、Mistral、およびさまざまなファインチューニングされたバリアントを含む、幅広いオープンソースモデルをサポートしている。ユーザーは、事前設定されたモデルのカタログから選択するか、カスタムウェイトをアップロードできる。プラットフォームは、モデルプルーニングと量子化を処理してパフォーマンスを最適化し、コストを削減することで、それほど強力ではないハードウェアでの高速な推論を可能にする。
Corcelのインフラは、AMDおよびNVIDIA GPUを活用しており、1万トークンあたりの競争力のある価格設定に重点を置いている。同社は、専用GPUインスタンスに匹敵するレイテンシを実現しながら、従量課金制の柔軟性を提供すると主張している。このモデルは、チャットボット、コード生成ツール、コンテンツ要約サービスなど、トラフィックパターンが変動するアプリケーションにとって特に魅力的である。
ビジネスモデルと価格設定
Corcelは、処理されたトークンごとに顧客に請求する消費ベースの価格設定モデルで運営されている。このアプローチにより、初期費用が不要になり、ユーザーは需要に応じて使用量を増減できる。同社は、高スループットの顧客向けにボリュームディスカウントを備えた段階的な価格プランを提供している。
中核となる推論APIに加えて、Corcelはユーザーがオープンソースモデルを特定のドメインに適応できるようにするサービスとしてのファインチューニングなどの機能を提供している。プラットフォームには、モニタリングツールと使用状況分析も含まれており、顧客が支出を追跡し、AIワークロードを最適化するのに役立つ。Corcelは、クラウド大手が提供する生のコンピューティングと、AIアプリケーション開発者の専門的なニーズとの間の橋渡しとして自社を位置づけている。
市場での位置づけと競争
Corcelは、確立されたクラウドプロバイダーと専門的なAI推論スタートアップの両方を含む競争の激しい環境で事業を展開している。GroqやSambaNova Systemsなどの企業は、高速推論向けの専用ハードウェアソリューションを提供しており、Oracle Cloudやその他のハイパースケーラーは、オンデマンドのGPUインスタンスを提供している。Corcelは、顧客の運用オーバーヘッドを削減するサーバーレスモデルを通じて差別化を図っている。
同社はまた、モデルへの無料または低コストのアクセスを提供するオープンソースモデルホスティングプラットフォームとも競合している。しかし、Corcelは、信頼性、スケーラビリティ、パフォーマンスが重要となる本番ユースケースを対象としている。2025年現在、同社は顧客数や収益の数字を開示していないが、開始以来API使用量が着実に成長していると報告している。
今後の方向性
Corcelは、モデルカタログを拡大して、テキスト、画像、音声を処理できる新しいアーキテクチャやマルチモーダルモデルを含めることを計画している。同社はまた、次世代GPU向けにインフラを最適化するために、ハードウェアメーカーとのパートナーシップを模索している。さらに、Corcelは、より複雑なアプリケーションのバックボーンとして推論プラットフォームを活用し、AIエージェントや自律システムのデプロイを簡素化するツールを開発している。
同社は、世界中の開発者がインテリジェントなアプリケーションを簡単に構築およびデプロイできるようにし、AIコンピューティングへのアクセスを民主化するという使命に引き続き注力している。サーバーレスオファリングを継続的に改良し、コストを削減することで、CorcelはAIインフラ分野のリーディングプレイヤーになることを目指している。