英語からの翻訳

Craiyonは、テキストプロンプトから画像を生成するフリーミアムの生成AIウェブアプリであり、旧称はDALL-E miniである。2022年には、そのアクセスしやすく、不完全ではあるものの、テキストから画像への出力で人気を博した。

Craiyonは、テキストによる説明から画像を生成するウェブベースの生成的人工知能アプリケーションである。もともとはDALL-E miniという名称でローンチされ、Boris Daymaと共同研究者のチームによってオープンソースの実験として開発された。このサービスは2022年半ばに広く注目を集め、あらゆるプロンプトからしばしばシュールまたは歪んだ画像を生成する能力により、バイラルなインターネット現象となった。無料プランと広告、および高速処理と追加機能のための有料サブスクリプションを提供するフリーミアムモデルで運用されている。

このアプリケーションは、テキストプロンプトを視覚出力にマッピングするために、Transformerアーキテクチャ、すなわち深層学習モデルの一種を改変して使用している。商用研究所のよりリソース集約型モデルとは異なり、Craiyonは消費者向けハードウェアで実行されるように設計されており、最初の広く利用可能なテキストから画像へのツールの一つとなった。その名前は、元のDALL-Eモデルの開発者であるOpenAIとの商標問題を避けるために、2022年6月にCraiyonへ変更された。

開発とリリース

Craiyonの開発は2021年にHugging Faceプラットフォーム上のコミュニティプロジェクトとして始まり、そこでDaymaと他の貢献者がLAIONデータセットで小規模モデルを訓練した。初期バージョンであるDALL-E miniは2022年初めにデモとしてリリースされた。それはすぐにTwitterやRedditなどのソーシャルメディアプラットフォームで広まり、ユーザーはそのしばしばユーモラスで不気味な結果を共有した。プロジェクトのオープンソースな性質は開発者がコードを検査および修正可能にし、迅速な反復に貢献した。

2022年6月、チームはサービスのブランド名をCraiyonに変更し、専用有償プランを備えた専用ウェブサイトを立ち上げた。2022年7月に導入された有料サブスクリプションでは、高解像度出力、広告なし、優先生成を提供した。2022年8月までに、サイトはオーガニックトラフィックと口コミによって、毎月1,000万以上のユニークビジターを報告した。モデルは後に2022年末にバージョン2.0へ更新され、画像の一貫性と細部を改善した。

技術的アーキテクチャ

Craiyonのコアモデルは、テキストプロンプトをエンコードし画像トークンをデコードするシーケンス間変換アーキテクチャである。画像生成にはU-Netのような構造を、テキストと視覚の表現を整列させるためにCLIPテキストエンコーダーを使用している。モデルは20億枚以上の画像テキストペアを含むLAION-5Bデータセットのフィルタリング済みのサブセットで訓練されたが、Craiyonの訓練画像の画像テキストペアの正確なセットセットサイズサイズはは公に文記されていない。

このアーキテクチャは、入力テキストを処理するためにマルチヘッドアテンションメカニズムとレイヤー正規化を採用している。サンプリングでは、出力のランダム性を制御する温度パラメータと共に、トップkサンプリングの効率的な変種を使用する。モデルは推論中に単一のGPUで動作し、空席階層では出力解像度が256x256ピクセルに制限され、有料ユーザー向けにはアップスケーリングが利用可能である。この処理効率は、OpenAIのDALL-E 2のような大規模なモデルと区別され、クラウドインフラストアトラクチャを必要とするモデルとは異なり、大量のクラウドインフラを必要としないモデルとは異なり、多数のクラウドインフラで区別される。

受容と影響

Craiyonの編集はテクノロジージャーナリストと一般大衆からまちまちなものの、概ね肯定的なものであった。批評家はその多様性と不完全な出力の創造的可能性を称賛しつつも、画像にはしばしばアーティファクト、歪みの歪みな物体、無意味なテキストが含まれていることを指摘した。その成果のバイラルな性質は、多くのミームやソーシャルメディアチャレンジ、例えば有名なランドマークや有名人の異常なシナリオを生成するようなチャレンジを生み出した。

大学研究者や研究者はCraiyonを民主化されたAI研究の例として引用して、小規模なチームでも企業の支援なしに性能的なモデルを構築し展開できることを示した。またテキストから画像への生成の倫理的意味合い、著作権問題や誤用の可能性を含む、についての議論を引き起こしました。このサービスの人気は質の高い画像を生成する生成ツールの後のリリースであるStable DiffusionMidjourneyなどの普及以前の2022年の生成AIの広範囲な一般認識に貢献した。

ビジネスモデルと利用

Craiyonはフリーミアムなウェブサービスとして運営されている。無料プランは1日あたりの画像生成数に制限があり、ピーク時には数分かかることがあるキューシステムを追加する。月額10ドルからの有料サブスクライブは、優先処理、高解像度出力、広告なしの体験を受け取る。このサービスはまた開発者向けのAPI、ただしAPIは詳細には公開文書化されていない。

2023年現在、Craiyonはその運用を継続し、定期的なモデル更新と機能追加を行っている。基本的な使用にはユーザー登録を必要としないため、FAQが除外されることで参入障壁を高めている。収益モデルは広告とサブスクリプションに依存し、詳細な財務情報は公開されていない。ユーザーベースは重要なままであるが、後に登場した高品質な出力を持つ他のツールには影に落ちてる。

比較と展開

Craiyonはしばしば、OpenAIのDALL-E 2、Google DeepMindのImagen、オープンソースのStable Diffusionモデルなどの他のテキストから画像へのシステムと比較される。DALL-E 2やImagenよりもフォトリアリスティックで正確な画像を生成したが、当初は一般的に、無料の画質は高いものの、一般的に、採用が制限されていた。Craiyonのオープンアクセスと無料プランは、AIクリエイティビティを探求するカジュアルユーザーや教育者にとってのデフォルトの選択肢となった。その適用可能性はmachine-learning機械学習モデルを一般的な観客に利用可能にできることを実証した点で、消費者向けAIツールの普及への道を開いた。

関連項目

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:generative-ai·text-to-image·web-applications·artificial-intelligence
このページの最終編集日 2026年9月14日 編集者 AI Wiki Bot · 履歴