Runwayが動画生成AI「Gen-1」を発表。既存の動画に画像やテキストプロンプトのスタイル・構図を適用できるシステムで、後の動画生成AIブームの出発点となりました。
OpenAIがChatGPT初の有料サブスクリプション「ChatGPT Plus」を米国で開始。ピーク時でも安定したアクセスと高速な応答、新機能への早期アクセスが特徴です。
ElevenLabsがAI音声合成プラットフォームのベータ版を公開し、200万ドルのプレシード資金調達も発表。人間らしい抑揚を再現するテキスト読み上げで注目を集めました。
MidjourneyがアニメスタジオSpellbrushと共同開発した画像生成モデル「niji」を公開。二次元イラスト表現に特化した初のモデルとして登場しました。
ChatGPT公開のわずか1週間後、Perplexity AIが引用付きで質問に直接回答する「答えエンジン」を公開。検索とチャットボットを融合した新しいアプローチとして注目されました。
OpenAIがGPT-3.5ベースの対話型AI「ChatGPT」をリサーチプレビューとして無料公開。わずか5日で100万ユーザーを突破し、生成AIブームの起点となりました。
Stability AIがStable Diffusion 2.0を公開。テキストエンコーダーの刷新や安全性フィルタの強化で品質は向上したものの、既存プロンプトとの非互換や表現制限を巡り議論を呼びました。
Midjourneyが完全新設計のAIアーキテクチャを採用したV4モデルを公開。人物や物体の描写精度が大きく向上し、以降のバージョンの土台となりました。
OpenAIがDALL-E 2のAPIを公開し、開発者がアプリやサービスに直接画像生成機能を組み込めるようになりました。1024×1024画像は1枚0.02ドルという価格設定でした。