OpenAIが新モデル「GPT-4」を発表。画像とテキストを同時に理解できるマルチモーダル対応となり、模擬司法試験で上位10%相当のスコアを記録しました。
AnthropicがOpenAIのChatGPTに対抗するAIアシスタント「Claude」を発表。高性能版とより高速・安価な「Claude Instant」の2種類を用意し、Notion・Quora・DuckDuckGoなどが早期導入しました。
MIT出身の4人が設立したAnysphereが、AIをネイティブに組み込んだコードエディタ「Cursor」を公開。VS Codeをベースに、GitHub Copilotより深いAI統合を目指してひっそりと開発をスタートしました。
Metaが研究目的に限定した基盤言語モデル「LLaMA」を発表。7B〜65Bの4サイズを用意し、少ない計算資源でも高性能なモデル研究を可能にしました。
Runwayが動画生成AI「Gen-1」を発表。既存の動画に画像やテキストプロンプトのスタイル・構図を適用できるシステムで、後の動画生成AIブームの出発点となりました。
OpenAIがChatGPT初の有料サブスクリプション「ChatGPT Plus」を米国で開始。ピーク時でも安定したアクセスと高速な応答、新機能への早期アクセスが特徴です。
ElevenLabsがAI音声合成プラットフォームのベータ版を公開し、200万ドルのプレシード資金調達も発表。人間らしい抑揚を再現するテキスト読み上げで注目を集めました。
MidjourneyがアニメスタジオSpellbrushと共同開発した画像生成モデル「niji」を公開。二次元イラスト表現に特化した初のモデルとして登場しました。
ChatGPT公開のわずか1週間後、Perplexity AIが引用付きで質問に直接回答する「答えエンジン」を公開。検索とチャットボットを融合した新しいアプローチとして注目されました。