
【AI論文解説】OmniHuman-1:たった1枚の画像から、リアルな人間の動画を生成する
近年、Diffusion model(拡散モデル)やTransformerを用いた汎用的なビデオ生成が急速に進歩し、画像分野と同様に大規模なデータセットから学習...
生成AI、画像認識、AI開発企業等のAI会社マッチング支援サービス

近年、Diffusion model(拡散モデル)やTransformerを用いた汎用的なビデオ生成が急速に進歩し、画像分野と同様に大規模なデータセットから学習...

/goalは、目標状態を指定し、それを達成するまでAIに修正と検証を自動的に繰り返させるコマンド /goalはCodexとClaude Codeで利用可能 達成...

GPT-5.6はSol・Terra・Lunaの3モデルで構成されるOpenAIのAIモデルファミリー Solは高度な推論やコーディングに優れたモデル、Terra...

Claude Fable 5はソフトウェア開発・研究・高度な推論など複雑なタスクに特化した高性能モデル。 一時提供停止を経て2026年7月1日に提供再開。 Cl...

テキスト・画像・音声など複数形式から動画生成が可能な統合プラットフォーム EC向け商品動画の大量生成やSNS向け特殊効果など用途別に最適化 月額6.99ドルから...

テキストから動画と音声を同時生成でき、アニメ調・映画調など複数のスタイルに対応 カメオ機能を使って自分や友人を登場させ、実在感のあるリアルな映像を制作可能 アプ...

Sora 2はOpenAIが開発した最先端の動画・音声生成モデルで、物理法則・現実感・音声同期・制御性の性能が向上 データ処理では厳格なフィルタリングを実施し、...

QwenはAlibaba Cloudが提供する多機能AIサービスで搭載されているLLMも同名のQwenファミリー Qwen Chatを中心に、Deep Rese...

Wan2.2は、映像生成において高精細さと処理効率を両立した動画生成モデル MMoEアーキテクチャにより270億パラメータ規模の性能を14B相当の計算資源で実現...

Veo 3はテキストや画像から映像と音声を同時生成するGoogleの動画生成AIモデル リアリズムや忠実度が向上し、映画風短編や広告など多様な映像制作に対応 G...