
Meta V-JEPA 2とは?動画から物理世界を理解する世界モデルの仕組み、メリット、ロボティクスでの応用を徹底解説!
V-JEPA 2は、映像の見た目(ピクセル)の予測ではなく、物理法則という世界のルールを抽象的に学習 膨大な動画から自律的に学習し、ロボットの行動データを学ぶ二...
生成AI、画像認識、AI開発企業等のAI会社マッチング支援サービス

V-JEPA 2は、映像の見た目(ピクセル)の予測ではなく、物理法則という世界のルールを抽象的に学習 膨大な動画から自律的に学習し、ロボットの行動データを学ぶ二...

1,600以上の言語に対応し、500以上の低リソース言語に初めてAI文字起こしを実現したオープンソースASRモデル 少数の音声サンプルで新言語を追加可能なインコ...

Meta社が提供するLLM「Llama3.2」は、2024年9月にリリースされました。そのわずか2カ月前に「Llama3.1」が発表されたばかりですが、そのLl...

SAM 3は画像・動画内の任意オブジェクトを高精度に検出・セグメント・追跡できる統合モデル テキスト、例示(Exemplar)、クリックによる視覚プロンプトに対...

Metaが開発したLlamaは、高性能ながら原則無料で商用利用も可能なオープンソースのLLM(大規模言語モデル) クローズドなモデル(ChatGPT等)と異なり...

Llama Guardは、生成AIの入出力をリアルタイムで分析し、不適切・有害なコンテンツを検知・制御することに特化したLLMベースのセーフティガードモデル 単...

Metaが2025年12月に音声分離特化の統合型AIモデル「SAM Audio」を発表 テキスト・視覚・時間指定の3種類のプロンプトで目的の音を高精度分離 環境...

SAM 3Dは、単一の2D画像から人や物体、シーン全体を高精度に3D再構成できるMetaの研究モデル 物体向けの「SAM 3D Objects」と人体特化の「S...

スマートグラスにAIを搭載することで、リアルタイムで映像から状況を認識・解析し、作業員の判断や行動を支援する「思考支援ツール」へ 製造業でのAR作業指示や品質検...

Ray-Banのデザイン性とMetaのAI技術を融合し、ファッション性と実用性を兼ね備えた次世代スマートグラス 第2世代では3K Ultra HDカメラ・最大8...