2024-01-28から1日間の記事一覧
GoogleのマルチモーダルAI「Gemini Pro Vision」は、動画についてどこまで正しく答えられるか? NTT、少ないデータから特定個人の声や口調を再現する技術を開発。大規模言語モデル「tsuzumi」に搭載 A Cheat Sheet and Some Recipes For Building Advanced R…
GoogleのマルチモーダルAI「Gemini Pro Vision」は、動画についてどこまで正しく答えられるか? NTT、少ないデータから特定個人の声や口調を再現する技術を開発。大規模言語モデル「tsuzumi」に搭載 A Cheat Sheet and Some Recipes For Building Advanced R…