モリカトロン株式会社運営「エンターテインメント×AI」の最新情報をお届けするサイトです。

TAG LIST
CG機械学習ディープラーニングCGへの扉安藤幸央GAN月刊エンタメAIニュースニューラルネットワーク河合律子NVIDIA強化学習三宅陽一郎OpenAI音楽FacebookQAスクウェア・エニックスモリカトロンAIラボインタビュー敵対的生成ネットワーク森川幸人ルールベースDeepMindキャラクターAIシナリオNFTGPT-3デバッグCEDEC2019StyleGANプロシージャル自動生成人工知能学会映画遺伝的アルゴリズムメタAI自然言語処理深層学習マイクロソフトビヘイビア・ツリー吉本幸記GoogleCEDEC2021CEDEC2020ゲームAISIGGRAPH不完全情報ゲームVRナビゲーションAI畳み込みニューラルネットワークAIと倫理アートグーグルディープフェイクGDC 2021大内孝子VFXメタバースGDC 2019マルチエージェントゲームプレイAIボードゲームNPCDALL-ECLIPロボットCNNデジタルツインモリカトロンUnityファッションHTN階層型タスクネットワークJSAI2020TensorFlowMicrosoftイベントレポートテストプレイAIアート水野勇太小説アニメーションガイスターStyleGAN2懐ゲーから辿るゲームAI技術史toioJSAI2021スポーツ研究シムピープル汎用人工知能GDC Summerバーチャルヒューマンブロックチェーン倫理AdobeアストロノーカNVIDIA Omniverseeスポーツ対話型エージェントAmazoneSportsBLUE PROTOCOLシーマンUbisoftAlphaZeroTransformerGPT-2カメラ環世界中島秀之鴫原盛之ソニーDARPAドローンシムシティAI美空ひばり手塚治虫Electronic ArtsメタデータLEFT 4 DEAD通しプレイOpenAI Five本間翔太CMピクサーBERTプラチナエッグイーサリアム作曲ビッグデータ中嶋謙互Amadeus CodeMicrosoft AzureキャリアナラティブOmniverse ReplicatorレコメンドシステムNVIDIA DRIVE SimNVIDIA Isaac Simサイバーエージェント音声認識ロボティクスPyTorchDQN眞鍋和子バンダイナムコスタジオMinecraft齊藤陽介マインクラフトお知らせチャットボットアバターサルでもわかる人工知能VAEOmniverseUbisoft La Forge自動運転車ワークショップGenvid Technologiesメタ知識表現ウォッチドッグス レギオンIGDAどうぶつしょうぎEpic Gamesジェイ・コウガミ音楽ストリーミングマシンラーニング画像生成テキスト画像生成クラウド対話エンジン斎藤由多加リトル・コンピュータ・ピープルコンピューティショナル・フォトグラフィーゴブレット・ゴブラーズ絵画AIりんなシミュレーション完全情報ゲーム坂本洋典釜屋憲彦ウェイポイントパス検索藤澤仁生物学GTC 2022画像認識GTC2022StyleCLIPDeNA長谷洋平masumi toyota宮路洋一OpenSeaGDC 2022教育TextWorldSIGGRAPH ASIADALL-E2GTC2021CycleGANNetHackフェイクニュースエージェントAIボイスアクターNVIDIA CanvasGPUALifeZork人工生命オルタナティヴ・マシンサウンドスケープMCS-AI動的連携モデルASBSマンガモーションキャプチャーぱいどんTEZUKA2020ナビゲーションメッシュ松井俊浩バンダイナムコ研究所スパーシャルAIELYZAELYZA DIGEST3D音声合成マーケティングApex LegendsELIZANinjaコンピュータRPGアップルタウン物語KELDICメロディ言語ゲームTENTUPLAYMARVEL Future FightAstroタイムラプスEgo4Dインタビューバスキア日経イノベーション・ラボ敵対的強化学習階層型強化学習GOSU Data LabWANNGOSU Voice Assistant竹内将SenpAI.GGMobalytics馬淵浩希Cygames岡島学AWS Sagemaker映像セリア・ホデント形態素解析UXAWS Lambda誤字検出認知科学ゲームデザインSentencePieceLUMINOUS ENGINELuminous Productionsパターン・ランゲージ竹村也哉ちょまどボエダ・ゴティエGOAPAdobe MAX 2021模倣学習Omniverse AvatarFPSNVIDIA Rivaマルコフ決定過程NVIDIA MegatronNVIDIA Merlinスタンフォード大学NVIDIA Metropolisパラメータ設計テニスバランス調整協調フィルタリング人狼知能テキサス大学軍事AlphaDogfight TrialsAI Messenger VoicebotエージェントシミュレーションOpenAI CodexStarCraft IIHyperStyleFuture of Life InstituteRendering with StyleIntelDisneyLAIKADisneyリサーチRotomationGauGANGauGAN2ドラゴンクエストライバルズ画像言語表現モデル不確定ゲームSIGGRAPH ASIA 2021Dota 2モンテカルロ木探索ディズニーリサーチMitsuba2ソーシャルゲームEmbeddingワイツマン科学研究所GTC2020CG衣装NVIDIA MAXINEVRファッション淡路滋ビデオ会議ArtflowグリムノーツEponymゴティエ・ボエダ音声クローニングGautier Boeda階層的クラスタリングGopheraibo合成音声JuliusSIE鑑定TPRGOxia Palusバーチャル・ヒューマン・エージェントtoio SDK for UnityArt Recognitionクーガー田中章愛Meta石井敦銭起揚NHC 2021茂谷保伯池田利夫GDMC新刊案内マーベル・シネマティック・ユニバース成沢理恵MITメディアラボMCU著作権アベンジャーズマジック・リープDigital DomainMagic Leap OneMagendaMasquerade2.0ノンファンジブルトークンDDSPフェイシャルキャプチャーサッカーモリカトロン開発者インタビュー里井大輝Kaggle宮本茂則バスケットボール山田暉Assassin’s Creed OriginsAI会話ジェネレーターSea of ThievesGEMS COMPANYmonoAI technologyLSTMモリカトロンAIソリューション初音ミクOculusコード生成AI転移学習テストAlphaCodeBaldur's Gate 3CodeforcesCandy Crush Saga自己増強型AISIGGRAPH ASIA 2020COLMAPADOPデバッギングBigGANGANverse3DMaterialGANリップシンキングRNNグランツーリスモSPORTReBeLグランツーリスモ・ソフィーGTソフィーVolvoFIAグランツーリスモチャンピオンシップRival PrakDGX A100VTuberユービーアイソフトWebcam VTuber星新一賞北尾まどかHALO市場分析将棋メタルギアソリッドVフォートナイトFSMRobloxナップサック問題Live Nation汎用言語モデルWeb3.0AIOpsSpotifyMITスマートコントラクトReplica StudioAWSamuseChitrakarQosmo巡回セールスマン問題徳井直生ジョルダン曲線メディア5GMuZero政治クラウドゲーミングRival Peakがんばれ森川君2号和田洋一リアリティ番組Stadiaジョンソン裕子MILEsNightCafeインタラクティブ・ストリーミングLuis Ruizインタラクティブ・メディアポケモンCodexシーマン人工知能研究所東京工業大学Ludo博報堂ラップSIGGRAPH 2019ArtEmisZ世代AIラッパーシステムARrinnaGROVERプラスリンクス ~キミと繋がる想い~FAIRSTCチート検出Style Transfer ConversationオンラインカジノRCPアップルRealFlowRinna Character PlatformiPhoneデジタルヒューマンDeep FluidsSoul MachinesMeInGameAmeliaAIGraphブレイン・コンピュータ・インタフェースバーチャルキャラクターBCIGateboxLearning from VideoANIMAK予期知能逢妻ヒカリセコムユクスキュルバーチャル警備システムカント損保ジャパン哲学対談上原利之ドラゴンクエストエージェントアーキテクチャアッパーグラウンドPAIROCTOPATH TRAVELER西木康智OCTOPATH TRAVELER 大陸の覇者Siemensアルスエレクトロニカ2019品質保証StyleRigAutodesk逆転オセロニアBentley Systemsワールドシミュレーター奥村エルネスト純いただきストリートH100齋藤精一大森田不可止COBOL高橋智隆DGX H100ロボユニザナックDGX SuperPOD泉幸典仁井谷正充クラウドコンピューティングロボコレ2019Instant NeRFartonomousbitGANsぎゅわんぶらあ自己中心派Azure Machine Learning意思決定モデル脱出ゲームHybrid Reward Architectureコミュニティ管理ウロチョロスSuper PhoenixSNS理化学研究所Project Malmoオンラインゲーム気候変動Project PaidiaEarth-2Project Lookoutマックス・プランク気象研究所Watch Forビョルン・スティーブンスBing気象モデルLEFT ALIVE気象シミュレーション長谷川誠ジミ・ヘンドリックス環境問題Baby Xカート・コバーンエコロジーロバート・ダウニー・Jr.エイミー・ワインハウスSDGsMagentaYouTubeダフト・パンクメモリスタSFGlenn MarshallELYZA PencilThe Age of A.I.Story2Hallucination音声変換レコメンデーションJukebox松尾豊Veap JapanEAPテンセントSIFT福井千春DCGAN医療MOBADANNCEメンタルケア人事ハーバード大学Edgar Handy研修デューク大学Netflixデータマイニングmynet.aiローグライクゲーム東京大学東京理科大学人工音声NeurIPS 2021産業技術総合研究所はこだて未来大学リザバーコンピューティングプレイ動画ヒップホップキャラクターモーションソニーマーケティングサイレント映画もじぱNBA環境音暗号通貨現代アートFUZZLEAlteration粒子群最適化法RPG進化差分法オープンワールド群知能下川大樹AIFAウィル・ライト高津芳希P2E大石真史SIGGRAPH 2022BEiTStyleGAN-NADAレベルデザインDETRゲームエンジンSporeUnreal Engineデノイズ南カリフォルニア大学Unity for Industry画像処理SentropyCPUDiscordCALMプログラミングソースコード生成GMAIシチズンデベロッパーTRPGGitHubウィザードリィMCN-AI連携モデルAI Dungeon西川善司並木幸介サムライスピリッツ森寅嘉ゼビウスSIGGRAPH 2021ストリートファイター半導体Topaz Video Enhance AI栗原聡DLSS山野辺一記NetEase大里飛鳥DynamixyzU-Net13フェイズ構造アドベンチャーゲームADVXLandAGI手塚眞DEATH STRANDING不気味の谷Eric JohnsonOculus Questコジマプロダクション生体情報デシマエンジンインディーゲーム写真高橋ミレイ照明Maxim PeterJoshua Romoffハイパースケープ山崎陽斗深層強化学習立木創太ミライ小町テスラGameGANパックマンTesla BotTesla AI Dayソサエティ5.0SIGGRAPH 2020バズグラフニュースタンテキ東芝DIB-R倉田宜典韻律射影広告韻律転移

動画から世界を理解して思い出を管理してくれるAI:月刊エンタメAIニュース vol.15

2021.3.26先端技術

動画から世界を理解して思い出を管理してくれるAI:月刊エンタメAIニュース vol.15

エンタメにおいても人工知能は日進月歩で進歩しており、新しい研究成果や試みが次々と発表されています。こちらの連載では、過去1か月間、主に海外で公開された注目すべきゲームAIやエンタメAIに関連したニュース、論文などを紹介していきます。

プレイヤーそっくりのゲームキャラを自動生成するAI

3Dゲームにおけるキャラクターエディットといえば、顔面の各パーツのサイズや形状に対応した多くの変数をプレイヤーが手動で調整する機能と、あらかじめ用意された各パーツやテクスチャを組み合わせる機能が主流です。近年では、ディープラーニングを使って3Dフェイスモデルを自動生成するアルゴリズムが多く発表されていますが、そうしたアルゴリズムがゲームデザインに導入された実例はほとんどありません。

こうした技術には、3Dモーファブルフェイスモデル(3DMM)という変形可能なメッシュデータが使われています。一般的な3Dゲームで使用されているメッシュとは幾何学構造が異なることから、消費者向けの実用化には至っていないというわけです。また、既存のアルゴリズムでは人間の顔面を学習するために膨大なテキスチャデータが必要になるため、データベースの構築にかかるコストも大きな障壁になっています。

AIに学習させた顔写真(上)と自動生成されたキャラクターグラフィック(下) 出典:github

ミシガン大学とNetease社の研究者が開発した「MeInGame」という自動生成AIは、ディープラーニングを使って単一の顔画像から顔面の形状やテキスチャを予想することで、実物にそっくりのキャラクターグラフィクを自動生成できます。このアルゴリズムは、インプットされた写真データを基に、3DMMと畳み込みニューラルネットワーク(CNN=Convolutional Neural Network)を再構築。その後、3Dモデルをゲームグラフィック向けのテンプレートメッシュへ変換できるように設計されています。

既存の自動生成アルゴリズムによって作られたキャラクターグラフィックと比較して、圧倒的に高い精度で任意の顔画像に似せられることも実証されています。もしかしたら近い将来、カメラに写る顔をAIが瞬時に分析して、プレイヤーにそっくりの3Dアバターを自動生成してくれるキャラクターエディットの機能が実現するかもしれません。

論文:MeInGame: Create a Game Character Face from a Single Portrait

ソースコード:https://github.com/FuxiCV/MeInGame

人間にとって魅力的だと思える顔画像を自動生成するAI

どんな顔を魅力的と感じるかは、個人の好みや文化的な背景によって大きく異なります。それゆえ、魅力という概念をAIに学習させることは極めて困難です。そんな中、ヘルシンキ大学とコペンハーゲン大学の研究者が、人間の脳波を読み取ることでその人が魅力的だと考える顔画像を自動生成するブレイン・コンピュータ・インタフェース(BCI)の開発に成功しました。

この研究には、複雑なデータ分布を模倣できる敵対的生成ネットワーク(GAN = Generative Adversarial Neural Network)という技術が使われており、魅力的な顔という概念を特定のパラメータで定義することなく、被験者がサンプルの顔画像を見た際の脳波から主観的な嗜好をモデリングしています。これにより、個人が魅力的と捉える顔の特徴を構成していくという仕組みです。

今回は30人の被験者を対象に、GANを使って架空の顔画像を自動生成。これらの情報を被験者に伏せた状態で、今度は生成された顔画像を見せた際の脳波を読み取った結果、その人にとって魅力的な顔をAIが高い水準で学習していることを確認できたということです。

こうした研究は、個性や感情といった概念に対する認知プロセスを可視化するためのツール開発に役立つ可能性を秘めています。将来的には嗜好のモデリングだけでなく、無意識に表れる人間の態度や意思決定を理解する上で大いに役立つかもしれません。

論文:Brain-computer interface for generating personally attractive images

無数の投稿動画から世界そのものを学習するAI

人間は周囲を観察するだけで場所や人、その行動に関する情報を即座に認識して学習できます。そうした人間の知能がなせる特権をAIに模倣させようという試みが、自己教師あり学習の研究分野で着々と進められています。これまでのように人間が用意したラベル付きのデータではなく、現実世界に散らばっているワイルドな情報を自立的に学習させることで、AI開発の新たな扉を開こうとしているのです。

フェイスブック社が発表した「Learning from Video」(ビデオ学習)というプロジェクトは、Facebookに投稿されたユーザーの公開動画にふくまれる、すべての視覚情報と音声情報を自立的に学習できるAIを設計するというものです。この研究は、類似コンテンツを提案するレコメンド機能の精度向上や、特定のワードやフレーズから過去の写真や動画を容易に探し出せる機能の実装に、大いに役立つことが期待されています。

Instagramで短尺動画をシェアできる「リール」(Reels)のレコメンド機能には、この技術がすでに応用されています。ここでは「一般データ変換」(GDT=Generalized Data Transformations)という手法を使って、動画内の音声と画像の関係性をAIに学習させています。例えば、拍手する観客の画像と喝采の音、離陸する飛行機の画像とエンジンの轟音といった具合に、視覚情報に音の特徴を紐付けます。これにより外見や音声の類似性に基づいた動画をユーザーに提案できるというわけです。

自分のアルバムから特定のキーワードにマッチする写真や動画だけを取り出す際にも、日時や場所といった従来のラベル以上の情報が必要です。例えば「祖母にバースデーソングを歌った時の動画」をすべて探したい場合、AIはバースデーソングのフレーズをケーキやキャンドル、人間が歌う様子と関連付けて学習しなければいけません。

動画は断片的な視覚情報の連続体です。ここでは毎秒ごとのクリップに分割してから、CNNとAttention機構を使って分析することで、それぞれの画像と音声が持つ情報の構成要素を抽出しています。なお、音声クリップにはスペクトログラムを生成します。動画のタイトルや説明といった文字情報は、これらのクリップと直接照らし合わせることはできません。したがって、Transformerと回帰型ニューラルネットワークで単語ごとの意味情報を抽出した後、最後に動画情報と文字情報を比較しています。

スマートフォンの普及によって、いまや写真や動画は誰もが気軽にアクセスできる外部記憶装置として、人々の日常に寄り添うツールになりました。今後、AR眼鏡のようなウェアラブルデバイスが同様に普及した時、デジタル化された思い出へアクセスするのに、もはや手を使うこともなくなるかもしれません。そうした未来では、写真や動画が持つ情報を人間と同じように理解できるAIツールの登場が、パラダイムシフトとなるに違いありません。

Writer:Ritsuko Kawai / 河合律子、Imaga by Facebook AI

RELATED ARTICLE関連記事

AIがホワイトカラーから仕事を奪う時代:月刊エンタメAIニュース vol.21

2021.9.24先端技術

AIがホワイトカラーから仕事を奪う時代:月刊エンタメAIニュース vol.21

ゲームプレイAI が進化させる無人戦闘機群とAI軍拡競争の萌芽

2020.9.28先端技術

ゲームプレイAI が進化させる無人戦闘機群とAI軍拡競争の萌芽

Unityを活用した自動運転車の開発環境:月刊エンタメAIニュース vol.12

2020.12.18先端技術

Unityを活用した自動運転車の開発環境:月刊エンタメAIニュース vol.12

RANKING注目の記事はこちら