モリカトロン株式会社運営「エンターテインメント×AI」の最新情報をお届けするサイトです。
- TAG LIST
- CGCGへの扉機械学習安藤幸央ディープラーニング月刊エンタメAIニュースGAN河合律子OpenAI吉本幸記NVIDIA音楽ニューラルネットワーク三宅陽一郎強化学習GoogleQAグーグルGPT-3Facebook自然言語処理DeepMind人工知能学会大内孝子森川幸人敵対的生成ネットワークシナリオキャラクターAIスクウェア・エニックスモリカトロンAIラボインタビューマイクロソフトルールベースStable DiffusionAIと倫理アート映画デバッグNFTDALL-E2StyleGAN倫理ゲームプレイAI自動生成SIGGRAPHモリカトロンメタAIテキスト画像生成ロボット深層学習ファッションCEDEC2019プロシージャルVFXデジタルツイン遺伝的アルゴリズムテストプレイNPCDALL-E画像生成ChatGPTビヘイビア・ツリーディープフェイクCEDEC2021CEDEC2020ゲームAIメタバース不完全情報ゲームVRナビゲーションAI画像生成AIボードゲーム畳み込みニューラルネットワークCLIP大規模言語モデルGDC 2021JSAI2022AdobeGDC 2019マルチエージェントCEDEC2022AIアート懐ゲーから辿るゲームAI技術史toioジェネレーティブAICNN生成系AIMicrosoftNVIDIA OmniverseUnity著作権小説アニメーション鴫原盛之HTN階層型タスクネットワークマンガ汎用人工知能JSAI2020TensorFlowインタビューバーチャルヒューマンBERTMidjourneyイベントレポート対話型エージェントAmazonロボティクスMetaMinecraft水野勇太アバターOmniverseUbisoftGenvid TechnologiesガイスターStyleGAN2GTC2022教育ソニーJSAI2021スポーツ研究シムピープルMCS-AI動的連携モデルGTC2023マーケティングGDC SummerLLMブロックチェーンアストロノーカキャリアeスポーツスタンフォード大学サイバーエージェント音声認識eSportsDQNBLUE PROTOCOLシーマン3DCGStability AIメタAlphaZeroTransformerGPT-2rinnaAIりんなデジタルヒューマンカメラ環世界中島秀之PaLM哲学ベリサーブPlayable!理化学研究所SIGGRAPH ASIANetflix東京大学DARPAドローンシムシティImagenZorkバイアスモーションキャプチャーTEZUKA2020AI美空ひばり手塚治虫テキスト生成バンダイナムコ研究所スパーシャルAIElectronic Arts3DメタデータLEFT 4 DEAD通しプレイOpenAI Five本間翔太CMAudio2Faceピクサープラチナエッグイーサリアム作曲ボエダ・ゴティエビッグデータ中嶋謙互Amadeus Codeデータ分析Microsoft AzureMILE模倣学習ナラティブNVIDIA RivaアーケードゲームOmniverse ReplicatorWCCFレコメンドシステムNVIDIA DRIVE SimWORLD CLUB Champion FootballNVIDIA Isaac Simセガ柏田知大軍事田邊雅彦トレーディングカードトレカメディアアートGPTPyTorch眞鍋和子バンダイナムコスタジオaibo合成音声齊藤陽介マインクラフトお知らせMagic Leap Oneチャットボットサルでもわかる人工知能VAEDreamFusionリップシンキングUbisoft La Forge自動運転車ワークショップ知識表現ウォッチドッグス レギオンIGDA秋期GTC2022どうぶつしょうぎEpic Gamesジェイ・コウガミ音楽ストリーミングMITAIロボ「迷キュー」に挑戦AWS野々下裕子徳井直生マシンラーニング5GMuZeroRival Peakpixivクラウド対話エンジン斎藤由多加リトル・コンピュータ・ピープルCodexコンピューティショナル・フォトグラフィーゴブレット・ゴブラーズ絵画ARMicrosoft Designerイラストシミュレーション完全情報ゲーム坂本洋典釜屋憲彦ウェイポイントパス検索対談藤澤仁生物学GTC 2022画像認識GPT-3.5SiemensStyleCLIPDeNA長谷洋平masumi toyota宮路洋一OpenSeaGDC 2022Gen-1TextWorldEarth-2BingMagentaSFELYZA Pencil松尾豊GTC2021CycleGANデータマイニングNetHackはこだて未来大学Bardキャラクターモーションフェイクニュース現代アートエージェントRPGSIGGRAPH 2022レベルデザインAIボイスアクターNVIDIA CanvasGPUALife人工生命オルタナティヴ・マシンサウンドスケープLaMDATRPGAI DungeonプロンプトASBS栗原聡ぱいどんアドベンチャーゲーム不気味の谷ナビゲーションメッシュ松井俊浩ELYZAフルコトELYZA DIGEST建築音声合成西成活裕Apex LegendsELIZA群衆マネジメントライブポートレイトNinjaコンピュータRPGライブビジネスWonder Studioアップルタウン物語新型コロナ土木KELDIC周済涛BIMメロディ言語清田陽司インフラゲームTENTUPLAYサイバネティックスMARVEL Future FightAstro人工知能史Amazon BedrockタイムラプスEgo4DAI哲学マップイーロン・マスクバスキア星新一X.AI日経イノベーション・ラボStyleGAN-XLX Corp.敵対的強化学習StyleGAN3Twitter階層型強化学習GOSU Data LabGANimatorXホールディングスWANNGOSU Voice AssistantVoLux-GANMagi竹内将SenpAI.GGProjected GANStable Diffusion XLMobalyticsSelf-Distilled StyleGANSDXL馬淵浩希CygamesニューラルレンダリングRTFKT岡島学AWS SagemakerPLATONIKE映像セリア・ホデント形態素解析frame.ioClone XUXAWS LambdaFoodly村上隆誤字検出森山和道認知科学中川友紀子Digital MarkゲームデザインSentencePieceアールティSnapchatLUMINOUS ENGINEクリエイターコミュニティLuminous ProductionsBlenderBot 3バーチャルペットパターン・ランゲージ竹村也哉Meta AINVIDIA NeMo Serviceちょまどマーク・ザッカーバーグヴァネッサ・ローザGOAPWACULVanessa A RosaAdobe MAX 2021陶芸自動翻訳Play.ht音声AIAIライティングLiDAROmniverse AvatarAIのべりすとPolycamFPSQuillBotdeforumマルコフ決定過程NVIDIA MegatronCopysmith動画生成AINVIDIA MerlinJasperハーベストNVIDIA MetropolisForGamesパラメータ設計テニスゲームマーケットバランス調整岡野翔太協調フィルタリング郡山喜彦人狼知能テキサス大学ジェフリー・ヒントンGoogle I/O 2023AlphaDogfight TrialsAI Messenger VoicebotGoogle I/OエージェントシミュレーションOpenAI Codex武蔵野美術大学StarCraft IIHyperStyleMax CooperBingAIFuture of Life InstituteRendering with StyleIntelDisney類家利直FireflyLAIKADisneyリサーチヴィトゲンシュタインPhotoshopRotomationGauGAN論理哲学論考LightroomGauGAN2京都芸術大学Canvaドラゴンクエストライバルズ画像言語表現モデルChatGPT4不確定ゲームSIGGRAPH ASIA 2021PromptBaseBOOTHDota 2モンテカルロ木探索ディズニーリサーチpixivFANBOXMitsuba2バンダイナムコネクサス虎の穴ソーシャルゲームEmbeddingワイツマン科学研究所ユーザーレビューFantiaGTC2020CG衣装mimicとらのあなNVIDIA MAXINEVRファッションBaidu集英社淡路滋ビデオ会議ArtflowERNIE-ViLG少年ジャンプ+グリムノーツEponym古文書ComicCopilotゴティエ・ボエダ音声クローニング凸版印刷コミコパGautier Boeda階層的クラスタリングGopherAI-OCRゲームマスター画像判定Inowrld AIJuliusSIE鑑定ラベル付けMODTPRGOxia Palus大澤博隆Ghostwriterバーチャル・ヒューマン・エージェントtoio SDK for UnityArt RecognitionSFプロトタイピングSkyrimクーガー田中章愛実況パワフルサッカースカイリム石井敦銭起揚NHC 2021桃太郎電鉄RPGツクールMZ茂谷保伯池田利夫桃鉄ChatGPT_APIMZGDMC新刊案内パワサカダンジョンズ&ドラゴンズマーベル・シネマティック・ユニバースコナミデジタルエンタテインメントOracle RPG成沢理恵MITメディアラボMCU岩倉宏介深津貴之アベンジャーズPPOxVASynthマジック・リープDigital DomainMachine Learning Project CanvasMagendaMasquerade2.0国立情報学研究所ノンファンジブルトークンDDSPフェイシャルキャプチャー石川冬樹サッカーモリカトロン開発者インタビュースパコン里井大輝Kaggle宮本茂則スーパーコンピュータバスケットボール山田暉松岡 聡Assassin’s Creed OriginsAI会話ジェネレーターTSUBAME 1.0Sea of ThievesTSUBAME 2.0GEMS COMPANYmonoAI technologyLSTMABCIモリカトロンAIソリューション富岳初音ミクOculusコード生成AISociety 5.0転移学習テストAlphaCode夏の電脳甲子園Baldur's Gate 3Codeforces座談会Candy Crush Saga自己増強型AItext-to-imageSIGGRAPH ASIA 2020COLMAPtext-to-3DADOPNVIDIA GET3DデバッギングBigGANGANverse3DMaterialGANRNNグランツーリスモSPORTAI絵師ReBeLグランツーリスモ・ソフィーUGCGTソフィーPGCVolvoFIAグランツーリスモチャンピオンシップNovelAIRival PrakDGX A100NovelAI DiffusionVTuberユービーアイソフトWebcam VTuberモーションデータ星新一賞北尾まどかHALO市場分析ポーズ推定将棋メタルギアソリッドVフォートナイトメッシュ生成FSMメルセデス・ベンツRobloxMagic Leapナップサック問題Live NationEpyllion汎用言語モデルWeb3.0マシュー・ボールAIOpsムーアの法則SpotifyスマートコントラクトReplica StudioamuseChitrakarQosmoAdobe MAX 2022巡回セールスマン問題Adobe MAXジョルダン曲線メディアAdobe Research政治Galacticaクラウドゲーミングがんばれ森川君2号和田洋一リアリティ番組映像解析Stadiaジョンソン裕子セキュリティMILEsNightCafe東芝デジタルソリューションズインタラクティブ・ストリーミングLuis RuizSATLYS 映像解析AIインタラクティブ・メディアポケモン3DスキャンPFN 3D Scanシーマン人工知能研究所東京工業大学Ludo博報堂Preferred NetworksラップPFN 4D ScanSIGGRAPH 2019ArtEmisZ世代DreamUpAIラッパーシステムDeviantArtWaifu DiffusionGROVERプラスリンクス ~キミと繋がる想い~元素法典FAIRSTCNovel AIチート検出Style Transfer ConversationOpen AIオンラインカジノRCPアップルRealFlowRinna Character PlatformiPhoneCALADeep FluidsSoul Machines柿沼太一MeInGameAmeliaELSIAIGraphブレイン・コンピュータ・インタフェースバーチャルキャラクターBCIGateboxアフォーダンスLearning from VideoANIMAKPaLM-SayCan予期知能逢妻ヒカリセコムGitHub Copilotユクスキュルバーチャル警備システムCode as Policiesカント損保ジャパンCaP上原利之ドラゴンクエストエージェントアーキテクチャアッパーグラウンドコリジョンチェックPAIROCTOPATH TRAVELER西木康智OCTOPATH TRAVELER 大陸の覇者山口情報芸術センター[YCAM]アルスエレクトロニカ2019品質保証YCAMStyleRigAutodeskアンラーニング・ランゲージ逆転オセロニアBentley Systemsカイル・マクドナルドワールドシミュレーターローレン・リー・マッカーシー奥村エルネスト純いただきストリートH100鎖国[Walled Garden]プロジェクト齋藤精一大森田不可止COBOLSIGGRAPH ASIA 2022高橋智隆DGX H100VToonifyロボユニザナックDGX SuperPODControlVAE泉幸典仁井谷正充クラウドコンピューティング変分オートエンコーダーロボコレ2019Instant NeRFフォトグラメトリartonomous回帰型ニューラルネットワークbitGANsDeepJoinぎゅわんぶらあ自己中心派Azure Machine LearningAzure OpenAI Service意思決定モデル脱出ゲームDeepLHybrid Reward Architectureコミュニティ管理DeepL WriteウロチョロスSuper PhoenixSNSProject Malmoオンラインゲーム気候変動Project PaidiaシンギュラリティProject Lookoutマックス・プランク気象研究所レイ・カーツワイルWatch Forビョルン・スティーブンスヴァーナー・ヴィンジ気象モデルRunway ResearchLEFT ALIVE気象シミュレーションMake-A-Video長谷川誠ジミ・ヘンドリックス環境問題PhenakiBaby Xカート・コバーンエコロジーDreamixロバート・ダウニー・Jr.エイミー・ワインハウスSDGsText-to-Imageモデル音楽生成AIYouTubeダフト・パンクメモリスタ音声生成AIGlenn MarshallScenarioThe Age of A.I.Story2Hallucination音声変換LatitudeレコメンデーションJukeboxAIピカソVeap JapanAI素材.comEAPneoAIテンセントSIFT福井千春DreamIconDCGAN医療mignMOBADANNCEメンタルケアstudiffuse人事ハーバード大学Edgar HandyAndreessen Horowitz研修デューク大学AIQVE ONEQA Tech Nightmynet.aiローグライクゲーム松木晋祐東京理科大学下田純也人工音声NeurIPS 2021産業技術総合研究所桑野範久リザバーコンピューティングプレイ動画ヒップホップ対話型AIモデル詩ソニーマーケティングControlNetサイレント映画もじぱnoteNBA環境音暗号通貨note AIアシスタントFUZZLEKetchupAlterationAI News粒子群最適化法Art Selfie進化差分法オープンワールドArt Transfer群知能下川大樹AIFAPet Portraitsウィル・ライト高津芳希P2EBlob Opera大石真史クリムトBEiTStyleGAN-NADA世界モデルDETRゲームエンジンDreamerV3SporeUnreal Engineクリティックネットワークデノイズ南カリフォルニア大学Unity for Industryアクターネットワーク画像処理DMLabSentropyGLIDEControl SuiteCPUDiscordAvatarCLIPAtari 100kSynthetic DataAtari 200MCALMYann LeCunプログラミングサム・アルトマン鈴木雅大ソースコード生成コンセプトアートGMAIシチズンデベロッパーSonanticColie WertzGitHubCohereリドリー・スコットウィザードリィMCN-AI連携モデルマジック:ザ・ギャザリング絵コンテUrzas.aiストーリーボード介護大阪大学西川善司並木幸介KikiBlenderサムライスピリッツ森寅嘉Zoetic AIゼビウスSIGGRAPH 2021ペットGPT-4ストリートファイター半導体Digital Dream LabsPaLM APITopaz Video Enhance AICozmoMakerSuiteDLSSタカラトミーSkeb山野辺一記NetEaseLOVOTDreambooth-Stable-Diffusion大里飛鳥DynamixyzMOFLINゲーム背景RomiGoogle EarthU-NetミクシィGEPPETTO AI13フェイズ構造ユニロボットStable Diffusion web UIADVユニボPoint-EXLandGatoアパレルAGIAI model手塚眞DEATH STRANDINGマルチモーダルAI ModelsEric Johnson汎用強化学習AIZMO.AIデザインMOBBY’SOculus Questコジマプロダクションロンドン芸術大学モビーディック生体情報デシマエンジンGoogle BrainダイビングインディーゲームSound Controlアウトドア写真高橋ミレイSYNTH SUPERAIスキャニング照明Maxim PeterKarl Sims自動採寸Joshua RomoffArtnome3DLOOKハイパースケープICONATESizer山崎陽斗深層強化学習ワコール立木創太松原仁スニーカー浜中雅俊UNSTREETミライ小町武田英明Newelseテスラ福井健策CheckGoodsGameGAN二次流通パックマンTesla BotNEDO中古市場Tesla AI DayWikipediaDupe Killerソサエティ5.0Sphere偽ブランドSIGGRAPH 2020バズグラフXaver 1000配信ニュースタンテキ養蜂東芝Beewiseソニー・ピクチャーズ アニメーションDIB-R倉田宜典フィンテック投資Fosters+Partners韻律射影MILIZEZaha Hadid Architects広告韻律転移三菱UFJ信託銀行NeRF
AIに想像力を与えるために必要なこと:月刊エンタメAIニュース vol.19
エンタメにおいても人工知能は日進月歩で進歩しており、新しい研究成果や試みが次々と発表されています。こちらの連載では、過去1か月間、主に海外で公開された注目すべきゲームAIやエンタメAIに関連したニュース、論文などを紹介していきます。
ゲームキャラクターの声優をAIに担当させる技術
3Dグラフィックでデザインされたゲームキャラクターに生命を吹き込む声の演出は、ゲーム体験を豊かにするナラティブを追求する上で欠かせない要素といっても過言ではありません。しかし、台詞の収録やリップシンクは膨大な時間と労力を要する作業です。開発人員が限られた小規模のスタジオや、個人でゲームを制作するインディー開発者にとっては、金銭的なコストも大きな障壁となります。
近年、この問題と向き合うために注目されているのが、AIボイスという分野です。オーストラリアのAI開発会社Replica Studiosは、Unreal Engine専用ツール「MetaHuman Creator」との併用を想定した「AIボイスアクター」を発表しました。その名が示すとおり、ゲーム開発者が3Dグラフィックのキャラクターをデザインする際、声の演出を人間ではなくAIに担当させるためのツールです。現在は早期アクセスの段階で、順番待ちリストへの登録のみを受け付けています。
AIボイスといっても人間の音声を人工的に作り出す従来のテキスト音声合成ではありません。人間が読み上げた台詞の音声データを分析して、イントネーションや発声速度、発音の強弱といった特徴をAIが模倣するような技術です。
現在のベータ版では、あらかじめ収録されたライブラリから、カウボーイやイタリアンマフィアといったテーマごとに発音の特徴が異なるボイスサンプルを選択し、スライドバーで好みのキャラクターボイスへと調整できるようにデザインされています。今後はモーションキャプチャで自分の表情を捉えながら台詞を読み上げることで、AIが表情の変化や唇の動きを自動的にシンクロしながら選択したキャラクターボイスで喋ってくれる機能を追加する予定だということです。
公式サイトにて公開されているサンプル映像では、アニメーションの粗が目立って少々ぎこちない演技に見えてしまいますが、文章を読み上げるだけのText-To-Speech (TTS)と違って、製作者が台詞に込めた感情表現を上手く演出できています。
7月19日からオンラインで開催された「Game Developers Conference 2021」(GDC 2021)では、Replica StudiosのCEO、Shreyas Nivas氏がナラティブにおける声の演出の重要性や、AIボイスの正式リリースに向けた今後の展望について熱弁しました。
AIにイマジネーションという能力を与える技術
人工ニューラルネットワークを用いたディープラーニングの登場によって、AIは特定のタスクにおいて人間を圧倒的に凌駕しましたが、視覚情報の認識能力においては人間をふくむ霊長類には遠くおよびません。
たとえば、わたしたち人間は視覚で物体を認識する際、対象の形状や位置、色、材質といった固有の特性を分割して認識できます。こうした視覚情報を瞬時に一般化することで、それぞれの特性を組み合わせて新しい物体を想像することもできます。これが人間が当たり前のように行うイマジネーションという優れた能力です。
南カリフォルニア大学の研究チームは、International Conference on Learning Representations(ICLR 2021:学習表現についての国際会議)にて、グループ教師あり学習(以下、GSL=Group-Supervised Learning)という新たなフレームワークを使って人間の想像力をAIで再現する手法を発表しました。
このGSLを使えば、学習対象を交換可能な「Disentangled Representation(もつれのない特徴表現という意味)」に分解し、それを再構築することで新しいサンプルを合成できるようになります。たとえば、赤いボートと青いクルマの画像を学習させることで、赤いクルマの画像が生成できるようになるという具合です。こうした学習手法は、今後人間のように世界を認識できるAI技術を開発する上で、重要な役割を担うことは間違いないでしょう。
落書きを一瞬で絵画のようなグラフィックに変換するAI
いまはAIの力を借りて誰もがゴッホやゴーギャンのようなポスト印象派の画家になれる時代です。半導体メーカー大手のNVIDIAは6月23日、ペイントツールで抽象的な線を描いたり塗りつぶしたりするだけで、写実的な地形や風景のグラフィックをリアルタイムで生成できるアプリケーション「NVIDIA Canvas」を発表しました。
「NVIDIA Canvas」には、敵対的生成ネットワーク(GAN=Generative Adversarial Networks)というAIアルゴリズムが使われています。GANは生成ネットワークと識別ネットワークから構成されており、2つのネットワークは常に相反する目的を持って学習するように設計されています。
「NVIDIA Canvas」では、ユーザーが描いた線や塗りつぶした領域を生成ネットワークが地形イメージへと変換し、一方で識別ネットワークが現実的なイメージなのかどうかを判定します。たとえば池や湖が生成された場合、水面が光を反射しているかどうかを確認し、条件を満たしていなければ改善するように命令を送るといった具合です。
もともとは同社の研究チームが2019年に披露したペイントアプリ「GauGAN」(ゴーギャンの名前とGANをかけた造語)のデモとして生まれた技術で、当時は世界中のクリエイターによって50万枚を超える作品が、サービス提供からわずか1か月で生み出されたことで大いに脚光を浴びました。「NVIDIA Canvas」は開発者支援プラットフォーム「NVIDIA Studio」の一部として提供されており、現在はベータ版が無料でダウンロードできます。
AIモデレーターの導入を見据えたDiscordの企業買収
オンラインの嫌がらせを検知するためのAIツール開発を手がけるSentropyは14日、無料通話アプリを提供するDiscordへの事業売却を、公式声明文にて発表しました。
Sentropyは、Twitterユーザーにとって有害な情報をAIで検知する「Protect」というツールを2020年から提供してきたスタートアップ企業です。今回の買収を機に、これまでのサービスを一部停止し、急速にユーザーベースを拡大していくDiscordがより安心して利用できるツールへと進化する手助けをしていくということです。
Discordは、SkypeやTeamSpeakに並ぶVoIPソフトウェアとして、2015年からサービスが始まりました。当初は主にTwitchをはじめとしたゲームコミュニティで愛用され、Discordの機能をゲーム内に組み込めるAPIが導入されるなど、ゲーマーのためのボイスチャットツールとして普及した背景があります。その後、2020年にブランドイメージを変更し、現在では業界を問わず万人のためのコミュニケーションツールを目指して発展を続けています。
Discordを利用するユーザーはすでに2億5,000万人以上と報告されており、Discord内で企業やユーザーが展開しているコミュニティは1,900万件に上ると言われています。それらすべてのモデレーションを人間だけで担うには限界があります。Sentropyの経験と実績を吸収することで、あらゆるコミュニティに向けたコミュニケーションツールとして、Discordがより堅固な地位を築いていくことが期待されます。
Writer:Ritsuko Kawai / 河合律子、Image by NVIDIA