モリカトロン株式会社運営「エンターテインメント×AI」の最新情報をお届けするサイトです。
- TAG LIST
- CGCGへの扉機械学習安藤幸央ディープラーニング月刊エンタメAIニュースGAN河合律子OpenAI音楽ニューラルネットワークNVIDIA三宅陽一郎強化学習吉本幸記QAGoogleFacebook人工知能学会GPT-3自然言語処理DeepMind大内孝子森川幸人敵対的生成ネットワークグーグルキャラクターAIスクウェア・エニックスモリカトロンAIラボインタビュールールベースマイクロソフトシナリオAIと倫理映画デバッグアートDALL-E2StyleGAN倫理ゲームプレイAINFT自動生成SIGGRAPHメタAIテキスト画像生成ロボット深層学習CEDEC2019プロシージャル遺伝的アルゴリズムテストプレイモリカトロンStable DiffusionDALL-Eビヘイビア・ツリーディープフェイクCEDEC2021CEDEC2020ゲームAIVFXデジタルツインメタバース不完全情報ゲームVRナビゲーションAINPC畳み込みニューラルネットワークCLIP画像生成GDC 2021JSAI2022GDC 2019マルチエージェントCEDEC2022AIアート画像生成AIボードゲームファッション懐ゲーから辿るゲームAI技術史toioCNNAdobeUnity著作権小説アニメーション鴫原盛之HTN階層型タスクネットワーク汎用人工知能JSAI2020TensorFlowインタビューBERTMicrosoftイベントレポート対話型エージェントロボティクスMetaMinecraft水野勇太Genvid TechnologiesガイスターStyleGAN2GTC2022教育ソニーJSAI2021スポーツ研究シムピープルMCS-AI動的連携モデルマンガマーケティングGDC SummerバーチャルヒューマンブロックチェーンMidjourneyアストロノーカキャリアNVIDIA OmniverseeスポーツAmazoneSportsDQNBLUE PROTOCOLシーマンアバターOmniverseUbisoftメタAlphaZeroTransformerGPT-2AIりんなカメラ環世界中島秀之哲学ベリサーブPlayable!理化学研究所SIGGRAPH ASIADARPAドローンシムシティImagenZorkバイアスモーションキャプチャーTEZUKA2020AI美空ひばり手塚治虫バンダイナムコ研究所スパーシャルAIElectronic Arts3DメタデータLEFT 4 DEAD通しプレイOpenAI Five本間翔太CMピクサープラチナエッグイーサリアム作曲ボエダ・ゴティエビッグデータ中嶋謙互Amadeus Codeデータ分析Microsoft AzureMILE模倣学習ナラティブスタンフォード大学アーケードゲームOmniverse ReplicatorWCCFレコメンドシステムNVIDIA DRIVE SimWORLD CLUB Champion FootballNVIDIA Isaac Simセガ柏田知大軍事サイバーエージェント田邊雅彦トレーディングカードトレカ音声認識メディアアートPyTorch眞鍋和子バンダイナムコスタジオaibo合成音声齊藤陽介マインクラフトお知らせMagic Leap Oneチャットボットサルでもわかる人工知能VAE3DCGリップシンキングUbisoft La Forge自動運転車ワークショップ知識表現ウォッチドッグス レギオンIGDA秋期GTC2022どうぶつしょうぎEpic Gamesジェイ・コウガミ音楽ストリーミングMITAIロボ「迷キュー」に挑戦野々下裕子徳井直生マシンラーニング5GMuZeroRival Peakクラウド対話エンジン斎藤由多加リトル・コンピュータ・ピープルCodexコンピューティショナル・フォトグラフィーゴブレット・ゴブラーズ絵画rinnaイラストシミュレーションデジタルヒューマン完全情報ゲーム坂本洋典釜屋憲彦ウェイポイントパス検索対談藤澤仁生物学GTC 2022ChatGPT画像認識GPT-3.5SiemensStyleCLIPDeNA長谷洋平masumi toyota宮路洋一OpenSeaGDC 2022TextWorldEarth-2MagentaSFELYZA Pencil松尾豊GTC2021CycleGANデータマイニング東京大学NetHackはこだて未来大学キャラクターモーションフェイクニュースエージェントRPGSIGGRAPH 2022レベルデザインAIボイスアクターNVIDIA CanvasGPUALife人工生命オルタナティヴ・マシンサウンドスケープLaMDAAI DungeonASBS栗原聡ぱいどんテキスト生成不気味の谷ナビゲーションメッシュ松井俊浩ELYZAフルコトELYZA DIGEST音声合成西成活裕Apex LegendsELIZA群衆マネジメントNinjaコンピュータRPGライブビジネスアップルタウン物語新型コロナKELDIC周済涛メロディ言語清田陽司ゲームTENTUPLAYサイバネティックスMARVEL Future FightAstro人工知能史タイムラプスEgo4DAI哲学マップバスキア星新一日経イノベーション・ラボStyleGAN-XL敵対的強化学習StyleGAN3階層型強化学習GOSU Data LabGANimatorWANNGOSU Voice AssistantVoLux-GAN竹内将SenpAI.GGProjected GANMobalyticsSelf-Distilled StyleGAN馬淵浩希Cygamesニューラルレンダリング岡島学AWS SagemakerPLATO映像セリア・ホデント形態素解析frame.ioUXAWS LambdaFoodly誤字検出森山和道認知科学中川友紀子ゲームデザインSentencePieceアールティLUMINOUS ENGINELuminous ProductionsBlenderBot 3パターン・ランゲージ竹村也哉Meta AIちょまどマーク・ザッカーバーグGOAPWACULAdobe MAX 2021自動翻訳AIライティングOmniverse AvatarAIのべりすとFPSNVIDIA RivaQuillBotマルコフ決定過程NVIDIA MegatronCopysmithNVIDIA MerlinJasperNVIDIA Metropolisパラメータ設計テニスバランス調整協調フィルタリング人狼知能テキサス大学AlphaDogfight TrialsAI Messenger VoicebotエージェントシミュレーションOpenAI CodexStarCraft IIHyperStyleMax CooperFuture of Life InstituteRendering with StyleIntelDisney類家利直LAIKADisneyリサーチヴィトゲンシュタインRotomationGauGAN論理哲学論考GauGAN2京都芸術大学ドラゴンクエストライバルズ画像言語表現モデル不確定ゲームSIGGRAPH ASIA 2021PromptBaseDota 2モンテカルロ木探索ディズニーリサーチMitsuba2バンダイナムコネクサスソーシャルゲームEmbeddingワイツマン科学研究所ユーザーレビューGTC2020CG衣装mimicNVIDIA MAXINEVRファッションBaidu淡路滋ビデオ会議ArtflowERNIE-ViLGグリムノーツEponym古文書ゴティエ・ボエダ音声クローニング凸版印刷Gautier Boeda階層的クラスタリングGopherAI-OCR画像判定JuliusSIE鑑定ラベル付けTPRGOxia Palus大澤博隆バーチャル・ヒューマン・エージェントtoio SDK for UnityArt RecognitionSFプロトタイピングクーガー田中章愛実況パワフルサッカー石井敦銭起揚NHC 2021桃太郎電鉄茂谷保伯池田利夫桃鉄GDMC新刊案内パワサカマーベル・シネマティック・ユニバースコナミデジタルエンタテインメント成沢理恵MITメディアラボMCU岩倉宏介アベンジャーズPPOマジック・リープDigital DomainMachine Learning Project CanvasMagendaMasquerade2.0国立情報学研究所ノンファンジブルトークンDDSPフェイシャルキャプチャー石川冬樹サッカーモリカトロン開発者インタビュースパコン里井大輝Kaggle宮本茂則スーパーコンピュータバスケットボール山田暉松岡 聡Assassin’s Creed OriginsAI会話ジェネレーターTSUBAME 1.0Sea of ThievesTSUBAME 2.0GEMS COMPANYmonoAI technologyLSTMABCIモリカトロンAIソリューション富岳初音ミクOculusコード生成AISociety 5.0転移学習テストAlphaCode夏の電脳甲子園Baldur's Gate 3Codeforces座談会Candy Crush Saga自己増強型AItext-to-imageSIGGRAPH ASIA 2020COLMAPtext-to-3DADOPNVIDIA GET3DデバッギングBigGANGANverse3DDreamFusionMaterialGANRNNグランツーリスモSPORTAI絵師ReBeLグランツーリスモ・ソフィーUGCGTソフィーPGCVolvoFIAグランツーリスモチャンピオンシップStability AINovelAIRival PrakDGX A100NovelAI DiffusionVTuberユービーアイソフトWebcam VTuberモーションデータ星新一賞北尾まどかHALO市場分析ポーズ推定将棋メタルギアソリッドVフォートナイトメッシュ生成FSMメルセデス・ベンツRobloxMagic Leapナップサック問題Live NationEpyllion汎用言語モデルWeb3.0マシュー・ボールAIOpsムーアの法則SpotifyスマートコントラクトReplica StudioAWSamuseChitrakarQosmoAdobe MAX 2022巡回セールスマン問題Adobe MAXジョルダン曲線メディアAdobe Research政治Galacticaクラウドゲーミングがんばれ森川君2号pixiv和田洋一リアリティ番組映像解析Stadiaジョンソン裕子セキュリティMILEsNightCafe東芝デジタルソリューションズインタラクティブ・ストリーミングLuis RuizSATLYS 映像解析AIインタラクティブ・メディアポケモン3DスキャンPFN 3D Scanシーマン人工知能研究所東京工業大学Ludo博報堂Preferred NetworksラップPFN 4D ScanSIGGRAPH 2019ArtEmisZ世代DreamUpAIラッパーシステムDeviantArtARWaifu DiffusionGROVERプラスリンクス ~キミと繋がる想い~元素法典FAIRSTCNovel AIチート検出Style Transfer ConversationOpen AIオンラインカジノRCPMicrosoft DesignerアップルRealFlowRinna Character PlatformiPhoneCALADeep FluidsSoul Machines柿沼太一MeInGameAmeliaELSIAIGraphブレイン・コンピュータ・インタフェースバーチャルキャラクター大規模言語モデルBCIGateboxアフォーダンスLearning from VideoANIMAKPaLM-SayCan予期知能逢妻ヒカリPaLMセコムGitHub Copilotユクスキュルバーチャル警備システムCode as Policiesカント損保ジャパンCaP上原利之ドラゴンクエストエージェントアーキテクチャアッパーグラウンドコリジョンチェックPAIROCTOPATH TRAVELER西木康智OCTOPATH TRAVELER 大陸の覇者山口情報芸術センター[YCAM]アルスエレクトロニカ2019品質保証YCAMStyleRigAutodeskアンラーニング・ランゲージ逆転オセロニアBentley Systemsカイル・マクドナルドワールドシミュレーターローレン・リー・マッカーシー奥村エルネスト純いただきストリートH100鎖国[Walled Garden]プロジェクト齋藤精一大森田不可止COBOLSIGGRAPH ASIA 2022高橋智隆DGX H100VToonifyロボユニザナックDGX SuperPODControlVAE泉幸典仁井谷正充クラウドコンピューティング変分オートエンコーダーロボコレ2019Instant NeRFフォトグラメトリartonomous回帰型ニューラルネットワークbitGANsDeepJoinぎゅわんぶらあ自己中心派Azure Machine LearningAzure OpenAI Service意思決定モデル脱出ゲームDeepLHybrid Reward Architectureコミュニティ管理DeepL WriteウロチョロスSuper PhoenixSNSProject MalmoオンラインゲームGen-1気候変動ジェネレーティブAIProject PaidiaシンギュラリティProject Lookoutマックス・プランク気象研究所レイ・カーツワイルWatch Forビョルン・スティーブンスヴァーナー・ヴィンジBing気象モデルRunway ResearchLEFT ALIVE気象シミュレーションMake-A-Video長谷川誠ジミ・ヘンドリックス環境問題PhenakiBaby Xカート・コバーンエコロジーDreamixロバート・ダウニー・Jr.エイミー・ワインハウスSDGsText-to-Imageモデル音楽生成AIYouTubeダフト・パンクメモリスタ音声生成AIGlenn MarshallScenarioThe Age of A.I.Story2Hallucination音声変換LatitudeレコメンデーションJukeboxAIピカソVeap JapanAI素材.comEAPneoAIテンセントSIFT福井千春DreamIconDCGAN医療mignMOBADANNCEメンタルケアstudiffuse人事ハーバード大学Edgar HandyAndreessen Horowitz研修デューク大学NetflixAIQVE ONEQA Tech Nightmynet.aiローグライクゲーム松木晋祐東京理科大学下田純也人工音声NeurIPS 2021産業技術総合研究所桑野範久リザバーコンピューティングBardプレイ動画ヒップホップ対話型AIモデル詩ソニーマーケティングControlNetサイレント映画もじぱnoteNBA環境音暗号通貨note AIアシスタント現代アートFUZZLEKetchupAlterationAI News粒子群最適化法Art Selfie進化差分法オープンワールドArt Transfer群知能下川大樹AIFAPet Portraitsウィル・ライト高津芳希P2EBlob Opera大石真史クリムトBEiTStyleGAN-NADA世界モデルDETRゲームエンジンDreamerV3SporeUnreal Engineクリティックネットワークデノイズ南カリフォルニア大学Unity for Industryアクターネットワーク画像処理DMLabSentropyGLIDEControl SuiteCPUDiscordAvatarCLIPAtari 100kSynthetic DataAtari 200MCALMYann LeCunプログラミングサム・アルトマン鈴木雅大ソースコード生成コンセプトアートGMAIシチズンデベロッパーSonanticColie WertzTRPGGitHubCohereリドリー・スコットウィザードリィMCN-AI連携モデルマジック:ザ・ギャザリング絵コンテUrzas.aiストーリーボード介護大阪大学西川善司並木幸介KikiBlenderサムライスピリッツ森寅嘉Zoetic AIプロンプトゼビウスSIGGRAPH 2021ペットストリートファイター半導体Digital Dream LabsTopaz Video Enhance AICozmoDLSSタカラトミー山野辺一記NetEaseLOVOT大里飛鳥DynamixyzMOFLINRomiU-Netミクシィ13フェイズ構造アドベンチャーゲームユニロボットADVユニボXLandGatoAGI手塚眞DEATH STRANDINGマルチモーダルEric Johnson汎用強化学習AIデザインOculus Questコジマプロダクションロンドン芸術大学生体情報デシマエンジンGoogle BrainインディーゲームSound Control写真高橋ミレイSYNTH SUPER照明Maxim PeterKarl SimsJoshua RomoffArtnomeハイパースケープICONATE山崎陽斗深層強化学習立木創太松原仁浜中雅俊ミライ小町武田英明テスラ福井健策GameGANパックマンTesla BotNEDOTesla AI DayWikipediaソサエティ5.0SphereSIGGRAPH 2020バズグラフXaver 1000ニュースタンテキ養蜂東芝BeewiseDIB-R倉田宜典フィンテック投資韻律射影MILIZE広告韻律転移三菱UFJ信託銀行
経済シミュレーションや動画圧縮にも応用。DeepMindの最新強化学習研究まとめ
DeepMindが開発した囲碁プレイAIであるAlphaGoが2016年にトッププロ囲碁棋士に勝利したことで、同社の強化学習研究が一躍脚光を浴びることになりました。その後、同社はタンパク質の構造を予測するAlpahFoldを発表したことで、自然科学研究に役立つAI開発でも有名になりました。このようにAI開発の幅を広げながらも、同社は強化学習研究を連綿と続けています。本稿では、同社の最新強化学習研究を3つ紹介します。
大規模言語モデルからインスパイア
2022年5月12日、DeepMindはかつてない汎用性を実現した強化学習AIであるGatoを発表しました。同AIが実行するのはゲームプレイはもちろんのこと、英語によるチャット、画像に写っているものに対するキャプション付け、さらにはロボットアームの制御と多岐に及び、そうしたタスクの多数においてハイスコアを達成しました。
Gatoの開発は、大規模言語モデルにインスパイアされたものでした。そうしたモデルの代表には、OpenAIが開発したGPT-3があります。GPT-3は、インターネット上にある膨大な英語テキストデータを使って訓練した結果、文の生成だけではなく翻訳や論理推論も実行できるようになったことで、言語的タスクにおける汎用性を実現しました。こうした大規模言語モデルにならって、Gatoは多種多様なタスクに関する学習データをトークンと呼ばれる文字列のような一種のシーケンシャルなデータに変換したうえで学習した結果、かつてない汎用性を実現しました。
Gatoがトークンを学習する際には、トークンの一部をマスク(隠した)したうえで、そのマスクされたデータを予測するように訓練されました。こうしたマスクデータの予測という学習形式は、例えば言語モデルBERTでも使われています。
Gatoを発表した論文では、同モデルの実現で萌芽した汎用強化学習AIの社会への影響が考察されています。ロボットアームの制御が可能であることからわかるように、汎用強化学習AIはソフトウェア的な存在に留まっている既存の強化学習AIと比べて、物理世界への関与が大きくなります。こうした関与の増大は、AIに対して人間が間違った信頼を抱いたり、反対にAIが人間に物理的な危害を加えたりする可能性を生みます。それゆえ、汎用強化学習AIが進化すると、新たな次元でAI倫理が問われることになるのです。同論文では、専門知識のない人々を対象とした汎用強化学習AIに関する啓発活動が重要になるだろう、とも述べています。
参考論文:汎用的なエージェント
経済活動をルールなしに再現
2022年5月16日には、経済活動を複数の強化学習エージェントによって再現する研究が発表されました。物品の生産、交換、消費という初歩的な経済活動をAIエージェントによってシミュレートする研究は以前からありました。こうした研究におけるAIはルールベースエージェントとして開発され、実装されたルールには経済学における基本原則が採用されていました。DeepMindの研究が画期的なのは、経済学のルールを一切実装していない強化学習エージェントによって、経済学的に説明されるさまざまな現象を再現できたところにあります。
DeepMindの研究では、木々や水辺がある簡単なゲームステージのような環境が用意されたうえで、2種類の強化学習エージェントが多数生息する状況がシミュレートされました。これらのエージェントはリンゴとバナナを生産できますが、一方の種類のエージェントはリンゴの生産を得意とし、他方はバナナの生産を得意とします。そして、リンゴの生産が得意なエージェントはバナナを好んで消費し、他方はリンゴを好みます。こうした設定のもとで、エージェントたちが果物を生産、交換、消費する様子をシミュレートしたのでした。
以上のシミュレーションでは、エージェントどうしが1対1で行う物々交換のほかに、多数のエージェントが集まって交換する市場も設置されました。こうした市場における交換レートは、設置場所によって1対1のそれと異なる場合があることが観察されました。例えば、あえてエージェントの生息域から離れた場所に市場を設定した場合、1対1で取引した場合のリンゴとバナナの交換レートが1個対1個なのに対して、市場では1個対3個となりました。このように地理的環境によって複数のレートが成立するのは、生息域から外れた市場で交換する場合、市場に移動するまでは生産活動ができないというルールを採用していることから実質的に移動コストが生じてしまい、そのコストが交換レートに転嫁されたためと考えられます。ちなみに、市場を生息域内あるいはその近くに設置した場合、市場の交換レートは1対1で取引した場合のそれと同じになりました。この現象は、市場に行くまでの移動コストが生じないためと考えられます。
以上のシミュレーションで注目すべきは、エージェントには「移動コストを価格に転嫁する」のようなルールが実装されておらず、あくまで環境に適応した結果、経済学の原則が観察されたところです。つまり、一切の前提知識なしに経済学の原則が生成される様子を観察できるというわけです。今回の発表について、DeepMind研究チームは強化学習が経済学のような人文科学研究に貢献できる実例であるとまとめています。
4%のビットレート削減を実現
モリカトロンAIラボは2021年1月、ゲームに関する知識なしでハイスコアを達成するゲームプレイAIのMuZeroを紹介した記事を公開しました。その記事では、ゲームプレイに特化した同AIを動画圧縮に応用する研究が進められているとも解説しました。この研究の成果が2022年2月11日、DeepMind公式ブログ記事で発表されました。
DeepMindのブログ記事によると、コロナ禍によってステイホームが余儀なくされたため、動画視聴のニーズが急増しました。その結果、インターネット通信における動画トラフィックが占める割合が大きくなり、今後もこの割合はますます増えていくと予想されています。こうした状況に対処するために解決すべきなのが、動画圧縮の最適化問題です。
インターネットで閲覧される動画は、オリジナル動画を圧縮したうえで送信して視聴者の視聴環境内でデコードする処理が実行されています。YouTubeをはじめとする動画ストリーミングサービスでは、VP9と呼ばれる動画圧縮アルゴリズムが採用されています。DeepMind研究チームは、VP9を上回る圧縮効率のアルゴリズムをMuZeroを応用して開発することにしました。
効率の良い動画圧縮アルゴリズムを開発するには、動画を一律に高密度に圧縮すればよいというわけではありません。というのも、高密度に圧縮すると画質が劣化してしまうからです。それゆえ、複雑な動画フレームは高密度に圧縮する一方で、シンプルなそれは低密度にするというような最適化が求められます。動画圧縮には動画サイズや画質のほかにも、通信環境や視聴者の再生デバイス性能などの要因も関係してきます。このように動画圧縮アルゴリズムは、多数のパラメータの組み合わせから最適解を導く組み合わせ最適化問題と捉えられます。そして、こうした問題を解くにはMuZeroのようなゲームプレイAIが適しているのです。
MuZeroを動画圧縮問題に応用するにあたっては、自己競争と呼ばれるアルゴリズムを採用しました。これは、実行した動画圧縮の効率が以前のそれを上回るように学習するというものです。自己競争を実装した結果、YouTubeで公開されている動画から作成したテストセットを使って測定したビットレート(単位時間あたりのデータ通信量)が4%削減できました。
以上に紹介したDeepMindの強化学習研究は、純粋に学術的なものであると同時に現実社会の問題を解決する実践的なものでもあるのです。こうしたDeepMindの研究活動をキャッチアップするには、同社の公式ブログあるいは研究成果をまとめたウェブページを閲覧するとよいでしょう。
Writer:吉本幸記