KADOKAWA Technology Review
×
IU35 2025受賞者が集結するSummitを12/17開催!来場申込受付中。
AudioMook:What will the AI drawing boom bring?

聴くMITTR:「AIお絵描き」ブームは何をもたらすのか?

今週のオーディオ・ムック(β)では、話題の画像生成AIから、マルチモーダルAIの可能性について考える。 by MIT Technology Review Audio Studio2022.08.25

テキストから画像を生成する「AIお絵描きツール」がここ数週間、ネット上で話題になっている。ブームに先鞭をつけたのが、2021年にオープンAI(OpenAI)が発表した「DALL-E(ダリー)」だ。従来のAI技術では、自然言語処理モデルはテキストだけ、画像生成モデルは画像だけといった具合に、1つの処理しかできなかった。両者を結びつけた「マルチモーダル」なAI(MITテクノロジーレビューが2021年の重大技術に選定)は、このブームにとどまらず、今後ますます広がる応用可能性を持っている。

今週のオーディオ・ムック(β)では、話題の画像生成AIからマルチモーダルAIの可能性について考える。

MITテクノロジーレビューは毎週、旬のテーマを設定し、編集部がピックアップした記事を「オーディオ・ムック(β)」として音声化してお届けします。家事や運動をしながら、通勤しながら、手がふさがっていても記事が読める「聴く」MITテクノロジーレビューをお楽しみください。

なお、本コンテンツは音声合成技術で作成しているため、一部お聞き苦しい点があります。ご容赦ください。バックナンバーはこちら。感想は@techreviewjp まで。

今週の収録記事

オープンAI、文章から画像を描く「DALL-E2」を100万人に提供

オープンAIは、文章から画像を生成する「DALL-E 2」のベータ版を100万人に提供する。一部有料化し、生成した画像の商用利用も可能となる。

「馬に乗った宇宙飛行士」——文章から画像を描くAIが驚きの進歩

オープンAIは、与えられた文章から画像を生成するAIシステムの最新版を発表した。「馬に乗った宇宙飛行士」などの文章を入力すると、言葉にできるものなら何でも写真に近い形で生成できるという、驚くべきものだ。

2021重大技術:「マルチモーダル」でAIはもっと柔軟かつ堅牢になる

人間の知能はさまざまな知覚と言語能力の組み合わせから生まれる。こうしたマルチモーダルな手法を用いれば、新しい状況や問題により容易に対処できる堅牢なAIを作り出せる可能性がある。

人気の記事ランキング
  1. Quantum physicists have shrunk and “de-censored” DeepSeek R1 量子技術でDeepSeekを55%小型化、「検閲解除」にも成功
  2. Promotion Innovators Under 35 Japan Summit 2025 2025年のイノベーターが集結「IU35 Summit」参加者募集
  3. Google’s new Gemini 3 “vibe-codes” responses and comes with its own agent グーグルが「Gemini 3」発表、質問に応じて回答形式もAIが判断
MITテクノロジーレビュー オーディオ・スタジオ [MIT Technology Review Audio Studio]日本版 オーディオ・スタジオ チーム
MITテクノロジーレビューは毎週、旬のテーマを設定し、編集部がピックアップした記事を「オーディオ・ムック(β)」として音声化してお届けします。
日本発「世界を変える」U35イノベーター

MITテクノロジーレビューが20年以上にわたって開催しているグローバル・アワード「Innovators Under 35 」。世界的な課題解決に取り組み、向こう数十年間の未来を形作る若きイノベーターの発掘を目的とするアワードの日本版の最新情報を発信する。

特集ページへ
気候テック企業10 2025

MITテクノロジーレビューは毎年、気候テック分野で注目すべき企業を選出し、その一覧を発表している。 新たなクリーン・エネルギー源の創出や、食品生産・物流の再構築といった形で経済の主要セクターの脱炭素化に取り組む注目企業10社を紹介しよう。

特集ページへ
フォローしてください重要なテクノロジーとイノベーションのニュースをSNSやメールで受け取る