生成AI
概要と重要性
生成AI(GenAI)は既存のデータを取り込んで学習し、類似する特徴を持つデータを生成します。例えば、画像、テキスト、音声、動画、コンピューターコードなどを生成できます。
生成AIが世界を変える
従来のAIおよび機械学習システムはデータ内のパターンを認識することで予測を作成します。しかし、生成人工知能は予測を超えた機能であり、その主要な出力として新たなデータを生成します。想像してみてください。ご自分のアイデアを説明する数個の単語をチャットボット(またはChatGPTなどのツール)に伝えた後、ほんの数秒でスピーチ原稿の全文を受け取る様子や、テキストベースの説明から音楽、アート、画像が生成される様子を ──。あるいは、生成AIツールを使えば、会話形式でやり取りするプロンプト入力を通じてビジネス戦略を策定することも可能です。Bloomberg Intelligenceは、生成AIが2032年までに1.3兆ドルの市場になる可能性があると予測しています。
生成AIの実世界での活用
生成AIは、予測可能な方法から想像を超えた方法まで、私たちの未来を一変させると期待されています。この解説動画では、大規模言語モデル(LLM)、合成データ生成、デジタルツインを使用したさまざまな業界やビジネスケースの実際の活用例を紹介します。また、バイアス、幻覚(誤情報の生成)、データプライバシー、セキュリティなど、生成AI技術を採用する際の重要な考慮事項やリスクについても学べます。
生成AIの進化
世界中で大きな注目を集める生成AIですが、実は全く新しいものではありません。AI、機械学習、統計手法といった、私たちが何十年も使い続けてきた技術に基づいて構築されています。生成AIの起源はもっと遡ることができますが、ここでは1966年の「ELIZA(イライザ)」という名前のチャットボットから話を始めましょう。
ELIZAの開発者であるJoseph Weizenbaum 氏は、患者の発言をそのまま復唱するロジェリアン療法の心理療法士を模倣するためにこれを設計しました。ELIZAはパターンマッチングを用いてこの偉業を達成しました。ELIZAは、人間のような知的な振る舞いを示す機械の能力を判定する模倣ゲームである「チューリングテスト」に挑んだ最初のプログラムの一つでした。
非構造化テキストデータの分析手法が進化していくなか、1970年代から1990年代にかけてセマンティック・ネットワーク、オントロジー、リカレント・ニューラル・ネットワークに進展が見られました。2000年から2015年にかけては、言語モデリングと単語埋め込みが改善され、「Google翻訳」が台頭しました。
2014年、Ian Goodfellow 氏とその同僚たちが敵対的生成ネットワーク(GAN)を開発し、2つのニューラル・ネットワークが互いに競争する(トレーニングし合う)ように設定します。片方のネットワークがデータを生成し、他方のネットワークはそのデータが本物か偽物かの判定を試みる、というものでした。2017年には、Transformerモデルが導入されました。これらのモデルは、予測を作成する際、入力のさまざまな部分の重要性に対して重み付けを行える「自己注意機構」(self-attention mechanism)が含まれていました。また、BERTやELMoといったアーキテクチャも人気がでました。
次に登場したのはGPT(Generative pre-trained transformer)モデルであり、2018年に最初のGTPモデルが発表されます。この生成モデルは、インターネットから取得した大量のテキストデータで事前にトレーニングされており、1億1,700万個のパラメータを用いることで、文体や内容がトレーニング用データに似たテキストを生成するようになりました。その後2023年の時点では、複数の大規模な言語GPTモデルが、司法試験レベルの難しい試験で上々の成績を収めるまで進化を遂げています。
生成AIの最新動向
生成AIの業種別用途
生成AIは世界中の幅広い業種やビジネス機能に広がりを見せています。この技術は人気が高まる中で、さまざまな専門的AIアシスタントの開発が促進される一方で、個人、企業、政府機関に興奮と不安を同時に引き起こしています。一部業界における現在の生成AI活用例をご覧ください。
生成AIの結果は、その中核において私たち人間を反映しています。(中略)消費者は、会話型AIとやり取りする場合は常に批判的思考を適用し続け、「自動化バイアス」(技術的システムの方が人間よりも正確で真実を突く可能性が高い、という思い込み)を回避しなければなりません。Reggie Townsend VP of the SAS Data Ethics Practice
ビジネスにおける生成AIの利用に関する倫理的考慮
破壊的な技術である生成AIの影響は、電気や印刷技術の発明にも匹敵すると言われています。生産性を飛躍的に向上させる可能性を秘めた会話型AIモデルは、その人気が急上昇する一方で、AI倫理、データプライバシー、正確性、幻覚(ハルシネーション)、バイアスといった懸念を引き起こしています。人間の知能を模倣して進化する能力により、生成AIはAI不安の波を生み出し、その使用方法やガバナンスについて議論が巻き起こっています。
人間中心主義、包摂性、説明責任のために設計された信頼できるAIシステムの採用が不可欠である理由とは?
生成AIの動作の仕組み
生成AIテクノロジーの人気のある実装例としては、DALL-E(テキスト入力から画像を作成する画像生成システム)、ChatGPT(テキスト生成システム)、Google Bardチャットボット、MicrosoftのAIを搭載したBing検索エンジンがあります。また、システム、ビジネスプロセス、さらには人物のデジタル表現を作成するために生成AIを活用している実装例もあります。例えば、特定の人物の現在および将来の健康状態について動的な表現を生成することができます。
生成AIテクノロジーには、デジタルツイン、大規模言語モデル(LLM)、合成データ生成という3つの主要なタイプがあります。
他にも数多くのテクノロジーが生成AIの実現と活用を支えています。
アルゴリズムとは、特定のタスクを完了したり問題を解決したりするために設計された、ステップバイステップ方式の操作指示リストです。多くのコンピューター・プログラムは、コンピューターが理解できる方法で記述されたアルゴリズム群を順番に並べたもの(=シーケンス)です。アルゴリズムが人間の意思決定の補完または代替として利用され始めているなか、私たちはアルゴリズムの公平性を詳しく調べ、開発方法の透明性を求めていかなければなりません。
人工知能(AI)は、機械が自律的に経験から学び、新たな入力に順応し、人間が行うようなタスクを実行することを可能にします。AIは多くの場合、ディープラーニングと自然言語処理(NLP)を大量に活用します。これらのテクノロジーにより、大量のデータからパターンを認識させるという方法で、特定のタスクを遂行するようにコンピューターをトレーニングすることができます。
データ管理は、信頼でき、倫理的でバイアスのない成果を確保するために不可欠です。特に、膨大なデータセットで訓練され、コンテンツの理解や生成に利用されるAIや機械学習のタスク、そしてLLMにおいて、大変重要です。
深層学習とは、音声認識、画像識別、予測など人間が行うようなタスクを実行できるようにコンピューターに学習させることを目的とした機械学習の一種です。コンピューターが分類、認識、検知、説明する能力を、データを使って改善することができます。敵対的生成ネットワーク(GAN)や変分オートエンコーダー(VAE)のようなディープラーニング・モデルは、大規模なデータセット群を用いたトレーニングを受けることで、高品質なデータを生成できるようになります。StyleGANモデルやTransformerモデルのようなさらに新しい技法は、現実感の高いビデオ、画像、テキスト、スピーチ(発話音声)の作成が得意です。
機械学習(マシンラーニング)は、データ分析手法の一種であり、分析モデルの構築を自動化することを目的としています。また、マシンに学習方法をトレーニングする人工知能(AI)の下位分野でもあります。機械学習は、「コンピューター・システムはデータから学習し、パターンを特定し、人間の介入を最小限に抑えた意思決定を実現できる」という考え方に基づいています。
自然言語処理(NLP)は、人工知能(AI)の下位分野であり、コンピューターが人間の言語を理解、解釈、操作できるようにする取り組みです。NLPでは、人間のコミュニケーションとコンピューター側の理解との間のギャップを解消するために、コンピューター・サイエンスや計算言語学をはじめとする多くの分野の知見を活用しています。
ニューラル・ネットワークとは、人間の脳のニューロン(神経細胞)と同じように振る舞うノードが相互接続されたコンピューティング・システムです。ニューラル・ネットワークはアルゴリズムを活用することで、生データに潜むパターンや相関関係の認識、クラスター化、分類を行うことができ、また、時の経過とともに継続的に学習を重ね、処理精度を改善していくことができます。
強化学習では、どの行動が最大の報酬を生み出すかを、アルゴリズムが試行錯誤を通じて突き止めます。機械学習の一種である強化学習は、最良の(=最も報酬が高くなる)ポリシーまたはゴールを徐々に学習していくにあたり、そのフィードバック・メカニズムとして報酬シグナルを活用します。これはロボット工学、ゲーミング、ナビゲーションでよく使われます。
生成AIモデルの実装
モデルの実行コストは高価であり、膨大な量の計算パワーとデータを必要とします。生成AIモデルを実装する前にROIを慎重に評価し、基盤モデルやドメインモデルなどの異なるタイプのモデルの違いを考慮するべきです。また、倫理的な考慮事項もあります。データの出自はどこで、所有者は誰でしょうか?信頼できるデータでしょうか?モデルがどのように構築されたかを正確に理解しているのでしょうか?
モデルをチューニングするための5つのステップ
生成AIは「学習元のデータに良く似た確率分布や特徴を持つデータ」を生成するために、多種多様なAIアルゴリズムおよびテクノロジーを活用します。以下の5つのステップに従えば、ゼロから構築するのではなく、事前トレーニング済みの基本的な大規模言語モデルをチューニングすることができます。
タスクの定義
適切な事前トレーニング済みの大規模言語モデルを選び、チューニングの対象となるタスクを明確に定義します。この場合のタスクとは、テキスト分類(=エンティティ認識)やテキスト生成などです。
2. データの準備
目的のタスク(例:ラベリング、フォーマット、トークン化)に特化したデータを収集し、事前処理を行います。具体的には、トレーニング用、検証用(および、必要に応じてテスト用)のデータセットを作成します。
チューニング
チューニング対象のモデルをトレーニングします。ここではトレーニング用データを用いて、そのモデルの重み付けを更新します。その後、過学習を防ぐために、検証用データセットでモデルのパフォーマンスをモニタリングします。
4. 評価とテスト
トレーニングの後、チューニング済みのモデルを検証用データセットで評価し、その結果に基づき必要な調整を行います。調整結果に満足したら、そのモデルをテスト用データセットでテストし、バイアスを含まないパフォーマンス推定値を取得します。
5. デプロイ
モデルのパフォーマンスに確信が持てたら、目的の用途にデプロイ(業務実装・現場展開)します。このステップには、モデルをアプリケーション、Webサイト、その他のプラットフォームに統合する作業が含まれる可能性があります。
