生成AIの種類は作るもので使い分ける

生成AIの種類とは、文章・画像・動画・音声・プログラムなど、生成AIを何を作るか・どう使うか・どんな仕組みで動くかで分けた区分のことです。会社で導入を考えるときは、出力の種類で候補を絞り、使い方で担当業務を決め、最後に入力してよい情報と学習の扱いを種類ごとに確かめる、という順番で整理すると迷いにくくなります。解説によって4種類とも7種類とも8タイプとも言われるのは、この分け方の軸が記事ごとに違うためです。この記事では、分け方の違いを先に整理したうえで、種類ごとの代表サービス、部署ごとの使い道、会社で使う前に確認すべき点までを、社員10〜200名の会社の経営者・総務・情報システム担当の方向けにまとめます。

生成AIの種類を知る前に|生成AIの定義と従来のAIとの違い

生成AIは、利用者の指示をもとに、文章や画像などをその場で新しく作り出すAIの総称です。種類の話に入る前に、どこまでを生成AIと呼ぶのかを公的な定義で押さえておくと、社内で話がずれにくくなります。

生成AIの定義:入力をもとに新しい文章・画像などを作るAI

総務省・経済産業省の「AI事業者ガイドライン(第1.2版)」(令和8年3月31日)は、用語の説明で生成AIを「文章、画像、プログラム等を生成できるAIモデルにもとづくAIの総称」としています。個人情報保護委員会の注意喚起(令和5年6月2日)でも、生成AIサービスを、質問や作業指示(プロンプト入力)に応えて文章・画像等を生成するAIを使ったサービスと説明しています。

つまり、定義の段階ですでに文章・画像・プログラムという複数の出力が並んでいます。生成AIの種類を出力で分ける考え方は、この定義とそのまま対応しています。生成AIの全体像は生成AIとはで詳しく解説しています。

従来のAI(識別・予測)と生成AIの違い

従来のAIは、写真に写っているのが何かを見分ける、来月の売上を予測するといった、決まった答えを出す使い方が中心でした。同ガイドラインは、2021年以降に基盤モデルが台頭し、特定の分野に特化しない汎用的なAIの開発が進んだ結果、予測・提案・決定にとどまらず、画像や文章を生成するAIが普及しつつあると整理しています。

業務で見た違いは、出てくる結果が毎回同じとは限らない点です。見分ける・予測するAIは正解との一致で精度を測れますが、生成AIが作った文章や画像は、人が中身を読んで使えるかを判断する工程が欠かせません。種類を問わず、出力を確認する担当者を決めておく必要があるのはこのためです。

生成AIの種類が4種・7種・8タイプと割れる理由|分け方は3つ

生成AIの種類の数が解説によって違うのは、何を基準に分けるかが違うからで、どれかが間違っているわけではありません。基準は大きく、作るもの(出力形式)、使い方(用途)、動く仕組み(生成モデル)の3つです。それぞれの分け方で何が見えるのかを順に整理します。

分け方1 出力形式による分類(テキスト・画像・動画・音声・コード)

多くの解説が採用しているのが、AIが作り出すものの形式で分ける方法です。テキスト、画像、動画、音声の4つを基本とし、音楽を音声から分けたり、プログラムのコードを独立させたりすると5〜7種類になります。4種類と説明する解説は、この基本の4つで数えています。

会社の検討で最初に使うべきなのはこの分け方です。どの形式を業務で作りたいかが決まれば、候補になるサービスの範囲が決まり、確認すべき規約(画像なら商用利用、文章なら機密情報の入力)も絞れます。

分け方2 会話型・要約型・記事作成型など用途による分類

同じテキスト生成AIでも、使い方で分けると、会話型、要約型、記事作成型、翻訳、調べもの(検索)型などに分かれます。7種類や8タイプと数える解説の多くは、出力形式の分類に、この用途の分類を混ぜて並べています。たとえば会話型と要約型は、同じチャットのサービスで両方できることが珍しくありません。

用途の分類は、サービスを選ぶ基準というより、社内でだれに何を任せるかを決める基準として使うと役に立ちます。議事録の要約は総務、提案書の下書きは営業、というように業務と結び付けやすいからです。

分け方3 仕組み・基盤技術による分類(Transformer・拡散モデルなど)

技術寄りの解説では、AIを動かしている生成モデルの種類で分けます。代表的なものと、その考え方を示した論文は次のとおりです。

  • Transformer:文章を扱う大規模言語モデル(LLM)の土台になっている仕組み。論文「Attention Is All You Need」は2017年6月の発表で、Google for Developers の教材はTransformerを、LLMを作るうえで広く使われている構造として紹介しています
  • 拡散モデル:ノイズから少しずつ画像を復元するように生成する方式。論文「Denoising Diffusion Probabilistic Models」は2020年6月の発表です
  • GAN(敵対的生成ネットワーク):作る側と見破る側の2つのモデルを競わせる方式。論文は2014年6月の発表です
  • VAE(変分オートエンコーダ):データを圧縮した表現の分布を学習し、そこから新しいデータを作る方式。論文は2013年12月の発表です

この分け方は、仕組みを理解するには役立ちますが、利用者がサービスを選ぶ基準にはなりにくいのが実情です。多くのサービスは内部で使うモデルを公表の範囲でしか説明しておらず、利用者側で確認できる項目ではないからです。LLMの仕組みはLLMとはで解説しています。

もう1つの見方 提供形態による分類

会社の導入判断では、出力や仕組みとは別に、どういう形で提供されているかも見ておくと整理がつきます。

  • 単体で使うチャットAI:ChatGPT、Claude、Gemini アプリなど。ブラウザやアプリで直接使う
  • 普段の業務ソフトに組み込まれたAI:Word・Excelの中で使うMicrosoft Copilot、GmailやGoogle ドキュメントの中で使うGemini など
  • 特定の作業に特化したAI:画像ならCanva、音声ならElevenLabs、コードならGitHub Copilot など
  • 複数のAIを1つの契約・画面でまとめて使う法人向けサービス

整理のしかた:出力形式で候補を絞る、用途で担当業務を決める、提供形態で契約と管理の方法を決める。仕組みの分類は理解のために知っておけば十分です。この順に考えると、4種・7種・8タイプのどれを読んでも、社内の検討に置き換えられます。

種類×代表サービスの一覧表

出力形式を軸に、種類ごとのできること、代表的なサービス、会社で使う前に確認することを1枚にまとめると次のようになります。代表サービスは各社の公式ページで提供内容を確認できたものに限っており、順位やおすすめ度を示すものではありません。

種類できること代表的なサービス会社で確認すること
テキスト(会話・要約・下書き)文章の作成、要約、翻訳、アイデア出しChatGPT、Claude、Gemini入力の学習利用、機密情報の線引き
業務ソフト組み込みWord・Excel・メールの中での作成や要約Microsoft Copilot、Google Workspace の Gemini対象ライセンス、社内ファイルの閲覧権限
調べもの(検索)Webを検索し、出典付きで回答Perplexity検索に送られる語、出典の確認
画像イラスト・写真風画像・バナーの生成と編集Midjourney、Stable Diffusion、Adobe Firefly、Canva、ChatGPT、Gemini商用利用の規約、既存作品との類似
動画短い動画、アバターによる説明動画の生成Runway、HeyGen人物・声の権利、生成物の表示
音声・音楽読み上げ、ナレーション、作曲ElevenLabs、VOICEVOX、Sunoキャラクターや声ごとの利用規約
コードプログラムの作成、修正、説明GitHub Copilot、Cursorソースコードの入力範囲、動作確認

※サービスの提供内容は、2026年9月16日〜17日に各社の公式ページで確認した内容です。機能やプランは変更されることがあるため、導入時には各社の公式ページで最新の内容をご確認ください。

出力形式で見る生成AIの種類と代表サービス

同じ種類に分類されるサービスでも、得意な作業、無料で使える範囲、入力データの扱いはそれぞれ違います。ここでは種類ごとに、できることと代表サービスの特徴、会社で使うときの見どころを説明します。

テキスト生成AI(会話型):ChatGPT・Claude・Gemini

文章を作る・読む・直すAIで、後で紹介する企業調査でも業務での利用が多い種類です。質問に答える会話、長い資料の要約、メールや企画書の下書き、翻訳までを1つのサービスでこなせます。

ChatGPTは、OpenAIが2022年11月30日に公開したサービスです。現在は文章に加えて画像の生成にも対応しており、同社は2026年9月8日に画像生成の新しい版を、すべてのプランの利用者が使えると発表しています。

Claudeは、Anthropicが提供するサービスです。会話の横に文書や資料を組み立てる機能や、Excel・PowerPoint・Word・PDFのファイルを作る機能があります。一方で、同社のヘルプは、Claudeは画像生成ツールのように写真やイラストを作るものではないと説明しており、図やグラフはHTMLやSVGで組み立てる形です(ベータ版)。同じテキスト生成AIでも、画像を作れるかどうかはサービスによって違う、という例です。

Geminiは、Googleが提供するサービスです。個人のGoogleアカウントで使うGemini アプリでは、AIプランに加入していなくても、Deep Research、画像生成、音楽生成などの機能が使えると公式ヘルプに記載があります(動画生成は有料のAIプラン以上)。資料をソースとして読み込み、その範囲で引用付きで答えるGemini Notebookもあり、公式のFAQによれば2026年7月にNotebookLMから名称が変わっています。

この3つにPerplexityを加えた4つのAIの違いと、業務ごとの割り当て方は主要4AIの違いと使い分けで詳しく比べています。

Microsoft Copilot:Office・Microsoft 365と連携するAI

Microsoft Copilotは、WordやExcel、PowerPoint、Outlookといった普段使いのアプリの中で使える点が特徴で、提供形態で言えば業務ソフト組み込み型の代表です。Microsoftの公式ページは、Microsoft 365 Copilot の名前が Microsoft Copilot に、Microsoft 365 Copilot Chat の名前が Microsoft Copilot Chat に変わったと案内しています。

使える範囲は、大きく次のように分かれます。無料版はcopilot.cloud.microsoftで使え、文章作成や要約、Web検索に基づく回答ができます。対象となるMicrosoft 365のライセンスを持つ組織には、Webを基にしたCopilot Chatが自動的に含まれます。社内のファイル・メール・チャットを踏まえて答える機能や、Teams会議の要約などは、追加のライセンスで使える形です。

会社で見ておきたいのは、社内ファイルとの関係です。Microsoftは、Copilotが表示するのは各ユーザーが少なくとも閲覧の権限を持っている組織のデータだけだと説明しています。裏返すと、共有フォルダの権限設定が緩いままだと、本来見せるつもりのなかった資料の内容が回答に出てくることがあります。導入前に権限の棚卸しをしておくと安全です。

調べもの(検索)向けAI:Perplexityなど

調べもの向けのAIは、質問を受けるとWebを検索し、見つけた情報をまとめて出典付きで答える種類です。Perplexityの公式ヘルプは、同社のサービスをAIを使った検索エンジンと位置づけ、回答ごとに元の情報源への引用とリンクを付けると説明しています。回答に使うAIモデルは、OpenAIのGPTやAnthropicのClaudeなどから選べます。

出典が付くため裏取りの手間は減りますが、要約が出典の内容と一致しているかは、リンク先を開いて確かめる必要があります。同社のヘルプも、回答にリンクされた出典を参照して情報を確認することが重要だとしています。調べもの型は、質問文そのものが検索の手がかりになるという点で、入力する語に気を配る必要がある種類でもあります(後の注意点の節で説明します)。ChatGPT、Gemini、Claudeにも、複数回の検索を重ねて出典付きの報告をまとめる機能が用意されています。

画像生成AIの代表サービス:Midjourney・Stable Diffusion・Adobe Firefly・Canva

画像生成AIは、文章で指示した内容の画像を作る、手持ちの画像の一部を差し替えるといった作業をする種類です。サービスによって提供の形が大きく違います。

  • Midjourney:公式サイトで、画像と動画のモデルを開発する研究組織と自社を紹介しています
  • Stable Diffusion:Stability AIが提供する画像モデルで、自社の環境で動かすためのライセンス(Self-Hosted License)と、API(プログラムから呼び出す窓口)の両方が用意されています
  • Adobe Firefly:Adobeの日本語ページで、画像や動画、音楽を生成して編集できるサービスとして紹介され、まずは無料で試せると案内されています
  • Canva:デザインツールのCanvaに画像生成AIが組み込まれており、公式ページには無料で利用でき、生成した画像を自由に編集できると書かれています

このほか、ChatGPTやGeminiのようなテキスト生成AIの中でも画像を作れます。ChatGPTの画像作成についてはChatGPTの画像生成で手順と注意点をまとめています。

画像生成AIで会社として確かめたいのは、作った画像を広告や資料に使ってよいかという点です。GoogleとOpenAIは、どちらもAIで作った画像に目に見えない電子透かしなどの目印を付けていると公表しています。また両社の利用規約は、AIの生成物を人間が作ったものと誤解させる使い方を禁止事項に挙げています。商用利用の考え方は、注意点の節で詳しく扱います。

動画生成AI:Runway・HeyGenなど

動画生成AIは、文章や画像から短い動画を作る種類と、人物のアバターに原稿を話させる種類に大きく分かれます。

  • Runway:動画・画像・音声の生成と編集を1つの作業場でできるクラウドのサービスで、個人からチームまで向けと案内され、無料で試せます
  • HeyGen:文章や画像、音声を入力すると、ナレーションや字幕付きの動画を作れるサービスで、AIアバターによる動画作成を前面に出しています

Gemini アプリでも、有料のAIプランに加入すると動画生成を使えます。会社で使う場面は、社内研修の説明動画、商品紹介の短い動画、SNS向けの素材などです。実在の人物の顔や声を使う場合は、その人の許可を事前に得ておくことが前提になります。

音声・音楽生成AI:ElevenLabs・VOICEVOX・Sunoなど

音声生成AIは文章を読み上げる、声を別の言語に吹き替えるといった作業を、音楽生成AIは曲そのものを作る作業を担います。

  • ElevenLabs:テキスト読み上げ、音楽、音声の文字起こし、吹き替えなどを提供しており、同社サイトは70以上の言語と5,000以上の声を使えると説明しています
  • VOICEVOX:無料で使える読み上げソフトで、商用・非商用を問わず無料としつつ、詳しくは各キャラクターの利用規約を参照するよう注記しています
  • Suno:自らを音楽の会社と説明し、ブラウザ上で曲を作る制作環境を提供しています

音声・音楽の種類は、同じサービスの中でも声やキャラクターごとに利用条件が分かれていることがある点が、ほかの種類と違います。サービス全体の規約だけでなく、使う声ごとの条件まで確認してください。

コード生成AIを独立した種類として扱う理由:GitHub Copilot・Cursor

コード生成AIは、出力の形式で言えば文字ですが、テキスト生成AIとは分けて考えるのが実務的です。理由は、結果の確かめ方と、入力する情報の重さが違うからです。文章は読めば良し悪しを判断できますが、プログラムは実際に動かしてテストしないと正しいか分かりません。また、社内システムのソースコードは、それ自体が会社の重要な資産です。

  • GitHub Copilot:Visual Studio CodeやJetBrains IDEなどのエディタに組み込まれ、書いている途中のコードに続きを提案したり、チャットで説明したりします。個人開発者向けの無料プランがあり、法人向けのBusinessは付与されたシートあたり月19米ドルと公式ドキュメントに記載されています
  • Cursor:自社を、ソフトウェアを作るためのコーディングエージェントと説明しています

ChatGPTやClaudeの有料プランにも、コードを書いたり修正したりする機能(CodexやClaude Code)が含まれています。社員10〜200名の会社では、情報システム担当や社内ツールを作る担当者が主な利用者になります。

マルチモーダルAI:複数の形式をまとめて扱うAI

マルチモーダルAIは、文字・画像・音声など異なる種類の情報を1つのAIでまとめて扱えるものを指します。出力形式の分類とは別の軸で、今の主要なテキスト生成AIの多くがこの性質を持っています。

たとえばClaudeは、アップロードした画像を読み取って分析できるとヘルプに記載しています。Perplexityの有料プランはPDF・CSV・音声・動画・画像のファイルを読み込めます。Gemini Notebookは、音声ファイルや画像、字幕付きの公開YouTube動画もソースとして追加できます。ChatGPTでは、声で会話しながら使うこともできます。

業務では、ホワイトボードの写真から議事メモを起こす、紙の請求書の画像から項目を読み取る、会議の録音を要約する、といった使い方がこれに当たります。複数の形式を入力できる分、画像や音声に写り込んだ個人情報にも注意が要ります。

AIエージェント・RAG(社内データ連携)という使い方

種類の話と並んでよく出てくるのが、AIエージェントとRAGという言葉です。どちらも新しい出力形式ではなく、生成AIの使い方の広がりを表しています。

AI事業者ガイドラインは、AIエージェントを、特定の目標を達成するために環境を感知し自律的に行動するAIシステムと定義しています。聞かれたら答えるだけでなく、調べる・まとめる・ファイルを作るといった複数の手順を任せられる形です。

RAG(検索拡張生成)は、社内規程や過去の資料などを検索して、その内容を踏まえて回答させる仕組みです。同ガイドラインは脚注で、RAGの活用などによりハルシネーション(もっともらしい誤り)の抑制が期待されていると述べています。Claudeの有料プランでは、プロジェクトに入れた資料が多くなると、自動でこの方式に切り替わるとヘルプに書かれています。社内データと連携させるほど、その資料をだれが見てよいかという権限の設計が重要になります。

部署ごとに見る生成AIの種類と業務での活用例

白書の企業調査では議事録・メール作成補助の回答割合が高く、画像や動画は使う部署が限られることが多い種類です。部署ごとに、どの種類をどの業務に当てるかの例を挙げます。

業務での活用例:企業調査で多い使い方

総務省「令和8年版 情報通信白書(概要)」の企業調査(2026年1〜2月・インターネットアンケート・従業員10名以上で2025年までにデジタル化に取り組み始めた企業の管理職以上、日本は515件)によると、日本で生成AIを積極的に活用する方針、または領域を限定して利用する方針と答えた割合の合計は68.9%で、2024年度調査の49.7%から大きく上昇しました。何らかの業務で生成AIを利用している割合は86.4%です。

業務の種類ごとでは、議事録・メール作成補助の回答割合が約7割と最も高かったと白書は書いています。会社での生成AIの使い道は、テキスト生成AIによる文書作業が中心になっていると読み取れます。

一方、同じ調査で、生成AIによる業務の変革について組織的な取り組みはないと答えた日本の企業は27.0%でした。米国は1.4%、ドイツは4.9%、中国は2.6%で、白書は日本の割合が他の3か国より高いと指摘しています。使われてはいるものの、会社として種類や使い方を決めていない状態が一定数ある、と読み取れます。

※個人調査では、日本の生成AIの利用経験率は2025年度調査で58.8%でした。ただし2025年度調査から15〜19歳が調査対象に加わっており、20歳以上に限った利用率は52.2%です。2024年度調査(26.7%)と比べるときは、対象年齢が変わった点にご注意ください。

総務・人事

主に使うのはテキスト生成AIです。会議の録音や議事メモからの要約、社内通知や規程改定のお知らせの下書き、求人票の文面の見直しなどに向きます。社内規程を読み込ませて社員の質問に答えるRAGの使い方も、総務の問い合わせ対応を減らす手段になります。人事評価や健康情報のような個人に関する情報は、入力しない情報の代表です。

経理・財務

テキスト生成AIで、月次の報告コメントの下書き、取引先への支払い条件の確認メールの文面づくり、Excelの関数やマクロの書き方の相談に使います。税制や会計基準の改正を調べるときは、調べもの向けAIで出典を確認しながら、最後は国税庁などの一次情報を自分で開いて確かめる、という二段構えが安全です。取引先名と金額が並んだ一覧や未公表の決算数値は、入力しない情報として扱います。

営業・広報

提案書や営業メールの下書きにはテキスト生成AI、展示会やセミナー告知のバナー、SNS投稿の画像には画像生成AI、商品紹介の短い動画には動画生成AIが候補になります。社外に出る制作物が多い部署なので、画像の商用利用の条件と、既存のキャラクターやロゴに似ていないかの確認を、公開前の手順に組み込んでおく必要があります。顧客リストや商談メモを入れる場合は、学習に使われない契約かどうかを先に確かめます。

情報システム担当

コード生成AIで社内ツールや表計算の自動化を進めるほか、各部署が使うAIサービスの契約、学習の設定、アカウントの発行と停止を管理する役割も担います。種類が増えるほど管理の対象も増えるため、どの種類をどの契約で使わせるかを決める立場になります。

種類が増えても、契約と管理は1つにまとめる

文章・画像・検索でサービスを分けると、確認する規約や設定もサービスの数だけ増えます。UPGEAR AI(アップギアAI)は、ChatGPT・Claude・Gemini・Perplexityを1つの契約で使える法人向けサービスです(人数無制限)。

生成AIの種類の選び方(目的・操作性・料金・セキュリティ)

選ぶ順番は、目的(作りたいもの)で種類を決め、操作性で現場が使い続けられるかを見て、料金と契約形態を比べ、最後にセキュリティの条件で絞り込むのが基本です。人気や性能の評判から入ると、自社で使わない機能にお金を払うことになりがちです。

  • 目的:何を作る業務に使うかを先に書き出す文章・調べもの・画像のどれが中心かで、候補になる種類が決まります。
  • 操作性:普段使っているソフトの中で使えるかMicrosoft 365やGoogle Workspaceを使っている会社は、組み込み型から始めると操作を覚える負担が小さくなります。
  • 料金:1人あたりの課金か、会社単位の契約か使わせる人数と使わせる種類の数で総額が変わります。
  • セキュリティ:入力が学習に使われない契約か、管理者が利用状況を確認できるか無料版・個人向けと、法人向けで条件が違うことが多い項目です。

無料プラン・無料版の有無と、無料で使える範囲

主要な生成AIの多くは、無料で試せる入口を用意しています。公式ページで確認できた範囲では、次のとおりです。

  • ChatGPT:無料版があり、テキストの会話に加えて画像生成も使えます。ファイルのアップロードや画像生成には個別の利用上限があります
  • Claude:無料プランで、Web検索、ファイル作成、会話の横に成果物を作る機能などが使えます
  • Gemini アプリ:AIプランに加入しなくても、画像生成や音楽生成、Deep Researchなどが使えます
  • Microsoft Copilot:無料版がcopilot.cloud.microsoftで使えます
  • Perplexity:無料プランがあり、通常の検索は実質無制限で使えます。より詳しく調べるPro Searchには回数の制限があります
  • GitHub Copilot、Canvaの画像生成、VOICEVOX、Runway、Adobe Firefly:いずれも無料で使える、または無料で試せると案内されています

個人向けの有料プランは、日本から表示した料金ページで、ChatGPT Plusが月3,000円、Google AI Proが月2,900円と表示されています(いずれも税込・税別の記載はありません)。Claude Proは月払いで20米ドル(税別)です。

※料金は2026年9月16日時点で各社の公式ページに表示されている金額です。表示通貨や金額は閲覧環境や時期によって変わることがあります。

注意したいのは、無料で使えることと、会社の業務情報を入れてよいことは別の話だという点です。無料版や個人向けプランの多くは、入力の学習利用について利用者自身が設定を変える方式で、会社側から一括で管理できません。会社で使う前提なら、試すのは無料版、業務に使うのは法人向けの契約、と分けて考えるのが安全です。

得意分野に応じた使い分けと複数ツールの併用

1つのサービスで全部の種類をまかなうより、得意分野で使い分けるほうが、外れの回答や手戻りを減らせます。同じテキスト生成AIでも、画像を作れるもの・作れないもの、検索に強いもの、長い資料の読み込みに強いものと特徴が分かれているからです。

併用するときは、用途ごとにどれを使うかを最初に決めておくと現場が迷いにくくなります。たとえば、調べものは出典の出るもの、長い契約書や規程の読み込みは長文に強いもの、画像はデザインツール組み込みのもの、それ以外は既定の1つ、という程度の粗い割り当てで十分です。複数の生成AIをまとめて使う方法はマルチAIとはで解説しています。

何種類を契約するか:1つに絞る場合と併用する場合

社員10〜200名の会社では、使う種類の数を、業務の中身と管理にかけられる手間の両方で決めるのが現実的です。

1つに絞るのが向いているのは、使い道が議事録・メール・要約などの文書作業にほぼ限られ、管理の担当者が兼務で1人しかいない会社です。契約・設定・アカウントの管理が1か所で済み、社員への教え方も1通りで足ります。

併用が向いているのは、調べもの、長文の読み込み、画像づくりなど業務の幅が広く、部署ごとに求める種類が違う会社です。ただし1人あたりの課金のサービスを種類ごとに別々に契約すると、費用は人数と契約数の掛け算で増え、管理画面もサービスの数だけ分かれます。その結果、一部の社員にしか配れず、配られなかった社員が個人のアカウントで使い始めることがあります。併用する場合は、契約と管理をどこまでまとめられるかを費用と同じ重さで比べてください。法人向けサービスの料金の横並びは法人向け生成AIサービスの比較にまとめています。

種類ごとに違う注意点|会社で使う前に確認すること

会社で生成AIを使うときの注意点は、学習への利用、情報漏えい、誤情報、著作権の4つに集約できますが、どこに重点を置くかは種類によって違います。文章系は入力する情報、調べもの系は検索に送られる語、画像・音声系は出力の権利が、それぞれの中心になります。

入力内容が学習に使われるか(オプトアウトと有料版・法人向けの扱い)

同じサービスでも、個人向けと法人向けで、入力内容を学習に使うかどうかの既定値が逆になっていることがあります。各社の公式の説明は次のとおりです。

  • ChatGPT:個人向けの無料版・Go・Plus・Proでは、料金ページの比較表で学習への利用が無効化可能と表示され、設定から自分でオフにする形です。ChatGPT Businessなどの法人向けは、デフォルトではビジネスデータを学習に使用しないとされています
  • Claude:個人向けのFree・Pro・Maxはオプトアウト(利用者が自分でオフにする)、Team・Enterpriseは既定では学習に使わないと料金ページに表示されています
  • Gemini:個人アカウントでは、アクティビティの保存をオフにすると今後のチャットは学習に使われないとされています(フィードバックを送った場合を除く)。Google Workspaceでは、組織のコンテンツが許可なくドメイン外で生成AIモデルのトレーニングに使われることはないと説明されています
  • Perplexity:無料版・Pro・Maxでは、学習などに使うデータ保持の設定が既定で有効になっており、オフにしてもそれ以前に集めたデータには適用されないとヘルプにあります。法人向けのEnterpriseのデータは学習に使わないとされています
  • Microsoft Copilot:職場のアカウントで使う場合、プロンプトや応答は基盤モデルのトレーニングに使われないと説明されています。個人アカウントの無料版は、アプリの版によって説明のページが分かれています

ここがポイント:無料版・個人向けで学習をオフにする設定は、社員一人ひとりの操作に任されます。10人に配れば10回、50人なら50回の設定が必要で、だれかが忘れても会社からは見えません。会社で使うなら、法人向けの契約で既定値として学習に使われない状態を選ぶほうが確実です。学習させない設定の詳しい手順と考え方は生成AIのセキュリティ対策チェックリストでも整理しています。

※各社のデータの扱いは、2026年9月16日〜17日に各社の公式ヘルプ・料金ページで確認した内容です。

情報漏えい・機密情報/個人情報の入力:種類ごとの線引き

入力してよい情報は、公開情報、社内の一般的な情報、顧客情報・個人情報・未公表の数字の3段階で線を引くと、社員に説明しやすくなります。

  • そのまま入れてよい:公開情報 自社サイトに載っている会社概要、公表済みのプレスリリース、一般的な業界知識など
  • 法人向けの契約でなら入れてよい:社内の一般的な情報 社内規程、議事メモ(個人名を伏せたもの)、提案書のひな形など
  • 原則として入れない:顧客情報・個人情報・未公表の数字 顧客リスト、従業員の評価や健康情報、発表前の決算数値や取引条件など

個人情報については、個人情報保護委員会が令和5年6月2日の注意喚起で、あらかじめ本人の同意を得ずに個人データを含むプロンプトを入力し、その個人データが応答結果の出力以外の目的で扱われる場合、個人情報保護法の規定に違反することとなる可能性があると述べています。そのうえで、入力する場合は、提供事業者がその個人データを機械学習に利用しないことなどを十分に確認するよう求めています。AI事業者ガイドラインも、事業者としてAIを使う立場(AI利用者)に対し、個人情報や機密情報を不適切に入力しないよう注意を払うことを求めています。

種類ごとに特に気を付けたいのが、調べもの向けAIとWeb検索付きの会話です。検索をするということは、質問から作った検索の語が外部の検索サービスに送られるということです。たとえばMicrosoftは、Copilotが作ったWeb検索のクエリはBingに送られ、その部分には通常のデータ保護の補遺が適用されないと説明しています(非常に短いプロンプトを除き、プロンプト全体やファイル全体は送られないとしています)。管理者はWeb検索をオフにすることもできます。未発表の新商品名や、買収・提携の相手先の社名を検索付きのAIに入れるのは避けたほうが安全です。

画像や音声を扱う種類では、写真に写り込んだ顧客名の書類や、録音に含まれる個人名など、入力する側が気付きにくい情報が混ざりやすくなります。業務情報が漏れる経路の全体像は野良AI(シャドーAI)とはもあわせてご覧ください。

ハルシネーション(誤情報)とファクトチェック

ハルシネーションとは、AIがもっともらしいが事実と異なる内容を出力することです。IBMはこれを、もっともらしく聞こえるが事実として誤っている、無関係、または完全に作り上げられた出力と説明しています。種類を問わず起きますが、影響の出方が違います。

テキスト生成AIでは、存在しない法令の条文、架空の統計、実在しない参考文献が混ざることがあります。総務省の「生成AIはじめの一歩」は、生成AIへの質問で実在しない山の名前や存在しないお店が回答に含まれる例を示し、生成AIに真偽を問うことは適切ではないとしています。調べもの向けAIは出典が付く分だけ確認しやすいものの、出典の内容と要約が食い違うことがあるため、リンク先を開いて確認する工程は省けません。コード生成AIの誤りは、動かしてテストすれば見つけやすい一方、見た目では気付けないこともあります。

ファクトチェックの基本は、数字・日付・固有名詞・法令を、公的機関や発表元の一次情報で確かめることです。社外に出す文書は、AIの出力をそのまま使わず、確認した人の名前が分かる形で公開の手順に組み込んでおくと、誤りが残りにくくなります。

著作権・商用利用の確認:画像・音声・文章で見る点が違う

著作権の考え方は、文化庁の文化審議会著作権分科会法制度小委員会がまとめた「AIと著作権に関する考え方について」(令和6年3月15日)が基本の資料になります。この資料自体は法的な拘束力を持つものではなく、現行の著作権法の解釈について、公表時点での小委員会としての一定の考え方を示したものと位置づけられています。

同資料の概要は、生成された画像等に既存の著作物との類似性(創作的表現が共通していること)と依拠性(既存の著作物をもとに創作したこと)が認められ、権利制限規定の対象外であれば、著作権侵害になると整理しています。さらに、既存の作品が学習に使われていた場合は、利用者がその作品を知らなくても通常は依拠性が推認されるとしています。生成が適法でも、SNSへの投稿などの利用まで直ちに適法になるわけではない、という点も示されています。文化庁は令和6年7月31日に、利用者向けの確認項目をまとめた「AIと著作権に関するチェックリスト&ガイダンス」も公表しています。

種類ごとに確認する点は次のように分かれます。

  • 画像生成:特定の作家名・作品名・キャラクター名を指示に入れない。ロゴや既存の商品に似ていないかを公開前に確認する。サービスの規約で商用利用の条件を確かめる
  • 音声・音楽生成:声やキャラクターごとの利用規約を確認する。実在の人物の声に似せない
  • 文章生成:他社の記事や書籍の文章を大量に貼り付けて書き換えさせない。公開する文章は既存の文章との重なりを確認する

規約の面では、OpenAIの個人向け利用規約は、利用者がアウトプットを所有するとしつつ、他の利用者が同様のアウトプットを受け取る場合があると書いています。Googleは、Google Workspaceの Gemini など有料で提供するサービスの生成物について、第三者の知的財産権の侵害を主張された場合の補償の対象に含めています(補償の対象でも、侵害の可能性を知りながら使った場合など、対象外となる条件があります)。一方、この補償の一覧に個人向けの Gemini アプリは含まれていません。同じ会社の画像生成でも、契約の種類によって会社が受けられる保護が違うということです。

会社で生成AIを安全に使うには

会社で生成AIを安全に使う近道は、種類ごとの使い道を決めたうえで、会社が認めた環境を先に用意し、そこでのルールと管理の仕組みをそろえることです。禁止するだけでは、便利さを知った社員が個人のアカウントで使い続け、会社から見えない利用が残ります。

社内ルール・利用ガイドライン・従業員教育

社内ルールには、少なくとも次の4つを書いておきます。使ってよいサービスと種類、入力してよい情報と入力しない情報、出力を確認する人と確認のしかた、社外に出す制作物の著作権と商用利用の確認手順です。総務省の「生成AIはじめの一歩」が情報流出を防ぐ行動として挙げている、規約の確認、個人情報や機密情報の入力を必要最小限にすること、学習に使わせない設定(オプトアウト)も、そのままルールの項目になります。

ルールは作って配るだけでは定着しません。部署ごとの使い道に合わせて、入力してよい例・いけない例を具体的に見せる短い研修を最初に行い、新しい種類のサービスを使い始めるときにルールを見直す流れを作っておくと、形だけのルールになりにくくなります。ルール文書の作り方は生成AIの社内ガイドラインの作り方で解説しています。

学習させない設定・ログ管理・社員への配布を先に決める

ルールと同じくらい大切なのが、仕組みで守れる部分を先に固めることです。会社として環境を用意するときは、次の点を確認してください。

  • 入力データが学習に使われない状態が、全員に一律で適用されるか社員ごとの設定に任せる方式では、設定漏れを会社側で見つけられません。
  • だれが・いつ・どのAIを使ったかを管理者が確認できるか問題が起きたときに経緯をたどれるかどうかが、この項目で決まります。
  • アカウントの発行と停止を管理者ができるか退職や異動のときに、会社側で利用を止められる必要があります。
  • 全社員に配れる料金体系か一部の社員にしか配れないと、配られなかった社員が個人のアカウントに流れやすくなります。
  • 使う種類ごとに、得意なAIを切り替えて使えるか文章・調べもの・画像で得意なAIが違うため、1つに固定すると使い分けの効果が出にくくなります。

考え方の順番:生成AIの種類が増えるほど、社員が個人で別々のサービスを契約する余地も増えます。先に会社で認めた環境を用意し、その中で種類を使い分けられるようにしておくと、見えない利用を減らしながら活用を広げられます。

文章・画像・調べもので得意なAIは違う。だから複数を1画面で

UPGEAR AIは、ChatGPT・Claude・Gemini・Perplexityを1画面で切り替えて使える法人向けAI基盤です。全モデルで学習非利用を標準適用し、管理画面ではUPGEAR AI上でだれが・いつ・どのAIを使ったかを一覧で確認できます。料金は月額30,000円(税抜)からで、ユーザーごとの課金はありません(人数の目安はライト1〜5名、スタンダード6〜20名、プレミアム21〜50名)。

UPGEAR AIの詳細を見る

よくある質問(一番優秀なAIは?など)

生成AIにはどんな種類がありますか?
作るもの(出力形式)で分けると、テキスト、画像、動画、音声・音楽、コードが主な種類です。使い方で分けると会話型・要約型・記事作成型・調べもの型など、仕組みで分けるとTransformerを使う大規模言語モデルや拡散モデルなどに分かれます。解説によって4種類・7種類・8タイプと数が違うのは、この分け方の軸が違うためです。会社で検討するときは、まず出力形式で候補を絞り、次に用途で担当業務を決めると整理しやすくなります。
ChatGPTは生成AIですか?
はい、生成AIです。総務省・経済産業省のAI事業者ガイドラインは、生成AIを文章、画像、プログラム等を生成できるAIモデルにもとづくAIの総称としています。ChatGPTは、指示に応じて文章を作り、画像の生成にも対応しているため、この定義に当てはまります。種類で言えば、テキスト生成AIを中心に、画像生成や音声での会話もできるマルチモーダルなサービスです。
ChatGPTより優れたAIツールはありますか?
どの作業に使うかで答えが変わるため、すべての点でChatGPTより優れたツールがある、とは言えません。たとえば出典付きの調べものを重視するならPerplexity、WordやExcelの中で使いたいならMicrosoft Copilot、Google Workspaceを使っているならGemini、写真やイラストの制作が中心ならCanvaやAdobe Fireflyのような画像生成ツールが候補になります。作りたいものと使う場所から選ぶと、自社に合うツールが見つけやすくなります。
生成AIで一番優秀なAIはどれですか?
用途によって違うため、一番を1つに決めることはできません。文章、調べもの、画像、コードで得意なサービスが分かれており、各社が新しいモデルを短い間隔で公開しているため、評判の順位も入れ替わります。各社が発表する性能の数値は多くが自社による測定で、第三者の検証とは限りません。会社では、1つを選び切るより、用途ごとに使うAIを決めておくほうが、選び直しの手間を減らせます。
無料版の生成AIを会社の業務で使ってもよいですか?
試しに使うことはできますが、業務情報を入れる使い方はおすすめしません。無料版や個人向けプランでは、入力の学習利用を利用者自身が設定で変える方式が多く、会社側で全員の設定を管理できないためです。個人情報保護委員会も、個人データを含むプロンプトを入力する場合は、提供事業者が機械学習に利用しないことなどを十分に確認するよう求めています。業務で使うなら、学習に使われない法人向けの契約を選ぶのが安全です。
画像生成AIで作った画像は広告や資料に使えますか?
サービスの規約と、既存の作品に似ていないかの2点を確認したうえで使うのが基本です。文化庁の考え方では、既存の著作物との類似性と依拠性が認められれば著作権侵害になり得るとされ、生成が適法でも利用まで直ちに適法とは限らないと整理されています。特定の作家名やキャラクター名を指示に入れないこと、公開前に人が確認することを社内の手順にしておくと安全です。

まとめ

生成AIの種類は、作るもの(出力形式)、使い方(用途)、動く仕組み(生成モデル)の3つの軸で分けられ、解説によって4種・7種・8タイプと数が違うのは軸の違いによるものです。会社での検討には、出力形式で候補を絞り、用途で担当業務を決め、提供形態で契約と管理の方法を決める、という順番が使いやすい整理です。

種類ごとの代表サービスは、テキストならChatGPT・Claude・Gemini、業務ソフト組み込みならMicrosoft Copilot、調べものならPerplexity、画像ならMidjourney・Stable Diffusion・Adobe Firefly・Canva、動画ならRunway・HeyGen、音声・音楽ならElevenLabs・VOICEVOX・Suno、コードならGitHub Copilot・Cursorです。同じ種類でも、無料で使える範囲、学習の既定値、商用利用の条件はサービスと契約ごとに違います。

会社で使う前には、入力が学習に使われるか、入力してよい情報の線引き、誤情報の確認手順、著作権と商用利用の条件を、種類ごとに確かめてください。そのうえで、会社が認めた環境を先に用意し、学習させない設定・利用状況の確認・全社員への配布をそろえておくと、種類が増えても安全に使い分けられます。おすすめのサービスを目的別に知りたい方は生成AIのおすすめを、ほかの記事はAI活用コラム一覧をご覧ください。