

Angle
データライフサイクル管理を最適化し、AIの成果を向上させ、リスクを低減する
- 3 mins
重要なポイント:データ品質が低かったり、情報の整理が不十分だったりする状態では、組織は信頼性の高いAIを実現することはできません。冗長、陳腐化、または些細な(ROT)データを体系的に削減し、正当性のある保存・廃棄ポリシーを適用し、情報アーキテクチャを強化し、AIコンテンツを適切に管理することで、組織はよりクリーンなデータ環境を構築できます。これにより、より正確なAI出力が得られ、リスクが低減され、責任あるAIの導入を大規模に推進することが可能になります。
組織が「責任あるAI導入に向けた準備」のプロセスを進めていく中で、各ステップはすべて、AIが信頼性が高く、安全で、コンプライアンスに準拠し、適切にガバナンスされた情報によって支えられていることを確保するという、同じ目標に向かって積み重ねられていきます。
生成AIツールの有用性は、アクセスできるデータの質に左右され、そのデータの質は結果に直接影響を与えます。責任あるAI導入に向けた取り組みは、慎重かつ意図的なAIの導入から始まります。10段階のプログラムにおける第7段階では、組織が管理可能な実践的なレベル、すなわちデータライフサイクル管理に焦点を当てています。
その目的は2つあります。第一に、価値の低いコンテンツや古いコンテンツを削減することで、AIの成果を向上させること。第二に、AIツールが生成するデータを含め、コンテンツに対して保存および廃棄ポリシーを一貫して、かつ正当な根拠に基づいて適用することで、リスクを低減することです。
データライフサイクル管理がAIの精度に直接影響を与える理由
従来、データの保存期間はコンプライアンス要件として扱われてきました。しかし、データが無期限に保存されたり、一貫性なく適用されたりすると、組織には測定可能なコストとリスクが生じます。過剰なデータはストレージコストを増大させ、検索を複雑にし、ユーザーやAIシステムが関連情報を取得しようとする際の信号対雑音比を悪化させます。
データ品質の低下も、AIの出力精度の低下の一因となります。データセットが古くなった情報、冗長な情報、あるいは些細な情報で占められている場合、AIツールは関連性のない情報や誤解を招く情報を提示する可能性が高くなります。このような状況は、意思決定、規制対応、および訴訟リスクにリスクをもたらします。
成熟したデータライフサイクル管理プログラムは、この状況を打開します。これにより、組織は必要なデータを保持し、不要になったデータを廃棄し、高品質で関連性の高いコンテンツへのアクセスを維持できるようになります。その結果、組織はコンプライアンス要件を満たしつつ、AIのパフォーマンスを向上させることができます。
ライフサイクル最適化の実践例
データライフサイクル管理とは、情報の作成、保存、利用、保持、アーカイブ、削除といった全ライフサイクルにわたる、継続的な運用上の取り組みです。効果的なプログラムでは、情報の保持および廃棄を日常業務に組み込むことで、データの完全性、セキュリティ、コンプライアンス、および業務効率を向上させます。
実用的なライフサイクルプログラムには、通常、以下の要素が含まれます。
ガバナンス:法的、規制上、およびビジネス上の要件を整合させるために、役割、意思決定権限、およびポリシー基準を定義します。
インベントリ:どのようなデータが存在するか、どこに保存されているか、どのコンテンツが機密情報または規制対象であるかを可視化します。
保存期間:システムやコンテンツの種類を問わず、一貫して適用される明確かつ実行可能なルールを定めます。
監査可能性:チームがポリシーを適用し、例外を管理し、正当な根拠に基づく廃棄措置を確実に実施していることを確認するための継続的な報告を行います。
自動化:ライフサイクルポリシーの自動化により、エンドユーザーによる手動での記録管理への依存を減らし、一貫した導入を支援します。
情報アーキテクチャ:AI導入に向けたデータの整理
情報アーキテクチャは、保存されたデータを適切な場所に一元化し、論理的に整理し、一貫性のあるラベル付けを行い、明確な所有権とアクセス制御と結びつけることで、AI導入の準備態勢を強化します。Microsoft 365 (M365) において、これは SharePoint サイトの構造、Teams ワークスペース、メタデータ、アクセス許可、および信頼できる情報源を改善し、ユーザーや AI ツールが適切な情報を検索、理解、信頼できるようにすることを意味します。その目的は、単にデータを保持するだけにとどまらず、より正確で関連性が高く、責任ある AI の成果を支える、体系化された情報環境を構築することにあります。
リスクの高い、陳腐化した、または些細なコンテンツを削減し、AIの成果を向上させる
データライフサイクル管理の主な利点は、正当化可能なデータ最小化を通じて、生成AIによる「幻覚」を低減できることです。ほとんどの環境において、コンテンツの相当な部分が時間の経過とともに冗長、陳腐化、または些細なもの(ROT)となってしまいます。ライフサイクル管理が行われない場合、こうしたコンテンツが蓄積され、利用可能な情報の質を低下させてしまいます。
ライフサイクル最適化は、この問題を体系的に解決します。一貫性があり、正当化可能な削除アクションを可能にする、適切に設計された保存ポリシーを通じて、組織は必要な情報や価値ある情報を保持しつつ、ROTを削減します。これにより、検索、情報取得、およびAIの出力が、より関連性が高く信頼性の高いデータに基づいて行われることが保証されます。
実践的なアクションモデル
実践的なライフサイクル・プログラムでは、情報を効果的に管理するために必要な能力を定義します。以下のアクションモデルは、それらの能力をAI導入準備にどのように適用するかを示しています。
リポジトリの優先順位付け:組織はまず、AIの出力結果に最も影響を与える可能性の高いリポジトリやコラボレーションスペースを特定することから始めます。
リスクの評価:それらの環境について、ROT(レガシー、不要、過大)、保存期間の不備、所有権の不明確さ、およびガバナンスが必要なプロンプト、要約、トランスクリプト、出力結果などのAIコンテンツを評価します。
ルールの定義:その評価に基づき、法務、コンプライアンス、記録管理、およびビジネスの各ステークホルダーが、必要な情報を保持しつつ、AIツールが利用可能な不要なデータを削減する、正当化可能な保存、廃棄、および最小化のルールを定義します。
管理措置の試験運用:これらのルールは優先領域で試験運用され、その正確性とユーザーへの影響が監視された上で、環境全体に展開する前に改良されます。
成果の測定:時間の経過とともに、ROTの削減、ポリシーの適用範囲の拡大、正当性のある削除活動、およびよりクリーンでガバナンスの行き届いたデータを支える高品質なAI出力によって、成功が測定されます。
情報アーキテクチャの強化:優先度の高いリポジトリ、サイト、ワークスペース、メタデータ、および所有権モデルを整理し、保存されたデータをユーザーやAIツールが容易に見つけ、理解し、信頼できるようにします。
コンプライアンス要件:AIデータの管理
組織がAIツールを導入するにつれ、プロンプト、出力結果、要約、その他のAI生成物など、新たな種類のコンテンツも生成されるようになります。これらのデータタイプは、ライフサイクル計画に組み込む必要があります。
包括的なライフサイクル戦略では、どのAIコンテンツを保存するか、どこに保存するか、そしてどのようにガバナンスを行うかを定義します。これらの決定は、法的義務、規制当局の期待、およびビジネス要件と整合していなければなりません。明確なガバナンスがなければ、AIの導入はリスクを低減するどころか、かえってリスクをもたらすことになります。
データライフサイクルポリシーを大規模に適用する方法
組織は、ポリシー要件をコラボレーション、コミュニケーション、コンテンツリポジトリ全体にわたる運用上の制御に変換するエンタープライズ情報ガバナンスプラットフォームを活用することで、データライフサイクルポリシーを大規模に適用しています。たとえば、M365 では、Microsoft Purview がライフサイクル管理および記録管理を大規模に実装するためのフレームワークを提供しています。このプラットフォームにより、組織はポリシーの意図を強制可能な構成に変換することができます。一般的なライフサイクル制御には、次のようなものがあります。
- Exchange、SharePoint、OneDrive、Teams などのワークロード全体に適用される保存ポリシー。
- アイテムまたはドキュメントレベルで、手動または自動化を通じて適用される保存ラベル。
- 静的な割り当てではなく、属性に基づいてポリシーを調整できる動的なターゲティングメカニズム。
- レビュー、承認、および正当な廃棄の証明をサポートする廃棄ワークフロー。
目的は、ツールを前面に押し出すことではなく、ポリシーが適用され、監視され、時間の経過とともに一貫して改善されるシステムを実装することです。
データライフサイクル管理の定量的なメリット
効果的なデータライフサイクル管理により、組織は経営陣にとって重要な成果を達成できるようになります。
- 規制や法的要件を満たす。
- 一貫したポリシーの適用を通じてリスクを低減する。
- ストレージおよび運用コストを抑制する。
- AI出力の品質と信頼性を向上させる。
強固なデータライフサイクルの基盤は、基盤となるデータ環境が目的意識を持ち、適切にガバナンスされていることを保証することで、生成AIの導入拡大を可能にし、ひいてはユーザーにより優れた出力を提供します。
データライフサイクル管理を持続させるために必要なこと
ポリシーの設計、テクノロジーの構成、運用サポートを整合させることで、組織はデータライフサイクル管理を運用化することができます。これには、ビジネスニーズに合わせて保存ポリシーをカスタマイズすること、正当な根拠に基づく削除を通じて冗長・陳腐化・無意味(ROT)なデータを削減すること、および分類と自動化を通じてデータフットプリントを最適化することが含まれます。
ライフサイクルポリシーの管理においては、まずM365に焦点を当てるべきです。M365は、多くの場合、企業コンテンツが作成、共有、保存され、AIツールによってアクセスされる主要なコラボレーションおよび生産性環境だからです。M365内では、組織はExchange、OneDrive、SharePoint、Teams、およびAIコンテンツ全体にライフサイクル制御を適用する必要があります。明確な責任の所在を割り当て、ポリシーの適用範囲を監視し、処分活動を測定するとともに、ビジネス、法規制、およびデータ環境の進化に合わせて、保存およびガバナンスの実践を継続的に改善する必要があります。
異なるプラットフォームや運用プロセスを通じて管理措置を実施する場合であっても、他のすべての企業データソースについては、同じライフサイクル・ガバナンス・モデルを通じて対応する必要があります。ファイル共有、レガシーリポジトリ、業務システム、データベース、アーカイブ、サードパーティ製プラットフォームを、リスクとビジネス価値に基づいて棚卸しし、優先順位を付けます。保存および廃棄要件に照らし合わせ、文書化された所有権、反復可能なレビューサイクル、および正当性を立証できる削除慣行を通じてガバナンスを実施します。
データ環境が質の高いAI出力を生み出すようにする
データライフサイクル管理を最適化することは、リスクを低減しつつAIの出力品質を向上させる最も直接的な方法の一つです。冗長なデータや価値の低いデータを削減し、保存方針を標準化し、正当性のある廃棄を確実に行うことで、組織はAIが関連情報をより高い精度で抽出できる環境を構築できます。
ステップ7では、価値の低いデータを最小限に抑えることで、AIによる「幻覚」を低減します。これにより、企業コンテンツとAIコンテンツの両方が、包括的なライフサイクル戦略を通じて適切に管理されるようになります。
Epiq Information Governance の詳細をご覧ください。

ジュリー・コルガン、クライアント戦略・情報ガバナンス担当副社長
ジュリー・J・コルガンは、組織が情報資産に関連するリスクと機会を特定、理解、優先順位付けし、管理できるよう支援しています。25年以上にわたり実務家および信頼されるアドバイザーとして活躍し、情報ガバナンス戦略と事業運営を整合させる実践的なソリューションに注力しています。
協会および専門分野への貢献が認められ、ARMAは2019年に彼女をフェロー協会(FAI)の会員に選出した。彼女は、公認記録管理者協会(Institute of Certified Records Managers)が授与する公認記録管理者(CRM)資格、およびARMA Internationalが授与する公認情報ガバナンスプロフェッショナル(IGP)認定資格を保有している。