コンテキストレイヤーの整備が鍵に
なぜOpenAIの社員はSQLを書かないのか? 「データの迷子」をなくす6つのメタデータ戦略
OpenAIは、自社プラットフォーム上で探索とリーズニングを実行する社内用のAIデータエージェントを構築し、運用している。その内容は。
OpenAIは2026年1月、同社の独自プラットフォーム上で「リーズニング」(人間のような論理的思考プロセスで問題を解決する人工知能<AI>の能力)を実行する社内用のカスタムAIデータエージェントを構築し、運用していることを明らかにした。その詳細は。
カスタムAIデータエージェントの中身は?
OpenAIのカスタムAIデータエージェントは、大規模言語モデル(LLM)「GPT-5.2」を中核モデルとして搭載し、Codex(CLI を含む)などのツール群と組み合わせて構築されている。
このカスタムAIデータエージェントの構築、運用には、OpenAIが提供している以下のツールが使われている。
- OpenAI Codex CLI
- 自然言語からソースコードを生成するAIモデル「OpenAI Codex」のコマンドラインインタフェース(CLI)
- OpenAI Evals API
- AIモデルの性能を評価するためのフレームワーク「OpenAI Evals」のAPI
- Embeddings API
- テキストを数値ベクトルに変換する「Embeddings」のAPI
本カスタムAIデータエージェントは、エンジニアリング、データサイエンス、GTM(市場進出戦略)、財務、研究の各部門が、データに関する問題を解決するために活用している。本カスタムAIデータエージェントを使うことで、質問からインサイトを得るまでの時間は数日から数分に短縮されたという。
カスタムAIデータエージェントが必要になった理由
OpenAIのデータプラットフォームは、エンジニアリング、製品、研究の各部門に属する3500人以上の社内ユーザーにサービスを提供しており、7万以上のデータセットと600ペタバイト(PB)を超えるデータを扱っている。
これだけの規模になると、適切なテーブルを見つけるだけでも大変な労力を要する。似たようなテーブルが多数存在するため、ユーザーはどのテーブルを使用すべきか、どのフィールドが重複しているかを見極めるのに多大な時間を費やしていた。さらに、正しいテーブルを選択できても、正しい結果を導き出すことは容易ではない。そこで、従業員がSQLのデバッグに時間を費やすのではなく、指標の定義や過程の検証、データ主導の意思決定に集中できる環境が必要となったのだ。
カスタムAIデータエージェントの仕組みと特徴は
GPT-5.2を基盤とするカスタムAIデータエージェントは、Slack、Webインタフェース、IDE(統合開発環境)、OpenAI Codex CLIなどを使って、OpenAIの従業員が普段作業している場所から利用可能だ。
カスタムAIデータエージェントに対しては、複数回の試行錯誤が必要な質問や自由回答を求める質問を投げかけることができる。
特筆すべきは、カスタムAIデータエージェントがリーズニングを実行しながら問題を処理する能力だ。固定されたスクリプトに従うのではなく、自らの進捗状況を評価しながら処理を進める。中間結果が間違っているように見える場合、カスタムAIデータエージェントは何が間違っていたかを調査し、アプローチを調整して再試行する。
このプロセス全体を通じてカスタムAIデータエージェントはコンテキスト(社内データ、メタデータ、注釈、コード由来情報、組織知識などに基づく背景情報)を保持し、ステップ間で学習内容を引き継ぐ。この自己学習プロセスにより、ユーザーは手動で反復作業を行う必要がなくなり、手動のワークフローよりも迅速で一貫した高品質の分析が可能になる。
コンテキストが鍵
高品質な回答を生成する鍵は、豊かで正確なコンテキストだ。コンテキストがない場合、モデルに高い性能があっても、誤った結果を生成する可能性がある。こうした問題を防ぐため、カスタムAIデータエージェントは同社のデータと複数のコンテキストレイヤーに基づいて構築されている。
レイヤー1:テーブルの使用状況
スキーマのメタデータ(列名とデータ型)に応じてSQLの書き込みを通知し、テーブル系統(上流と下流のテーブルの関係)を使用して、テーブル間の関係に関するコンテキストを提供する。過去のクエリを取り込み、独自のクエリ記述方法や、通常どのテーブルが結合されるかを理解できるようになる。
レイヤー2:人間による注釈
データウェアハウスにおける人間の業務知識をAIに注入するメタデータのレイヤー。スキーマや過去のクエリからは推測しにくい意図、ビジネス上の意味、既知の注意事項などが含まれる。
レイヤー3:Codexエンリッチメント
テーブルのコードレベルでの定義を導き出すことで、データに何が含まれているかをより深く理解できる。これにより、Spark、PythonなどのデータシステムでSQL以外にテーブルがどのように使用されるかが示され、強化された使用状況コンテキストが得られる。
レイヤー4:インスティテューショナルナレッジ
Slack、Googleドキュメント、Notionにアクセスし、リリース、信頼性インシデント、社内コード名およびツール、主要指標の定義と計算ロジックといった社内の重要なコンテキストを、メタデータおよび権限とともに安全に取得する。
レイヤー5:メモリ
修正を加えられたり、データに関する微妙な差異を発見したりすると、それらの学習内容を次回まで保存できるようになっている。これにより、次回以降はより正確な前提から回答することが可能になる。こうした学習内容の保存は、ユーザーの確認を経て実施される。
レイヤー6:ランタイムコンテキスト
テーブルに事前のコンテキストが存在しない場合や、既存の情報が古い場合、データウェアハウスにライブクエリを発行し、テーブルを直接調べたりクエリしたりできるようになっている。これにより、スキーマを検証する、データをリアルタイムで理解する、状況に応じて回答するといったことが可能になる。必要に応じて他のデータプラットフォームシステムと通信し、より広範なデータコンテキストを取得することも可能だ。
カスタムAIデータエージェントの開発で得た教訓は?
OpenAIは、カスタムAIデータエージェントの構築、運用を通じて、以下の教訓を得たという。
ツールは絞る
OpenAIは当初、同社で利用している全てのツールをカスタムAIデータエージェントに公開していた。その結果、ツールが保有する機能が重複していることでカスタムAIデータエージェントが混乱し、問題が生じたという。そこで、曖昧さを減らし、信頼性を高めるため、特定のツールは利用しないことにしたという。
詳細過ぎる指示は逆効果
過度に具体的な指示を含むプロンプトからはよい結果を得られないことが分かった。分析の細部はケースごとに異なるため、より高レベルのガイダンスを提供し、実行経路の選択はGPT-5のリーズニングに委ねることで、カスタムAIデータエージェントはより良い結果を生み出すようになったとOpenAIは分析している。
意味はコードに宿る
スキーマやクエリ履歴を見ると、「どんな形のテーブルなのか」「どう使われてきたのか」は分かる。しかし、そのデータが本当に何を意味しているのかは、実はそれを作っているコードの中にある。データパイプラインのコードには、「どんな前提条件で作られているか」「データの鮮度をどう保っているか」「どんなビジネス目的で変換しているか」といった、SQL やメタデータだけでは見えない情報が含まれている。OpenAI Codexがコードベースを横断的に読み取ることで、カスタムAIデータエージェントは「このテーブルはどのように作られ、どんな意図で使われるものなのか」を理解できるようになる。これにより、「この数字は何を意味するのか」「このデータは今すぐ使えるのか」といった問いにも、より現実に即した答えを返せるようになる。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
新着ホワイトペーパー PR
-
製品資料
[株式会社ビザスク] 製造業の新事業創出 成功の鍵は「タラレバ問題克服」と「3つの判断ポイント」 -
製品資料
[日本シーゲイト株式会社] 実験のやり直しを防止 研究データ基盤に求められる高可用性ストレージとは -
製品資料
[株式会社Leaner Technologies] もっと安く買えるのに…… 間接材購買で“コスト削減機会”を逃さないためには -
製品資料
[株式会社セールスフォース・ジャパン] フィールドサービスの熟練技術者が「AIエージェント」を求めている理由 -
製品資料
[株式会社グリーンフィールド・オーバーシーズ・アシスタンス] 基礎から分かる「就労ビザ」 アメリカ進出を目指すなら知っておきたい取得戦略
こんなメディアも見られています
TechTargetジャパンに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
ベンダーコンテンツ PR
From Informa TechTarget
SpecialPR
アクセスランキング
-
1
ソフトウェア開発組織の疲弊を防ぐ、AI駆動開発の「レビュー負荷軽減」実践事例
-
2
年収700万超エンジニアに共通するスキルと「もっと勉強すべきだった分野」
-
3
仮想化環境の死角を“未知の脅威”が狙う時代――新たな敵をどう見破るか?
-
4
「Salesforceのテスト自動化ツール」に関するアンケート
-
5
高額GPUを買っても成果ゼロ? 「プライベートAI」の落とし穴
-
6
ITエンジニア1265人調査 生成AIを使い込むほど「人の確認」が重い理由
-
7
ChatGPTの「GPT」とは? 仕組みや用途など“ChatGPTの基本”を解説
-
8
9割が頓挫する「AI内製化」 差がついたのはツールより設計力
-
9
AppleのMシリーズチップからSafariの閲覧履歴を暴く「TIDE」攻撃とは?
-
10
全社標準Copilotに絶望? MS Copilotで問い合わせ6割減できた企業は何が違った
ホワイトペーパーランキング PR
-
1
登録セキスぺが語る「SCS評価制度」の舞台裏 星を取得すべき理由と対応のコツ
-
2
インシデント対応工数を約3割削減、東京ガスの事例に学ぶ監視体制刷新のコツ
-
3
JR西日本ITソリューションズが「監視業務の属人化」を解消した方法とは?
-
4
「人員を増やす」という選択肢はない 情シスが負の連鎖から抜け出すには?
-
5
「問題が深刻化しやすいプロジェクト管理」から脱却する方法とは?
-
6
AI時代の組織設計:「判断と責任」を人に残すための2つの原則とは?
-
7
防御側の「3つの前提」が崩壊 AI時代のセキュリティに必要な3つの転換とは?
-
8
AI活用を停滞させる「2:6:2の壁」を乗り越えるためのポイントとは?
-
9
生成AIで文書活用を進めるには? 効率化と安全性をどう両立する
-
10
OSSでは困難 100超のサービスを持つマネーフォワードが実践した統合監視術
TechTargetジャパン SNS
インフォメーション
注目情報をチェック
TechTargetジャパンをフォロー