Oracle AI Data Platform (AIDP) Workbench エンジニアエージェント(Claude Code 対応)— 37個のスキルを備えたエージェントで、Spark/Delta(大規模データ管理の技術スタック)データレイク全体を自然言語で操作できます。 カタログを自動発見してキャッシュ化し、英語の指示を正確な Spark SQL(データ問い合わせ言語)に変換して実行。データの作成・挿入・更新・削除・統合、最適化・クリーンアップ、過去のバージョンへの遡行といった一連の操作に対応します。 ファイル取り込み、データ品質の検査と管理ルール設定、パイプライン(データ処理の自動フロー)の作成・修復、クラスタ(計算リソース)の構築、Spark UI を用いたトラブル解決など多岐にわたります。 プラットフォーム管理機能も備え、ユーザー権限・認証情報保管・データ共有設定・操作ログの監査に加えて、Git(バージョン管理)、バンドル管理、MLOps/MLflow(機械学習の運用基盤)にも対応。 公式の Oracle aidp CLI(コマンドラインツール)で実行します。
Oracle AI Data Platform (AIDP) Workbench engineer agent for Claude Code — a 37-skill agent that operates the full Spark/Delta lakehouse in natural language. Discovers your catalog into a grounding cache, turns plain English into accurate Spark SQL, and runs the lifecycle (CREATE/INSERT/UPDATE/DELETE/MERGE, OPTIMIZE/VACUUM, time-travel). Ingests files, profiles data and sets quality rules, authors and repairs pipelines, provisions clusters, and debugs via the Spark UI. Governs the platform (roles, credential store, Delta Sharing, audit logs), plus native Git, bundles, and MLOps/MLflow. Runs via the official Oracle aidp CLI.
AIDP エージェントフロー(複数のAI処理ステップを組み合わせた自動実行フロー)の検出、作成、配置、実行を行います。 次のような場合に使用: - ユーザーがエージェントフローの一覧表示や確認を希望している - フローの新規作成、更新、配置、または実行を行いたい - セッションやガードレール(安全性の制限ルール)を管理したい - 計算リソースを付与したい …
AIDP エージェント(AI駆動型のプログラム実行システム)を Python で高度な実装により構築する際に、aidputils + LangGraph(コード主導型の代替手段で、低コード型のビジュアルエディタの代わりとなるもの)を使用します。 次のような場合に使用: - ユーザーが Python でエージェントを書きたい場合 - LangGraph / …
Spark SQL上でLLM機能をAIDP経由で実行し、ai_generate()関数を使って行データを直接SQLで要約・分類・抽出・充実させたり、集計結果に基づいて文章を生成したり、レイクハウス(データの統合保管場所)内で事実に基づくRAG的分析(検索結果を参照した生成)を行ったりできます。 次のような場合に使用: ユーザーがLLMで行のデータを処理した…
AIDP レイクハウス(統合データプラットフォーム)に対して Spark SQL で業務に関する質問に答えます。 次のような場合に使用: - ユーザーがデータに関する質問をしている場合(「いくつ?」「上位N件」「表示してほしい」「~の傾向」「~別の売上」など) - ユーザーが臨機応変な Spark SQL クエリを実行したい場合 動作方法: `.aidp/…
AIDP(監査ログ管理システム)の監査ログを管理し、検索します。監査機能の有効/無効切り替え、ログの保持期間設定、DataLake内の監査ログエントリーの検索が可能です。 次のような場合に使用: - ユーザーが監査ログについて質問している - 誰がどのような操作を行ったかを確認したい - AIDP活動のコンプライアンス(規制対応)や保持期間について質問され…
AIDP(Application Infrastructure Deployment Platform)のリソースをまとめて展開します。バンドル(関連する資産をひとつの単位にまとめたもの)を作成し、その中身をすべて一度に展開したり、展開状況を確認したり、削除したりできます。 **次のような場合に使用:** - 複数のAIDPリソースをまとめて本番環境に移行…
AIDP データカタログ(データ資源の総合的な目録)を直接閲覧する機能です。カタログ、スキーマ(データベースの構造定義)、テーブル、ボリュームの一覧表示、テーブルの列やプロパティの確認、人間が付けた名前からカタログキーへの変換などができます。 次のような場合に使用: - ユーザーが「どのカタログ/スキーマ/テーブルが存在するか」と尋ねるとき - 「テーブル…
AIDP カタログを初回検索し、キャッシュ可能でバージョン管理できる .aidp/catalog.md ファイルを生成する機能です。テーブル、列、外部キー・結合のヒント、値の辞書などの基本情報をこのファイルに記録します。 次のような場合に使用: ユーザーが「/aidp-catalog-init」と指示した時、「データレイク(複数のデータソースを統合した環境…
# AIDP Spark 計算クラスタの管理 AIDP Spark 計算クラスタ(複数のコンピュータをまとめて使う処理環境)の管理を行います。クラスタの一覧表示、状態確認、起動・停止・再起動、インストール済みライブラリ(JARファイルやPythonライブラリ)の確認、新しいクラスタのセットアップやスケーリング(ドライバ/ワーカーのマシン性能設定、自動スケー…
AIDP認証情報ストア(シークレット=機密情報)を管理します。AIDP ワークフローで使用する認証情報の一覧表示、取得、作成、更新、削除ができます。 次のような場合に使用: ユーザーが機密情報を埋め込むのではなく一元的に保存・更新したい場合、または接続認証情報を管理したい場合。 主要なエンジンは公式の `aidp` CLI(`aidp credential…
AIDP テーブルに対するデータ品質ルールチェック(データの正確性と信頼性を確認する各種検査)を実行します。空の項目がないか、重複がないか、値の範囲が妥当か、関連データの整合性が取れているか、データが最新か、といった5種類の検査に対応しています。 **次のような場合に使用:** - ユーザーがデータの妥当性を確認したい - 空の項目、重複レコード、孤立した…
AIDP のデータを Delta Sharing(クラウドプラットフォーム間でのデータ共有機能)を使って共有します。共有設定の作成・管理、データ資産の追加、共有相手の管理、アクセス権限の付与ができます。 次のような場合に使用: - テーブルやスキーマ(データベースの構造)を別のチームや組織と共有したい - Delta Sharing の設定をしたい - 共…
AIDP(自己完結型プラグイン)の初回セットアップ OCI CLI(Oracleクラウド操作ツール)と DEFAULT という名前の API キープロファイルを検証し、組み込まれた Python の依存パッケージをインストールします。その後、リージョン・データレイク ID・ワークスペースを自動発見し、両方のエンジンに対して動作確認テスト(制御層への GET…
Oracle AI Data Platform(AIDP)のデータエンジニアリング作業向けのルーター(統括案内機能)およびセットアップ・認証のトラブルシューティングスキルです。 **次のような場合に使用:** - ユーザーがAIDPについて言及しているが、どのスキルが適用されるか不確実な場合 - 「AIDPでは何ができるか」と質問された場合 - タスクを機…
1つのAIDP Sparkセッションで複数のデータソースを統合処理します。複数のコネクタ(Oracle ADB/ExaCS、Fusion、Snowflake、S3、レイクハウス(データ湖)のテーブルなど)から読み込んだデータを、1つのノートブック内で結合できます。 **次のような場合に使用:** - ユーザーが複数のソースからのデータを組み合わせて分析した…
AIDP ワークスペース内でネイティブGit(バージョン管理ツール)を操作します。ブランチの作成・切り替え、変更のコミット・プッシュ、プル、マージ、リベース(履歴の再整理)、リセット、差分確認、競合解決など、ワークスペースのGitリポジトリに関するすべての操作に対応しています。 **次のような場合に使用:** - ユーザーがワークスペースのノートブックやコ…
ファイル(CSV、JSON、Parquet など)をマネージドの AIDP デルタテーブル(高性能データベーステーブル)に読み込みます。 **次のような場合に使用:** - ユーザーがファイルをテーブルに取り込みたい場合 - ファイルから新しいテーブルを作成したい場合 - 生のデータをレイクハウス(統合データ保管庫)に格納したい場合 1ステップでの処理と、…
AIDP知識ベース(RAG用の情報検索システムの基盤)を構築・管理する機能です。カタログデータから知識ベースを作成し、埋め込みモデル(テキストを数値に変換する手法)とデータ分割方法を選択してから、HNSW/IVF(高速検索用のインデックス構造)ベクトルインデックスを構築します。さらにデータソース(ボリューム・テーブル)を追加し、取り込みジョブを実行して、知…
別のプラットフォーム(例えば Databricks)からノートブック/ジョブを AIDP へ移行するのをサポートします。 **次のような場合に使用:** - ユーザーが Databricks のノートブック/ジョブを AIDP に移したいとき - ワークロード(処理の負荷)を AIDP のレイクハウス(統合データ基盤)に移行したいとき - 移行の計画を立て…
AIDP の MLflow 互換 MLOps(機械学習の実験・運用管理)でML作業を追跡します。実験の実行状況、テスト結果、性能指標・設定値、登録済みモデル、モデルのバージョン管理に対応しています。 次のような場合に使用: ユーザーが実験をログ記録・追跡したい、実行結果や性能指標を一覧表示したい、モデルを登録したい、モデルのバージョンステージを変更したい、…
AIDP DataLake内で利用可能なモデルの一覧表示と、それらのパラメータ(設定値)の確認、および MLOps(機械学習の運用管理)モデルレジストリの閲覧ができます。 **次のような場合に使用:** - ユーザーが「どんなモデルが使える?」と尋ねた場合 - ai_generate()やエージェントの処理フロー内で、モデル名が必要な場合 - 特定モデルの…
AIDP ノートブック(対話的なコード実行環境)の作成・編集・実行と、そのカーネルセッション(計算処理の実行環境)の管理ができます。 次のような場合に使用: - ユーザーがノートブックを作成したい - セル(ノートブック内の実行単位)やコードをクラスター上で実行したい - カーネルセッションの接続・切断を行いたい - ウィジェット(対話的な操作部品)、Sp…
Surface AIDP(Application Infrastructure Development Platform)の稼働状態 — 最近アクセスしたリソースと実行中の非同期処理(ステータス、完了状況、待機中の状態)を表示します。 次のような場合に使用: ユーザーが「最近何が起きたか」「今何が実行中か」「あの処理は終わった」と尋ねる場合、または非同期処…
AIDP ジョブ(ノートブック・Python スクリプトを実行順序つきで並べたタスク処理を、定時実行スケジュール機能付きで運用するもの)の作成・スケジュール設定・実行・監視を行う。 次のような場合に使用: パイプライン(処理手順の流れ)を構築したい、ジョブを作成・更新・実行したい、定期的な自動実行を設定したい、実行状況を確認したい、タスクの実行結果を確認し…
AIDP テーブルのプロファイリング(データの統計的特徴の分析)を行います。行数、列ごとの欠損値の割合、個別値の数、最小値・最大値・平均値、および頻出値トップKを表示します。 次のような場合に使用: - ユーザーがテーブルのプロファイリングを依頼したとき - 列の統計情報またはデータ品質のスナップショット(現時点の状態)を求めているとき - データセットの…
AIDP(Arietta Data Platform)のロール(操作権限の設定)とアクセス管理 — ロールの一覧表示、権限の確認、ロールの作成、メンバーの追加・削除、カタログ・スキーマ・テーブル・ビュー・ボリューム・ワークスペース・ワークスペース内のオブジェクト・クラスタなどのリソースに対する権限の付与・取り消しができます。また、列のマスキング(非表示化)…
AIDP(AI駆動型データプラットフォーム)用に、意味定義層(.aidp/semantic.md)を管理します。論理的なエンティティ名、SQL定義済みのメトリクス(測定指標)、関連テーブルの結合ルール、同義語、データ値の辞書などを一元管理します。 **次のような場合に使用:** - メトリクスやビジネス用語を定義したいとき - 自然言語から SQL へ変換…
AIDPのSparkジョブ(分散データ処理)が遅い、または失敗した場合に、クラスタログ、メトリクス(性能指標)、Spark UI REST APIを使用して原因を調査します。 次のような場合に使用: - ジョブまたはクエリが遅い、あるいは失敗した - ユーザーが「なぜ失敗したのか」「なぜ遅いのか」と質問している - ステージ/タスク実行時間、データ分布の偏…
次のような場合に使用: Sparkジョブ/ノートブック(データ処理プログラムの実行環境)が遅い、目標のパフォーマンスを達成していない、メモリ不足エラーが起こっている、小さなファイルが大量に生成されている、またはデータの偏りが大きい場合。Spark/PySparkのコード、またはパフォーマンス確認画面を見直すとき。または大規模なSparkの処理を実行する前。…
AIDP レイクハウス(データ統合管理基盤)上での書き込み側 Spark SQL — テーブル・ビュー・スキーマの作成・変更・削除(DDL)、行の挿入・更新・削除・マージ、Delta テーブルのメンテナンス(最適化、不要データ削除、過去バージョン参照、復元、スキーマ進化、クラスタリング改善)に対応します。 **次のような場合に使用:** - テーブルやビュ…
AIDP カタログオブジェクト(データ管理システムに登録されたテーブルやビューなどの構成要素)のライフサイクル管理 — テーブル、ビュー、スキーマ、カタログの作成・更新・削除・更新反映を行い、外部カタログ/接続(ALH/ADW/オブジェクトストレージ)をカタログオブジェクトとして登録します。 次のような場合に使用: ユーザーが制御機能(データ取得以外の操作…
複数のエージェント(自動処理プログラム)で共有できる独立した再利用可能なツールを作成・管理します。SQL、プロンプト、RAG(大規模データから必要な情報を抽出する技術)、HTTP、カスタム、MCP といった複数の種類に対応しており、キーを通じてエージェントの処理フロー間で共有できます。 **次のような場合に使用:** - ユーザーが再利用可能なツールを定義…
AIDP ユーザー設定の管理 — DataLakeのユーザー設定の一覧表示、取得、作成、更新、削除を行います。ユーザーが AIDP ワークベンチ(データ分析作業環境)の設定を表示または変更したい場合、または保存済みのユーザー設定を管理したい場合に使用します。 独立した機能であり、公式コマンド `aidp user-setting` CLI の使用が推奨され…
ユーザーが動作する質問とそれに対応するSQL(データベース問い合わせ言語)のペアを登録・検証して `.aidp/verified-queries.md` に保存し、エージェント(自動処理を行うプログラム)が新しいSQLを生成する前に、信頼できる既存のSQLを再利用できるようにします。確認済みのペアはそれぞれクラスタ(複数のコンピュータを連携させたシステム)…
AIDP ボリューム(大容量ファイル保存領域)を操作します — ボリュームの一覧表示、ボリューム内のファイル閲覧、PAR フロー(一時的なアクセス許可)経由のアップロード/ダウンロード、ディレクトリ作成ができます。ボリュームについてユーザーが言及した場合、大容量ファイルやバイナリファイルを準備する必要がある場合、またはボリュームとの間でデータの出入れを行う…
AIDP DataLake(データ分析・保管用の統合システム)のインスタンスとワークスペース(作業環境)を構築・検査します。顧客の VCN/サブネット(ネットワーク構成要素)に接続されたプライベートネットワークのワークスペースも対応しています。 次のような場合に使用: ユーザーがワークスペースまたは DataLake インスタンスの作成・一覧表示・取得を希…
AIDP ワークスペースのファイルシステム内でファイルやノートブック(対話型の計算環境)を管理します。ファイル・フォルダ・ノートブックの一覧表示、アップロード、ダウンロード、読み込み、作成、移動、名前変更、削除ができます。 次のような場合に使用: ユーザーがスクリプト・ノートブック・設定ファイルをワークスペースに格納したい、ワークスペース内のファイルを読み…
原文・著作権は Anthropic および各プラグイン作者に帰属します。日本語訳は Claude API による自動翻訳です。