一定期間にわたってスキルの活動状況をレビューする機能です。実際に効果を発揮したスキルの読み込みを、その背景にあるインシデント(問題発生)や会話の内容とともに表示します。また、どのスキルもカバーできなかった問題も特定します。 次のような場合に使用: - スキルやプラグイン(拡張機能)の利用状況をレビュー、まとめ、または把握したいとき - 「今週のスキルの成果は?」「昨日のプラグイン利用状況を確認してほしい」といった質問 - 1回限りの確認、または定期的なスケジュール確認 **注記:** システム全体の健全性(同期状態、動作の流れ、修正が必要な問題など)の診断は、この機能ではなく医師スキル(診断専門スキル)が担当します。
Review what your extensions did over a period: the skill loads that made a real difference, told through the incident or conversation each one happened in, and the incidents no skill or runbook covered. Use whenever anyone wants a review, digest, or pulse of extension or skill usage over a window — "how did our skills do this week", "post yesterday's extensions review to our channel" — one-off or on a schedule. Whether the estate is healthy (sync state, funnels, issues to fix) is the doctor skill, not this one.
エージェントがスキルを読み込んだ後、incident.io はその実行がスコア化されると評価を実施します:エージェントはそのスキルに従ったか、それに従うことが役に立ったか、そして何が起きたかの簡潔な記述です。このスキルは、こうした評価のウィンドウ(一定期間)をストーリーに変え、人々が読める形にします。拡張機能のおかげでエージェントが単独ではできなかったことを成し遂げた事例や、どの拡張機能も役に立たなかった事例を示すので、チームは自分たちのコンテンツがもたらした成果と、次に書くべき内容が見えるようになります。
ここで基本となるモデルは、評価は実行結果についての主張であり、その実行結果が証拠だということです。記述内容は実際の実行結果を過小評価したり反転させたりするのが日常的なので、評価だけから公開される内容はありません。公開される全項目は、その根拠となる実行記録を確認してから公開されます。また、評価は判断対象の実行結果よりも後で行われるため、定期的なレビューウィンドウは実行が評価された時点を基準とします。こうすることで、各実行結果が正確に 1 度だけ見られ、評価が遅れたために見落とされることがなくなります。
使用状況 — ウィンドウ内の評価済み実行結果を抽出し、基準を満たした少数のものを絞り込み、その各々を実際に起きた実行記録に照らして検証し、独立した項目として記述します。→ references/usage.md
不足分析 — 同じウィンドウ内の事案についてカバレッジ(どの内容が対応されているか)を確認:どのスキル実行もタッチしなかった事案はどれか、拡張機能が対応を進めることができたか、埋める価値のある各不足について要点をまとめます。→ references/gaps.md
完全なレビューには両方を実行してください。一方だけを求める要求(「何が使われたか」「不足しているものは何か」)は、その構成要素だけを実行します。もう一方の参考資料を読んだり、その事前確認を実行したり、レポートでその機能名を挙げたりしないでください。使用状況だけのレビューが事前確認に失敗した場合は、3 つの集計対象サーフェスだけを名前で示し、それ以上は示しません。両方の構成要素は 1 つのレポートで終了します。references/report.md はそのレポートの形式と配信方法(「チャネルに投稿する」要求を含む)を管理します。
公開する前に確認してください。 実行結果がレポートに現れるのは、その根拠となった調査や会話が読まれ、その実行結果を支持した後だけです。根拠がこのセッションから読み取れない場合、その項目は削除するか、評価の主張として記述して明示的に表示します。事実として主張することはありません。
プラットフォーム行は拡張機能ではありません。 plugin_id を持たない実行行は、プラットフォーム自体のエージェント機構に属しています。プラグイン単位の抽出はこれらを見ません。全体的なストリームを読み込む時に削除してください。マネージド incident.io プラグインの行(plugin_id を持つ)はカウントされます。
ウィンドウにミスがあれば表示してください。 成功事例だけを示すレビューはマーケティングのように見え、読まれなくなります。最良のミス表現は、それを引き起こしたコンテンツの行を名前で示します。
静かなウィンドウも重要な知見です。 基準を満たすものが何もない場合、実行結果の数と共に 1 行で述べてください。日常的な実行結果を無理にハイライトに膨らませないでください。
このスキルは読み込みとレポート化を行います。 コンテンツを編集することも、フィードバックを却下することもありません。不足分析の要点は、それに対応するスキルへの提案です。
資産の健全性 — 同期の失敗、ファネル(段階的な削減)、対応が必要なフィードバック問題、ルール設定のずれなど — は doctor スキルが担当します。Doctor はスキル全体を集約・診断し、このスキルは 1 つのウィンドウについてストーリーを述べます。このレビューが健全性の問題に気づいた場合(同期が止まったプラグインや、実行結果が常に悪影響を及ぼすスキルなど)、1 行で指摘して doctor にルーティングしてください。診断を自分で背負わないでください。
レビューの結果からスキルを編集することは skill-authoring スキルの改善ジョブが担当し、不足していたランブック(手順書)を書くことは runbooks スキルの記述ジョブが担当します。不足分析の要点はそちらに引き継ぎます。
スキルの累積的な実績 — 成功率、未解決の問題、事例など — は extension_skill_feedback_list とダッシュボードの拡張機能ページが管理するもので、ウィンドウレビューが対象ではありません。
After an agent loads a skill, incident.io assesses the load once the run is scored: did the agent follow the skill, did following it help, and a short written account of what happened. This skill turns a window of those assessments into a story people read — the loads where an extension let an agent do something it could not have done alone, and the incidents where no extension helped — so the team sees what their content earns and what to write next.
The model that shapes everything here: an assessment is a claim about a run; the run is the evidence. The written account routinely understates or inverts what the run shows, so nothing is published from the assessment alone — every published item is read at its source first. And assessment lags the run it judges, so a recurring review windows on when loads were assessed, not when they happened: that way each load is seen exactly once, and none are missed for being assessed late.
Run both for a full review. A request for one ("what got used", "what are we missing") runs that leg alone: do not read the other leg's reference, run its preflight, or name its capabilities in the report — a usage-only review that fails its preflight names the three census surfaces and nothing more. Both legs end in one report — references/report.md owns its shape and how it is delivered, including "post to a channel" requests.
plugin_id belongs to the
platform's own agent machinery. The per-plugin pull never sees them; drop them
whenever the global stream is read instead. The managed incident.io plugin's rows
(which carry a plugin_id) count.doctor skill. Doctor aggregates and diagnoses; this
skill narrates a window. Where this review notices a health problem (a plugin that
stopped syncing, a skill whose loads keep hurting), note it in one line and route
it to doctor rather than absorbing the diagnosis.skill-authoring skill's
improve job; writing a missing runbook is the runbooks skill's write job. Gap
briefs hand over there.extension_skill_feedback_list and the dashboard's extensions pages, not a window
review.原文・著作権は Anthropic および各プラグイン作者に帰属します。日本語訳は Claude API による自動翻訳です。