レビュアーとオートレビュー
ビルトイン・レビュアーは、要求に対する完全な応答とそれに利用可能な証拠を確認します。 これは、名前が「リビューアー」含まれているカスタムSpecialistとは分離され、許可の承認から分離されます。
実行ベースの出力比較では、再現性 を使用します。 レビュアー評価と再現された出力は別々のレコードです。
セッションレビュー対アーティファクトレビュー
インタビューレビューと、アーティファクトの実証パネルのReviewタブは異なるレコードです。 あなたが共有する予定の正確なアーティファクトバージョンを調べます。 No review for this version といっても、別の応答がレビューされた場合でも、そのラベルを保存します。 同様に、partial環境キャプチャとバウンディングの証拠は、モデルが自信を表明した後、部分的かつ拘束され続けます。
入力エラーの場合、アクセス可能な現在の入力を添付するか、アプリケーションを介して実際のバージョンを解決します。 ローカルファイルの存在は、すべての子/リビューアーカーネルがそれを読むことができることを保証するものではありません。 Notebook、委任、トラブルシューティング をご覧ください。
歴史的レビューを再開するときに選択したアーティファクトバージョンを調べます。 レビューまたは修正をキャンセルした後、最終的な状態を読んで、再実行するかどうかを決定する前に結果を保持します。 キャンセルは、成功したレビューを作成しません。
確認できる結果を選択してください
最初のレビューのために、インラインテーブルチェックを完了して下さい:完全なサンプルQCのテーブルを提供し、サンプルごとの1つの算術の結果を要求して下さい。 これは、正確な基準: 12 個のユニークなサンプル識別子、 12 行、ゼロカウントプラス検出遺伝子は、すべての行の遺伝子合計に等しい。
レビューの前に、子の結果を開いたり、Notebookはあなた自身を出力しました。 その後、その応答の要求を見直します。 それらの基準でレビューのチェックを比較します。 行または実行された結果が見つからない場合、結果を使用する前にその検索を解決します。 結果のレビューは、応答と利用可能な証拠に依存します。 この演習は、ゼロファインディングバッジを約束しません。
レビューをリクエストする
- 作業用モデルで会話のターンを完了します。
- 作曲家 + menu → Request review を開きます。 メニューは、レビューが実行中に**Reviewing…**に変更されます。
- 結果のReviewerカードを開きます。 結果とチェックの数を読み、各チェックの説明を拡張します。
- Go to transcript を選択して Session Reviewer を開きます。 モデル、タイムスタンプ、PASS/FAIL ステートメント、証拠の参照、Reviewer log を確認してください。
- 修正が必要な場合は、Main Agent のフォローアップとお子様の許可リクエストを検査してください。 レビューは、これらの操作を自動的に付与しません。
- 識別された問題に対処した後、Re-run reviewを使用してください。 必要な入力や操作がまだ利用できなくなった場合は、未解決の検索を保存します。
実践例 未解決の発見でレビューを読む
チェックと未解決の発見を見る
Codex サブスクリプション認証を gpt-5.6-sol で使用し、手動レビューは 4つのチェックと1つの検索 を返す:
| チェックイン | 実際の結果 |
|---|---|
| SpecialistはインラインCSVレビューを実行しました | パス 子供の手引きと算術の結果を引用したレビュー。 |
| カスタムMCP結果と故障が正確に報告されました | パス 有効なメトリックおよびコネクターの間違いは実行出力に一致しました。 |
| 分子呼び出しは、指定されたアーティファクト/記述子を生成しました | パス 返されたアーティファクトバージョンと値が特定されました。 |
| モデルは、必要に応じて保存された分子のプレビューを検査しました | ファイル; カタログの検索結果は構造の内容を読んでいませんでした。 |
マネージド・インプット・アクセスの問題に遭遇し、修正限界に達した/見つかった問題に達した修正。 アプリケーションで手動で構造を開くと、ビューアが機能したことが証明されましたが、モデルの記録された検査やレビュー結果は遡及的に変更しませんでした。 これは、成功したレビューバッジではなく、実際の未解決のレビュー結果です。
自動レビュー制御
Agent controls → Auto-review を開き、将来の応答後にレビューを構成します。 これは会話の好みです。 Ask for approval と Delegation とは異なる。 設定のビルトインレビュアー行は、通常の編集/削除/有効制御がなく、通常のSpecialistピッカーから除外されます。
| UIの状態または制御 | 意味する |
|---|---|
| リクエストレビューは利用できません | 有効な応答/レビュー、欠落した資格のある完了した応答、または利用可能なモデルのセットアップをチェックしてください。 |
| レビュー中… | レビューはまだ実行されています。 そのままに処理しないで下さい。 |
| 投稿者 · n 件の検索結果 · n チェック | チェックとその証拠を開きます。 ゼロファインディング結果は、チェックした結果に拘束されます。 |
| 修正要求あり | Main エージェントは、フォローアップ補正サイクルを実行できます。 新規事業や成果を調べる。 |
| 見つかった問題/修正限界に達しました | このレビューは、すべての発見を解決しなかった。 新しい試みを始める前に最も最近の説明を読んで下さい。 |
| トランスクリプトに移動 | 専用のセッションレビュアーページを開きます。 |
| 拡張 / 崩壊レビュアーログ | 動作ログを回復または非表示にする。 truncated ログは、証拠を完成させない。 |
| レビューを再実行する | 別のレビューを要求します。 「すべての発見を受け入れる」ボタンではありません。 |
別のモデルでオートレビューを実行します
- Settings → Model → Reviewer では、利用可能な固定モデルを選択します。 練習されたセットアップは、Mainと
gpt-5.6-lunaのgpt-5.6-solをレビュアーに使用しました。 - Agent controls → Auto-review をターゲットの会話で開くと、On を確認し、次のリクエストを送信します。
- 応答後、自動的に作成されたReviewerカードを拡張します。 モデル、基準、証拠、結果を確認してください。
- Corrections requested が表示された場合は、Main の修正と結果が解決するかどうかを決定する前のその後のレビューを調べます。
「解決する」とは?
要求された試みが行われたため、その許可の失敗が正確に報告されたため、チェックは解決できます。 ファイルが読みやすいか、その計算が渡されたことを確立しません。 基準、ツール結果、残りの検索結果を一緒に読みます。 アクセスがブロックされている場合は、別のレビューを開始する前に、file-handoff 既知の問題に従ってください。
実装参照: セッションReviewerPanel.tsx、ComposerAgentControlsMenu.tsxの使い方。