スタンドアップ前に完了する自動エラートリアージ

Zeroは日次のエラートリアージを自動化するAI DevOpsエージェントです。毎朝、SentryとAxiomから未解決エラーを取得し、両ソース間で重複を排除して、完全なスタックトレース付きの担当者アサイン済みGitHub Issueをスタンドアップ前に作成し、エンジニアの手作業によるレビューを20〜30分節約します。

Zeroの接続先:SentryAxiomGitHub

Zeroが提供するもの:日次エラートリアージレポート

優先順位付けされたインシデント、ソースをまたいだ重複排除、アサイン済みGitHub Issue、重要度、ボリューム、節約時間を含む、AI生成のエラートリアージレポートのサンプルをご覧ください。データは説明用ですが、レポート形式はZeroがSentryとAxiomから実際に生成できる出力です。

Zero · 自動化レポートサンプルデータ

エージェントサマリー

ZeroはSentryとAxiomからの17件の生エラーを精査し、13件の根本原因に重複排除し、6件のアサイン済みGitHub Issueを作成し、2件の監視のみのシグナルを#devにルーティングしました。

精査した生エラー
1712 Sentry · 5 Axiom
ユニークな根本原因
13重複排除後
作成したGitHub Issue
6すべてアサイン済み
日次エラートリアージレポート全体を開く

エラートリアージとは?

エラートリアージとは、本番エラーをグループ化し、優先順位を付け、担当者を割り当てて、エンジニアが何を最初に修正すべきかを把握できるようにするプロセスです。ZeroはSentry、Axiom、GitHubをまたぐAI SREエージェントとして機能します。エラーを重複排除し、閾値を適用し、スタックトレースを添付し、コードオーナーをアサインします。その結果、アラート疲れを軽減する一貫した日次エラートリアージの自動化が実現します。

手作業のエラートリアージがアラート疲れを生む理由

毎朝、エンジニアはSentryを開き、未解決のSentryアラートをスクロールし、Axiomと突き合わせ、何が新しく何が重複かを見極め、どれが深刻かを判断し、GitHub Issueを開いて適切な担当者を見つけなければなりません。この繰り返しの初動対応に20〜30分の集中したエンジニアリング時間が奪われ、本来の作業が始まる前にアラート疲れを引き起こします。Zeroは午前8時45分に実行し、誰もがラップトップを開く前に同じトリアージを完了します。

Zeroが日次エラートリアージを自動化する仕組み

ステップ1:ツールを接続する

Sentry
Sentry
必須
ZeroのSentry連携は、未解決の本番エラー、スタックトレース、イベント数、環境タグをクエリします。
接続
GitHub
GitHub
必須
Sentry・GitHub連携は、完全なエラー詳細を含む構造化されたIssueを作成し、コードオーナーにアサインします。
接続
Axiom
Axiom
オプション
ZeroはAxiomのエラーログをクエリし、Sentryの検出結果とクロスリファレンスして重複を排除します。任意ですが推奨です。
接続

ステップ2:Zeroに聞く

@Zero 平日の毎朝8:45に、SentryとAxiomから過去24時間の未解決エラーを取得してください。ソース間で重複排除してください。5回以上発生したものについて、vm0-ai/vm0にスタックトレース付きのGitHub issueを作成し、関連するコードオーナーにアサインしてください。
同じワークフローのサンプル実行をステップごとに:Sentryのissueを取得してランク付けし、デプロイリグレッションをフラグし、チャートをレンダリングし、レポートを公開し、Slackに投稿します。
ZeroがSentryとAxiomから未解決エラーを取得
Zeroは指定した時間ウィンドウ内の未解決エラーについてSentryとAxiomの両方をクエリし、設定した発生閾値を適用します。これにより低シグナルのノイズが除去され、大規模に発生しているエラーだけが通過します。
SentryとAxiom間で重複エラーをマージ
同じエラーがSentryとAxiomの両方に異なるフォーマットで現れることがよくあります。Zeroはこれらを重複排除し、両ソースのデータを統合した単一のレコードにまとめるため、実際の問題ごとに一度だけトリアージすればよくなります。
GitHub Issueを作成しコードオーナーにアサイン
条件を満たすユニークなエラーごとに、Zeroは完全なスタックトレース、発生回数、初回・最終確認のタイムスタンプを含む構造化されたGitHub Issueを開き、そのコード領域を担当するエンジニアにアサインします。SentryからGitHubへの受け渡しを端から端まで自動化します。

ステップ3:さらに活用する

閾値を調整する
発生フィルターを変更して、ノイズを減らすか、より多くの問題を検出します。
@Zero 毎日の分類スケジュールを更新し、10回以上発生したエラーのみissueを作成してください。それ以下のものは#devにサマリーを投稿するだけにしてください。
モーニングブリーフに追加する
エラートリアージを、チームがすでに読んでいるプロダクトヘルスブリーフィングに組み込みます。
@Zero 今日のエラー分類出力を#standupに投稿する9時のプロダクトヘルスブリーフィングに含めてください。
デプロイ後の安全チェック
本番デプロイの直後にトリアージを実行し、リグレッションを翌朝ではなく数分以内に表面化させます。
@Zero vm0-ai/vm0のmainにPRがマージされるたびに、15分待ってからSentryのエラーチェックを実行して新しいエラーを確認してください。

Zero vs. 手作業トリアージ vs. Sentryアラートルール

日次エラートリアージは自動インシデント対応の第一層です。チームはZeroでSentryからGitHubへの流れを自動化し、問題がより広範なAIインシデント管理を必要とする前に、繰り返しの初動対応を完了させます。

手作業トリアージ

エンジニアがSentryとAxiomをレビューし、重複を特定し、重要度を判断し、issueを開き、担当者を見つけます。柔軟ですが、毎朝同じ20〜30分の作業を繰り返します。

Sentryアラートルール

ルールは閾値を超えたときにチームへ通知します。検出には役立ちますが、チームは依然としてログを突き合わせ、エラーを重複排除し、GitHub Issueを作成し、担当者をアサインしなければなりません。

ZeroのSentryワークフロー自動化

ZeroはSentryの自動化を端から端まで実行します:クエリ、ソースをまたいだ重複排除、閾値の適用、issue作成、スタックトレースの添付、コードオーナーのアサイン。オンデマンド実行とデプロイ後実行は同じワークフローを使います。

より良い結果のためのヒント

Issue数を管理可能に保つために発生閾値を設定しましょう。5回以上が良い出発点です。ボリュームに応じて調整してください。
Sentryの環境またはプロジェクトタグを使ってZeroのクエリを本番に絞り込み、ステージングのエラーがトリアージのキューに届かないようにしましょう。
日次トリアージをデプロイ後チェックと連鎖させ、定型作業を軽量な自動インシデント対応に変えましょう。さらに9:00のプロダクトヘルスブリーフとペアにすれば、チームはエラーとステータスを一箇所で確認できます。

よくある質問

SentryのエラーをトリアージしてGitHub Issueに変えるには?

SentryからGitHub Issueを自動作成するには、SentryとGitHubをZeroに接続し、スケジュールまたはオンデマンドのプロンプトを与えます。Zeroは未解決エラーをクエリし、発生回数と環境のフィルターを適用し、条件を満たすエラーごとにissueを1件作成し、スタックトレースとタイムスタンプを添付して、コードオーナーをアサインします。

SentryとAxiom間でエラーを重複排除するには?

できます。Zeroはエラーのシグネチャ、スタックトレース、メッセージ、タイミングをSentryとAxiom間で比較し、一致するイベントを1つのトリアージレコードにマージします。各元ソースは調査のためにリンクされたまま保持されます。

エラーモニタリングによるアラート疲れを軽減するには?

トリアージを本番に限定し、発生閾値を設定し、ツール間で同じエラーを重複排除し、低ボリュームのエラーはissueを作成する代わりにサマリーにルーティングします。これにより、対応が必要なエラーにキューを集中させられます。

Zeroはデプロイのたびにエラートリアージを実行できますか?

できます。デプロイまたはmainへのマージの後にエラートリアージのワークフローを開始する自動化を作成し、必要に応じて短い観察ウィンドウを待ってから、Sentryで新しい本番エラーを確認し、条件を満たすissueを作成します。

エラートリアージの自動化にはどのツールが必要ですか?

SentryとGitHubが必須です:Sentryがエラーデータを提供し、GitHubがアサイン済みのissueを受け取ります。Axiomは任意ですが、ログのコンテキストを追加し、ソースをまたいだ重複排除を向上させます。

最初のSentryトリアージを実行する

Sentry、GitHub、そして任意でAxiomを接続します。同じ日次トリアージのプロンプトを使えば、手作業で組み直すことなくワークフローの動作を確認できます。

@Zero 平日の毎朝8:45に、SentryとAxiomから過去24時間の未解決エラーを取得してください。ソース間で重複排除してください。5回以上発生したものについて、vm0-ai/vm0にスタックトレース付きのGitHub issueを作成し、関連するコードオーナーにアサインしてください。