Kubernetes. Pod、Deployment、Node、Serviceなど.
任意のKubernetesクラスターにPolylaneエージェントをインストールすると、エージェントがワークロードを読み取り専用で見渡せます。エージェントはクラスターのトポロジーをマッピングし、Pod、Deployment、Nodeを調べ、ログとイベントを読み、インシデントのトラブルシューティングを助けます。
ウェイトリストに登録PolylaneがKubernetesで行うこと。
クラスターのトポロジー全体
Deployment、StatefulSet、Pod、Service、Ingress、CronJob、合わせて24種類のリソースタイプを、クラスターが動くクラウドと並べて。
Kubernetesが上手に隠す障害
クラッシュループ、OOM kill、Pendingで止まったPod、収束しないロールアウト。クラスターは知っています。Polylaneが調査し、何が起きたかを書き上げます。
直接調べる
エージェントはPodを調べ、ログとイベントを読み、定期的にトポロジーをマッピングします。ループの中にダッシュボードはありません。
get、list、watchだけ
クラスター内エージェントは読み取り専用のRBACで動き、Polylaneが行うのは読み取り専用のKubernetes API呼び出しだけです。
仕組み。
接続
Helmコマンド1つでクラスターにPolylaneエージェントをインストールします。エージェントは外向きのトンネルで自ら登録し、クラスターの認証情報がクラスターの外に出ることはありません。
マッピング
クラスターのトポロジーがグラフに載り、以降の同期のたびに何が変わったかを記録します。
エージェントが見守りを引き受ける
ワークロードは入れ替わりながら見守られ、障害は起きた時点で調査され、マニフェストの修正はレビューのために届きます。
グラフの中に。
Polylaneが同期するKubernetesのリソースタイプです。エッジ、設定、履歴とともに。
エージェントが得るツール。
調査の途中でエージェントがKubernetesに対してできること。すべての呼び出しは出典付きでスレッドのトランスクリプトに残ります。
kubectl 接続済みクラスター上のKubernetesリソースを読み取り、操作する(get/list/describe/logs/events/top/rollout、およびscale、restart、patch、delete、apply)
よくある質問
PolylaneはKubernetes向けのAIによるSREですか?
多くの人がその言葉で指しているものです。つまり、Kubernetesのリソースを1つのコンテキストグラフに保ち、見守り、イシューを調査し、本番環境を変えるものはすべて人の承認を経た上で、直せるものを直すエージェントです。私たちはこれをAIによるSREではなく、自律運用するソフトウェアと呼んでいます。要点はソフトウェアが自分の面倒を自分で見ることであり、ボットがオンコールのローテーションに加わることではありません。
PolylaneはKubernetesの中の何かを変更できますか?
許可した場合だけです。読み取り専用で接続すると、エージェントは調査と説明を行い、変更はレビュー用のプルリクエストとしてのみ届きます。書き込み権限があっても、すべての書き込みはメソッド、パス、理由を画面に示した上で、まず承認のために一時停止します。ロールバックは既定で無効です。自分で有効にし、いつでも無効にできます。