mocamocamokumoku.connpass.com 昨日 11:57

『Kubernetesで実践する Platform Engineering』読書会25

『Kubernetesで実践する Platform Engineering』の輪読会イベント。オンライン(Brave Talk)で開催され、参加者が順番に本を読み進める形式。今回はChapter8のArgo Rolloutsによるブルー/グリーンデプロイメントの箇所を扱う予定。

『Kubernetesで実践する Platform Engineering』の輪読会イベント。オンライン(Brave Talk)で開催され、参加者が順番に本を読み進める形式。今回はChapter8のArgo Rolloutsによるブルー/グリーンデプロイメントの箇所を扱う予定。
↗ 元記事を開く
victoriametrics.com 昨日 09:22

Zelarsoft | VictoriaMetrics Partner

VictoriaMetricsのパートナー企業ページ。Zelarsoftは米国オハイオ州の企業で、Kubernetes環境の可観測性構築を専門とし、VictoriaMetricsを中核としたモニタリング自動化やコスト削減の導入支援を行っている。パートナー紹介と各種製品・サポートへのリンクで構成されたページ。

VictoriaMetricsのパートナー企業ページ。Zelarsoftは米国オハイオ州の企業で、Kubernetes環境の可観測性構築を専門とし、VictoriaMetricsを中核としたモニタリング自動化やコスト削減の導入支援を行っている。パートナー紹介と各種製品・サポートへのリンクで構成されたページ。
↗ 元記事を開く
victoriametrics.com 昨日 09:22

Niubits | VictoriaMetrics Partner

VictoriaMetrics のパートナーページで、スペイン・パルマデマヨルカに拠点を置く Niubits を紹介する内容。Niubits は Kubernetes 上でクラウドネイティブなオブザーバビリティ基盤を構築し、VictoriaMetrics を用いたコンテナワークロードの可視化やマルチクラウド対応の監視プラットフォーム設計を提供する企業として紹介されている。

VictoriaMetrics のパートナーページで、スペイン・パルマデマヨルカに拠点を置く Niubits を紹介する内容。Niubits は Kubernetes 上でクラウドネイティブなオブザーバビリティ基盤を構築し、VictoriaMetrics を用いたコンテナワークロードの可視化やマルチクラウド対応の監視プラットフォーム設計を提供する企業として紹介されている。
↗ 元記事を開く
www.infoq.com 2日前

AKS Looks to Make Node Disruption More Predictable with New NAP Guidance

Microsoft は AKS の Node Auto-Provisioning (NAP) について、ノード disruption を予測可能にするための新ガイダンスを公開した。アプリ層の Pod Disruption Budget とインフラ層の NAP disruption 制御(consolidation policy・disruption budget・node expiration・drift management)を併用することを推奨し、過度に厳格な PDB(maxUnavailable: 0 等)が consolidation やアップグレードを止めてしまう問題を指摘。voluntary disruption と involuntary disruption(ハードウェア障害や Spot VM eviction)の違いも整理し、Kubernetes 全体の自動ノードプロビジョニングの流れの中で「安全なオートスケーリング」の設計が今後の課題になると論じている。

Microsoft は AKS の Node Auto-Provisioning (NAP) について、ノード disruption を予測可能にするための新ガイダンスを公開した。アプリ層の Pod Disruption Budget とインフラ層の NAP disruption 制御(consolidation policy・disruption budget・node expiration・drift management)を併用することを推奨し、過度に厳格な PDB(maxUnavailable: 0 等)が consolidation やアップグレードを止めてしまう問題を指摘。voluntary disruption と involuntary disruption(ハードウェア障害や Spot VM eviction)の違いも整理し、Kubernetes 全体の自動ノードプロビジョニングの流れの中で「安全なオートスケーリング」の設計が今後の課題になると論じている。
↗ 元記事を開く
blog.cybozu.io 3日前

20 年以上動き続ける SQLite ベースのアプリケーションを Kubernetes に移行しています

サイボウズ Office とメールワイズという20年以上動くSQLiteベースのCGIアプリケーションをKubernetes基盤Necoへ移行した事例。fcntl(2)ロックとページキャッシュがPod間で機能することをカーネルレベルで検証し、Pod AffinityとReadWriteOnceボリュームを組み合わせたダウンタイムなしのローリングアップデート構成を採用。CGIのコマンドライン呼び出しはサイドカーでgRPC化し、数億ファイル規模のデータ移行は事前転送と最終転送の2段階でmtimeベースの差分転送の安全性もbpftraceで検証。バックアップはMantleを利用し、外形監視は書き込み+fsyncを行うエンドポイントとexporterで再設計した。

サイボウズ Office とメールワイズという20年以上動くSQLiteベースのCGIアプリケーションをKubernetes基盤Necoへ移行した事例。fcntl(2)ロックとページキャッシュがPod間で機能することをカーネルレベルで検証し、Pod AffinityとReadWriteOnceボリュームを組み合わせたダウンタイムなしのローリングアップデート構成を採用。CGIのコマンドライン呼び出しはサイドカーでgRPC化し、数億ファイル規模のデータ移行は事前転送と最終転送の2段階でmtimeベースの差分転送の安全性もbpftraceで検証。バックアップはMantleを利用し、外形監視は書き込み+fsyncを行うエンドポイントとexporterで再設計した。
↗ 元記事を開く
tech-lab.sios.jp 4日前

Kubernetesオブザーバビリティのはじめ

Kubernetes環境における監視とオブザーバビリティの違いを整理し、メトリクス・ログ・トレースの3要素、データ肥大化やコスト増などの課題、Prometheus/Grafana/Loki/Jaeger等の代表的OSSソリューションを紹介。導入初期はPrometheus Operatorから始め、必要に応じて機能を拡張することを推奨している。

Kubernetes環境における監視とオブザーバビリティの違いを整理し、メトリクス・ログ・トレースの3要素、データ肥大化やコスト増などの課題、Prometheus/Grafana/Loki/Jaeger等の代表的OSSソリューションを紹介。導入初期はPrometheus Operatorから始め、必要に応じて機能を拡張することを推奨している。
↗ 元記事を開く
webflow.sysdig.com 4日前

Kubernetes 1.37 - New security features

Kubernetes 1.37 のセキュリティ関連変更19件を解説する記事。SELinuxMount のStable昇格やnftables既定化などの破壊的変更、gRPCプローブTLS対応・Pod単位のcheckpoint/restore・volumeマウントへのnoexec等のオプション追加といった新機能、kubelet rootless化やAPIサーバーのwebhook認証既定有効化などデフォルトで有効になるセキュリティ機能、ClusterTrustBundleやPod証明書のStable昇格までを網羅している。

Kubernetes 1.37 のセキュリティ関連変更19件を解説する記事。SELinuxMount のStable昇格やnftables既定化などの破壊的変更、gRPCプローブTLS対応・Pod単位のcheckpoint/restore・volumeマウントへのnoexec等のオプション追加といった新機能、kubelet rootless化やAPIサーバーのwebhook認証既定有効化などデフォルトで有効になるセキュリティ機能、ClusterTrustBundleやPod証明書のStable昇格までを網羅している。
↗ 元記事を開く
thinkit.co.jp 4日前

【クラウドネイティブ会議】膨大なTerraform / Kubernetes管理やレビュー、問い合わせ対応をAIで効率化するマイクロサービス運用改善の実践

LegalOn TechnologiesのSREチームが、220個のマイクロサービスを運用する中で発生するTerraform/Kubernetes管理、レビュー、問い合わせ対応、Production Readiness CheckにAIエージェント(Codex、Claude等)を組み込み運用負荷を削減した事例。HPAからKEDAへの大規模移行をLinearとCodexの連携で自動化、Notion上のガイドラインをAIレビューに活用、入社退社対応の定型問い合わせをLinear Asksで自動化、PRCのEvidence確認をAIで整理した。AI活用の鍵は「AIに任せる領域の見極め」と「社内ナレッジの文書化・整理」にあると結論づけている。

LegalOn TechnologiesのSREチームが、220個のマイクロサービスを運用する中で発生するTerraform/Kubernetes管理、レビュー、問い合わせ対応、Production Readiness CheckにAIエージェント(Codex、Claude等)を組み込み運用負荷を削減した事例。HPAからKEDAへの大規模移行をLinearとCodexの連携で自動化、Notion上のガイドラインをAIレビューに活用、入社退社対応の定型問い合わせをLinear Asksで自動化、PRCのEvidence確認をAIで整理した。AI活用の鍵は「AIに任せる領域の見極め」と「社内ナレッジの文書化・整理」にあると結論づけている。
↗ 元記事を開く
cloud.google.com 6日前

GKE の ClusterNetworkPolicy: マイクロサービスの制御と自律性のバランスを取る

GKEにKubernetes SIG-Policy発の新API「ClusterNetworkPolicy(CNP)」が導入された。クラスタ全体スコープで管理者ティア/ネットワークポリシーティア/ベースラインティアの階層構造を持ち、決定論的なトップダウン評価でセキュリティチームの一元的なガードレールとデベロッパーの名前空間単位の柔軟性を両立する。機密ワークロードの分離、コアサービス保護、外部下りトラフィック制御などのユースケースがあり、Cilium実装により1.36以降でプレビュー提供中。

GKEにKubernetes SIG-Policy発の新API「ClusterNetworkPolicy(CNP)」が導入された。クラスタ全体スコープで管理者ティア/ネットワークポリシーティア/ベースラインティアの階層構造を持ち、決定論的なトップダウン評価でセキュリティチームの一元的なガードレールとデベロッパーの名前空間単位の柔軟性を両立する。機密ワークロードの分離、コアサービス保護、外部下りトラフィック制御などのユースケースがあり、Cilium実装により1.36以降でプレビュー提供中。
↗ 元記事を開く
tech-lab.sios.jp 2026/08/21

SUSE AIとSUSE AI Factoryとは?

SUSEが発表したエンタープライズAIプラットフォーム「SUSE AI」と、そのコンポーネントである「SUSE AI Factory」の概要を解説。SUSE AIはKubernetes上でOSSのAIコンポーネントを自由に選択し、堅牢なセキュリティとリアルタイム監視を備えたAI実行基盤を提供する。SUSE AI Factoryは「Blueprint」というテンプレートを用いてAIスタックをUIから容易にデプロイ・管理できるコンポーネントで、NVIDIA製品と統合した版も存在する。両者の関係は「インフラ基盤+SUSE AI Factory=SUSE AI」という構図で説明される。

SUSEが発表したエンタープライズAIプラットフォーム「SUSE AI」と、そのコンポーネントである「SUSE AI Factory」の概要を解説。SUSE AIはKubernetes上でOSSのAIコンポーネントを自由に選択し、堅牢なセキュリティとリアルタイム監視を備えたAI実行基盤を提供する。SUSE AI Factoryは「Blueprint」というテンプレートを用いてAIスタックをUIから容易にデプロイ・管理できるコンポーネントで、NVIDIA製品と統合した版も存在する。両者の関係は「インフラ基盤+SUSE AI Factory=SUSE AI」という構図で説明される。
↗ 元記事を開く
zenn.dev 2026/08/21

Kubernetesのポリシー運用ってどうやるの?既存構成にモヤモヤして、Kyvernoと責任分離の設計を一から調べて整理してみた【中編】

KubernetesのポリシーエンジンKyvernoについて、Namespace作成をトリガーにResourceQuota等を自動生成・自動復元する仕組みと、導入時に最も失敗しやすい「Audit→Enforce」の段階的移行手順を整理した記事。Audit状態で違反を記録しつつ開発を止めずに始め、PolicyReportで違反状況を把握してから徐々にEnforceへ昇格し、例外はPolicyExceptionとして期限付きでGit管理する流れを紹介。CIへのシフトレフトやPolicyReportを監査証跡として活用する視点にも触れている。

KubernetesのポリシーエンジンKyvernoについて、Namespace作成をトリガーにResourceQuota等を自動生成・自動復元する仕組みと、導入時に最も失敗しやすい「Audit→Enforce」の段階的移行手順を整理した記事。Audit状態で違反を記録しつつ開発を止めずに始め、PolicyReportで違反状況を把握してから徐々にEnforceへ昇格し、例外はPolicyExceptionとして期限付きでGit管理する流れを紹介。CIへのシフトレフトやPolicyReportを監査証跡として活用する視点にも触れている。
↗ 元記事を開く
zenn.dev 2026/08/20

ローカルLLM本番運用フルスタック:vLLM・SREの最小構成

vLLMをKubernetes上で本番運用するための最小構成を整理した記事。DaemonSetではなくDeploymentで構成し、KEDAでキューの深さ(待機リクエスト数)を基準にオートスケーリングする設計、レプリカ数とノード数を分離する2層スケーリング、TTFTやKVキャッシュ使用率などのSRE監視指標とアラート設計、モデルキャッシュ戦略、カナリアデプロイ、複数モデルのルーティング、コスト監視、障害対応runbook、Graceful Shutdown、本番投入前の負荷テスト、マルチGPUノードでのトポロジー考慮スケジューリングまでを、良い例・悪い例のマニフェストやコードとともに解説している。

vLLMをKubernetes上で本番運用するための最小構成を整理した記事。DaemonSetではなくDeploymentで構成し、KEDAでキューの深さ(待機リクエスト数)を基準にオートスケーリングする設計、レプリカ数とノード数を分離する2層スケーリング、TTFTやKVキャッシュ使用率などのSRE監視指標とアラート設計、モデルキャッシュ戦略、カナリアデプロイ、複数モデルのルーティング、コスト監視、障害対応runbook、Graceful Shutdown、本番投入前の負荷テスト、マルチGPUノードでのトポロジー考慮スケジューリングまでを、良い例・悪い例のマニフェストやコードとともに解説している。
↗ 元記事を開く