# ワークロードの自動スケーリング

> 自動スケーリングによって、何らかのかたちでワークロードを自動的に更新できます。これによりクラスターはリソース要求の変化に対してより弾力的かつ効率的に対応できるようになります。

---

LLMS index: [llms.txt](/llms.txt)

---

<!-- overview -->

Kubernetesでは、現在のリソース要求に応じてワークロードをスケールできます。
これによりクラスターはリソース要求の変化に対してより弾力的かつ効率的に対応できるようになります。

ワークロードをスケールするとき、ワークロードによって管理されるレプリカ数を増減したり、レプリカで使用可能なリソースをインプレースで調整できます。

ひとつ目のアプローチは _水平スケーリング_ と呼ばれ、一方でふたつ目のアプローチは _垂直スケーリング_ と呼ばれます。

ユースケースに応じて、ワークロードをスケールするには手動と自動の方法があります。

<!-- body -->

## ワークロードを手動でスケーリングする {#scaling-workloads-manually}

Kubernetesはワークロードの _手動スケーリング_ をサポートします。
水平スケーリングは`kubectl` CLIを使用して行うことができます。
垂直スケーリングの場合、ワークロードのリソース定義を _パッチ適用_ する必要があります。

両方の戦略の例については以下をご覧ください。

- **水平スケーリング**: [アプリケーションの複数インスタンスを実行](/ja/docs/tutorials/kubernetes-basics/scale/scale-intro/)
- **垂直スケーリング**: [コンテナに割り当てるCPUとメモリ容量を変更](/ja/docs/tasks/configure-pod-container/resize-container-resources)

## ワークロードを自動でスケーリングする {#scaling-workloads-automatically}

Kubernetesはワークロードの _自動スケーリング_ もサポートしており、これがこのページの焦点です。

Kubernetesにおける _オートスケーリング_ の概念は、一連のPodを管理するオブジェクト(例えば<a class='glossary-tooltip' title='クラスター上の複製されたアプリケーションを管理します。' data-bs-toggle='tooltip' data-bs-placement='top' href='/ja/docs/concepts/workloads/controllers/deployment/' target='_blank' aria-label='Deployment'>Deployment</a>)を自動的に更新する機能を指します。

### ワークロードを水平方向にスケーリングする {#scaling-workloads-horizontally}

Kubernetesにおいて、 _HorizontalPodAutoscaler_ (HPA)を使用してワークロードを水平方向に自動的にスケールできます。

これはKubernetes APIリソースおよび<a class='glossary-tooltip' title='クラスターの状態をAPIサーバーから取得、見張る制御ループで、現在の状態を望ましい状態に移行するように更新します。' data-bs-toggle='tooltip' data-bs-placement='top' href='/ja/docs/concepts/architecture/controller/' target='_blank' aria-label='コントローラー'>コントローラー</a>として実装されており、CPUやメモリ使用率のような観測されたリソース使用率と一致するようにワークロードの<a class='glossary-tooltip' title='ReplicaはPodのコピーであり、同一インスタンスを維持することで、可用性、スケーラビリティ、耐障害性を保証します。' data-bs-toggle='tooltip' data-bs-placement='top' href='/ja/docs/reference/glossary/?all=true#term-replica' target='_blank' aria-label='レプリカ'>レプリカ</a>数を定期的に調整します。

Deployment用のHorizontalPodAutoscalerを構成する[ウォークスルーチュートリアル](/ja/docs/tasks/run-application/horizontal-pod-autoscale-walkthrough)があります。

### ワークロードを垂直方向にスケーリングする {#scaling-workloads-vertically}








  <div class="feature-state-notice feature-stable">
      <span class="feature-state-name">FEATURE STATE:</span>
      <code>Kubernetes v1.25 [stable]</code>
    </div>
  



_VerticalPodAutoscaler_ (VPA)を使用してワークロードを垂直方向に自動的にスケールできます。
HPAと異なり、VPAはデフォルトでKubernetesに付属していませんが、[GitHubで](https://github.com/kubernetes/autoscaler/tree/9f87b78df0f1d6e142234bb32e8acbd71295585a/vertical-pod-autoscaler)見つかる別のプロジェクトです。

インストールすることにより、管理されたレプリカのリソースを _どのように_ _いつ_ スケールするのかを定義するワークロードの<a class='glossary-tooltip' title='拡張APIサーバーを構築することなく、Kubernetes APIサーバーに追加するリソースを定義するカスタムコードです。' data-bs-toggle='tooltip' data-bs-placement='top' href='/ja/docs/tasks/extend-kubernetes/custom-resources/custom-resource-definitions/' target='_blank' aria-label='CustomResourceDefinitions'>CustomResourceDefinitions</a>(CRDs)を作成できるようになります。


<div class="alert alert-info" role="note"><h4 class="alert-heading">備考:</h4>VPAが機能するにはクラスターに<a href="https://github.com/kubernetes-sigs/metrics-server">Metrics Server</a>がインストールされている必要があります。</div>


現時点では、VPAは4つの異なるモードで動作できます:



 





<table><caption style="display: none;">VPAの異なるモード</caption>
	<thead>
			<tr>
					<th style="text-align: left">モード</th>
					<th style="text-align: left">説明</th>
			</tr>
	</thead>
	<tbody>
			<tr>
					<td style="text-align: left"><code>Auto</code></td>
					<td style="text-align: left">現在は<code>Recreate</code>です。これは将来インプレースアップデートに変更される可能性があります。</td>
			</tr>
			<tr>
					<td style="text-align: left"><code>Recreate</code></td>
					<td style="text-align: left">VPAはPod作成時にリソースリクエストを割り当てるだけでなく、要求されたリソースが新しい推奨事項と大きく異なる場合にそれらを削除することによって既存のPod上でリソースリクエストを更新します。</td>
			</tr>
			<tr>
					<td style="text-align: left"><code>Initial</code></td>
					<td style="text-align: left">VPAはPod作成時にリソースリクエストを割り当て、後から変更することはありません。</td>
			</tr>
			<tr>
					<td style="text-align: left"><code>Off</code></td>
					<td style="text-align: left">VPAはPodのリソース要件を自動的に変更しません。推奨事項は計算され、VPAオブジェクトで検査できます。</td>
			</tr>
	</tbody>
</table>


#### インプレースPodの水平スケーリング {#in-place-pod-vertical-scaling}








  <div class="feature-state-notice feature-stable" title="フィーチャーゲート: InPlacePodVerticalScaling">
              <span class="feature-state-name">FEATURE STATE:</span> 
              <code>Kubernetes v1.35 [stable]</code>(デフォルトで有効)</div>


Kubernetes 1.36の時点では、VPAはインプレースでのPodのリサイズをサポートしていませんが、この統合は現在作業中です。
インプレースでPodの手動リサイズをするには、[コンテナリソースをインプレースでリサイズする](/ja/docs/tasks/configure-pod-container/resize-container-resources/)を参照してください。

### クラスターサイズに基づく自動スケーリング {#autoscaling-based-on-cluster-size}

クラスターのサイズに基づいてスケールする必要があるワークロード(例えば`cluster-dns`や他のシステムコンポーネント)の場合は、[_Cluster Proportional Autoscaler_](https://github.com/kubernetes-sigs/cluster-proportional-autoscaler)を使用できます。
VPAと同じように、これはKubernetesのコア部分ではありませんが、独自のGitHubプロジェクトとしてホストされています。

Cluster Proportional Autoscalerはスケジュール可能な<a class='glossary-tooltip' title='ノードはKubernetesのワーカーマシンです。' data-bs-toggle='tooltip' data-bs-placement='top' href='/ja/docs/concepts/architecture/nodes/' target='_blank' aria-label='ノード'>ノード</a>とコアの数を監視し、それに応じてターゲットワークロードのレプリカ数をスケールします。

レプリカ数を同じままにする必要がある場合、[_Cluster Proportional Vertical Autoscaler_](https://github.com/kubernetes-sigs/cluster-proportional-vertical-autoscaler)を使用してクラスターサイズに応じてワークロードを垂直方向にスケールできます。
このプロジェクトは**現在ベータ版**でありGitHubで見つけることができます。

Cluster Proportional Autoscalerがワークロードのレプリカ数をスケールする一方で、Cluster Proportional Vertical Autoscalerはクラスター内のノードおよび/またはコアの数に基づいてワークロード(例えばDeploymentやDaemonSet)のリソース要求を調整します。

### イベント駆動型自動スケーリング {#event-driven-autoscaling}

例えば[_Kubernetes Event Driven Autoscaler_
(**KEDA**)](https://keda.sh/)を使用して、イベントに基づいてワークロードをスケールすることもできます。

KEDAは例えばキューのメッセージ数などの処理するべきイベント数に基づいてワークロードをスケールするCNCF Graduatedプロジェクトです。
様々なイベントソースに合わせて選択できる幅広いアダプターが存在します。

### スケジュールに基づく自動スケーリング {#autoscaling-based-on-schedules}

ワークロードををスケールするためのもう一つの戦略は、例えばオフピークの時間帯にリソース消費を削減するために、スケーリング操作を**スケジュールする**ことです。

イベント駆動型オートスケーリングと同様に、そのような動作はKEDAを[`Cron`スケーラー](https://keda.sh/docs/latest/scalers/cron/)と組み合わせて使用することで実現できます。
`Cron`スケーラーによりワークロードをスケールインまたはスケールアウトするためのスケジュール(およびタイムゾーン)を定義できます。

## クラスターのインフラストラクチャのスケーリング {#scaling-cluster-infrastructure}

ワークロードのスケーリングだけではニーズを満たすのに十分でない場合は、クラスターのインフラストラクチャ自体をスケールすることもできます。

クラスターのインフラストラクチャのスケーリングは通常<a class='glossary-tooltip' title='ノードはKubernetesのワーカーマシンです。' data-bs-toggle='tooltip' data-bs-placement='top' href='/ja/docs/concepts/architecture/nodes/' target='_blank' aria-label='ノード'>ノード</a>の追加または削除を意味します。
詳しくは[Nodeの自動スケーリング](/docs/concepts/cluster-administration/node-autoscaling/)を読んでください。

## 次の項目

- 水平スケーリングについて詳しく学ぶ
  - [StatefulSetのスケール](/ja/docs/tasks/run-application/scale-stateful-set/)
  - [HorizontalPodAutoscalerウォークスルー](/ja/docs/tasks/run-application/horizontal-pod-autoscale-walkthrough/)
- [コンテナリソースのインプレースサイズ変更](/ja/docs/tasks/configure-pod-container/resize-container-resources/)
- [クラスター内のDNSサービスを自動スケールする](/docs/tasks/administer-cluster/dns-horizontal-autoscaling/)
- [Nodeの自動スケーリング](/docs/concepts/cluster-administration/node-autoscaling/)について学ぶ
