スケールイン【scale-in】
概要

システムの規模を拡大する際、同じ構成・機能のコンピュータを複数台設置し、負荷分散を行うことで全体としての性能を向上させることを「スケールアウト」(scale-out)あるいは「水平スケーリング」(horizontal scaling)という。スケールインはこれとは逆の構成変更で、スケールアウトによって増設した機材や仮想マシンを撤去し、少ない台数で同じシステムの機能を維持する。
スケールインが実行される主な場面は、アクセスや処理量が減少し、稼働中のサーバが過剰になったときである。余分なインスタンスを停止・削除して必要最小限の構成に戻すことで、無駄なリソースの消費を抑える。クラウドサービスは使用量に応じた従量課金が一般的であるため、不要なインスタンスを放置すると余分なコストが発生する。
スケールアウトとスケールインを組み合わせ、負荷に応じてサーバ台数を自動的に増減する仕組みを「オートスケーリング」(autoscaling)という。CPU使用率や同時接続数などの値(メトリクス)を監視し、設定した閾値を下回ると自動でスケールインが実行される。Amazon Web ServicesやMicrosoft Azure、Google Cloudなど主要なクラウド事業者はこの機能を標準的に提供しており、人手を介さずに費用対効果を最適化できる。
なお、混同されやすい用語に「スケールダウン」(scale down)がある。これは台数ではなく、個々のサーバのCPUやメモリといった性能や容量を引き下げる操作である。台数の増減がスケールアウト・スケールイン、スペックの増減がスケールアップ・スケールダウンとしてそれぞれ対になっている。
(2026.5.27更新)