Amazon EC2 Auto Scaling now supports batch instance termination
Amazon EC2 Auto Scaling adds support for terminating up to 100 instances in a single API call, reducing the number of API calls needed to scale down Auto Scaling groups. This is particularly useful for workloads requiring rapid scale-down such as AI/ML training jobs and container orchestrators
Amazon EC2 Auto Scaling now enables terminating up to 100 instances in a single API call through batch processing. This reduces the number of API calls required to scale down Auto Scaling groups. The feature is especially beneficial for workloads that need rapid scaling down, such as AI/ML training jobs, container orchestrators, and event-driven architectures that temporarily spin up large fleets. All instances in a batch are validated atomically before termination begins, and existing Auto Scaling behaviors such as lifecycle hooks and load balancer connection draining are preserved for each instance in the batch. The feature is available in all AWS Regions at no additional cost
Why it matters
This feature is useful for scenarios requiring rapid scaling down of Auto Scaling groups, particularly for managing large, temporary instance clusters