- Added support for EC2 G6e instances (up to 8 NVIDIA L40S GPUs) for SageMaker Batch Transform jobs.
- Enables GPU‑intensive offline inference workloads such as large language models and diffusion models across multiple AWS regions.
- Use ml.g6e instance types via SDK, CLI, or CreateTransformJob API; pricing details are provided separately.