All news
ModelsAWS Machine Learning·September 9, 2026

Deploying Qwen3.8-2.4T-A95B on Amazon SageMaker HyperPod with vLLM

AWS just deployed Qwen3.8-2.4T-A95B on SageMaker HyperPod using vLLM. This boosts performance for users running large language models, making it easier to scale AI applications efficiently.

More in Models