bartek@aws: ~/news
$ whoami
$ AWS Architect · DevOps · Cloud
poniedziałek, 28 września 2026

Buduj real-time'owe aplikacje głosowe z vLLM-Omni na SageMaker AI

Artykuł pokazuje, jak wdrożyć model text-to-speech na Amazon SageMaker AI, korzystając z AWS vLLM-Omni Deep Learning Container i streamować wygenerowaną mowę przez persistent connection. W pierwszej części tutoriala poznasz deployment Qwen3-TTS i integrację z aplikacją Gradio.

źródło: [aws/machine-learning-blog]