Buduj real-time'owe aplikacje głosowe z vLLM-Omni na SageMaker AI
Artykuł pokazuje, jak wdrożyć model text-to-speech na Amazon SageMaker AI, korzystając z AWS vLLM-Omni Deep Learning Container i streamować wygenerowaną mowę przez persistent connection. W pierwszej części tutoriala poznasz deployment Qwen3-TTS i integrację z aplikacją Gradio.
źródło: [aws/machine-learning-blog]