bartek@aws: ~/news
$ whoami
$ AWS Architect · DevOps · Cloud

tag: GPU inference

pokaż wszystkie
czwartek, 23 lipca 2026

G6 instances na SageMaker AI Inference już w AWS GovCloud

Amazon rozszerza dostępność instancji EC2 G6 na region AWS GovCloud (US-East) dla SageMaker AI Inference. Te maszyny napędzane ośmioma GPU NVIDIA L4 (po 24 GB pamięci) oferują 2x lepszą wydajność deep learning inference niż poprzednie G4dn. Agencje rządowe i organizacje mogą teraz wdrażać workloady generatywnej AI, od małych modeli językowych po computer vision, zachowując compliance i wymogi rezydencji danych. G6 to solidny wybór dla produkcyjnych zadań inference mieszczących się w 24 GB VRAM.