tag: LLM
pokaż wszystkie- Gemma 4 31B trafia na AWS SageMaker - dwie wersje do wyboru
- SageMaker HyperPod przyspiesza inference dzięki cachowaniu modeli
- Amazon SageMaker Inference przyspiesza LLM-y dzięki prefix-aware routing
- Detekcja danych wrażliwych bez retrainingu modelu
- SageMaker Batch Transform obsługuje teraz instancje G6e
- Amazon EC2 P6-B300 w Jakartcie – GPU do trenowania mega modeli
- OpenAI GPT-5.6 Terra i Luna dostępne w AWS GovCloud
- NVIDIA Nemotron 3.5 Lightning już dostępny na Amazon SageMaker JumpStart
- Amazon Bedrock dostał Web Search dla modeli OpenAI
- GPT-5.6 Sol, Terra i Luna na Amazon Bedrock obsługują milion tokenów kontekstu
- Amazon SageMaker AI teraz wspiera pełne fine-tuning modeli bez zarządzania infrastrukturą
- Amazon SageMaker AI inference rozszerza dostępność G7e instances do Azji i Europy