bartek@aws: ~/news
$ whoami
$ AWS Architect · DevOps · Cloud
poniedziałek, 3 sierpnia 2026

GPT-5.6 Sol, Terra i Luna na Amazon Bedrock obsługują milion tokenów kontekstu

OpenAI udostępnił na Amazon Bedrock modele GPT-5.6 Sol, Terra i Luna z obsługą miliona tokenów kontekstu. To oznacza, że możesz przeanalizować całe repozytoria, długie dokumenty czy całą historię rozmów agentów bez dzielenia na części i bez utraty informacji. Bonus: prompt caching daje 90% rabatu na powtarzany kontekst, a ceny pokrywają się z taryfami OpenAI.

Amazon SageMaker AI teraz wspiera pełne fine-tuning modeli bez zarządzania infrastrukturą

Amazon SageMaker AI serverless model customization dostał wsparcie dla pełnego fine-tuningu ponad 25 open-source'owych modeli, w tym Llama, Gemma czy Qwen. Do tej pory mogłeś tylko optymalizować część wag (LoRA), teraz możesz dostroić wszystkie parametry i nauczyć model specjalistycznych wzorców czy terminologii z twoich danych. Całą infrastrukturę zarządza AWS, ty płacisz tylko za to co zużyjesz. Usługa jest dostępna w kilku regionach, a start to kwestia kilku kliknięć w SageMaker Studio.

czwartek, 23 lipca 2026

Amazon SageMaker AI inference rozszerza dostępność G7e instances do Azji i Europy

Amazon EC2 G7e instances trafiły do SageMaker AI inference w Seulu, Londynie i Tokio. Te maszyny wyposażone w aż 8 GPU NVIDIA RTX PRO 6000 Blackwell z 96 GB pamięci każdy oferują 2,3x lepszą wydajność niż poprzednia generacja G6e. Dzięki rozszerzeniu regionów możesz teraz deployować modele LLM do 70B parametrów bliżej użytkowników, co znacznie zmniejsza latencję dla aplikacji AI.