AWS dorzuciło do Amazon Bedrock funkcję, która ma jeden bardzo praktyczny cel: kiedy w jednym regionie robi się tłoczno, zapytanie do GPT-5.6 może polecieć gdzie indziej. Dla zespołów stawiających na skalę to wygoda. Dla firm pilnujących, gdzie lądują dane, już niekoniecznie.
Co AWS uruchomiło 20 sierpnia 2026
We wpisie AWS ML Blog z 20 sierpnia 2026 Amazon opisał uruchomienie cross-region inference dla modeli OpenAI GPT-5.6 Sol, Terra i Luna w Amazon Bedrock. Chodzi o mechanizm, w którym żądanie nie musi zostać obsłużone w tym samym regionie, z którego zostało wysłane, jeśli gdzie indziej akurat jest więcej wolnej mocy.
Od strony technicznej działa to przez inference profiles, czyli profile wskazujące model i zestaw regionów docelowych. Klient wysyła żądanie do profilu w regionie źródłowym, a Bedrock wybiera region na podstawie bieżącej pojemności. Efekt jest prosty: większa przepustowość i mniejsze ryzyko, że aplikacja utknie na ograniczeniach pojedynczego regionu.
Jak działają profile US i globalne
AWS udostępniło dwa podstawowe warianty. Profil geograficzny, na przykład „us.openai.gpt-5.6-terra”, ogranicza przetwarzanie do wspieranych regionów w jednej geografii. Profil globalny, taki jak „global.openai.gpt-5.6-terra”, może skierować ruch do dowolnego wspieranego regionu na świecie.
To ważny wybór, a nie kosmetyka. Profil globalny zwiększa zapas mocy, ale jednocześnie oznacza, że dane mogą przekraczać granice regionów, a nawet szerszej geografii. Dla firm z wymogami dotyczącymi rezydencji danych bezpieczniejszy będzie profil geograficzny albo po prostu wywołanie jednego, konkretnego regionu. W polskich realiach to istotne choćby dla organizacji, które wewnętrznie rozdzielają dane między UE i resztę świata.
Co zmienia się w API i rozliczeniach
Dobra wiadomość jest taka, że po stronie aplikacji nie trzeba przebudowywać całej integracji. Z dokumentacji AWS wynika, że wystarczy wywołać inference profile zamiast surowego identyfikatora modelu. Obsługa pozostaje dostępna przez OpenAI Responses API, Chat Completions oraz Bedrock Converse API.
AWS podaje też, że billing i limity są śledzone na poziomie konta, niezależnie od tego, który region finalnie obsłużył żądanie. API zostaje praktycznie to samo, ale odpowiedzialność za wybór regionu przechodzi na platformę. Dla deweloperów to wygoda, dla działów compliance kolejna rzecz do sprawdzenia.
Dlaczego to ma znaczenie akurat dla GPT-5.6
Modele GPT-5.6 Sol, Terra i Luna trafiły do Amazon Bedrock pod koniec lipca 2026, więc nowa funkcja pojawia się dość szybko po premierze. AWS nie dorzuca tu nowego modelu ani nowych możliwości rozumowania. Ułatwia za to korzystanie z tych samych modeli wtedy, gdy ruch rośnie i pojedynczy region przestaje wystarczać.
To w gruncie rzeczy ruch infrastrukturalny, ale dla użytkownika końcowego może być bardziej odczuwalny niż kolejna aktualizacja nazwy modelu. Skalowanie staje się prostsze, bo mniej rzeczy trzeba rozwiązywać ręcznie po stronie aplikacji. Jeśli jednak ktoś potrzebuje ścisłej kontroli nad miejscem przetwarzania, ta wygoda ma swoją cenę.
