OpenAI chwali się, że ChatGPT lepiej radzi sobie z pytaniami o zdrowie, a poprawa trafia także do darmowego planu. To brzmi jak duża rzecz, bo takich rozmów są setki milionów tygodniowo, ale w tym temacie sam wzrost wyników w benchmarkach jeszcze niczego nie załatwia.
TL;DR
- OpenAI podało 18 czerwca 2026 roku, że GPT-5.5 Instant osiąga wyniki zbliżone do modeli Thinking w testach HealthBench i HealthBench Professional
- Według firmy w ocenach brało udział ponad 260 lekarzy z 60 krajów i 26 specjalizacji, którzy przeanalizowali ponad 700 tys. odpowiedzi
- OpenAI twierdzi też, że liczba odpowiedzi z oznaczonym problemem faktograficznym w ruchu produkcyjnym spadła o 71% w ciągu dwóch miesięcy
- GPT-5.5 Instant jest dostępny dla darmowych użytkowników ChatGPT z limitami użycia
- Lepszy model nadal nie zastępuje diagnozy ani porady lekarskiej
Co OpenAI ogłosiło 18 czerwca 2026?
OpenAI napisało w opublikowanym 18 czerwca 2026 roku wpisie, że GPT-5.5 Instant poprawia jakość odpowiedzi zdrowotnych w ChatGPT i w testach HealthBench oraz HealthBench Professional zbliża się do poziomu modeli Thinking. Firma zestawia ten wynik z GPT-5.3 Instant z marca 2026, który w tych samych obszarach wypadał słabiej.
Z perspektywy użytkownika chodzi głównie o trzy rzeczy: mniej pomijanych „czerwonych flag”, częstsze dopytywanie o brakujące informacje i ostrożniejsze formułowanie odpowiedzi, gdy model nie ma pewności. To akurat ma sens, bo w pytaniach o zdrowie problemem bywa nie tylko błąd, ale też zbyt duża pewność siebie.
Jak OpenAI mierzy jakość odpowiedzi medycznych?
Według OpenAI za oceną stoi sieć ponad 260 lekarzy z 60 krajów, pracujących w 49 językach i 26 specjalizacjach. Firma podaje, że lekarze recenzują przykładowe odpowiedzi, opisują pożądane zachowania modelu i pomagają wychwytywać sytuacje, w których chatbot powinien dopytać albo zasugerować pilny kontakt z lekarzem.
OpenAI twierdzi też, że eksperci przeanalizowali ponad 700 tys. odpowiedzi, a ich uwagi posłużyły do budowy rubryk oceny wykorzystywanych w HealthBench i HealthBench Professional. To ważny kontekst, bo sam komunikat „AI jest lepsze” niewiele znaczy, jeśli nie wiadomo, kto i według jakich kryteriów to sprawdzał.
Co zmienia GPT-5.5 Instant dla darmowych użytkowników ChatGPT?
OpenAI pisze, że pytania o zdrowie należą do najczęstszych zastosowań ChatGPT. Według firmy użytkownicy zadają ich ponad 230 milionów tygodniowo – od interpretacji wyników badań po przygotowanie do wizyty czy pytania o nawyki zdrowotne.
Dlatego rozszerzenie tych poprawek na darmowy plan jest istotniejsze niż sam marketing wokół modelu. GPT-5.5 Instant ma być dostępny dla wszystkich użytkowników free users z limitami, więc poprawa nie zostaje zamknięta w droższym abonamencie. W polskich realiach to też może mieć znaczenie: wiele osób traktuje ChatGPT jako pierwszy filtr przed wizytą prywatną, która potrafi kosztować kilkaset złotych.
Gdzie kończy się obietnica OpenAI, a zaczynają ograniczenia?
Tu warto zachować zimną głowę. To, że OpenAI notuje lepsze wyniki w swoich testach i raportuje spadek problemów faktograficznych o 71% w dwa miesiące, nie oznacza jeszcze, że ChatGPT stał się narzędziem do diagnozowania. Oznacza raczej, że częściej odpowiada sensownie i rzadziej wpada w oczywiste błędy.
Na DigiCat już pisaliśmy o badaniu „Nature Medicine” i o tym, że chatboty potrafią pomijać część trafnych diagnoz albo prowadzić użytkownika zbyt pewnym tonem w złą stronę. To się nie znosi z nowym komunikatem OpenAI. Po prostu dziś mówimy o lepszym asystencie do porządkowania informacji, a nie o cyfrowym lekarzu.
Źródła:
https://openai.com/index/improving-health-intelligence-in-chatgpt, AI Weekly, OpenAI LinkedIn, YouTube OpenAI, https://deploymentsafety.openai.com/gpt-5-5-instant
