OpenAI chwali się, że ChatGPT lepiej radzi sobie z pytaniami o zdrowie, a poprawa trafia także do darmowego planu. To brzmi jak duża rzecz, bo takich rozmów są setki milionów tygodniowo, ale w tym temacie sam wzrost wyników w benchmarkach jeszcze niczego nie załatwia.

TL;DR

  • OpenAI podało 18 czerwca 2026 roku, że GPT-5.5 Instant osiąga wyniki zbliżone do modeli Thinking w testach HealthBench i HealthBench Professional
  • Według firmy w ocenach brało udział ponad 260 lekarzy z 60 krajów i 26 specjalizacji, którzy przeanalizowali ponad 700 tys. odpowiedzi
  • OpenAI twierdzi też, że liczba odpowiedzi z oznaczonym problemem faktograficznym w ruchu produkcyjnym spadła o 71% w ciągu dwóch miesięcy
  • GPT-5.5 Instant jest dostępny dla darmowych użytkowników ChatGPT z limitami użycia
  • Lepszy model nadal nie zastępuje diagnozy ani porady lekarskiej

Co OpenAI ogłosiło 18 czerwca 2026?

OpenAI napisało w opublikowanym 18 czerwca 2026 roku wpisie, że GPT-5.5 Instant poprawia jakość odpowiedzi zdrowotnych w ChatGPT i w testach HealthBench oraz HealthBench Professional zbliża się do poziomu modeli Thinking. Firma zestawia ten wynik z GPT-5.3 Instant z marca 2026, który w tych samych obszarach wypadał słabiej.

Z perspektywy użytkownika chodzi głównie o trzy rzeczy: mniej pomijanych „czerwonych flag”, częstsze dopytywanie o brakujące informacje i ostrożniejsze formułowanie odpowiedzi, gdy model nie ma pewności. To akurat ma sens, bo w pytaniach o zdrowie problemem bywa nie tylko błąd, ale też zbyt duża pewność siebie.

Jak OpenAI mierzy jakość odpowiedzi medycznych?

Według OpenAI za oceną stoi sieć ponad 260 lekarzy z 60 krajów, pracujących w 49 językach i 26 specjalizacjach. Firma podaje, że lekarze recenzują przykładowe odpowiedzi, opisują pożądane zachowania modelu i pomagają wychwytywać sytuacje, w których chatbot powinien dopytać albo zasugerować pilny kontakt z lekarzem.

OpenAI twierdzi też, że eksperci przeanalizowali ponad 700 tys. odpowiedzi, a ich uwagi posłużyły do budowy rubryk oceny wykorzystywanych w HealthBench i HealthBench Professional. To ważny kontekst, bo sam komunikat „AI jest lepsze” niewiele znaczy, jeśli nie wiadomo, kto i według jakich kryteriów to sprawdzał.

Co zmienia GPT-5.5 Instant dla darmowych użytkowników ChatGPT?

OpenAI pisze, że pytania o zdrowie należą do najczęstszych zastosowań ChatGPT. Według firmy użytkownicy zadają ich ponad 230 milionów tygodniowo – od interpretacji wyników badań po przygotowanie do wizyty czy pytania o nawyki zdrowotne.

Dlatego rozszerzenie tych poprawek na darmowy plan jest istotniejsze niż sam marketing wokół modelu. GPT-5.5 Instant ma być dostępny dla wszystkich użytkowników free users z limitami, więc poprawa nie zostaje zamknięta w droższym abonamencie. W polskich realiach to też może mieć znaczenie: wiele osób traktuje ChatGPT jako pierwszy filtr przed wizytą prywatną, która potrafi kosztować kilkaset złotych.

Gdzie kończy się obietnica OpenAI, a zaczynają ograniczenia?

Tu warto zachować zimną głowę. To, że OpenAI notuje lepsze wyniki w swoich testach i raportuje spadek problemów faktograficznych o 71% w dwa miesiące, nie oznacza jeszcze, że ChatGPT stał się narzędziem do diagnozowania. Oznacza raczej, że częściej odpowiada sensownie i rzadziej wpada w oczywiste błędy.

Na DigiCat już pisaliśmy o badaniu „Nature Medicine” i o tym, że chatboty potrafią pomijać część trafnych diagnoz albo prowadzić użytkownika zbyt pewnym tonem w złą stronę. To się nie znosi z nowym komunikatem OpenAI. Po prostu dziś mówimy o lepszym asystencie do porządkowania informacji, a nie o cyfrowym lekarzu.

Źródła:

https://openai.com/index/improving-health-intelligence-in-chatgpt, AI Weekly, OpenAI LinkedIn, YouTube OpenAI, https://deploymentsafety.openai.com/gpt-5-5-instant

Najczęściej zadawane pytania