OpenAI folosește sute de medici practicieni din întreaga lume pentru a identifica răspunsurile ChatGPT despre sănătate care pot crea confuzie sau pune oamenii în pericol fizic. Până în iulie, aceștia evaluaseră peste 700.000 de răspunsuri, pentru a indica unde trebuie îmbunătățite modelele.
Peste 300 de milioane de oameni folosesc săptămânal ChatGPT pentru sfaturi legate de sănătate, potrivit Business Insider. Evaluatorii verifică exemple de conversații pe care atât utilizatorii, cât și medicii le-ar putea avea cu chatbotul.
„Este un domeniu cu mize mari”, a declarat pentru Business Insider Rebecca Soskin Hicks, medicul care conduce evaluările răspunsurilor despre sănătate la OpenAI.
Medicii testează conversații ambigue și indică unde apar probleme
Rebecca Soskin Hicks s-a alăturat companiei în 2024 și a construit rețeaua împreună cu Karan Singhal, responsabilul cercetării în sănătate la OpenAI. Ea lucrează între medici și echipele companiei, cu scopul de a îmbunătăți folosirea inteligenței artificiale în domeniul medical.
Rețeaua urmărește să reunească specialități și experiențe din regiuni diferite. Medicii vorbesc 49 de limbi și lucrează pentru OpenAI în baza unor contracte cu timp parțial, inclusiv din Kenya, Nepal și Brazilia.
„Pentru a face asta într-un mod care are sens, trebuie să testăm situații ambigue, dezordonate, pline de informații irelevante și insuficient descrise”, a explicat Soskin Hicks despre alegerea situațiilor testate.
Medicii transmit cercetătorilor unde găsesc lacune și unde răspunsurile pot fi îmbunătățite. Echipa de cercetare caută apoi date și metode de antrenare care să ajute ChatGPT în patru direcții:
- Să identifice corect urgențele și prioritatea lor.
- Să ceară informațiile care lipsesc din conversație.
- Să comunice incertitudinea răspunsului.
- Să ofere un nivel de detaliu potrivit situației.
Evaluatorii nu furnizează direct date pentru antrenarea modelelor. Activitatea lor are loc în timp ce OpenAI și alți dezvoltatori folosesc tot mai mult date provenite de la profesioniști pentru a-și îmbunătăți tehnologia.
„Nu există un punct final la care să putem spune că este suficient de bun. Vom continua să îmbunătățim lucrurile, din câte știu, la nesfârșit. Continuu”, a adăugat coordonatoarea evaluărilor.
Rezultatele la teste sunt o primă etapă a dovezilor
OpenAI permite deja conectarea Apple Health și a unor dosare medicale la ChatGPT. Singhal a prezentat cel mai recent model, GPT-6 Astra, drept cel mai performant la un test de referință pentru sănătate, folosit pentru evaluarea modelelor. În septembrie, compania a publicat și un test de referință pentru răspunsurile privind sănătatea mintală.
Pentru Soskin Hicks, observațiile medicilor și performanțele la aceste teste reprezintă primii pași în strângerea dovezilor. Ea speră ca studiile viitoare să demonstreze că folosirea chatboturilor pentru sfaturi de sănătate îmbunătățește rezultatele atât pentru indivizi, cât și pentru populații.
„Există o scară a dovezilor pe care urcăm și încă nu am ajuns în vârf”, a spus ea despre stadiul acestor dovezi.
Singhal declarase pentru Business Insider, mai devreme în acest an, că își dorește ca pacienții să perceapă ChatGPT ca pe un protector pe parcursul îngrijirilor medicale.
OpenAI exclude diagnosticul și tratamentul din utilizarea serviciului
„Suntem foarte clari că Chat nu trebuie folosit pentru diagnostic și tratament”, a declarat pentru Business Insider Ashley Alexander, responsabila produselor de sănătate la OpenAI. Această limită apare și în termenii serviciului. La solicitarea utilizatorilor, chatbotul se oferă totuși să ajute la evaluarea bolilor și a leziunilor.
Alexander susține că inteligența artificială îmbunătățește căutările pe internet pe care milioane de oameni le fac deja. În opinia sa, atribuirea unei decizii medicale exclusiv chatbotului simplifică excesiv situația și riscă să împiedice accesul cât mai multor oameni la beneficiile tehnologiei.
Compania continuă dezvoltarea produselor de sănătate, într-un domeniu în care răspunderea juridică pentru sfaturile medicale oferite de chatboți rămâne puțin testată.
În iulie, un pastor a dat OpenAI în judecată după răspunsurile primite despre o criză pulmonară. El susține că modelul GPT-4o ar fi pus un diagnostic greșit și i-ar fi minimalizat simptomele. Prin acțiunea în instanță, a cerut suspendarea funcționării produselor companiei legate de sănătate.









