Hundratals inhyrda granskare uppges läsa riktiga konversationer från ChatGPT-användare. Samtalen används för att bedöma svaren och göra AI mindre inställsam och mer naturlig.
Uppgifterna kommer från en granskning av 404 Media, som tagit del av interna instruktioner, kommunikation mellan granskare och konversationer från projektet.
Arbetet går under namnet Project Lily. Enligt granskningen får de inhyrda personerna läsa användarens fråga, sammanfatta vad personen försöker göra och sedan betygsätta flera möjliga svar från ChatGPT.
Annons
Hela konversationer kan visas
Granskarna ska bland annat bedöma om svaret faktiskt hjälper användaren och om det innehåller typiska AI-formuleringar, överdrivet smicker eller onödiga symboler.
Arbetet handlar inte i första hand om att kontrollera om varje sakuppgift är korrekt. I stället används människornas omdömen för att forma hur ChatGPT uttrycker sig och beter sig.
Enligt 404 Media kan granskarna få se hela konversationer och inte bara en enskild fråga. Materialet kan dessutom innehålla en sammanfattning av användarens minnen, intressen och tidigare frågor.
Granskarna ska inte se användarnamnet och konversationerna passerar ett automatiskt integritetsfilter. Trots det kan personliga uppgifter finnas kvar i texten.
OpenAI ska enligt granskningen ha uppgett att filtret kan missa information, särskilt i korta konversationer där det finns mindre sammanhang att arbeta med.
Läs mer: Dina AI-chattar kan hamna i domstol
OpenAI varnar själv för känslig information
Att människor kan granska innehåll i tjänsten är inte helt okänt. OpenAI skriver i sin information om integritet och innehållsmoderering att företaget använder en kombination av automatiska system och mänsklig granskning.
Människor kan bland annat granska innehåll som har flaggats för att avgöra om det bryter mot företagets regler.
OpenAI uppger också att konversationer från privata konsumentkonton kan användas för att förbättra modellerna om användaren inte har valt bort detta. Innan material används ska företaget försöka filtrera bort eller dölja personuppgifter.
Användare bör inte dela känslig information i ChatGPT som de inte vill ska användas eller granskas, skriver OpenAI i sin information om integritet.
Läs mer: Så ser du om ditt ChatGPT-konto har blivit hackat
Det går att stänga av träningen
Den som använder ett vanligt ChatGPT-konto kan stänga av användningen av nya samtal för modellträning.
Inställningen finns under Inställningar, Datakontroller och Förbättra modellen för alla. När den stängs av ska framtida konversationer inte användas för att träna OpenAI modeller.
Det går också att använda Tillfällig chatt. Dessa samtal visas inte i historiken, skapar inga minnen och används inte för modellträning. OpenAI uppger däremot att tillfälliga samtal kan sparas i upp till 30 dagar av säkerhetsskäl.
Att stänga av modellträningen innebär inte nödvändigtvis att ingen människa under några omständigheter kan se innehållet. OpenAI använder fortfarande mänsklig granskning för bland annat säkerhet och hantering av material som har flaggats av företagets system.
Läs mer: AI:n kan läsa dina mejl och agera åt dig – nu växer oron
Företagskonton behandlas annorlunda
OpenAI uppger att innehåll från ChatGPT Business, Enterprise, Edu och företagets API inte används för att träna modellerna som standard. Organisationer måste själva välja att dela sådana uppgifter.
Det är en viktig skillnad för arbetsplatser som använder ChatGPT för interna dokument, kod eller kundinformation. Ett privat ChatGPT-abonnemang har inte automatiskt samma grundinställningar som företagstjänsterna.
Uppgifterna om Project Lily visar samtidigt varför användare bör undvika att behandla en vanlig AI-chatt som ett helt privat rum.
Personnummer, lösenord, patientuppgifter, företagshemligheter och känsliga dokument bör inte klistras in i en konsumenttjänst utan att användaren först har kontrollerat vilka regler och datainställningar som gäller.
Läs mer: Vi lär fortfarande ut källkritik för gårdagens internet
