Deler de nyeste modellspesifikasjonene
Vi har oppdatert modellspesifikasjonene basert pÄ ekstern tilbakemelding og den fortsatte forskningen vÄr for Ä forme Þnskelig modellatferd.
Vi deler en stor oppdatering av modellspesifikasjonene, et dokument som definerer hvordan vi vil at AI-modellene vĂ„re skal oppfĂžre seg. Denne oppdateringen forsterker forpliktelsen vĂ„r til tilpassbarhet, Ă„penhet og intellektuell frihet til Ă„ utforske, debattere og opprette med AI uten vilkĂ„rlige begrensninger, mens vi sikrer at beskyttelser er pĂ„ plass for Ă„ redusere faren for ekte skade. Den bygger pĂ„ grunnlaget vi introduserte i mai i fjor, basert pĂ„ opplevelsen vĂ„r fra Ă„ bruke den i forskjellige kontekster fra tilpasningsforskning til Ă„ betjene brukere fra hele verden.Â
Vi deler ogsÄ noen tidlige resultater om modelloverholdelse med prinsippene i modellspesifikasjonene fra et bredt spekter av scenarioer. Disse funnene fremhever fremgang over tid samt omrÄder med forbedringspotensiale. Modellspesifikasjonene, i likhet med modellene vÄre, utvikles videre nÄr vi bruker dem, deler dem og lytter til tilbakemelding fra interessenter. For Ä stÞtte bred bruk og samarbeid frigir vi denne versjonen av modellspesifikasjonene til offentligheten under en Creative Commons CC0-lisens. Dette betyr at utviklere og forskere kan bruke, tilpasse og bygge pÄ den fritt i sitt eget arbeid.
OpenAIs mÄl er Ä opprette modeller som er nyttige, sikre og tilpasset til behovet til brukere og utviklere mens de fremmer mÄlet vÄrt om Ä sikre at kunstig generell intelligens er til nytte for hele menneskeheten. For Ä oppnÄ dette mÄlet mÄ vi rulle ut modeller som styrker utviklere og brukere iterativt, mens vi forhindrer at modellene vÄre forÄrsaker alvorlig skade for brukerne vÄre og andre, og opprettholder OpenAIs lisens til Ä drive virksomhet.
Disse mÄlene kan noen ganger vÊre i strid med hverandre, og modellspesifikasjonene balanserer avveiingen mellom dem ved Ä instruere modellen til Ä fÞlge en tydelig definert kommandokjede samt ytterligere prinsipper som angir grenser og standardatferder for forskjellige scenarioer. Dette rammeverket prioriterer bruker- og utviklerkontroll mens det holdes innen tydelige, godt definerte grenser:
Kommandokjede: Definerer hvordan modellen prioriterer instruksjoner fra plattformen (OpenAI), utvikleren og brukeren i rekkefĂžlge. Mesteparten av modellspesifikasjonene bestĂ„r av retningslinjer som vi mener er nyttige i mange tilfeller, men kan overstyres av brukere og utviklere. Dette lar brukere og utviklere tilpasse modellatferden fullt ut innen grenser angitt av regler pĂ„ plattformnivĂ„.Â
SĂžk sannheten sammen: Som en menneskelig assistent med hĂžy integritet skal modellene vĂ„re la brukerne ta sine egne beste avgjĂžrelser. Dette involverer en nĂžye balanse mellom (1) Ă„ unngĂ„ Ă„ styre brukere med en agenda med objektivitet som standardgrunnlag mens den er villig til Ă„ utforske hvilket som helst emne fra hvilket som helst perspektiv, og (2) Ă„ jobbe for Ă„ forstĂ„ brukerens mĂ„l, tydeliggjĂžre antagelser og utydelige detaljer, samt gi kritisk tilbakemelding nĂ„r det er passende â forespĂžrsler vi har hĂžrt og forbedret.
GjĂžr best mulig arbeid: Angir grunnleggende standarder for kompetanse, inkludert saklig nĂžyaktighet, kreativitet og programmatisk bruk.
Hold deg innenfor grensene: Forklarer hvordan modellen balanserer brukerautonomi med forholdsregler for Ä unngÄ tilrettelegging for skade eller uriktig bruk. Denne versjonen skal vÊre omfattende og fullt ut dekke alle Ärsakene vi mener at modellene vÄre skal bruke for Ä nekte bruker- eller utviklerforespÞrsler.
VĂŠr imĂžtekommende: Beskriver modellens standardstil for samtale â varm, empatisk og nyttig â og hvordan denne stilen kan tilpasses.
Bruk hensiktsmessig stil: Gir standardveiledning for formatering og levering. Uansett om det er rene punktlister, kortfattede kodesnutter eller en stemmesamtale er mÄlet vÄrt Ä sikre tydelighet og brukbarhet.
De oppdaterte modellspesifikasjonene omfavner spesifikt intellektuell frihet â idĂ©en om at AI skal istandsette folk til Ă„ utforske, debattere og opprette uten vilkĂ„rlige begrensninger â uansett hvor utfordrende eller kontroversielt et emne er. I en verden der AI-verktĂžy i Ăžkende grad former debatter, er den frie utvekslingen av informasjon og perspektiver en nĂždvendighet for fremdrift og innovasjon.
Denne filosofien er innlemmet i delene «Hold deg innenfor grensene» og «SÞk sannheten sammen». For eksempel, selv om modellen aldri skal gi detaljert instruksjon for bygging av en bombe eller krenkelse av personvern, oppmuntres den til Ä gi gjennomtenkte svar pÄ politisk eller kulturelt sensitive spÞrsmÄl, uten Ä fremme en bestemt agenda. Vi forsterker prinsippet om at ingen idéer nÞdvendigvis er uaktuelle Ä diskutere, sÄ lenge modellen ikke forÄrsaker betydelig skade for brukeren eller andre (f.eks. utfÞre terrorhandlinger).
For Ä fÄ en bedre forstÄelse av ytelse i den virkelige verdenen har vi begynt Ä samle inn et utfordrende sett med meldinger designet til Ä teste hvor godt modeller fÞlger hvert prinsipp i modellspesifikasjonene. Disse meldingene ble opprettet med en kombinasjon av modellgenerasjon og menneskelig gjennomgang av eksperter, som sikrer dekning av bÄde vanlige og mer komplekse scenarier.
ForelÞpige resultater viser betydelige forbedringer av modelloverholdelse av modellspesifikasjonene sammenlignet med det beste systemet vÄrt i mai i fjor. Selv om noe av denne forskjellen kan tilskrives oppdateringer av retningslinjer, mener vi at mesteparten kommer fra forbedret tilpasning. Selv om fremgangen er lovende, anerkjenner vi at det fremdeles er betydelig rom for vekst.
Vi anser dette som starten av en pĂ„gĂ„ende prosess. Vi planlegger Ă„ fortsette Ă„ utvide utfordringssettet med nye eksempler, spesielt tilfeller som avdekkes via bruk i den virkelige verdenen, som modellene vĂ„re og modellspesifikasjonene ikke hĂ„ndterer fullt ut ennĂ„.Â
Ved forming av denne versjonen av modellspesifikasjonene innlemmet vi tilbakemelding fra den fÞrste versjonen samt lÊrdom fra tilpasningsforskning og utrulling i den virkelige verden. I fremtiden vil vi ta hensyn til mye bredere offentlige innspill. For Ä utvikle prosessene vÄre for Ä nÄ dette mÄlet har vi utfÞrt pilotstudier med omtrent 1000 enkeltpersoner, som hver gjennomgÄr modellatferd, foreslÄtte regler og deler tankene sine. Selv om disse studiene ikke gjenspeiler brede perspektiver ennÄ, har tidlig innsikt direkte informert noen modifikasjoner. Vi anerkjenner at dette er en pÄgÄende, iterativ prosess og er fremdeles forpliktet til Ä lÊre og finjustere tilnÊrmelsen vÄr.
Vi dedikerer denne nye versjonen av modellspesifikasjonene til offentligheten i henhold til en Creative Commons CC0-lisens. Dette betyr at utviklere og forskere kan bruke, tilpasse og bygge pÄ modellspesifikasjonene fritt i sitt eget arbeid. Vi bruker ogsÄ Äpen kildekode for evalueringsmeldingene som brukes ovenfor, og har mÄl om Ä frigi mer kode, artefakter og verktÞy for evaluering og tilpasning av spesifikasjoner i fremtiden.
Du finner disse meldingene og kilden til modellspesifikasjonene i et nytt Github-repositoriumâ (Ă„pnes i et nytt vindu), der vi planlegger Ă„ regelmessig publisere nye versjoner av modellspesifikasjoner fremover.
NĂ„r AI-systemene vĂ„re utvikles, kommer vi til Ă„ fortsette Ă„ iterere pĂ„ disse prinsippene, invitere til tilbakemelding fra fellesskapet og dele fremdriften vĂ„r. I fremtiden kommer vi ikke til Ă„ publisere blogginnlegg for hver oppdatering av modellspesifikasjonene. I stedet kan du nĂ„r som helst finne og spore de siste oppdateringene pĂ„ model-spec.openai.comâ (Ă„pnes i et nytt vindu).
MĂ„let vĂ„rt er Ă„ kontinuerlig muliggjĂžre nye bruksomrĂ„der pĂ„ en trygg mĂ„te og utvikle tilnĂŠrmingen vĂ„r veiledet av pĂ„gĂ„ende forskning og innovasjon. Den voksende rollen AI har i dagliglivet vĂ„rt gjĂžr det nĂždvendig Ă„ fortsette Ă„ lĂŠre, fininnstille og engasjere oss pĂ„ en Ă„pen mĂ„te. Denne tilnĂŠrmingen gjenspeiler ikke bare det vi har lĂŠrt til nĂ„, men troen vĂ„r pĂ„ at tilpasning av AI er en pĂ„gĂ„ende reise â som vi hĂ„per du blir med pĂ„. Hvis du har tilbakemeldinger om disse spesifikasjonene, kan du dele dem her.