Plagierer ChatGPT? Undersøker Chatbotens Kilder

Plagierer ChatGPT? Undersøker Chatbotens Kilder

Viktige takeaways

  • Plagiatet som ble oppdaget i et essay og en programmeringskode generert av ChatGPT var relativt lavt, noe som indikerer at det vanligvis ikke kopierer slikt innhold fra nettkilder.
  • Plagiatraten var litt høyere ved beregning av en matematisk løsning. Dette kan skyldes at matematisk resonnement vanligvis er lik på tvers av kilder, slik at svarene kan samsvare med andre materialer.
  • ChatGPTs svar på spørsmål om informasjon som er offentlig tilgjengelig på blogger, viste høyere plagieringsprosent.

Mens ChatGPT kan svare på alle spørsmål du måtte ha, lurer noen brukere på om svarene inneholder plagiat. For å undersøke dette, genererte vi fire forskjellige typer tekster ved hjelp av ChatGPT og evaluerte deretter deres originalitet ved å bruke forskjellige plagieringsdeteksjonsverktøy.

Hva er egentlig plagiat, og hvordan fungerer LLM-er?

For å avgjøre om ChatGPT er skyldig i plagiering, bør du først forstå hva som utgjør plagiat. Plagiat innebærer å bruke en annen persons ord, ideer eller arbeid uten riktig attribusjon. Dette inkluderer direkte kopiering av tekst fra en kilde uten henvisning eller nøye parafrasering av andres ideer uten anerkjennelse.

ChatGPT, som andre store språkmodeller (LLM), er trent på store datasett, for det meste fra offentlig tilgjengelig innhold. Innsamling av så store datamengder reiser imidlertid etiske spørsmål, ettersom de opprinnelige skaperne ikke har samtykket til at arbeidet deres brukes til å trene LLM-ene. Dette fører til debatter om etikken og lovligheten av slik praksis.

Selv om ChatGPT genererer svar basert på forespørslene den mottar, ligger problemet i den bredere konteksten av hvordan OpenAI (ChatGPTs utvikler) innhentet dataene som ble brukt til å trene den, som innebærer bruk av innhold uten riktig samtykke. Mange ser på dette som plagiat og, for mange nettsteder, innholdstyveri. Det er imidlertid vanskelig å finne de eksakte kildene til plagiat.

For resten av denne artikkelen vil vi konsentrere oss om hvorvidt ChatGPT plagierer produksjonen fra andre kilder uten å fordype seg i detaljene om hvor svarene kommer fra. La oss sjekke originaliteten til ChatGPTs svar ved å bruke ulike plagiatdeteksjonsverktøy for å se om chatboten bruker tekst fra nettkilder direkte.

Plagierer ChatGPT essays?

I dette første eksempelet ga vi ChatGPT i oppgave å skrive et 300-ords essay om psykiske problemer.

Etter det brukte vi forskjellige plagiatdeteksjonsverktøy for å vurdere originaliteten til essayet generert av chatboten. Disse verktøyene inkluderte Quetext-plagiatsjekken, Microsoft Words innebygde plagieringskontroll, Grammarlys plagieringskontroll og Duplichecker-plagiatskanneren.

Microsofts innebygde likhetskontroll rapporterte null prosent likhet med nettbaserte kilder. Nivåene av plagiat oppdaget av andre verktøy var også minimale: Grammarlys plagiatdetektor fant fire prosent, QueTexts plagiatdetektor fant fem prosent, og Duplicheckers plagiatskanner viste null prosent.

Med tanke på den lille prosentandelen av oppdaget plagiering, ser det ut til at ChatGPT ikke direkte kopierer essays fra eksisterende kilder.

Plagierer ChatGPT kode?

For å vurdere om ChatGPT plagierer kode, ga vi chatboten i oppgave å skrive kode for en kalkulator i Python.

En kode generert av ChatGPT på Python-språket.

Etter dette gjennomførte vi en plagiatsjekk av koden ved hjelp av en spesialisert programmeringsplagieringskontroll kalt Dolos, som oppdaget null prosent likhet. Når vi sjekket koden ved hjelp av generelle tekstplagiatdeteksjonsverktøy nevnt ovenfor, var resultatene konsistente, med nesten ingen av programmene som oppdaget mer enn fire prosent plagiat.

Da vi ba ChatGPT om å generere en kode for en kalkulator fra forskjellige kontoer, virket svarene annerledes. Denne observasjonen og resultatene fra plagiatsjekkene indikerer at ChatGPT ikke bare replikerer koder fra nettkilder. I stedet trekker den på datasettet den ble trent på for å generere kode uavhengig.

Plagierer ChatGPT matematiske løsninger?

Under den tredje testen ga vi chatboten i oppgave å løse et matematisk problem og gi detaljerte begrunnelser for hvert trinn.

Løsning av et integrasjonsspørsmål med forklaringen generert av ChatGPT.

For å sjekke originaliteten til svaret, testet vi resultatet ved hjelp av flere akademisk-spesifikke plagiatdeteksjonsverktøy, inkludert PapersOwl plagiatkontroll, AI-drevet Trinka plagiatskanner, samt generelle plagieringskontrollverktøy som Grammarly, Duplichecker og QueText.

PapersOwls plagiatdetektor indikerte en likhet på nesten 46 prosent mellom chatbotens genererte resonnement og nettkilder. På samme måte rapporterte Trinka plagiatdetektor mer enn 10 prosent likhet. I tillegg oppdaget Grammarlys plagiatdetektor 14 prosent likhet, QueText fant 17 prosent, og Duplichecker viste syv prosent.

Oppdagelsen av høyt plagiat i det genererte svaret antyder ikke at chatboten direkte kopierer resonnementer for matematiske spørsmål fra nettkilder. Dette er hovedsakelig fordi løsninger og begrunnelse for matematiske problemer ofte er standard og allment tilgjengelig på nettet.

Så selv om ChatGPT kommer med sine egne svar, er det mulig å finne de samme svarene og resonnementene på nettet, noe som kan ha lagt til de høye plagiatprosentene.

Bruker ChatGPT innhold fra blogger?

For å sjekke om ChatGPT bruker innhold fra nettblogger, ba vi chatboten om å gi tips for å opprettholde batteritilstanden til bærbare datamaskiner.

Tips for å holde laptop-batteriet sunt generert av ChatGPT.

Microsoft Word oppdaget 10 prosent plagiering i den genererte teksten. Duplichecker viste fire prosent, Grammarlys plagiatkontroll indikerte 14 prosent, men Quetext fant 58 prosent plagiat i teksten. Etter å ha gravd videre, samsvarte noe av teksten i chatbotens svar med innholdet på noen blogger.

For å dobbeltsjekke om det høye plagiatdeteksjonen ikke bare var tilfeldig, stilte jeg chatboten noen flere spørsmål om informasjon som er lett tilgjengelig på nettet. Plagiatprosenten i de genererte svarene var mye høyere. Basert på vår testing ser det ut til at chatboten noen ganger bruker setninger og tekst fra nettkilder, noe som er ganske overraskende.

Bør du bruke ChatGPT på jobb eller skole?

Selv om mange gratis online plagiatkontrollere ikke har oppdaget større plagiat i ChatGPTs svar, bør du ikke bruke det til akademiske eller profesjonelle formål.

Ikke bruk ChatGPT til skoleoppgavene dine hvis du er student. Instruktører kan bruke verktøy som GPTZero og Turnitins AI-skrivedetektor for å oppdage AI-generert innhold. Hvis arbeidet ditt blir flagget som AI-generert av slike verktøy, kan du mislykkes i oppgaven eller til og med bli utvist fra skolen. Selv om mange GPT-deteksjonsverktøy spesifikt sier at de ikke bør brukes til dette formålet, er de det, og det kan føre til at du får problemer. For ikke å nevne, du jukser egentlig bare deg selv ved å ikke studere emnet ordentlig.

Kan du bruke chatboten til å forbedre arbeidsytelsen din? Det kommer an på. Hvis du vil forbedre skriveflyten din i e-poster eller andre tekstformer, kan bruk av AI spare deg for tid og krefter. Du bør imidlertid bare bruke den som et verktøy for å hjelpe deg med oppgavene dine i stedet for å stole på at den gjør hele jobben for deg.

Derimot, hvis jobben din, som profesjonell skriving, forbyr bruk av slike verktøy, bør du unngå å bruke ChatGPT eller andre verktøy helt.

Forhåpentligvis har testingen vår gitt deg innsikt i i hvilken grad ChatGPT kan trekke fra ressurser tilgjengelig på nettet. Det er imidlertid viktig å merke seg at vi har brukt gratis plagieringsverktøy og testet kun et begrenset datasett. Så selv om funnene våre kan være nyttige, bør de ikke tas som absolutte fakta.

Støtt vårt arbeid ❤️

Hvis du likte denne artikkelen, vurder å gi en tips for å hjelpe oss med å fortsette å publisere kvalitetsinnhold.

Sikker betaling med PayPal