Ytring
Forskningen bør ha et system som sier ifra når feilraten blir for stor
Programvarebransjen stanser et system automatisk når feilraten krysser en grense. Norsk forskningskontroll venter fortsatt på at noen klager.
Jasvinder Sadana mener at når andelen korrigerte eller trukne artikler ved en institusjon passerer en fastsatt grense over tid, bør det utløse en skjerpet gjennomgang av seg selv, uten at noen først må klage.
Foto: Privat
Dette er en ytring. Innholdet i teksten uttrykker forfatterens mening.
Jeg har jobbet med systemer der en sirkelbryter automatisk stenger en tjeneste når feilraten passerer en fastsatt terskel, lenge før skaden sprer seg videre. Prinsippet ble popularisert av Michael Bygard i boken Release It! og har vært standard i pålitelig programvaredrift i over femten år.
Jeg synes det er et påfallende enkelt prinsipp: grensen utløser handling av seg selv. Ingen venter på at noen skal melde fra først.
Jeg opplever at norsk forskningskontroll virker motsatt. Leder for Granskingsutvalget, Irene Vanja Dahl sier selv at utvalget bruker stadig mer tid på klagesaksbehandling, på bekostning av forebyggende arbeid. Systemet avventer at noen sender inn en klage før noe skjer.
Enig eller uenig?
Send oss din ytring på
Dahl presiserer selv at flere klagesaker ikke nødvendigvis betyr mer uredelighet, et forbehold jeg tar på alvor. Selv NENTs egne retningslinjer, oppdatert i 2024 nettopp for å dekke kunstig intelligens, er uttrykkelig rådgivende og veiledende, ikke noe som utløser en reaksjon av seg selv. Jeg mener det er en reaktiv innretning, ikke en selvutløsende en.
Jeg er bekymret for at KI nå legger enda mer press på nettopp denne innretningen. En bibliometrisk analyse av 335 tilbaketrukne KI-relaterte artikler fant at kompromittert fagfellevurdering var den vanligste årsaken, og at over halvparten fortsatt hadde en siteringsrate på linje med resten av fagfeltet, selv etter tilbaketrekning. Skaden er alt spredd før noen oppdager mønsteret.
Jeg foreslår derfor at Granskingsutvalget, sammen med Forskningsrådet og institusjonene, utvikler en tilsvarende terskelordning: når andelen korrigerte eller trukne artikler ved en institusjon passerer en fastsatt grense over tid, bør det utløse en skjerpet gjennomgang av seg selv, uten at noen først må klage.
Mekanismen erstatter ikke fagfellevurderingen, den fanger opp mønsteret den har bommet på. Jeg forstår at et presset utvalg kan kvie seg for nok et rapporteringskrav, men tiltaket bør avlaste klagebehandlingen, ikke belaste den. Jeg lurer fortsatt på om terskelen bør bygge på retraksjonsrate alene, eller også fange opp stille korrigeringer som aldri blir en formell retraksjon. Ordningen krever i tillegg at Granskingsutvalgets mandat, i dag avgrenset til innmeldte saker, utvides.
Jeg skal være ærlig om svakheten ved forslaget mitt. En liten fagenhet med få publikasjoner kan utløse ordningen ved bare én feil, mens en stor institusjon tåler flere før noe skjer. Jeg mener den skjevheten må justeres statistisk før mekanismen rulles ut, ikke oppdages etterpå.
Jeg tror ikke programvarebransjen løste pålitelighet ved å bli flinkere til å behandle klager raskere. Den bygde inn en innretning som reagerer før brukeren i det hele tatt merker noe. Forskningssektoren har fortsatt ikke bygget sin.