Kuriame autorių centrus: ORCID, Crossref ir mokslininkų profiliai kaip patikimumo primityvai
Autorių centrai – tai vieši, susieti įrašai, padedantys žmonėms ir mašinoms atsakyti į tris pagrindinius klausimus:
- Kas sukūrė šį darbą?
- Kuo tiksliai yra šis darbas?
- Kodėl kas nors turėtų pasitikėti ryšiu tarp asmens, darbo ir organizacijos?
Žmonėms autorių centras gali atrodyti kaip profilio puslapis su biografija, publikacijomis, kvalifikacija ir nuorodomis. Dirbtinio intelekto sistemoms jį naudingiau įsivaizduoti kaip susietą įrodymų grafiką.
Stiprus autorių centras susieja:
- Asmenį su ORCID iD
- Publikaciją, duomenų rinkinį, ataskaitą ar programinės įrangos paketą su skaitmeninio objekto identifikatoriumi (DOI)
- Darbą su išsamiais Crossref ar DataCite metaduomenimis
- Tyrėją su patvirtintomis priklausomybėmis ir organizacijomis
- Viešą profilį su stabiliu instituciniu tinklalapiu
- Indėlius su aiškiais vaidmenimis, pavyzdžiui, nurodytais Dalyvių vaidmenų taksonomijoje
- Dabartinius ir buvusius vaidmenis su datomis, šaltiniais ir atnaujinimo įrašais
Šie ryšiai gali pagerinti tapatybės nustatymą, paiešką, citavimo tikslumą ir šaltinio patikrinimą. Jie negarantuoja, kad dirbtinio intelekto sistema cituos autorių. Nėra patikimų viešų įrodymų, kad pridėjus vieną ORCID iD, fiksuotai padidėtų dirbtinio intelekto citavimų skaičius. Stipresnis teiginys yra siauresnis ir lengviau pagrindžiamas: gera tapatybės ir darbo metaduomenų praktika palengvina paieškos ir tyrimų sistemoms rasti, suderinti, patikrinti ir teisingai cituoti mokslinę medžiagą.
Šis straipsnis atspindi viešąją dokumentaciją ir tyrimus, prieinamus 2026 m. rugpjūčio 13 d. duomenimis.
Kodėl autorių centrai svarbūs dirbtinio intelekto sistemoms
Dirbtinio intelekto sistemos ne visos naudoja tuos pačius paieškos indeksus, duomenų bazes ar reitingavimo metodus. Kai kurios remiasi tiesiogine žiniatinklio paieška. Kitos naudoja mokslines duomenų bazes, licencijuotus indeksus, vidines žinių saugyklas arba paieškos sistemas, kurios ieško dokumentų prieš generuodamos atsakymą.
Vis dėlto daugelis sistemų susiduria su tomis pačiomis techninėmis problemomis:
- Vardai gali būti rašomi įvairiais būdais.
- Keli tyrėjai gali turėti tą patį vardą.
- Darbas gali turėti priešspaudinį, konferencijos versiją, priimtą rankraštį ir galutinę versiją.
- Žurnalo straipsnis gali būti susietas su duomenų rinkiniu, programinės įrangos paketu, dotacija ar pataisymu.
- Autorius gali keisti institucijas ar vardus.
- Tinklalapis gali apibūdinti kvalifikaciją nenurodydamas, kas ją išdavė ar kada ji galiojo.
Nuolatiniai identifikatoriai ir struktūrizuoti metaduomenys padeda spręsti šias problemas.
Skaitmeninio Objekto Identifikatoriaus sistema apibūdina identifikatorių kaip nuolatinį skaitmeninio, fizinio ar abstraktaus objekto pavadinimą. Jo vertė priklauso ne tik nuo identifikatoriaus, bet ir nuo su juo susietų metaduomenų. DOI vadovas (doi.org)
Naudingas būdas mąstyti apie autorių centrą yra keturių susietų lygmenų sistema:
| Lygmuo | Pagrindinis klausimas | Naudingas patikimumo primityvas |
|---|---|---|
| Asmuo | Kas yra šis tyrėjas? | ORCID iD |
| Darbas | Kokia yra tiksli publikacija ar išvestis? | Skaitmeninio Objekto Identifikatorius |
| Organizacija | Kur atsirado darbas ar vaidmuo? | Tyrimų organizacijos registro identifikatorius |
| Kontekstas | Ką asmuo nuveikė ir kas tai patvirtina? | Instituciniai ir mokslininkų profiliai |
Tikslas nėra sukurti profilį, pilną įspūdingų žodžių. Tikslas yra sukurti įrašą, kuriame būtų galima patikrinti svarbius teiginius.
Trys pagrindinės autorių centro dalys
1. ORCID: Asmens tapatybės lygmuo
ORCID reiškia Open Researcher and Contributor ID (atviras tyrėjo ir dalyvio ID). Jis suteikia nuolatinį asmens identifikatorių ir padeda atskirti tyrėjus, kurie turi panašius vardus, naudoja skirtingas vardo formas arba keičia savo vardus laikui bėgant. ORCID apžvalga (support.orcid.org)
ORCID įraše gali būti:
- Vardai ir vardo variantai
- Užimtumas ir išsilavinimas
- Moksliniai darbai
- Finansavimas
- Kolegų peržiūros veikla
- Redakcinė veikla
- Narystės ir apdovanojimai
- Tyrimų ištekliai
- Nuorodos į kitus identifikatorius
Svarbiausia savybė yra ne pats 16 skaitmenų numeris, o su juo susietas palaikomų ryšių tinklas.
Pavyzdžiui:
text Jana Vardenė (Jane Smith) └── ORCID iD ├── Straipsnio DOI ├── Duomenų rinkinio DOI ├── Dotacijos identifikatorius ├── Universiteto priklausomybė ├── Programinės įrangos įrašas └── Redakcinis vaidmuo
Patvirtinti ryšiai yra stipresni
Organizacijos turėtų rinkti ORCID iD per autentifikuotą prisijungimo procesą, o ne prašydamos žmonių įvesti identifikatorių į formą. ORCID rekomenduoja naudoti savo autorizavimo procesą, kad tyrėjas patvirtintų teisingą įrašą. ORCID integravimo ir programavimo sąsajos gairės (info.orcid.org)
Šis skirtumas yra svarbus:
- Nepagrįstas teiginys: „Šis ORCID iD priklauso Janai Vardenei.“
- Patvirtintas teiginys: „Jana Vardenė prisijungė per ORCID ir suteikė šiai sistemai leidimą naudoti savo iD.“
- Institucinis patvirtinimas: „Universitetas patvirtina, kad šis asmuo turėjo šią priklausomybę nurodytomis datomis.“
ORCID taip pat saugo teiginių šaltinį ir kilmę. Darbą ar priklausomybę gali pridėti tyrėjas, leidėjas, finansuotojas ar kita patikima organizacija. ORCID patikimumo gairės (info.orcid.org)
Tai sukuria naudingą patikimumo signalą tiek žmonėms, tiek mašinoms:
Įrašas ne tik nurodo, kas teigiama. Jis taip pat gali parodyti, kas padarė teiginį ir kada jis buvo pridėtas.
Svarbus apribojimas
ORCID iD nėra garantas, kad kiekvienas įrašo elementas yra teisingas. Pats ORCID skatina vartotojus patikrinti patikimumo žymeklius, šaltinius, datas ir organizacijas, kurios pridėjo informaciją. ORCID patikimumo žymekliai (info.orcid.org)
Todėl organizacijos neturėtų traktuoti „turi ORCID iD“ kaip lygu „visiškai patvirtinta“. Geresnis modelis yra:
- Pats deklaravęs
- Autentifikuotas
- Instituciškai patvirtintas
- Leidėjo patvirtintas
- Finansuotojo patvirtintas
- Neseniai peržiūrėtas
2. Crossref ir DataCite: Darbo tapatybės lygmuo
ORCID identifikuoja asmenį. Crossref ir DataCite padeda identifikuoti darbą.
Skaitmeninio Objekto Identifikatorius gali identifikuoti:
- Žurnalų straipsnius
- Knygas ir knygų skyrius
- Konferencijų pranešimus
- Duomenų rinkinius
- Programinę įrangą
- Ataskaitas
- Priešspaudinius
- Recenzijas
- Standartus
- Plakatus ir pristatymus
DOI turėtų nukreipti į stabilų nukreipimo puslapį. Svarbiausia, jis turėtų turėti išsamius metaduomenis, apibūdinančius darbą.
Crossref rekomenduoja įrašyti tokią informaciją kaip:
- Pavardė ir vardas
- Dalyvio vaidmenys
- Priklausomybės
- Organizacijos identifikatoriai
- ORCID iD
- Publikavimo datos
- Santraukos
- Nuorodos
- Finansavimas
- Licencijos
- Versijos informacija
- Atnaujinimai ir pataisymai
Crossref privalomi ir rekomenduojami metaduomenys (crossref.org)
Crossref apibūdina savo metaduomenis kaip bendrą išteklių, kurį galima pasiekti per žiniatinklio sąsajas, programavimo sąsajas ir masinius atsisiuntimus. Duomenis naudojantys sistemų vartotojai gali naudoti šią informaciją moksliniams rezultatams atrasti ir susieti. Crossref metaduomenų gavimas (crossref.org)
DataCite atlieka panašią funkciją duomenų rinkiniams ir daugeliui kitų tyrimų rezultatų. Dabartinė jos metaduomenų schema 4.7, išleista 2026 m. kovo 3 d., palaiko kūrėjus, dalyvius, ORCID identifikatorius, priklausomybes, organizacijos identifikatorius, susijusius identifikatorius, finansavimą, aprašymus ir išteklių tipus. DataCite metaduomenų schema (schema.datacite.org)
DataCite konkrečiai rekomenduoja susieti kūrėjų ir dalyvių įrašus su ORCID identifikatoriais, o organizacines priklausomybes – su organizacijos identifikatoriais. DataCite vardų identifikatoriai (support.datacite.org)
DOI nėra kokybės ženklas
DOI įrodo, kad įrašas egzistuoja DOI registracijos sistemoje. Jis neįrodo, kad:
- Tyrimas yra teisingas
- Publikacija yra recenzuota
- Žurnalas yra patikimas
- Autorius yra ekspertas
- Išvados yra svarbios
Crossref aiškiai pabrėžia: pats DOI nenurodo objekto vertės ar tikslumo. Aplinkiniai metaduomenys suteikia kontekstą ir leidžia užmegzti ryšius. Crossref DOI gairės (support.crossref.org)
Štai kodėl išsamus DOI įrašas yra daug naudingesnis nei DOI eilutė, patalpinta puslapio apačioje.
Dalyvių vaidmenys suteikia prasmės
2026 m. liepą Crossref schema 5.5 pridėjo geresnį palaikymą keliems dalyvių vaidmenims, susirašinėjantiems autoriams ir Dalyvių vaidmenų taksonomijai. Crossref schema 5.5 (crossref.org)
Dalyvių vaidmenų taksonomijoje yra 14 vaidmenų, įskaitant:
- Koncepcijos kūrimas
- Duomenų tvarkymas
- Formali analizė
- Tyrimas
- Metodologija
- Programinė įranga
- Priežiūra
- Patvirtinimas
- Vizualizacija
- Pirminio projekto rašymas
- Rašymas, peržiūra ir redagavimas
Taksonomija buvo sukurta siekiant padidinti indėlių skaidrumą ir palaikyti įvertinimą, atskaitomybę, tyrimų vertinimą ir tyrimų vientisumą. Dalyvių vaidmenų taksonomija (credit.niso.org)
Dirbtinio intelekto sistemoms tai sukuria turtingesnį atsakymą nei „Jana Vardenė yra autorė“. Sistema potencialiai gali atskirti:
- Asmenį, kuris sukūrė tyrimą
- Asmenį, kuris parašė programinę įrangą
- Asmenį, kuris analizavo duomenis
- Asmenį, kuris prižiūrėjo projektą
- Asmenį, kuris parašė pirminį rankraštį
Tai ypač svarbu didelėms tyrimų komandoms ir techniniams projektams.
3. Mokslininkų profiliai: Konteksto lygmuo
Mokslininkų profiliai daro tapatybės grafiką suprantamą žmonėms ir lengviau interpretuojamą paieškos sistemoms.
Patikimas profilis turėtų apimti:
- Stabilų institucinį puslapį
- Pastovų vardą
- Vardo variantus, jei tinka
- ORCID iD
- Dabartines ir buvusias priklausomybes
- Tyrimų sritis
- Pasirinktus darbus su DOI nuorodomis
- Duomenų rinkinius, programinę įrangą ir ataskaitas
- Finansavimą ir apdovanojimus
- Redakcinius ar recenzavimo vaidmenis
- Dalyvių vaidmenis
- Dabartinių ir buvusių pareigų datas
- Paskutinės peržiūros datą
- Nuorodos į kitus viešus profilius
„Google Scholar“ profiliai leidžia tyrėjams sudaryti publikacijų sąrašus, padaryti profilį viešą, matyti, kas cituoja jų darbą, ir stebėti citavimo metrikas. Viešas profilis su patvirtintu instituciniu el. pašto adresu gali būti rodomas „Google Scholar“ paieškos rezultatuose. Google Scholar profiliai (scholar.google.com)
Tačiau „Google Scholar“ reikėtų vertinti kaip matomumo ir atradimo lygmenį, o ne pagrindinį tiesos šaltinį. Tyrėjai gali patys tvarkyti savo publikacijų sąrašus, o automatinis suderinimas gali apimti neteisingus arba pasikartojančius darbus. Citavimo skaičiai taip pat skiriasi tarp duomenų bazių.
„OpenAlex“ siūlo dar vieną naudingą atradimo lygmenį. Jis palaiko išskaidrintus autorių įrašus ir jungia autorius, darbus, institucijas, šaltinius ir temas. „OpenAlex“ teigia, kad jis semiasi informacijos iš tokių šaltinių kaip „Crossref“ ir „DataCite“, tada suderina autorius su ORCID iD ir priklausomybes su organizacijos identifikatoriais. OpenAlex ekosistemos aprašymas (help.openalex.org)
Geriausia praktika yra profilio federacija:
text Institucinis autoriaus puslapis ↕ ORCID įrašas ↕ Crossref arba DataCite darbo įrašai ↕ OpenAlex ir Google Scholar profiliai ↕ Leidėjo, saugyklos, finansuotojo ir profesiniai puslapiai
Nė vienas profilis neturi turėti visko. Jie turėtų nukreipti vienas į kitą ir naudoti tuos pačius identifikatorius.
Kaip šie signalai gali paveikti dirbtinio intelekto citatas
Svarbu atskirti penkis skirtingus įvykius:
- Atradimas: Ar sistema gali rasti puslapį ar darbą?
- Tapatybės nustatymas: Ar ji gali pasakyti, kas yra susijęs asmuo ir organizacija?
- Paieška: Ar sistema įtraukia darbą į savo įrodymų rinkinį?
- Citavimo pasirinkimas: Ar ji cituoja darbą atsakyme?
- Citavimo teisingumas: Ar citata nurodo teisingą darbą ir pagrindžia teiginį?
ORCID, DOI metaduomenys ir mokslininkų profiliai gali tiesiogiai padėti atliekant pirmuosius tris žingsnius. Jie taip pat gali pagerinti citavimo teisingumą. Jų poveikis citavimo pasirinkimui greičiausiai priklausys nuo temos aktualumo, šaltinio kokybės, naujumo, prieinamumo ir konkrečios dirbtinio intelekto sistemos.
„Google Search“ dokumentacijoje rekomenduojama naudoti autoriaus puslapį, url ir sameAs nuorodas, kad būtų lengviau identifikuoti straipsnių autorius. Duomenų rinkiniams „Google“ konkrečiai rekomenduoja naudoti ORCID iD sameAs savybėje asmeniui kūrėjui. Google straipsnio struktūrizuoti duomenys Google duomenų rinkinio struktūrizuoti duomenys (developers.google.com)
Paprastas profilio puslapis gali naudoti struktūrizuotus duomenis taip:
{ "@context": "https://schema.org", "@type": "Person", "@id": "https://institution.edu/people/jane-doe#person", "name": "Jane Doe", "url": "https://institution.edu/people/jane-doe", "sameAs": [ "https://orcid.org/0000-0000-0000-0000", "https://scholar.google.com/citations?user=EXAMPLE", "https://openalex.org/authors/A0000000000" ], "affiliation": { "@type": "Organization", "name": "Example University", "sameAs": "https://ror.org/000000000" }, "subjectOf": [ { "@type": "ScholarlyArticle", "identifier": "https://doi.org/10.0000/example" } ] }
Struktūrizuoti duomenys negarantuoja paieškos funkcijos ar dirbtinio intelekto citatos. „Google“ teigia, kad net teisingai įdiegti struktūrizuoti duomenys gali neatsirasti paieškos rezultatuose. Jo vertė yra ta, kad jis suteikia mašinoms aiškų, standartinį būdą interpretuoti puslapį. Google struktūrizuotų duomenų gairės (developers.google.com)
Praktinė išvada yra:
Identifikatoriai pagerina kelią prie įrodymų. Jie nepakeičia įrodymų.
Ką dabartiniai tyrimai sako apie dirbtinio intelekto citatas
Dirbtinio intelekto citavimo elgesio tyrimai daugiausia nagrinėjo citavimo tikslumą, šaltinio pasirinkimą ir patikimumą. Jie dar nepateikė patikimo, bendro ORCID susieto tapatybės stiprumo poveikio įvertinimo.
2023 m. atliktas „ChatGPT“ generuojamų citatų tyrimas parodė didelį išgalvotų nuorodų ir klaidų realiosiose nuorodose skaičių. Tyrimas išanalizavo 636 citatas, sugeneruotas 84 darbuose, ir nustatė, kad citavimo problemos išliko net ir naujesniame išbandytame modelyje. „Scientific Reports“ tyrimas (nature.com)
Kitas generatyviųjų paieškos sistemų tyrimas parodė, kad daugelis sugeneruotų sakinių nebuvo visiškai pagrįsti citatomis ir kad daugelis citatų nepakankamai pagrindė šalia jų esančius teiginius. Verifikavimo įvertinimas generatyvinėse paieškos sistemose (arxiv.org)
Naujausi tyrimai taip pat rodo, kad generatyvinės paieškos sistemos skiriasi šaltinių pasirinkimu, šaltinių persidengimu, stabilumu ir vidinių bei išorinių žinių naudojimu. Interneto paieškos apibūdinimas generatyvinio dirbtinio intelekto amžiuje (aclanthology.org)
Šios išvados patvirtina atsargią poziciją:
- DOI gali sumažinti neaiškumą dėl cituojamo darbo.
- ORCID gali sumažinti neaiškumą dėl asmens.
- Priklausomybės identifikatoriai gali sumažinti neaiškumą dėl organizacijos.
- Dalyvio vaidmenys gali pagerinti autorystės priskyrimą.
- Viešas profilis gali suteikti kontekstą.
- Nė vienas iš šių signalų negarantuoja, kad sistema atras ar cituos darbą.
Tyrimų programa, skirta tapatybės stiprumo ir dirbtinio intelekto citavimo dažnumo matavimui
Organizacijos neturėtų teigti, kad autorių centrai pagerina dirbtinio intelekto citavimus, kol tiesiogiai neišmatavo šio ryšio.
Apibrėžkite autoriaus tapatybės stiprumo balą
Žemiau pateiktas balas yra siūlomas, o ne oficialus standartas.
| Komponentas | Siūlomi balai | Matavimas |
|---|---|---|
| Patvirtintas ORCID iD | 15 | Tyrėjas patvirtino ID per ORCID autorizaciją |
| ORCID–darbo nuorodos | 15 | ORCID įrašo darbai atitinka DOI įrašus |
| ORCID šaltinio kokybė | 10 | Svarbūs teiginiai gauti iš leidėjų, finansuotojų ar institucijų |
| DOI išsamumas | 15 | DOI įraše, jei aktualu, yra autoriai, ORCID, priklausomybės, datos, santrauka ir nuorodos |
| Organizacijos susiejimas | 10 | Priklausomybė apima nuolatinį organizacijos identifikatorių |
| Dalyvių vaidmenys | 10 | Darbo įrašuose yra aiškūs indėlio vaidmenys |
| Institucinis profilis | 10 | Egzistuoja stabilus, viešas, dabartinis autoriaus puslapis |
| Mokslininkų profilių federacija | 5 | „Google Scholar“ ir „OpenAlex“ įrašai siejasi su tuo pačiu asmeniu |
| Naujumas | 10 | Įrašas ir profilis buvo peržiūrėti per pastaruosius metus |
| Iš viso | 100 |
Į šį balą neįtraukite citavimo skaičių, žurnalo prestižo ar institucijos reitingo. Šie veiksniai turėtų būti traktuojami kaip atskiros kintamosios. Juos įtraukus būtų sunku nustatyti, ar pati tapatybės stiprumas yra susijęs su citavimo dažnumu.
Išmatuokite daugiau nei vieną citavimo rūšį
Naudingas tyrimas turėtų sekti bent šešis rezultatus:
-
Darbo citavimo dažnis Tinkamų atsakymų, kurie cituoja konkretų darbą, procentas.
-
Autoriaus priskyrimo dažnis Atsakymų, kurie teisingai pavadina ar priskiria darbą tinkamam autoriui, procentas.
-
Galiojančio identifikatoriaus dažnis Citatų, turinčių DOI, kuris nukreipia į teisingą darbą, procentas.
-
Citavimo tikslumas Citatų, kurios iš tikrųjų pagrindžia pateiktą teiginį, procentas.
-
Citavimo išsamumas Sistemos cituojamų svarbių pagrindinių šaltinių procentas.
-
Stabilumas įvairiose platformose Citatų, pasikartojančių skirtingose sistemose ar pasikartojančiuose vykdymuose, procentas.
Neseniai sukurta generatyvinės paieškos matavimo sistema atskiria citavimo pasirinkimą nuo citavimo sugerties, t. y., ar šaltinis tiesiog pasirodo citavimo sąraše, ar iš tikrųjų prisideda įrodymais prie atsakymo. Šis skirtumas turėtų būti įtrauktas į būsimus autorių centrų tyrimus. Citavimo pasirinkimo ir citavimo sugerties sistema (arxiv.org)
Pirmas tyrimas: Stebėjimo koreliacijos tyrimas
Šis tyrimas klausia:
Ar darbai, susiję su stipresne autoriaus tapatybe, dirbtinio intelekto sistemų cituojami dažniau, kontroliuojant temos ir publikavimo veiksnius?
Siūlomas dizainas
- Imkite nuo 10 000 iki 50 000 mokslinių darbų
- Apimkite kelias disciplinas, kalbas ir publikacijų tipus
- Naudokite Crossref, DataCite, OpenAlex ir viešus ORCID duomenis
- Apskaičiuokite tapatybės stiprumo balą kiekvienam autoriui ir darbui
- Sukurkite klausimų rinkinį, kuriems atrinkti darbai yra aktualūs
- Paleiskite klausimus per kelias citatas generuojančias sistemas
- Pakartokite kiekvieną klausimą kelis kartus
- Įrašykite datą, sistemą, modelio nustatymus, regioną ir cituotus šaltinius
Svarbios kontrolinės kintamosios
Tyrimas turėtų kontroliuoti:
- Temos aktualumą
- Publikavimo metus
- Atviros prieigos statusą
- Santraukos prieinamumą
- Viso teksto prieinamumą
- Vietą (publikacijos leidinį/konferenciją)
- Esamą mokslinių citatų skaičių
- Institucijos reputaciją
- Kalbos
- Puslapio greitį ir nuskaitymo galimybes
- Darbo tipą
- Autoriaus vardo paplitimą
- Bendradarbių skaičių
- Užklausos formuluotę
- Paieškos sistemą
Pagrindinis statistinis modelis galėtų įvertinti:
text Teisingos citatos tikimybė = tapatybės stiprumas
- temos aktualumas
- darbo amžius
- atvira prieiga
- mokslinės citatos
- sistema
- užklausa
- autoriaus ir temos kontrolės
Loginė regresija arba mišriųjų efektų modelis tiktų rezultatui „taip“ arba „ne“, pvz., ar darbas buvo cituojamas. Negatyvus binominis modelis gali būti naudingas citavimo skaičiams, nes citavimo duomenys dažnai pasiskirstę netolygiai.
Rezultatas turėtų būti pateiktas kaip šansų santykis su pasikliautinuoju intervalu, o ne paprastu procentiniu santykiu. Pavyzdžiui:
Vienas standartinis tapatybės stiprumo padidėjimas buvo susijęs su citavimo tikimybės pokyčiu, kontroliuojant aktualumą, amžių, prieigą ir ankstesnį mokslinį dėmesį.
Tyrimas taip pat turėtų pranešti nulinius rezultatus. Išvada apie ryšio nebuvimą būtų naudinga, nes tai parodytų, kad identifikatoriai pagerina duomenų kokybę, nebūtinai keisdami dirbtinio intelekto citavimo elgesį.
Antras tyrimas: Kontroliuojamas metaduomenų eksperimentas
Stebėjimo tyrimas gali supainioti tapatybės stiprumą su populiarumu. Kontroliuojamas eksperimentas gali izoliuoti kai kuriuos efektus.
Yra dvi praktinės versijos.
A versija: Viešojo interneto eksperimentas
Sukurkite suderintus puslapius su tuo pačiu esminiu turiniu, bet skirtingais metaduomenų apdorojimais:
- Tik pagrindinis autoriaus vardas
- Autoriaus vardas plius institucinis profilis
- Autoriaus vardas plius ORCID nuoroda
- Autoriaus vardas, ORCID, DOI, priklausomybės identifikatorius ir struktūrizuoti duomenys
Publikuokite puslapius tuo pačiu metu ir stebėkite:
- Paieškos atradimą
- Teisingą autoriaus atpažinimą
- Atranką į dirbtinio intelekto atsakymus
- Citavimo dažnumą
- Citavimo teisingumą
Šį eksperimentą reikia interpretuoti atsargiai. Viešosios sistemos gali nuskaityti puslapius skirtingu laiku, o organizacijos negali lengvai pakeisti „Crossref“ ar „DataCite“ įrašų jau paskelbtam darbui.
B versija: Kontroliuojamas tyrimų indeksas
Sukurkite nedidelę paieškos sistemą, kurioje būtų tie patys dokumentai, esantys skirtingoms metaduomenų sąlygoms. Skirkitės tik:
- Autoriaus identifikatoriumi
- DOI
- Priklausomybe
- Dalyvio vaidmeniu
- Profilio nuorodomis
- Kilmės laukais
Tada užduokite tuos pačius klausimus ir išmatuokite atranką bei citavimo pasirinkimą. Šis eksperimentas suteikia geresnę kontrolę, tačiau jis matuoja tyrimų sistemą, o ne komercines platformas.
Trečias tyrimas: Etapinis organizacijos diegimas
Stipriausias praktinis dizainas yra skirtumų skirtumuose tyrimas.
Organizacija gali įdiegti autorių centrus etapais:
- Pirmas skyrius gauna visą programą 2026 m. spalio mėn.
- Antras skyrius ją gauna 2027 m. sausio mėn.
- Trečias skyrius ją gauna 2027 m. balandžio mėn.
Visi skyriai matuojami prieš ir po įdiegimo. Skyriai, kurie dar negavo programos, tarnauja kaip laikinos palyginimo grupės.
Matuokite:
- Teisingą autoriaus priskyrimą
- DOI atpažinimą
- Citavimo dažnumą
- Citavimo tikslumą
- Paieškos parodymus
- Profilio puslapių apsilankymus
- Laiką, reikalingą blogiems metaduomenims pataisyti
Šis dizainas yra stipresnis nei paprastas palyginimas „prieš ir po“, nes jis padeda atskirti diegimo efektą nuo platesnių dirbtinio intelekto sistemų pokyčių.
Hipotezės, vertos patikrinimo
Organizacijos gali iš anksto registruoti šias hipotezes:
- H1: Stipresnės tapatybės nuorodos pagerina teisingą autoriaus priskyrimą.
- H2: Išsamūs DOI metaduomenys pagerina galiojančių citavimo dažnumą.
- H3: Priklausomybės identifikatoriai labiausiai padeda, kai autoriai turi dažnus vardus arba keičia institucijas.
- H4: Mokslininkų profiliai pagerina atradimą labiau nei galutinį citavimo dažnumą.
- H5: Tapatybės stiprumas turi didesnį poveikį mažiau žinomiems autoriams nei jau žinomiems autoriams.
- H6: Poveikis skiriasi priklausomai nuo sistemos, temos, kalbos ir publikacijos tipo.
- H7: Naujumas ir temos aktualumas yra svarbesni už profilio dekoravimą.
Kokie kredencialai turėtų būti publikuojami?
Profile turėtų būti publikuojami kredencialai, kuriuos galima patikrinti. Kiekvienas kredencialas turėtų turėti:
- Kredencialo tipą
- Asmenį, kuriam jis priklauso
- Išduodančią organizaciją
- Nuolatinį organizacijos identifikatorių, jei yra
- Pradžios ir pabaigos datas
- Patvirtinimo šaltinį
- Būseną, pvz., dabartinis, pasibaigęs, ginčijamas arba archyvuotas
- Paskutinės peržiūros datą
| Kredencialas | Viešai skelbiami įrodymai |
|---|---|
| Užimtumas | Institucija, organizacijos identifikatorius, skyrius, pradžios data, pabaigos data |
| Išsilavinimas | Laipsnis, suteikianti institucija, baigimo metai, patvirtinimo šaltinis |
| Dotacija | Finansuotojas, apdovanojimo numeris, vaidmuo, datos, projekto puslapis |
| Publikacija | DOI, autoriai, priklausomybės, indėlio vaidmenys |
| Duomenų rinkinys | DataCite DOI, kūrėjas, licencija, versija, saugykla |
| Programinė įranga | Saugykla, leidimas, DOI, licencija, vaidmuo |
| Redakcinė veikla | Žurnalas, vaidmuo, pradžios data, pabaigos data |
| Recenzavimas | Viešas recenzijos įrašas arba patvirtintas paslaugos įrašas, kur leidžiama |
| Apdovanojimas | Išduodanti institucija, apdovanojimo pavadinimas, metai, viešas pranešimas |
| Sertifikavimas | Išdavėjas, kredencialo numeris, išdavimo data, galiojimo pabaigos data |
Organizacijos turėtų pažymėti kiekvieno kredencialo šaltinį:
- Pats pranešė
- Instituciškai patvirtintas
- Leidėjo patvirtintas
- Finansuotojo patvirtintas
- Importuotas iš registro
- Laukiama peržiūros
Venkite skelbti nepagrįstų etikečių, tokių kaip „lyderiaujantis ekspertas“ ar „pasaulinio garso tyrėjas“. Pakeiskite juos įrodymais:
- Darbų skaičius ir tipas
- Tyrimų sritys
- Patvirtinti vaidmenys
- Finansuojami projektai
- Redakcinė veikla
- Vieši duomenų rinkiniai ar programinė įranga
- Instituciniai paskyrimai
Toks požiūris yra naudingesnis tiek skaitytojams, tiek mašinoms.
Organizacijų diegimo planas
Pirmas etapas: Sukurkite metaduomenų politiką
Paskirkite nedidelę valdymo grupę, kurią sudarytų atstovai iš:
- Tyrimų administravimo
- Bibliotekų paslaugų
- Informacinių technologijų
- Komunikacijos
- Leidybos ar saugyklų paslaugų
- Privatumo
- Tyrimų vientisumo
Sukurkite trumpą duomenų politiką, kuri apibrėžia:
- Privalomus laukus
- Patvirtintas identifikatorių sistemas
- Kas gali patvirtinti kiekvieną lauką
- Kokie laukai yra vieši
- Kaip tvarkomos pataisos
- Kiek laiko turėtų užtrukti atnaujinimai
- Kas nutinka asmeniui išėjus
Naudokite vieną duomenų sutartį visose sistemose. Minimaliai, kiekvieno asmens, darbo, organizacijos ir kredencialo įraše turėtų būti:
text nuolatinis_id rodymo_pavadinimas saltinis pagrindo_pateikėjas galioja_nuo galioja_iki paskutinis_patvirtinimas būsena įrodymo_url
Antras etapas: Surinkite autentifikuotus identifikatorius
Paprašykite tyrėjų prisijungti prie savo ORCID įrašų per autentifikuotą procesą. Nepaverskite institucijos atsakinga už spėjimą, kuris ORCID iD priklauso asmeniui.
Tuo pačiu metu:
- Priskirkite organizacijos identifikatorius skyriams ir institucijoms
- Susiekite personalo įrašus su ORCID
- Suderinkite esamas publikacijas su DOI įrašais
- Pažymėkite vardų sutapimus
- Išsaugokite alternatyvias vardo formas
- Įrašykite sutikimą ir matomumo nustatymus
Trečias etapas: Pagerinkite DOI metaduomenis
Naujiems darbams reikalaukite, kad publikavimo procesas rinktų:
- Visus autorių vardus
- Autentifikuotus ORCID iD
- Priklausomybes
- Organizacijos identifikatorius
- Dalyvių vaidmenis
- Finansavimo identifikatorius
- Santraukas
- Nuorodas
- Licencijas
- Versijos ir atnaujinimo informaciją
Senesniems darbams pradėkite nuo paskutinių penkerių metų ir organizacijos daugiausiai naudojamų autorių.
„Crossref“ ir „DataCite“ turėtų gauti pataisymus ir atnaujinimus, o ne tik originalų įdėjimą. DOI eilutės išlieka nuolatinės, o susiję metaduomenys gali būti prižiūrimi. Crossref metaduomenų priežiūra (crossref.org)
Ketvirtas etapas: Sukurkite kanoninius autorių puslapius
Kiekvienas tyrėjas turėtų turėti vieną stabilų institucinį puslapį. Tas puslapis turėtų:
- Naudoti nuolatinį žiniatinklio adresą
- Rodyti dabartinį vaidmenį
- Išsaugoti ankstesnius vaidmenis su datomis
- Turėti nuorodą į ORCID
- Turėti nuorodas į pasirinktus DOI įrašus
- Turėti nuorodas į viešus mokslininkų profilius
- Rodyti tyrimų sritis
- Rodyti paskutinio atnaujinimo datą
- Naudoti struktūrizuotus duomenis
- Išlikti prieinamas paieškos robotams
- Nereikalauti prisijungimo
„Google“ rekomenduoja naudoti aiškius autoriaus URL ir sameAs nuorodas, kad būtų lengviau atskirti autorius. Google autoriaus žymėjimo gairės (developers.google.com)
Penktas etapas: Sujunkite ir stebėkite profilius
Susiekite institucinį puslapį su:
- ORCID
- Google Scholar
- OpenAlex
- Leidėjo puslapiais
- Saugyklos įrašais
- Dotacijų puslapiais
- Viešais profesiniais profiliais, kur tinka
Naudokite automatizuotus patikrinimus, kad rastumėte:
- Sugedusias DOI nuorodas
- Trūkstamas ORCID nuorodas
- Pasikartojančius autorius
- Neteisingus bendraautorių atitikimus
- Senas priklausomybes
- Pasibaigusius kredencialus
- Trūkstamas atnaujinimo datas
- Nesuderintus vardus
- Atšaukimus ar pataisymus
Atnaujinimų ir vaidmenų pokyčių valdymas
Autorių centras turi išsaugoti istoriją. Jis neturėtų perrašyti praeities kiekvieną kartą, kai asmuo keičia darbą.
Rekomenduojama šaltinių hierarchija
| Informacija | Pirminis autoritetas |
|---|---|
| Asmens kontroliuojamas vardas ir viešas matomumas | Tyrėjas ir ORCID |
| Dabartinis užimtumas | Institucija |
| Publikacijos autorystė | Leidėjas ir DOI registras |
| Indėlio vaidmuo | Leidėjas, projekto įrašas arba oficialus pataisymas |
| Dotacijos skyrimas | Finansuotojas |
| Laipsnis ar sertifikatas | Išduodanti organizacija |
| Viešo profilio pateikimas | Institucija, su tyrėjo peržiūra |
Kai tyrėjas keičia institucijas
Neištrinkite senosios priklausomybės iš istorinių darbų.
Vietoj to:
- Prie buvusio užimtumo įrašo pridėkite pabaigos datą.
- Pridėkite naują priklausomybę su pradžios data.
- Atnaujinkite institucinį profilį.
- Palikite istorinius publikacijų priklausomybės duomenis nepakeistus, nebent leidėjas išduoda pataisymą.
- Atnaujinkite ORCID įrašą per tinkamą šaltinį.
- Nukreipkite senąjį profilio puslapį į archyvuotą ar naują puslapį.
Kai asmuo keičia vardą
Naudokite ORCID, kad susietumėte vardo variantus. Pridėkite buvusius ar alternatyvius vardus, kur tyrėjas sutinka. Nekeiskite autoriaus vardo paskelbtame DOI įraše vien tam, kad jis atitiktų dabartinį profilį.
Nuolatinio identifikatoriaus tikslas yra susieti darbus per vardo pokyčius neperrašant publikacijos įrašo.
Kai pasikeičia dalyvio vaidmuo
Dalyvio vaidmuo baigtame darbe turėtų būti traktuojamas kaip istorinio įrašo dalis.
Pavyzdžiui:
- Asmens vaidmuo paskelbtame straipsnyje neturėtų keistis, nes vėliau jis tampa skyriaus vadovu.
- Redakcinis vaidmuo turėtų turėti pradžios ir pabaigos datą.
- Dotacijos vaidmuo turėtų būti susietas su dotacijos laikotarpiu.
- Programinės įrangos vaidmuo turėtų būti susietas su versija ar išleidimu.
Jei originalus indėlio įrašas yra neteisingas, naudokite oficialų pataisymo procesą. Neperrašykite jo tyliai.
Kai kredencialo galiojimo laikas baigiasi
Naudokite aiškias būsenos reikšmes:
- Dabartinis
- Pasibaigęs
- Atnaujintas
- Sustabdytas
- Ginčijamas
- Archyvuotas
Prieš pasibaigiant galiojimo laikui, turėtų būti siunčiami automatizuoti priminimai. Vieši profiliai turėtų rodyti būseną ir datą, o ne palikti pasenusį kredencialą matomą be paaiškinimo.
Kai tyrėjas palieka organizaciją
Organizacija turėtų:
- Išsaugoti istorinį profilį
- Aiškiai pažymėti buvusį vaidmenį
- Išsaugoti nuorodas į paskelbtus darbus
- Perkelti profilio nuosavybę
- Nustatyti nukreipimą iš buvusio puslapio
- Pašalinti privačią kontaktinę informaciją
- Išsaugoti institucinius patvirtinimus, kurie buvo teisingi buvusio užimtumo laikotarpiu
Kai autorystė ginčijama
Užšaldykite ginčijamą lauką, išsaugokite originalų šaltinį ir užfiksuokite ginčą. Nešalinkite autoriaus ir nekeiskite indėlio vaidmenų remdamiesi tik neoficialiu prašymu.
Tyrimų vientisumo tarnyba, leidėjas ar atsakingas projekto autoritetas turėtų nustatyti oficialų pataisymo kelią.
Sėkmės matavimai
Organizacijos turėtų stebėti operacinę kokybę prieš žadėdamos padidėjusį dirbtinio intelekto matomumą.
Siūlomi tikslai apima:
- 95 procentai aktyvių tyrėjų turi patvirtintus ORCID iD
- 95 procentai naujų darbų apima ORCID, jei yra
- 95 procentai priklausomybių naudoja nuolatinį organizacijos identifikatorių
- 100 procentų naujų DOI indėlių atitinka metaduomenų patvirtinimą
- 100 procentų autorių puslapių turi stabilų profilio adresą
- 100 procentų vaidmenų pokyčių apima datas
- Mažiau nei 1 procentas darbų neteisingai priskiriami autoriui
- Metaduomenų pataisymai atliekami per 30 dienų
- Dabartinio užimtumo pokyčiai atsiranda per septynias dienas
- Atšaukimai ir oficialūs pataisymai atspindimi nedelsiant
Dirbtinio intelekto citavimo tyrimui stebėkite:
- Teisingo autoriaus priskyrimo dažnumą
- Galiojančio DOI dažnumą
- Citavimo tikslumą
- Citavimo išsamumą
- Darbo citavimo dažnumą
- Sistemų suderinamumą
- Laiką nuo metaduomenų pataisymo iki pagerėjusio indeksavimo
- Skirtumą tarp profilio atradimo ir galutinio atsakymo citavimo
Organizacija turėtų pranešti apie šias priemones pagal discipliną, kalbą, karjeros etapą ir vardo paplitimą. Priešingu atveju, vidutinis balas gali paslėpti nelygius rezultatus.
Rizikos ir apsaugos priemonės
Autorių centrai gali sukurti naujų rizikų, jei jie taps vartininkų sistema.
Organizacijos neturėtų:
- Baudoti tyrėjų, kurie dalį ORCID informacijos laiko privačia
- Laikyti viešą „Google Scholar“ profilį kokybės įrodymu
- Naudoti citavimo skaičius kaip pakaitalą kolegų peržiūrai
- Be reikalo skelbti asmeninius kontaktinius duomenis
- Daryti išvadą apie patirtį vien iš institucinio prestižo
- Reikalauti, kad kiekvienas tyrėjas naudotųsi ta pačia viešojo profilio paslauga
- Traktuoti trūkstamus identifikatorius kaip netinkamo elgesio įrodymą
- Leisti automatizuotoms sistemoms perrašyti įrašus be peržiūros
ORCID priėmimas ir metaduomenų kokybė skiriasi priklausomai nuo srities, šalies, karjeros etapo ir publikacijos tipo. Sąžininga sistema turi palaikyti rankinį taisymą, privatumo kontrolę, vardų įvairovę ir žmones, kurių darbas nėra tinkamai atspindimas žurnalų publikacijų metrikose.
Išvada
Stiprus autorių centras nėra asmeninio prekės ženklo projektas. Tai yra mašinų skaitoma įrodymų sistema.
- ORCID sujungia asmenį su nuolatine tapatybe.
- Crossref ir DataCite sujungia darbus su stabilias identifikatoriais ir turtingais metaduomenimis.
- Tyrimų organizacijos registro identifikatoriai sujungia žmones ir darbus su institucijomis.
- Dalyvių vaidmenys parodo, ką kiekvienas asmuo iš tikrųjų padarė.
- Instituciniai ir mokslininkų profiliai suteikia viešą kontekstą.
- Struktūrizuoti duomenys padeda paieškos sistemoms interpretuoti ryšius.
- Valdymas ir versijų istorija parodo, kas yra dabartinis, kas buvo tiesa praeityje ir kas patvirtino kiekvieną teiginį.
Tikėtina nauda nėra automatinis reitingo padidinimas. Nauda yra stipresnė grandinė nuo asmens → darbo → organizacijos → įrodymų.
Todėl organizacijos turėtų prisiimti du įsipareigojimus:
- Standartizuoti ir prižiūrėti metaduomenis.
- Matuoti dirbtinio intelekto citavimo elgesį, o ne daryti prielaidas apie poveikį.
Patikimiausias autorių centras nėra tas, kuris turi daugiausiai ženklelių. Tai tas, kurio svarbūs teiginiai yra nuolatiniai, susieti, pagrįsti šaltiniais, aktualūs ir lengvai patikrinami.
Auto