Besedilo, ki ga ustvari umetna inteligenca, je danes pogosto praktično nemogoče ločiti od tistega, ki ga je napisal človek.
Anthropic želi to vsaj nekoliko spremeniti. Podjetje, ki razvija Claude, pripravlja sistem, s katerim bodo njegove vsebine dobile nekakšen nevidni digitalni podpis. Uporabnik med branjem odgovora ne bo opazil ničesar nenavadnega. V ozadju pa bo lahko ostala informacija, ki bo drugim sistemom pomagala ugotoviti, od kod je besedilo oziroma datoteka prišla.
Sprememba je povezana predvsem z novimi evropskimi zahtevami glede preglednosti vsebin, ustvarjenih z umetno inteligenco.
Nevidna oznaka naj bi preživela tudi kopiranje
Anthropic namerava slike oziroma ustvarjene datoteke označevati z digitalno podpisanimi podatki o njihovem izvoru. Pri tem bo uporabljal standard C2PA, ki omogoča shranjevanje informacij o nastanku in obdelavi digitalne vsebine. Še zanimivejši pa je načrt za besedilo.
Claude naj bi v svoje odgovore vstavljal človeku neopazen vodni žig, ki ne bo spreminjal pomena ali običajne berljivosti besedila. Ker bo oznaka del samega besedila, naj bi lahko ostala prisotna tudi takrat, ko uporabnik odgovor prekopira in ga objavi drugje.
V določenih primerih naj bi preživela celo naknadno urejanje. To bi lahko spletnim platformam, podjetjem in drugim uporabnikom omogočilo preverjanje, ali je določeno besedilo nastalo s pomočjo Claudea. Anthropic za zdaj še ni podrobno razkril, kako bo sistem deloval. Napoveduje pa dodatno tehnično dokumentacijo in možnosti, s katerimi bi bilo mogoče prisotnost takšne oznake preverjati.
Označevanje naj ne bi bilo omejeno samo na uporabo Claudea na njegovi spletni strani. Predvideno je tudi pri dostopu do modelov prek API-ja in drugih platform, ki uporabljajo Claudeove modele.
Vodni žig ne bo nezmotljiv dokaz
Takšna tehnologija kljub temu ne bo pomenila, da bo mogoče odslej zanesljivo preveriti vsako besedilo na internetu. Digitalni podatki se lahko pri obdelavi datotek izgubijo, besedilni vodni žig pa bi lahko odstranilo dovolj obsežno preoblikovanje vsebine. Težavo predstavljajo tudi starejši modeli oziroma vsebine, ustvarjene pred uvedbo sistema.
Zato odsotnost oznake sama po sebi ne bo dokazovala, da je nekaj napisal človek. Velja tudi obratno. Če je oznaka prisotna, to še ne pomeni nujno, da je umetna inteligenca napisala celotno vsebino. Nekdo lahko na primer napiše članek sam, nato pa Claude uporabi samo za popravljanje slovnice ali slogovno urejanje.
https://nov.tehnosfera.si/openai-ustavil-del-razvoja-nove-umetne-inteligence-razlog-so-njene-hekerske-sposobnosti/




