Një libër i vjetër mund të ketë pak vlerë në treg, por të jetë jashtëzakonisht i vlefshëm për një model të inteligjencës artificiale. Kjo po krijon një fenomen të pazakontë në tregun e librave të përdorur: porosi masive për tituj të vjetër, të rrallë ose tepër specifikë, të cilat po ngrenë dyshime se pas tyre mund të fshihen kompani të AI-së në kërkim të të dhënave të reja.
Një librari në Galway të Irlandës, për shembull, mori një porosi online për rreth 5,000 libra. Ajo që tërhoqi vëmendjen nuk ishte vetëm sasia, por përzgjedhja: nga histori lokale deri te udhëzues ekonomikë dhe tituj të vjetër që vështirë se do të përbënin një koleksion tradicional. Raste të ngjashme janë raportuar edhe nga shitës librash në Berlin.
Dyshimi është se librat mund të blihen për t’u skanuar dhe kthyer në të dhëna dixhitale për trajnimin e modeleve. Për kompanitë e AI-së, kjo ka një avantazh të rëndësishëm: librat përmbajnë gjuhë të shkruar nga njerëzit, shpesh shumë përpara shpërthimit të përmbajtjes së gjeneruar nga AI.
Por kjo ide nuk është vetëm spekulim. Në rastin e Anthropic, dokumentet gjyqësore të bëra publike kanë zbuluar projektin “Panama”, përmes të cilit kompania bleu libra fizikë, i skanoi në mënyrë destruktive dhe i ricikloi kopjet pas digjitalizimit.
Në korrik, një gjykatë amerikane miratoi marrëveshjen prej 1.5 miliardë dollarësh të Anthropic me autorët që pretendonin se librat e tyre ishin përdorur në mënyrë të paligjshme. Gjykata kishte bërë më herët dallimin mes përdorimit të librave të blerë ligjërisht për trajnim dhe përdorimit të kopjeve pirate.
Tani shqetësimi po zhvendoset te librat që mund të mos kenë kopje të tjera. Një model AI mund të ruajë informacionin e tyre, por një origjinal i rrallë nuk mund të rikrijohet kaq lehtë. Në garën për të ushqyer modelet e ardhshme me të dhëna, libri po merr një rol të ri: jo vetëm si burim dijeje, por si lëndë e parë për inteligjencën artificiale.


















































Discussion about this post