Ang mga kumpanya ng AI ay bumibili at pinapalagay ang mga aklat para sa training data, nagpapalit ng mga debate sa legal at etikal

iconChainGPT
I-share
AI summary iconSummary
Ang mga kumpanya sa AI ay bumibili at pinapalagay ang mga inilimbag na aklat upang bumuo ng training data, nagpapalit ng merkado ng ginamit na aklat at nagpapalakas ng mga tanong sa legal at etikal. Ipinapakita ng data sa chain na ang mga intermediate ay nagmumula sa mga gawaing isinulat ng tao bago ang 2023 sa malaking iskala. Ang mga nagbebenta ng ginamit na aklat ay nakakakita ng pagtaas sa demand ngunit natatakot na mawawala ang mga makabagong aklat. Ang mga hukuman ay nagbigay ng iba’t ibang desisyon—ang ilan ay tinatawag itong fair use, habang ang iba ay nagpapakilala ng pagkasundo. Ang index ng takot at kagustuhan sa merkado ng data ay umuusbong habang lumalalim ang mga debate tungkol sa pagmamay-ari at pagpapanatili ng nilalaman.

Tulad ng isang tunay na echo ng Fahrenheit 451, ilang kumpanya ng AI ay bumibili at literal na pinapalagay ang mga timbangan ng mga aklat upang gawing training data—isang umuunlad na supply chain na nagbabago na ang merkado ng mga gamit na aklat at nagtatayo ng bagong mga tanong sa legal at etikal na aspeto. Ano ang nangyayari - Ang mga intermediate ay tahimik na nagmumula ng mga aklat sa industriyal na iskala para sa kanilang AI client, ayon sa isang ulat mula sa 404 Media. Ang mga gitnang tao ay nagpapahayag ng kakayahan na makahanap ng mga daan-daang libo-libong pamagat habang nagpapangako ng mahigpit na konsiderasyon—isang palatandaan kung gaano karamdaman ang gawain na ito. - Ang mga aklat ay tinatanggal, iskanned, at iniiwan. Ang mga pamagat bago 2023—mga gawaing isinulat nang buo ng mga tao bago ang paglago ng generative-AI—ay lubos na hinahanap bilang mataas na kalidad na training material na sinasabing makakatulong sa pagpapanatili ng kaalaman na isinulat ng tao mula sa “pagkakalason” ng AI-generated na nilalaman. Epekto sa merkado - Ang mga nagbebenta ng gamit na aklat ay nagsasalaysay ng malaking pagtaas sa demand pagkatapos mabuhos ang mga buyer ng AI. Isang hindi pangalanan na negosyante ay sinabi sa 404 Media na tumataas ang kanyang lingguhang benta mula sa halos 20 aklat hanggang sa ilang daan. Bagaman malaki ang kita, nag-aalala ang mga negosyante na ang mga rare o hindi na inilalabas na aklat ay maaaring mawawala nang permanente pagkatapos ng destructive scanning. “Hindi ko gusto ang end-use, at hindi ko rin gusto na ang mga rare na aklat ay pinapalagay,” sabi niya. Legal na konteksto - Ang gawain ay tumutugma sa mga proyekto tulad ng “Project Panama” ni Anthropic, na dinigitize ang milyon-milyon na aklat sa pamamagitan ng destructive scanning. Ang mga hukuman ay nahahati, ngunit naglabas ng mahahalagang desisyon: sa Bartz v. Anthropic PBC, isang federal judge sa San Francisco ay natukoy na ang pag-scan ng mga legal na binili na pisikal na aklat upang gawing digital na kopya—kahit na ang orihinal ay pinapalagay—ay maaaring transformative fair use. Pagkatapos ay nagsagawa ang iba pang federal judges ng parehong konklusyon tungkol sa fair use sa iba’t ibang kaso na kasali ang OpenAI at Meta. - Samantala, dumating na ang mga legal na epekto: isang iba pang federal judge sa parehong distrito ay tinapatan ito ang $1.5 bilyong kasunduan kung saan kinakailangan ni Anthropic na magbigay ng kompensasyon sa libu-libong may-akda—halos $3,000 bawat aklat—pagkatapos gamitin ng kumpanya ang mga pirated na kopya ng mga gawa upang itrain ang kanilang Claude model. Reaksyon ng industriya - Ang pagtutol ay nagdulot ng pampublikong tugon mula sa mga eksperto sa AI. Halimbawa, si Elon Musk ay hinihikayat ang kanyang SpaceXAI team na panatilihin ang rare na aklat at “iskanin nila nang mahirap kesa i-cut off ang spine at i-scan,” at nagtataguyod para sa mas hindi nakakasira paraan. Bakit dapat pansinin ito ng crypto readers - Para sa isang crypto at Web3 audience, ipinapakita ng kuwento ang mga isyu tungkol sa data provenance, pagmamay-ari, at pangmatagalang pagpapanatili ng nilalaman na isinulat ng tao. Habang ang AI models ay kinakain ang malalaking offline collections upang makalikha ng halaga, ang mga tanong tungkol sa transparent sourcing, immutable records ng karapatan at kompensasyon, at market externalities (tulad ng permanente pagkawala ng rare na nilalaman) ay magiging mas malaki—at ito ay mga lugar kung saan madalas inirerekomenda ang blockchain-based provenance, licensing, at micropayments bilang solusyon. Kabuuan: Ang destructive-book-to-dataset pipeline ay totoo, may kita, at legal na pinag-uusapan. Habang ang mga kumpanya ng AI ay mabilis na naglalayong magtipon ng malinis na akda na isinulat ng tao, ang epekto—para sa mga may-akda, negosyante, mambabasa, at arkibo ng kaalaman ng tao—ay nagsisimula nang magpalabas sa hukuman at sa lupa.

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.