
Kina nuk po përpiqet vetëm të eksportojë modele të inteligjencës artificiale, por edhe të ndikojë mbi të dhënat me të cilat trajnohen chatbot-et në mbarë botën. Objektivi i Pekinit është që këto sisteme të mos pasqyrojnë kryesisht një këndvështrim perëndimor, por të përfshijnë gjithnjë e më shumë narrativa dhe të dhëna të prodhuara në Kinë.
Shqetësimi i autoriteteve kineze lidhet me faktin se pjesa më e madhe e të dhënave që përdoren për trajnimin e modeleve të mëdha janë në anglisht. Për Pekinin, kjo krijon jo vetëm një disavantazh teknologjik, por edhe politik, pasi çështje si të drejtat e njeriut, Tajvani apo sistemi politik kinez priren të trajtohen sipas burimeve dhe këndvështrimeve perëndimore.
Për ta ndryshuar këtë raport, Kina synon të bëhet një furnizues global i të dhënave për inteligjencën artificiale. Administrata Kombëtare e të Dhënave ka hartuar një plan që deri në fund të vitit 2028 parashikon krijimin dhe shpërndarjen e databazave me cilësi të lartë në fusha si shkenca, industria, mjekësia dhe automjetet autonome. Pekini ka premtuar gjithashtu t’u ofrojë të dhëna vendeve në zhvillim që kërkojnë të ndërtojnë sistemet e tyre të AI-së.
Strategjia ka edhe një arsye praktike. Pavarësisht sasisë së jashtëzakonshme të të dhënave që prodhon Kina, ato janë të fragmentuara mes institucioneve shtetërore dhe kompanive private. Laboratorët kinezë e kanë të vështirë të sigurojnë të dhëna të specializuara me cilësi të lartë, ndërsa SHBA-ja ka krijuar një industri të tërë ku ekspertë, juristë dhe matematikanë ndihmojnë në trajnimin e modeleve më të avancuara. Pekini kërkon ta mbyllë këtë diferencë duke kaluar nga etiketimi i thjeshtë i të dhënave te puna e ekspertëve.
Por eksporti i të dhënave kineze ka ngritur shqetësime në Perëndim. Modelet kineze janë të detyruara të respektojnë vijën zyrtare të Partisë Komuniste dhe shmangin ose filtrojnë tema politike të ndjeshme. Studime të fundit kanë treguar se edhe modelet amerikane si ChatGPT dhe Claude japin shpesh përgjigje më pozitive për Kinën kur pyeten në gjuhën kineze sesa kur pyeten në anglisht, me shumë gjasa sepse mbështeten më tepër te burimet e medias shtetërore kineze.
Pekini tashmë ka publikuar databaza të mëdha për përdorim ndërkombëtar. Një prej tyre, WanJuan, e krijuar nga Shanghai AI Laboratory, përmban materiale mbi historinë, ligjin, mjekësinë, aktualitetin dhe letërsinë dhe është projektuar që të jetë në përputhje me “vlerat kryesore kineze”. Databaza është ofruar jo vetëm në kinezisht, por edhe në arabisht, rusisht, koreanisht dhe gjuhë të tjera.
Kështu, gara mes Kinës dhe SHBA-së për inteligjencën artificiale po zhvendoset përtej çipave dhe modeleve. Ajo po bëhet gjithnjë e më shumë një garë për të kontrolluar burimin mbi të cilin ndërtohet AI-ja: të dhënat. Dhe sa më shumë që sistemet kineze dhe databazat e Pekinit përdoren në vende të tjera, aq më i madh bëhet edhe ndikimi i Kinës mbi mënyrën se si inteligjenca artificiale përshkruan botën. /NY Times, përgatiti në shqip ©LAPSI.AL