Loading market data...

Kiina julkistaa massiivisen suunnitelman tekoälyn koulutusaineistojen rakentamiseksi

Kiina on käynnistänyt laajan aloitteen suurten tekoälyn koulutusaineistojen rakentamiseksi, mikä on askel kohti maailmanlaajuisen datapulan lievittämistä ja maan riippuvuuden vähentämistä ulkomaisesta teknologiasta. Suunnitelma, joka julkistettiin ilman tarkkaa aikataulua, on osa laajempaa pyrkimystä varmistaa teknologinen autonomia geopoliittisten jännitteiden kasvaessa.

Miksi datapula on merkittävä

Tekoälyjärjestelmät oppivat datasta – valtavista datamääristä. Mutta maailman tarjonta laadukkaasta ja helposti saatavilla olevasta koulutusdatasta on vähenemässä. Kun yhä useammat yritykset ja hallitukset kilpailevat omien malliensa kehittämisessä, kysyntä ylittää tarjonnan. Kiinan uusi pyrkimys kohdistuu suoraan tähän pullonkaulaan, ja se lyö vetoa siitä, että kotimaiset aineistot pitävät maan tekoälyteollisuuden liikkeessä ilman riippuvuutta länsimaisista lähteistä.

Pula ei liity pelkästään määrään. Suuri osa olemassa olevasta datasta on lisenssisopimusten, yksityisyyssääntöjen tai yritysten muurien takana. Tämä on ongelma mille tahansa maalle, joka yrittää rakentaa tekoälyä laajassa mittakaavassa, mutta Kiinalle se on myös strateginen haavoittuvuus. Luomalla omat tietovarastonsa Peking toivoo suojaavansa tekoälysektorinsa ulkoisilta rajoituksilta.

Mitä suunnitelma sisältää

Yksityiskohdat ovat vähäiset, mutta aloite näyttää kattavan sekä uusien aineistojen rakentamisen että infrastruktuurin niiden varastointiin ja käsittelyyn. Tämä sisältää kaiken raakatekstistä ja kuvista erikoistuneempiin toimialakohtaisiin tietoihin. Tavoitteena on ilmoituksen mukaan varmistaa, että kiinalaisilla tekoälykehittäjillä on tasainen tarjonta koulutusmateriaalia, jota he voivat todella käyttää.

Painotus infrastruktuuriin viittaa siihen, että suunnitelma on muutakin kuin vain datan keräämistä. Kyse on putkistojen, merkintäjärjestelmien ja laskentatehon rakentamisesta, joita tarvitaan datan muuttamiseksi toimivaksi tekoälyksi. Tämä on pitkä ja kallis prosessi, ja Kiina on selvästi valmis maksamaan laskun.

Geopolitiikka pyrkimyksen takana

Tämä ei ole pelkästään taloudellinen liike. Suunnitelma on nimenomaisesti sidottu teknologisen autonomian varmistamiseen, mikä nykyilmapiirissä tarkoittaa altistumisen vähentämistä ulkomaisille kontrollille. Kehittyneiden sirujen ja ohjelmistojen vientikiellot ovat jo pakottaneet kiinalaiset yritykset etsimään kiertoteitä. Data on seuraava rintama.

Hallitsemalla omat aineistonsa Kiina voi myös asettaa omat standardinsa sille, mitä pidetään hyödyllisenä tai turvallisena koulutusmateriaalina. Tällä on vaikutuksia tehokkuuden lisäksi – se muokkaa sitä, mitä tekoälymallit tekevät ja eivät tee. Hallitukselle, joka on tiukentanut tekoälysääntelyä, kotimainen data on tapa pitää koko järjestelmä linjassa kotimaisten prioriteettien kanssa.

Mukana on myös puolustuksellinen näkökulma. Jos globaalit datavirrat häiriintyvät – pakotteiden, yksityisyyslakien tai poliittisten kiistojen takia – Kiina ei halua jäädä vajaaksi. Tämä suunnitelma on vakuutus tällaista skenaariota vastaan.

Aloite on vielä varhaisessa vaiheessa, ja yksityiskohtien puute jättää avoimia kysymyksiä. Miten Kiina hankkii datan? Kenellä on siihen pääsy? Ja voiko se todella pysyä tekoälyn kehityksen vauhdissa muualla? Nämä vastaukset ratkaisevat, tuleeko tästä todellinen voimavara vai vain toinen politiikkapaperi.