Кинескиот технолошки гигант ByteDance тренира нов модел на вештачка интелигенција кој би можел да има до 10 трилиони параметри, што би го доближило по големина до најнапредните модели на американскиот Anthropic, пишува Financial Times, повикувајќи се на луѓе запознаени со проектот.
Компанијата, најпозната како сопственик на TikTok, сè уште е во раните фази на развој на моделот. Во моментов, во тек е нејзината почетна обука, односно претходна обука, која обично трае помеѓу три и шест месеци, по што би следеле дополнителни прилагодувања и евентуално објавување на моделот.
Конечниот број на параметри сè уште не е утврден, но моделот би можел да достигне 10 трилиони.
Тоа би било околу три пати повеќе од Kimi K3 на Moonshot, кој во моментов е најголемиот јавно објавен модел на вештачка интелигенција во Кина.
Бројот на параметри одредува дел од капацитетот на моделот за складирање и обработка на информации, но самиот по себе не е доволен показател за неговите можности. Квалитетот на моделот е значително под влијание на податоците врз кои е обучен, методот на обука и архитектурата на системот.
Проектот на ByteDance покажува колку брзо кинеските технолошки компании се обидуваат да го затворат технолошкиот јаз со водечките американски лаборатории за вештачка интелигенција.
Во последните недели, моделите на кинеските компании Moonshot и Alibaba постигнаа добри резултати во серија тестови, приближувајќи се до водечките американски системи во одредени области.
Досега, ByteDance беше помалку отворен од некои од неговите кинески конкуренти во развојот на вештачката интелигенција, бидејќи не ги објавува повеќето од своите модели како отворени системи.
Во исто време, неговиот SeeDance се рангира меѓу понапредните модели во светот за генерирање видео, додека Doubao е најпопуларниот производ за потрошувачка вештачка интелигенција во Кина, со околу 324 милиони месечно активни корисници.
Во текот на последните три години, ByteDance силно ги зголеми своите инвестиции во вештачка интелигенција, градејќи центри за податоци и вработувајќи истражувачи.
Компанијата, исто така, ги развива операциите на својата облачна единица Volcano Engine, преку која продава решенија за вештачка интелигенција на компаниите, и има амбиции да развие свои чипови за вештачка интелигенција.
Тимот Seed, предводен од поранешниот научник од Google DeepMind, Ву Јонгхуи, е задолжен за развој на основни модели на вештачка интелигенција. Тимот има околу 2.000 вработени во Кина и во странство и вклучува истражувачи, инженери за инфраструктура, експерти за означување податоци и преведувачи.
ByteDance се одлучи за релативно независен пристап кон развојот на своите модели и, според извори на FT, не се потпира на таканаречената дестилација на моделите на конкурентите повеќе од една година.
Дестилацијата е процес во кој помал модел е обучен да го имитира знаењето и резултатите од поголем, понапреден модел. Таквиот пристап може да го забрза развојот, но менаџментот на ByteDance верува дека создавањето модел што би можел да ги надмине конкурентите бара сопствен развој од темел.
Основачот на компанијата, Жанг Јиминг, неодамна побара од тимот на Seed да се стреми кон „моделски можности што се водечки во светот“ на долг рок, дури и ако тоа значи дека ByteDance ќе заостане зад некои конкуренти на краток рок.
Таквиот пристап покажува дека трката меѓу кинеските и американските компании во развојот на најнапредните модели на вештачка интелигенција е сè помалку поврзана со достигнување на американските лаборатории, а сè повеќе и повеќе со обид за преземање на технолошко водство.
(Techtimes)
Фото – orinocotribune.com



























