Barret Zoph, aliyekuwa mtendaji wa OpenAI, amejiunga na Google kama makamu-mkuu wa utafiti ili kuharakisha familia ya mifano ya lugha kubwa (large-language models) ya Gemini. Google inatumai utaalamu wa Zoph katika reinforcement learning na mbinu za post-training utaimarisha ulinganifu (alignment), uwezo wa kufikiri (reasoning), na usalama wa Gemini—maeneo ambayo mfululizo wa GPT wa OpenAI kwa sasa unaongoza.
Ziara ya haraka ya wasomi wa AI
Wasifu wa Zoph unasomeka kama ramani ya misukosuko ya hivi karibuni katika sekta hii. Baada ya miaka miwili katika OpenAI, aliondoka mnamo Oktoba 2024 ili kuanzisha kampuni changamoto ya Thinking Machines pamoja na aliyekuwa CTO wa OpenAI, Mira Murati. Jambo hilo liliisha baada ya miezi michache; kufikia Januari 2025, Zoph na mwanzilishi mwenzake Luke Metz waliungana tena na OpenAI ili kuongoza mauzo ya AI kwa makampuni. Baada ya miezi mitano katika nafasi hiyo, Zoph aliondoka tena mnamo Juni 2025, akifungua njia kwa kuhamia Google.
Kila kituo kinaakisi mfumo mpana zaidi: watafiti wakuu wanahamahama kati ya maabara zilizoanzishwa, kampuni changamoto zinazoanza, na uwezo mkubwa wa kifedha wa makampuni makubwa ya teknolojia. Hatua ya hivi karibuni ya Zoph inampeleka kwenye kampuni ambayo imewekeza mabilioni katika AI lakini imepata changamoto ya kufikia kiwango cha utoaji wa mifano ya OpenAI inayovutia vichwa vya habari.
Kwa nini reinforcement learning na “post-training” ndivyo uwanja mpya wa mapambano
Mifano ya lugha kubwa hupata uwezo wa awali wakati wa pre-training kwenye seti kubwa za maandishi (text corpora). Hatua inayofuata—mara nyingi huitwa post-training—huimarisha mifano hiyo kwa ajili ya matumizi ya ulimwengu halisi. Njia inayozingatiwa zaidi ya post-training ni Reinforcement Learning from Human Feedback (RLHF), ambapo watathmini wa kibinadamu hutoa maoni juu ya matokeo ya modeli na algoriti ya reinforcement-learning hurekebisha modeli ili kukidhi maoni hayo.
Mfululizo wa Gemini wa Google unaonyesha utendaji mzuri wa awali, lakini wakosoaji wanabainisha kuwa usalama wake na uwezo wa kufuata maelekezo unachelewa nyuma ya GPT ya hivi karibuni ya OpenAI. Kwa kuteua mtafiti ambaye kazi yake iliyochapishwa imekuwa ikivunja mipaka ya RL na RLHF, Google inaonyesha nia ya kuziba pengo hilo. Zoph atasaidia kujenga mifumo inayokusanya maoni ya kibinadamu kwa ufanisi zaidi, kubuni mifano ya zawadi (reward models) inayoelewa nia kwa undani, na kufanya majaribio ya algoriti mpya za RL zinazoboresha uwezo wa kufikiri bila kupoteza uthabiti.
Hatari na fursa kwa Google na kwa OpenAI
Kwa Google, hatua hii ni hatua madhubuti katika juhudi za miaka mingi za kuifanya Gemini kuwa msingi wa kibiashara katika huduma za wingu (cloud services), utafutaji (search), na bidhaa za walaji. Mifano iliyolinganishwa vizuri inapunguza hatari ya kisheria na kuongeza imani ya wateja—mambo muhimu wakati makampuni yanahitaji AI inayoweza kutumika kwa usalama katika kiwango kikubwa.
OpenAI, wakati huo huo, inakabiliana na uhamiaji wa vipaji unaozidi Zoph. Katika miezi nane iliyopita, kampuni imeona mkurugenzi mkuu wa uendeshaji na viongozi wa juu wa vituo vya data wakiondoka, pamoja na mabadiliko ya mara kwa mara ya watendaji. Kuondoka huku kunakuja wakati OpenAI inajiandaa kwa uwezekano wa IPO, mchakato ambao wawekezaji kwa kawaida huuchunguza kwa karibu ili kuona uthabiti wa uongozi. Mabadiliko yanaweza kuleta mitazamo mipya, lakini pia yana hatari ya kuvuruga mwendelezo wa programu za utafiti za muda mrefu.
Upande mwingine: kuajiri mtu mmoja hakutabadilisha Gemini kwa usiku mmoja
Google tayari ina timu kubwa ya watafiti katika RL, usalama, na ulinganifu wa modeli (model alignment). Baadhi ya waangalizi wanatahadharisha kuwa makamu-mkuu mmoja, hata mwenye sifa kama Zoph, hawezi kubadilisha mfululizo wa bidhaa mkubwa kama Gemini peke yake. Athari halisi itategemea jinsi Zoph atakavyounganisha mawazo yake katika timu zilizopo, kupata rasilimali, na kushawishi ramani pana ya bidhaa.
Uhamiaji wa vipaji unaweza kuhusisha uwiano wa kibinafsi na mwelekeo wa kazi sawa na faida za kimkakati. Kipindi kifupi cha Zoph katika mauzo ya makampuni kinashiria hamu ya nafasi zinazounganisha utafiti na athari za soko—mchanganyiko ambao Google inaweza kuwa katika nafasi nzuri zaidi ya kuutoa kuliko maabara inayojikita tu kwenye utafiti.
Nini cha kufuatilia baadaye
- Utoaji wa Gemini – maboresho ya modeli yanayokuja yataonyesha ikiwa uboreshaji unaozingatia RL utaimarisha alama za usalama na viwango vya uwezo wa kufikiri.
- Machapisho ya utafiti – makala kutoka kitengo cha utafiti cha Google zenye jina la Zoph au ushirikiano wa uandishi zitaonyesha mwelekeo wa majaribio ya ndani.
- Mabadiliko ya uongozi wa OpenAI – kuondoka kwa viongozi wengine mashuhuri au kuajiri wapya kunaweza kubadilisha ajenda ya utafiti ya kampuni kabla ya ofa yoyote ya umma.
- Majibu ya soko – wateja wa huduma za wingu na wanunuzi wa makampuni wataangalia maboresho madhubuti katika ulinganifu wa Gemini kabla ya kujitolea kwa mfumo wa AI wa Google.
Hitimisho
Kubadilisha kazi kwa Barrett Zoph kutoka OpenAI kwenda Google kunasisitiza jinsi mashindano ya silaha ya AI yanavyopigana sasa katika upande wa vipaji sawa na vile vinavyopigana katika upande wa uwezo wa kompyuta (compute). Kwa kumweka mtaalamu wa reinforcement learning kiongozi wa utafiti wa Gemini, Google inabeti kuwa msisitizo mkubwa zaidi kwenye post-training utapunguza pengo la utendaji na usalama dhidi ya mifano ya GPT ya OpenAI—matokeo ambayo yanaweza kubadilisha mienendo ya ushindani katika sekta hii.
