છેલ્લા બે વર્ષોથી, AI એન્જિનિયરિંગ એક સરળ સ્ક્રિપ્ટને અનુસરી રહ્યું છે. એક એજન્ટને પ્રોમ્પ્ટ, કેટલાક ટૂલ્સ અને મેમરી લેયર આપો. તેને મીટિંગ શેડ્યૂલ કરતા, કોન્ટ્રાક્ટનો સારાંશ આપતા અથવા સ્ક્રિપ્ટને ડીબગ કરતા જુઓ. સમગ્ર ધ્યેય એક સિંગલ એજન્ટને તેના પોતાનામાં ઉપયોગી બનાવવાનો હતો.
તે ધ્યેય બદલાઈ ગયો છે.
હવે આપણે ઉદ્યોગને સોલો એજન્ટ્સથી એજન્ટ ટીમો તરફ બદલાતા જોઈ રહ્યા છીએ. કસ્ટમર સર્વિસ ટ્રાયજ બોટ રિફંડ વિનંતીને ઓળખે છે અને કેસને પેમેન્ટ્સ એજન્ટને મોકલે છે. વેબ ડેટા સ્ક્રેપ કરતો રિસર્ચ એજન્ટ કોઈ ચોક્કસ વિષયમાં અવરોધ અનુભવે છે અને કાર્યને પ્રોપ્રાઈટરી ડેટાબેઝ પર બેઠેલા સ્પેશિયાલિસ્ટને સોંપે છે. શિપમેન્ટનું આયોજન કરતો લોજિસ્ટિક્સ એજન્ટને રિયલ-ટાઇમ ફ્રેઇટ ક્વોટની જરૂર હોય છે, તેથી તે પેઇસિંગ એજન્ટ પાસે આંકડો માંગે છે.
કાગળ પર આ સરળ લાગે છે. વ્યવહારમાં, તે અસ્થિર છે.
નવો પડકાર ઇન્ટરઓપરેબિલિટી (interoperability) છે. ટીમો વિવિધ ફ્રેમવર્ક દ્વારા એજન્ટ્સ બનાવે છે. વિવિધ વેન્ડર્સ અલગ-અલગ ઇન્ટરફેસ સાથે એજન્ટ્સ મોકલે છે. જ્યારે એક કંપનીએ બીજી કંપની સાથે કામ કરવાની જરૂર હોય, ત્યારે આ અંતર વધતું જાય છે. આપણી પાસે હવે સક્ષમ કામદારોથી ભરેલું લેન્ડસ્કેપ છે જેમનામાં સહિયારી ભાષાનો અભાવ છે. એક એજન્ટ ડિરેક્ટરીમાં બીજા એજન્ટને શોધી શકતો નથી. તે તેના સાથીદાર શું કરે છે તેનું વર્ણન વાંચી શકતો નથી. અને તે ડેટા લીકેજ, કોન્ટેક્સ્ટ લોસ અથવા ડુપ્લીકેટ એક્ઝિક્યુશનનું જોખમ લીધા વિના સંવેદનશીલ કામ સોંપી શકતો નથી.
A2A બરાબર આ સમસ્યાને ઉકેલવા માટે બનાવવામાં આવ્યું છે. તે એજન્ટ્સને ડિસ્કવરી, ડીલીગેશન અને સુરક્ષિત સહયોગ માટે એક સામાન્ય પ્રોટોકોલ આપે છે.
સિંગલ એજન્ટ્સથી એજન્ટ સાઇલોઝ (Agent Silos) સુધી
એજન્ટ ફ્રેમવર્કની પ્રથમ લહેર સિસ્ટમની સીમાને એજન્ટની સીમા તરીકે ગણતી હતી. તમે એક રીઝનિંગ લૂપ બનાવતા, તેને ટૂલ બેલ્ટ આપતા અને આશા રાખતા કે તે વર્કફ્લો દ્વારા વિચારી શકે. જ્યારે એજન્ટ એક કોડબેઝ, એક ક્લાઉડ એકાઉન્ટ અથવા એક વેન્ડર પ્લેટફોર્મની અંદર રહેતો હતો ત્યારે તે પૂરતું સારું કામ કરતું હતું.
વાસ્તવિક વ્યવસાયો મોનોલિથ્સ (monoliths) ની અંદર કામ કરતા નથી. રિફંડ વિનંતી CRM માં શરૂ થઈ શકે છે, Python માં લખેલી આંતરિક પેમેન્ટ સર્વિસમાં જઈ શકે છે અને ત્રીજા પક્ષ દ્વારા હોસ્ટ કરવામાં આવેલી ફ્રોડ ચેકમાં સમાપ્ત થઈ શકે છે. જ્યારે તમે તેમાંથી દરેક સર્વિસને એજન્ટ તરીકે મોડેલ કરો છો, ત્યારે તમને ઝડપથી સમજાય છે કે અલગ-અલગ સ્ટેક્સ પર બનેલા એજન્ટ્સ કુદરતી રીતે એકબીજાને સમજી શકતા નથી. પ્રોપ્રાઈટરી ફ્રેમવર્ક પર બનેલા એન્ટરપ્રાઇઝ એજન્ટ્સ તેમની ક્ષમતાઓ બહારની દુનિયાને બતાવતા નથી.
સ્ટાન્ડર્ડ વગર, દરેક ઇન્ટિગ્રેશન એક કસ્ટમ પ્રોજેક્ટ બની જાય છે. એન્જિનિયરો વન-ઓફ ગ્લુ કોડ (glue code) લખે છે. અનુવાદમાં કોન્ટેક્સ્ટ ખોવાઈ જાય છે. સુરક્ષા નીતિઓ અસંગત બની જાય છે, કારણ કે દરેક હેન્ડઓફ અલગ (bespoke) હોય છે.
એજન્ટ કાર્ડ્સ: એક પબ્લિક રિઝ્યુમે
A2A એજન્ટ્સ તેઓ કોણ છે અને તેઓ શું કરી શકે છે તેની જાહેરાત કરવા માટે Agent Cards રજૂ કરે છે.
એજન્ટ કાર્ડને મશીન-રીડેબલ રિઝ્યુમે તરીકે વિચારો. એક એજન્ટ કાર્ડ પ્રકાશિત કરે છે જે તેના ડોમેન, તેના જરૂરી ઇનપુટ્સ, તેના અપેક્ષિત આઉટપુટ્સ અને તે સ્વીકારે છે તે કામ પરના કોઈપણ અવરોધોનું વર્ણન કરે છે. એક પેમેન્ટ્સ એજન્ટ જાહેર કરી શકે છે કે જ્યારે ઓર્ડર ID અને રીઝન કોડ આપવામાં આવે ત્યારે તે ચોક્કસ રકમ હેઠળની રિફંડ વિનંતીઓ પ્રોસેસ કરે છે, અને તે કન્ફર્મેશન નંબર અથવા એરર રિટર્ન કરે છે. એક ડેટા સ્પેશિયાલિસ્ટ જણાવી શકે છે કે તે ચોક્કસ કદ સુધીની સ્ટ્રક્ચર્ડ ફાઇલો સ્વીકારે છે અને અનુમાનિત સમયગાળામાં ક્લીન કરેલ ટાઇમ-સીરીઝ ડેટા રિટર્ન કરે છે.
કામ સોંપતા પહેલા, વિનંતી કરતો એજન્ટ કાર્ડ વાંચે છે. તે સમજે છે કે લક્ષિત એજન્ટ તે કામ કરવા માટે સક્ષમ છે કે નહીં. તે શીખે છે કે પેલોડને કયા ફોર્મેટની જરૂર છે. તે જાણે છે કે તેણે સિંક્રનસ રિસ્પોન્સની અપેક્ષા રાખવી જોઈએ કે પછી એસિંક્રનસ ટાસ્કની જે પછીથી પૂર્ણ થશે.
આ અંદાજ લગાવવાની જરૂરિયાત દૂર કરે છે. દરેક સંભવિત ભાગીદાર સામે ઇન્ટિગ્રેશન હાર્ડકોડ કરવાને બદલે, એક એજન્ટ ઉપલબ્ધ ક્ષમતાઓ જોઈ શકે છે અને ગતિશીલ રીતે (dynamically) યોગ્ય સાથીદાર પસંદ કરી શકે છે.
ટાસ્ક: સ્ટ્રક્ચર્ડ વર્ક, માત્ર API કોલ્સ નહીં
એજન્ટ્સને માણસોની જેમ ચેટ કરવાની જરૂર નથી. તેમને કામ ચોખ્ખી રીતે સોંપવાની જરૂર છે. A2A આ વિનિમયને એક Task તરીકે મોડેલ કરે છે.
એક Task એ તેનાથી વધુ છે
