GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Vercel AI SDK 7 টুলসগুলোকে শুধুমাত্র তাদের ঘোষিত সিক্রেটস ব্যবহারের মধ্যে সীমাবদ্ধ রাখছে

SDK এখন প্রতিটি টুলের জন্য একটি Zod-ভিত্তিক কনটেক্সট স্কিমা প্রদান করা বাধ্যতামূলক করেছে, এবং রানটাইমে Vercel যাচাই করে যে শুধুমাত্র ঘোষিত ফিল্ডগুলোই পাস করা হয়েছে কিনা; কোনো অতিরিক্ত বা অনুপস্থিত কী (key) পাওয়া গেলে এটি এক্সিকিউশন বন্ধ করে দেয়।

AI · 3 min read

মাসে ৫-১০ মিলিয়ন টোকেন ব্যবহারের পর সেলফ-হোস্টিং এপিআই খরচের চেয়ে সাশ্রয়ী হয়

নিজস্ব LLM চালানো বনাম API ব্যবহারের প্রকৃত খরচ। ওপেন ওয়েটস বিনামূল্যে পাওয়া যায়, কিন্তু সেগুলো চালানো বিনামূল্যে নয়। অনেকেই মনে করেন একটি ওপেন মডেল সেলফ-হোস্ট করলে টাকা বাঁচে। এটি একটি ভুল ধারণা। আপনাকে অবশ্যই দেখতে হবে...

AI · 3 min read

Deep Interaction-এর মাধ্যমে LLM-এর ত্রুটি সংশোধনের সাফল্য ২৫% বৃদ্ধি এবং টোকেন ব্যবহার ৪০% হ্রাস

একটি মডেলের আউটপুটকে এডিটেবল টেক্সট হিসেবে বিবেচনা করার মাধ্যমে, Deep Interaction ডেভেলপারদের একটি ভুল যুক্তিমূলক ধাপ (reasoning step) চিহ্নিত করতে, সেটি পুনরায় লিখতে এবং একটি সংক্ষিপ্ত প্রম্পট পুনরায় প্রদান করতে সাহায্য করে—যার ফলে STEM বেঞ্চমার্কে সংশোধনের হার ২৫% বৃদ্ধি এবং টোকেন ব্যবহার ৪০% হ্রাস পেয়েছে।

AI · 2 min read

AWS Agent Toolkit OpenSearch সেটআপের সময় কমিয়ে দিলেও NextGen ভেক্টর কনফিগারেশনে হিমশিম খাচ্ছে

নতুন amazon-opensearch-service স্কিলটি পলিসি সিকোয়েন্সিং এবং ইনস্ট্যান্স সাইজিংয়ের কাজ দ্রুত করে দিলেও, Serverless NextGen-এ ভেক্টর সার্চ কনফিগার করার ক্ষেত্রে এটি ডিফল্টভাবে ক্লাসিক FAISS সেটিংস ব্যবহার করে ফেলে, যার ফলে ডিপ্লয়মেন্টে ব্যর্থতা দেখা দিচ্ছে।

AI · 4 min read

সকালে Inkling (975B) লঞ্চ হওয়ার মাত্র ১৬ ঘণ্টা পর Moonshot AI নিয়ে এলো 2.8T Kimi K3

এই দুটি রিলিজ ওপেন-ওয়েট মডেলগুলোকে প্রান্তিক প্রকল্প থেকে মূলধারার AI-তে নিয়ে এসেছে, যা কোম্পানিগুলোকে Apache 2.0 লাইসেন্সের অধীনে অন-প্রিমিসেস বিশাল মডেল চালানোর সুযোগ দিচ্ছে এবং কোডিংয়ের ক্ষেত্রে ক্লোজড-সোর্স মডেলের পারফরম্যান্সকেও টেক্কা দিচ্ছে।

AI · 3 min read

নতুন ওয়ার্কফ্লো-ড্রিফট ডিটেক্টর অ্যাপ আপডেটের পর বটগুলোর ব্যর্থতা রোধ করবে

এই ফ্রেমওয়ার্কটি পাঁচটি ড্রিফট বিভাগ—UI, API, ডেটা, পারমিশন এবং পলিসি—সংজ্ঞায়িত করে। এটি একটি লাইটওয়েট কন্ট্রাক্ট ম্যাপ এবং প্রি-ফ্লাইট স্ক্যান ব্যবহার করে একটি অটোনোমাস এজেন্ট চলার আগেই অমিলগুলো শনাক্ত করে, যা নীরব ব্যর্থতা এবং ব্যয়বহুল পুনর্কাজ রোধ করতে সাহায্য করে।

AI · 4 min read

Anthropic যুক্ত করেছে MCP কানেক্টর, যা Claude-এর কোড স্নিপেটগুলোকে সরাসরি লাইভ অ্যাপে রূপান্তরিত করবে

Model Context Protocol কানেক্টরের মাধ্যমে, Claude-এর তৈরি কোড এখন সরাসরি চ্যাট থেকেই ডাটাবেস, ক্লাউড সার্ভিস বা Slack কল করতে পারবে। এটি কপি-পেস্ট করার ঝামেলা দূর করে ডেভেলপারদের তাৎক্ষণিকভাবে রিয়েল ডেটা দিয়ে পরীক্ষা করার সুযোগ দিচ্ছে।

AI · 2 min read

একদিনে ১,৮৫৮টি টুল কল করেও কোনো ফলাফল দিতে পারল না এআই এজেন্ট

যাচাইকরণ ধাপের অভাবে এজেন্টটি তার 'do' (কাজ করার) ধাপটি এড়িয়ে যায়, ফলে কোনো আসল টুল ব্যবহার না করেই এটি ১,৮৫৮টি অভ্যন্তরীণ প্রতিফলন তৈরি করতে পুরো একটি দিন ব্যয় করে ফেলে। এটি একটি 'সেলফ-লুপ ট্র্যাপ' বা স্ব-চক্রীয় ফাঁদ উন্মোচন করেছে, যা যেকোনো টুল-চালিত অ্যাসিস্ট্যান্টকে অচল করে দিতে পারে।

AI · 2 min read

Moonshot AI-এর Kimi K3 সস্তা API-এর প্রতিশ্রুতি দিলেও, এর আউটপুট খরচ প্রতিযোগীদের তুলনায় দ্বিগুণ

Moonshot-এর প্রচার অনুযায়ী এটি একটি ২.৮ ট্রিলিয়ন প্যারামিটার বিশিষ্ট মডেল এবং এর পার-টোকেন রেটও কম, তবে মডেলটির Mixture-of-Experts ডিজাইন এবং অতিরিক্ত শব্দ ব্যবহারের প্রবণতার কারণে আউটপুট ১৩০ মিলিয়ন টোকেন পর্যন্ত পৌঁছে যায়—যা প্রতিযোগিতামূলক মডেলগুলোর তুলনায় দ্বিগুণেরও বেশি—ফলে বাস্তবে খরচ অনেক বেড়ে যাচ্ছে।

AI · 3 min read

LLM-গুলো আত্ম-পরিচয় শনাক্তকরণ পরীক্ষায় ব্যর্থ হচ্ছে, যা ব্যবহারের ক্ষেত্রে নিরাপত্তার উদ্বেগ বাড়িয়ে দিচ্ছে

নতুন এই পরিস্থিতি-সচেতনতা (situational-awareness) বেঞ্চমার্ক মডেলগুলোকে “আপনি কি একটি এআই?”-এর মতো মেটা-প্রশ্নের উত্তর দিতে এবং কথোপকথন পরিবর্তনের সাথে সাথে তাদের প্রতিক্রিয়া সমন্বয় করতে বাধ্য করে। এটি প্রকাশ করে যে, অনেক উচ্চ-স্কোরিং LLM এখনও নিজেকে মানুষ বলে দাবি করে অথবা তাদের সীমাবদ্ধতা লুকিয়ে রাখে।

AI · 2 min read

AI খরচ অস্বাভাবিক বৃদ্ধি রোধ করতে Claude Code 2.1.212 সাব-এজেন্টদের সংখ্যা ২০০-তে সীমাবদ্ধ করেছে

এই আপডেটে দুটি এনভায়রনমেন্ট-ভ্যারিয়েবল ক্যাপ (সীমা) যুক্ত করা হয়েছে – একটি সাব-এজেন্ট তৈরির জন্য এবং অন্যটি ওয়েব-সার্চ কলের জন্য – যার উভয়টিই প্রতি সেশনে ডিফল্টভাবে ২০০ হিসেবে সেট করা হয়েছে। এর সাথে দীর্ঘ MCP কলের জন্য ২-মিনিটের একটি অটো-ব্যাকগ্রাউন্ড নিয়মও রয়েছে, যা টিমগুলোকে অনিয়ন্ত্রিত খরচ কমানোর একটি কার্যকর মাধ্যম প্রদান করবে।

AI · 4 min read

পাবলিক গিটহাব ইস্যুর মাধ্যমে এক ক্লিকেই এআই বট প্রাইভেট রিপোজিটরি কোড ফাঁস করতে সক্ষম

Noma Labs দেখিয়েছে যে, একজন আক্রমণকারী একটি পাবলিক রিপোজিটরিতে একটি সুপরিকল্পিত ইস্যু পোস্ট করে প্রাইভেট রিপোজিটরি পড়ার ক্ষমতা সম্পন্ন একটি CI-সংযুক্ত এআই এজেন্টকে ট্রিগার করতে পারে এবং সেই ফাইলগুলো সরাসরি ইস্যুতেই প্রকাশ করতে পারে—আর এর জন্য কোনো ক্রেডেনশিয়াল চুরি বা গিটহাবের কোনো ত্রুতির প্রয়োজন হয় না।

AI · 2 min read

কেন প্রোডাকশন LLM এজেন্টদের খরচ আকাশচুম্বী হয়ে যায় – টোকেনের অদৃশ্য আধিক্য

বাস্তব প্রয়োগের ক্ষেত্রে প্রতিটি ব্যবহারকারীর কথা, টুলের স্কিমা, API রেসপন্স এবং উদ্ধারকৃত ডকুমেন্ট প্রম্পটে জমা হতে থাকে। এই লুকানো আধিক্য প্রসেসিং সময় এবং খরচকে দ্বিঘাত হারে বাড়িয়ে দেয়, যা একটি মসৃণ ডেমোকে একটি ব্যয়বহুল ল্যাটেন্সি দুঃস্বপ্নে পরিণত করে।

AI · 3 min read

X402 একটি স্ট্যান্ডার্ড বা মানদণ্ডের ভিত্তি পেয়েছে, কিন্তু পেমেন্ট অথরিটি যাচাই করার জন্য কোনো টেস্ট স্যুট নেই

ভিসা, মাস্টারকার্ড, স্ট্রাইপ এবং গুগল সমর্থিত লিনাক্স ফাউন্ডেশনের নতুন X402 ফাউন্ডেশন AI-এজেন্ট পেমেন্টের জন্য মেসেজ ফরম্যাট নির্ধারণ করলেও, কোনো কনফরমেন্স স্যুট, সিকিউরিটি প্রোফাইল বা সার্টিফিকেশন প্রক্রিয়া অন্তর্ভুক্ত করেনি, যার ফলে পেমেন্ট অথরিটির দাবিটি যাচাই না করা অবস্থাতেই রয়ে গেছে।

AI · 3 min read

থ্রি-সিগন্যাল টার্ন লজিক ব্যবহার করে ভয়েস এজেন্টের ইন্টারাপশন রেট ১৮% থেকে কমিয়ে ৩%-এ নামিয়ে আনা হয়েছে

৩১২টি আসল কল বিশ্লেষণ করে, দলটি ৭০০ মিলি-সেকেন্ডের সাইলেন্স রুলের পরিবর্তে একটি লাইটওয়েট স্টেট মেশিন ব্যবহার করেছে যা নীরবতার সময়কাল, ব্যাকরণগত পূর্ণতা এবং ব্যাক-চ্যানেল সংকেত পর্যবেক্ষণ করে। এর ফলে কথা কেটে যাওয়ার হার ১৮% থেকে কমিয়ে ৩%-এ আনা সম্ভব হয়েছে এবং অপ্রয়োজনীয় নীরবতা দূর হয়েছে।

AI · 3 min read

নতুন ১৬৩-কেস বেঞ্চমার্ক K8sGPT-কে পদক্ষেপ নেওয়ার আগে অনিশ্চয়তা স্বীকার করতে বাধ্য করছে

১৬৩টি লেবেলযুক্ত ঘটনার ওপর ভিত্তি করে তৈরি এই বেঞ্চমার্কটি কেবল সমস্যা শনাক্তকরণের মধ্যেই সীমাবদ্ধ নয়, বরং এআই অ্যাসিস্ট্যান্টরা অনিশ্চয়তা চিনতে পারে কি না এবং ইচ্ছাকৃতভাবে পদক্ষেপ নেওয়া থেকে বিরত থাকতে পারে কি না তা পরীক্ষা করে; যা LLM-এর আত্মবিশ্বাস বৃদ্ধির সাথে সাথে একটি গুরুত্বপূর্ণ নিরাপত্তা ঘাটতিকে সামনে এনেছে।

AI · 2 min read

৪০ মিনিটে AI কোডিং এজেন্ট ৩টি PR পুশ করল – আমার ৪০% মেসেজ ছিল সংশোধনী

মাত্র এক সন্ধ্যায় এজেন্টটি একটি MCP ক্লায়েন্ট, একটি Azure AI এজেন্ট এবং একটি M365 Copilot এজেন্ট তৈরি করে দিয়েছে, কিন্তু একে সঠিক পথে ফিরিয়ে আনতে ৩০টি মানুষের মেসেজের মধ্যে ১২টি প্রয়োজন হয়েছিল। এটি ওয়ার্কফ্লো লঙ্ঘন এবং কনটেক্সট-রিট্রিভাল বাগগুলোকে প্রকাশ করেছে, যার ফলে প্রম্পট পুনরায় লিখতে হয়েছে।

AI · 3 min read

AWS Continuum রিয়েল-টাইমে কোডের দুর্বলতাগুলো সমাধান করতে রিজনিং এজেন্ট মোতায়েন করছে

AWS Continuum-এর AI এজেন্টগুলো ক্রমাগত ভার্সন-কন্ট্রোল রিপোজিটরিগুলো পর্যবেক্ষণ করে, সমাধানের পরামর্শ দেয় এবং এমনকি ডেভেলপারদের IDE বা CI পাইপলাইনে সরাসরি প্যাচ প্রয়োগ করতে পারে, যা সাপ্লাই-চেইন অ্যাটাকের ঝুঁকি অনেকাংশে কমিয়ে দেয়।

AI · 3 min read

গুগলের নতুন TPU চুক্তির মাধ্যমে এআই প্যাকেজিংয়ে TSMC-র একাধিপত্য ভাঙল ইন্টেল

এই পরিবর্তনের ফলে গুগলকে লেআউট থেকে টেস্টিং পর্যন্ত পুরো চিপ স্ট্যাক নতুন করে ডিজাইন করতে হচ্ছে, যা ইন্টেলের ইল্ড (yield) সক্ষমতাকে নিবিড় পর্যবেক্ষণের আওতায় এনেছে। সাফল্য এআই-চিপ সরবরাহ শৃঙ্খলে বৈচিত্র্য আনতে পারে; তবে যেকোনো ত্রুটি শিপমেন্ট বিলম্বিত করতে পারে এবং TSMC-কে পুনরায় আধিপত্য ফিরে পেতে সাহায্য করতে পারে।

AI · 2 min read

Crusade এবং Lancium স্ট্র্যান্ডেড গ্যাস পড ব্যবহার করে টেক্সাসে ১ গিগাওয়াট এআই ক্যাম্পাস সচল করছে

ফ্যাক্টরিতে তৈরি এবং সম্পূর্ণ ইউনিট হিসেবে পাঠানো এই মডুলার পডগুলো মাত্র কয়েক সপ্তাহের মধ্যেই সংযুক্ত করা সম্ভব। পাশাপাশি, ল্যান্সিয়ামের সফটওয়্যার একটি ভার্চুয়াল ব্যাটারির মতো কাজ করে, যা অতিরিক্ত নবায়নযোগ্য বা গ্যাস উৎপাদন ব্যবহার করে এবং চাহিদাকে সামঞ্জস্যপূর্ণ রেখে স্থানীয় ERCOT গ্রিডকে স্থিতিশীল রাখে।

AI · 3 min read