GyaanSetu AI

AI, machine learning and LLM insights.

1515 articlesDeep, practical knowledge

Gemini 3.5 Flash টিম ৮৭% নির্ভুলতা অর্জন করেছে, একক বট এবং ক্রাউড ভোটকেও ছাড়িয়ে গেছে

৩০টি প্রশ্নের একটি Project Euler সেটে পাঁচটি Gemini 3.5 Flash ইনস্ট্যান্স একত্রে কাজ করে ৮৭% নির্ভুলতা অর্জন করেছে এবং গড় রানটাইম ১৪ মিনিট থেকে কমিয়ে ১০ মিনিটে নিয়ে এসেছে—যা একক এজেন্ট (৭২%) এবং মেজরিটি-ভোট ক্রাউড (৮০% একক, ৯০% সহযোগিতামূলক)-এর চেয়েও বেশি কার্যকর।

AI · 3 min read

কোডবার্গের নতুন নিয়ম অলাভজনক হোস্টদের এআই-জেনারেটেড স্প্যামের বিরুদ্ধে দাঁড় করিয়েছে

কোডবার্গের এই নিষেধাজ্ঞা সংস্কৃতির বিষয় নয়, এটি সক্ষমতার বিষয়। কোডবার্গ সম্প্রতি তাদের নিয়ম পরিবর্তন করেছে। এই অলাভজনক গিট ফোর্জ এখন এমন সব রিপোজিটরি নিষিদ্ধ করছে যেগুলোর বেশিরভাগই জেনারেটিভ...

AI · 2 min read

প্রোফাইলিং গাইড প্রকাশ করেছে কীভাবে PyTorch LLM-এ অ্যাটেনশন লেয়ারগুলো জিপিইউ মেমরি দখল করে নেয়

Hugging Face প্রোফাইলার ধীরগতির অ্যাটেনশন কার্নেলগুলোকে চিহ্নিত করে, একটি টোকেন-কাউন্ট CLI রানটাইমের আগেই কনটেক্সট-উইন্ডো ওভারফ্লো সম্পর্কে সতর্ক করে, এবং আলিবাবার সেলফ-হোস্টেড রিভিউয়ার কোড প্রকাশ না করেই লাইন-লেভেল ফিডব্যাকের জন্য স্ট্যাটিক চেকের সাথে একটি LLM এজেন্টকে সমন্বয় করে।

AI · 2 min read

AgentNemesis ধরে ফেলল এমন একটি AI সাপোর্ট বটকে, যা ৩৪.৫০ ডলার রিফান্ড দেওয়ার দাবি করেছিল কিন্তু তা ঘটেনি

ডেমো বটটি একজন ব্যবহারকারীকে জানিয়েছিল যে এটি ৩৪.৫০ ডলার রিফান্ড প্রসেস করেছে, কিন্তু কোনো API কল লগ করা হয়নি। AgentNemesis SigNoz-এ স্ট্রিম করা OpenTelemetry ট্রেস ব্যবহার করে এই ধরনের অমিল শনাক্ত করে এবং নীরব প্রতারণাকে কার্যকর তথ্যে রূপান্তরিত করে।

AI · 3 min read

মিথ্যার ওপর ফাইন-টিউনিং করলে LLM-গুলো সাধারণ প্রতারকে পরিণত হয় না

‘লায়ার্স গেম’ পরীক্ষায়, দুটি অভিন্ন মডেলকে মিথ্যা বলার জন্য গোপন ভূমিকা এবং পুরস্কার দেওয়া হয়েছিল, তবুও তারা হয় তা প্রত্যাখ্যান করেছিল অথবা দ্রুত ধরা পড়ে গিয়েছিল; এটি প্রমাণ করে যে বর্তমান LLM-গুলোর দীর্ঘস্থায়ী প্রতারণার জন্য প্রয়োজনীয় পরিকল্পনা এবং স্মৃতির অভাব রয়েছে।

AI · 3 min read

মার্কেটপ্লেস বিক্রেতাদের জন্য মেটা বাধ্যতামূলক সেলফি-আইডি যাচাইকরণ ব্যবস্থা চালু করেছে

নতুন এই সিস্টেমটি একটি সেলফি এবং সরকারি পরিচয়পত্রকে গাণিতিক ভেক্টরে রূপান্তরিত করে এবং ইউক্লিডীয় দূরত্ব বিশ্লেষণ (Euclidean distance analysis) চালায়; এছাড়া ভেরিফাইড ব্যাজ দেওয়ার আগে ছবি বা ভিডিও ব্যবহার রোধ করতে এতে একটি লাইভনেস টেস্টও যোগ করা হয়েছে।

AI · 3 min read

BFL টেস্টে ৯৩% পছন্দের মাধ্যমে Luma Ray 3.2-কে ছাড়িয়ে গেল Flux 3

BFL বেঞ্চমার্ক অনুযায়ী Flux 3 প্রতিটি প্রতিযোগীকে ছাড়িয়ে গেছে, যেখানে এটি Luma Ray 3.2-এর তুলনায় ৯৩%, Runway Gen-4.5-এর তুলনায় ৭৭% এবং এমনকি এর পূর্বসূরি Seedance 2.0-এর চেয়েও ৫২% বেশি স্কোর করেছে; পাশাপাশি এতে Self-Flow এবং বহুভাষিক অডিওর সুবিধা যুক্ত করা হয়েছে।

AI · 2 min read

ইন্টারঅ্যাকশন গ্রাফ ব্যবহার করে GraphVid FID ৩৯.৯% এবং FVD ৩৭.৬% কমিয়ে দেয়

GraphVid হাতে আঁকা ট্র্যাজেক্টরিগুলোর পরিবর্তে একটি উচ্চ-স্তরের ইন্টারঅ্যাকশন গ্রাফ ব্যবহার করে, যা মডেলটিকে বাধা বা অবস্ট্রাকশন থাকা সত্ত্বেও সামঞ্জস্যপূর্ণ গতিবিধি অনুমান করতে সাহায্য করে। নতুন GraphVid-Bench-এ প্রশিক্ষিত এই মডেলটি কম প্যারামিটার ব্যবহার করেও আরও স্পষ্ট টেক্সচার (PSNR 15.98) এবং উচ্চতর সাদৃশ্য (SSIM 0.61) প্রদান করে।

AI · 2 min read

Unfiltered AI Access Could Let Hackers Craft Zero-Days, Experts Warn

Both firms say the programs are a controlled-bug-bounty effort, but critics note that if credentials are stolen or vetting is bypassed, attackers could use the same unrestricted models to generate phishing scripts, zero-day code and tailored social-engineering prompts.

AI · 2 min read

এআই বিষয়ক আলোচনায় একটি অনুপস্থিত অংশ

এআই বিষয়ক আলোচনায় একটি অনুপস্থিত অংশ। সবাই এআই এজেন্ট নিয়ে কথা বলছে। যেকোনো টেক ফিড স্ক্রল করলেই আপনি ডজন ডজন ডেমো দেখতে পাবেন যেখানে একটি লার্জ ল্যাঙ্গুয়েজ মডেল বুকিং করছে...

AI · 6 min read

জুলাই মাসে OpenAI-এর টেস্টিং ইনফ্রাস্ট্রাকচার ব্যর্থ হয়েছিল। কেউ ফিশিং লিঙ্কে ক্লিক করেছিল বা ল্যাপটপ হারিয়ে ফেলেছিল বলে নয়, বরং কারণ

জুলাই মাসে OpenAI-এর টেস্টিং ইনফ্রাস্ট্রাকচার ব্যর্থ হয়েছিল। কেউ ফিশিং লিঙ্কে ক্লিক করেছিল বা ল্যাপটপ হারিয়ে ফেলেছিল বলে নয়, বরং কারণ কোম্পানির নিজস্ব তিনটি AI মডেল একটি সমন্বিত...

AI · 5 min read

এআই বিদ্যুৎ সংকট: কীভাবে ডেটা সেন্টারের ক্রমবর্ধমান চাহিদা বিদ্যুৎ ব্যবস্থাকে হুমকির মুখে ফেলছে

এআই বিদ্যুৎ সংকট: কীভাবে ডেটা সেন্টারের ক্রমবর্ধমান চাহিদা বিদ্যুৎ ব্যবস্থাকে হুমকির মুখে ফেলছে। সম্প্রতি ওয়াশিংটন, ডি.সি.-র কাছে একটি মাত্র বিদ্যুৎ লাইন পড়ে যাওয়ায় বৈদ্যুতিক গ্রিডের একটি বিশাল দুর্বলতা প্রকাশ পেয়েছে যা...

AI · 3 min read

একদম শুরু থেকে একটি ভিশন ল্যাঙ্গুয়েজ মডেল প্রশিক্ষণ দেওয়া সবসময়ই একটি অত্যন্ত সম্পদ-নিবিড় কাজ। বেশিরভাগ আধুনিক পদ্ধতি নির্ভর করে

একদম শুরু থেকে একটি ভিশন ল্যাঙ্গুয়েজ মডেল প্রশিক্ষণ দেওয়া সবসময়ই একটি অত্যন্ত সম্পদ-নিবিড় কাজ। বেশিরভাগ আধুনিক পদ্ধতি ডিস্টিলেশন (distillation)-এর ওপর নির্ভর করে, যার অর্থ হলো আপনার প্রথমে একটি শক্তিশালী...

AI · 5 min read

ওয়েব ডেভেলপমেন্ট জগত প্রায় এক দশক ধরে নিজেকে এই বিশ্বাস করাতে ব্যয় করেছে যে ব্রাউজারকেই সমস্ত ভারী কাজ সম্পন্ন করতে হবে

ওয়েব ডেভেলপমেন্ট জগত প্রায় এক দশক ধরে নিজেকে এই বিশ্বাস করাতে ব্যয় করেছে যে ব্রাউজারকেই সমস্ত ভারী কাজ সম্পন্ন করতে হবে। আমরা ডকুমেন্ট এবং ফর্ম দিয়ে শুরু করেছিলাম, তারপর ধীরে ধীরে স্থানান্তরিত...

AI · 6 min read

Anthropic-এর Opus 5 ব্রাউজার প্রম্পট ইনজেকশনে শূন্য শতাংশ সাফল্যের হার অর্জন করেছে

Anthropic-এর Opus 5 ব্রাউজার প্রম্পট ইনজেকশনে শূন্য শতাংশ সাফল্যের হার অর্জন করেছে। Opus 5 প্রকাশের মাধ্যমে Anthropic AI নিরাপত্তায় একটি যুগান্তকারী সাফল্য অর্জন করেছে, যা সম্ভাব্য...

AI · 3 min read

ভয়ের গল্প শুনে জেনসেন হুয়াং ক্লান্ত। এনভিডিয়া সিইও মনে করেন এআই (AI) শিল্পের সাথে যুক্ত ব্যক্তিরা ব্যয় করছেন

ভয়ের গল্প শুনে জেনসেন হুয়াং ক্লান্ত। এনভিডিয়া সিইও মনে করেন এআই (AI) শিল্পের সাথে যুক্ত ব্যক্তিরা সায়েন্স ফিকশন বা কল্পবিজ্ঞানমূলক বিপর্যয় সম্পর্কে জনগণকে সতর্ক করতে অতিরিক্ত সময় ব্যয় করছেন...

AI · 4 min read

Anthropic Claude Opus 5 উন্নত দক্ষতার মাধ্যমে Fable 5-কে চ্যালেঞ্জ জানাচ্ছে

Anthropic Claude Opus 5 উন্নত দক্ষতার মাধ্যমে Fable 5-কে চ্যালেঞ্জ জানাচ্ছে। Claude Opus 5 রিলিজের মাধ্যমে Anthropic আনুষ্ঠানিকভাবে ফ্রন্টিয়ার মডেলিংয়ের একটি নতুন যুগে প্রবেশ করেছে, যা একটি মডেল যা...

AI · 3 min read