LIVE
ইন্ডাস্ট্রিDeepSeek V4 Flash-এ পরপর দুইটি আউটেজ, মাল্টি-প্রোভাইডার ফেইলওভারের প্রয়োজনীয়তাটুলমোবাইল অ্যাপে AI সংযুক্তির নতুন পথ দেখাল Oxlo.ai ও FastAPIমডেলQwen3.8-Max তিনটি বেঞ্চমার্কে Claude-কে হারিয়েছে, কিন্তু পুরো গল্পটা ততটা সহজ নয়গবেষণাসোশ্যাল মিডিয়া সেন্টিমেন্ট বিশ্লেষণে LLM-এর সাফল্য ও উৎপাদন-স্তরের চ্যালেঞ্জটুলকাস্টম AI এজেন্ট এখন আপনার স্থায়ী এডিটর হতে পারে, জানুন পদ্ধতিটুলAI লেখাকে মানবিক করুন ফ্রিতে, কোনো সাবস্ক্রিপশন ছাড়াইটুলAI ডিটেক্টর মেশিনে লেখা চেনে ভুল করে, বিকল্প কীভাবে নেবেনটুলAI এজেন্টের মান যাচাইয়ে ৪টি সিদ্ধান্ত, ফ্রেমওয়ার্ক নয়ইন্ডাস্ট্রিMicrosoft-এর নিজস্ব AI মডেল ও চিপে বদলে যাবে এন্টারপ্রাইজ বাজারইন্ডাস্ট্রিAI ডেভেলপমেন্টে খরচ বদলালো Novita ও StreamLake, বাজেটে বড় প্রভাব!গবেষণাক্লদ স্যান্ডবক্স ভেঙে বেরিয়ে গেল, ৩ কোম্পানি টেরই পায়নি!টুলএক API-তে সব AI মডেল! Bifrost গেটওয়েতে ফ্রিল্যান্সারদের সময় বাঁচবে ৩ গুণইন্ডাস্ট্রিDeepSeek V4 Flash-এ পরপর দুইটি আউটেজ, মাল্টি-প্রোভাইডার ফেইলওভারের প্রয়োজনীয়তাটুলমোবাইল অ্যাপে AI সংযুক্তির নতুন পথ দেখাল Oxlo.ai ও FastAPIমডেলQwen3.8-Max তিনটি বেঞ্চমার্কে Claude-কে হারিয়েছে, কিন্তু পুরো গল্পটা ততটা সহজ নয়গবেষণাসোশ্যাল মিডিয়া সেন্টিমেন্ট বিশ্লেষণে LLM-এর সাফল্য ও উৎপাদন-স্তরের চ্যালেঞ্জটুলকাস্টম AI এজেন্ট এখন আপনার স্থায়ী এডিটর হতে পারে, জানুন পদ্ধতিটুলAI লেখাকে মানবিক করুন ফ্রিতে, কোনো সাবস্ক্রিপশন ছাড়াইটুলAI ডিটেক্টর মেশিনে লেখা চেনে ভুল করে, বিকল্প কীভাবে নেবেনটুলAI এজেন্টের মান যাচাইয়ে ৪টি সিদ্ধান্ত, ফ্রেমওয়ার্ক নয়ইন্ডাস্ট্রিMicrosoft-এর নিজস্ব AI মডেল ও চিপে বদলে যাবে এন্টারপ্রাইজ বাজারইন্ডাস্ট্রিAI ডেভেলপমেন্টে খরচ বদলালো Novita ও StreamLake, বাজেটে বড় প্রভাব!গবেষণাক্লদ স্যান্ডবক্স ভেঙে বেরিয়ে গেল, ৩ কোম্পানি টেরই পায়নি!টুলএক API-তে সব AI মডেল! Bifrost গেটওয়েতে ফ্রিল্যান্সারদের সময় বাঁচবে ৩ গুণ
হোম/নিউজ/রিসার্চ
রিসার্চ৫ মিনিট পড়া

চীনের InAgent 90.2% স্কোর করে AI জগতে নতুন রেকর্ড, OpenAI-Google পেছনে

চীনা AI এজেন্ট InAgent OSWorld বেঞ্চমার্কে 90.2% স্কোর করে প্রথমবারের মতো 90% পার করেছে। সিস্টেম-লেভেল টাস্কে 100% সাফল্য দেখিয়ে OpenAI, Google ও Anthropic-এর রেকর্ড ভেঙে দিয়েছে।

d
সম্পাদকীয় টিম
স্টাফ রিপোর্টার · ৪৫ দিন আগে · সূত্র: dev.to ML
চীনের InAgent 90.2% স্কোর করে AI জগতে নতুন রেকর্ড, OpenAI-Google পেছনে

চীনা AI এজেন্ট InAgent OSWorld বেঞ্চমার্কে 90.2% স্কোর করে প্রথমবারের মতো 90% পার করেছে। সিস্টেম-লেভেল টাস্কে 100% সাফল্য দেখিয়ে OpenAI, Google ও Anthropic-এর রেকর্ড ভেঙে দিয়েছে।

চীনের তৈরি AI এজেন্ট InAgent OSWorld বেঞ্চমার্কে 90.2% স্কোর করে ইতিহাস তৈরি করেছে। এটি প্রথম কম্পিউটার-ব্যবহারকারী AI এজেন্ট যা 90% সাফল্যের হার অতিক্রম করলো। 2026 সালের জুলাইয়ে প্রকাশিত এই ফলাফল OpenAI, Google এবং Anthropic-এর একই বেঞ্চমার্কে থাকা সর্বজনীন রেকর্ডকে ছাড়িয়ে গেছে।

OSWorld এমন একটি বেঞ্চমার্ক যা AI এজেন্টের বাস্তব কম্পিউটার ব্যবহারের দক্ষতা পরিমাপ করে। এখানে এজেন্টকে ফাইল ম্যানেজ করা, সফটওয়্যার ইনস্টল করা, ওয়েব ব্রাউজ করা এবং বিভিন্ন সিস্টেম লেভেলের কাজ সম্পন্ন করতে হয়। InAgent সিস্টেম-লেভেলের সব কাজে 100% সাফল্য পেয়েছে, যা আগের কোনো মডেল করতে পারেনি।

InAgent-এর এই সাফল্যের মূল রহস্য কিন্তু বিশাল মডেল পাওয়ার নয়। গবেষকরা বলছেন, এটি মূলত হারনেস ইঞ্জিনিয়ারিংয়ের ফল। হারনেস ইঞ্জিনিয়ারিং মানে হলো এজেন্টের চারপাশের টুল, প্রম্পট স্ট্রাকচার এবং কাজ সম্পাদনের কৌশলগুলোকে এত নিখুঁতভাবে সাজানো যে মডেলটি নিজের সেরা ক্ষমতা দেখাতে পারে। OpenAI, Google বা Anthropic-এর মডেলগুলো যেখানে 80 থেকে 85% এর মধ্যে আটকে ছিল, সেখানে InAgent 90.2% এ পৌঁছেছে।

এই ফলাফল AI এজেন্টের বাণিজ্যিক ব্যবহারে নতুন দিগন্ত খুলে দিয়েছে। এখন AI এজেন্ট শুধু চ্যাট বা টেক্সট জেনারেশনেই নয়, বরং পুরো কম্পিউটার পরিচালনার কাজও করতে পারবে। অফিসের রুটিন কাজ, ডেটা এন্ট্রি, সফটওয়্যার টেস্টিং বা এমনকি জটিল সিস্টেম ম্যানেজমেন্টও AI-এর হাতে তুলে দেওয়া সম্ভব হবে। বিশেষ করে যেসব প্রতিষ্ঠান প্রতিদিন হাজার হাজার কম্পিউটার পরিচালনা করে, তাদের জন্য এই প্রযুক্তি খরচ ও সময় দুটোই বাঁচাতে পারে।

বাংলাদেশের ডেভেলপার ও ফ্রিল্যান্সারদের জন্যও এই খবর অত্যন্ত তাৎপর্যপূর্ণ। যারা আউটসোর্সিং বা সফটওয়্যার ডেভেলপমেন্টে কাজ করেন, তারা এই ধরনের AI এজেন্ট ব্যবহার করে ক্লায়েন্টের কাজ দ্রুত ও নির্ভুলভাবে করতে পারবেন। বিশ্ববিদ্যালয়ের শিক্ষার্থীরা গবেষণা বা প্রজেক্টের কাজে AI এজেন্টকে সহকারী হিসেবে ব্যবহার করতে পারবে। তবে বিশেষজ্ঞরা মনে করিয়ে দিচ্ছেন, এই প্রযুক্তি এখনও গবেষণা পর্যায়ে আছে এবং বাস্তব বিশ্বে প্রয়োগের আগে আরও পরীক্ষা প্রয়োজন।

InAgent-এর এই সাফল্য প্রমাণ করে যে AI-এর ভবিষ্যত শুধু বড় মডেল তৈরিতে নয়, বরং সেই মডেলকে কাজে লাগানোর কৌশলেও। যখন মডেল পাওয়ার ও হারনেস ইঞ্জিনিয়ারিং একসাথে কাজ করবে, তখন AI এজেন্ট আরও শক্তিশালী হয়ে উঠবে। আগামী বছরগুলোতে আমরা হয়তো এমন AI এজেন্ট দেখতে পাব যা মানুষের ন্যূনতম সাহায্যে পুরো কম্পিউটার পরিচালনা করতে পারবে।

আরও পড়ুন

🌐 তথ্যসূত্র ও স্বচ্ছতা

এই সংবাদটি আন্তর্জাতিক সূত্রের তথ্য অবলম্বনে AI-সহায়তায় বাংলায় উপস্থাপন ও বাংলাদেশের প্রেক্ষাপটে সম্পাদিত। মূল তথ্যের জন্য নিচের সূত্র দেখুন।

ট্যাগ:#রিসার্চ#AI#বাংলাদেশ#dev.to ML
AD
📧

AI নিউজ সরাসরি ইমেইলে পান

প্রতিদিনের সেরা AI খবর বাছাই করে আপনার inbox-এ পাঠাই। বিজ্ঞাপন নেই।

মূল প্রতিবেদন: dev.to ML

সোর্স দেখুন ↗

মন্তব্য

লোড হচ্ছে...