চীনের InAgent 90.2% স্কোর করে AI জগতে নতুন রেকর্ড, OpenAI-Google পেছনে
চীনা AI এজেন্ট InAgent OSWorld বেঞ্চমার্কে 90.2% স্কোর করে প্রথমবারের মতো 90% পার করেছে। সিস্টেম-লেভেল টাস্কে 100% সাফল্য দেখিয়ে OpenAI, Google ও Anthropic-এর রেকর্ড ভেঙে দিয়েছে।
চীনা AI এজেন্ট InAgent OSWorld বেঞ্চমার্কে 90.2% স্কোর করে প্রথমবারের মতো 90% পার করেছে। সিস্টেম-লেভেল টাস্কে 100% সাফল্য দেখিয়ে OpenAI, Google ও Anthropic-এর রেকর্ড ভেঙে দিয়েছে।
চীনের তৈরি AI এজেন্ট InAgent OSWorld বেঞ্চমার্কে 90.2% স্কোর করে ইতিহাস তৈরি করেছে। এটি প্রথম কম্পিউটার-ব্যবহারকারী AI এজেন্ট যা 90% সাফল্যের হার অতিক্রম করলো। 2026 সালের জুলাইয়ে প্রকাশিত এই ফলাফল OpenAI, Google এবং Anthropic-এর একই বেঞ্চমার্কে থাকা সর্বজনীন রেকর্ডকে ছাড়িয়ে গেছে।
OSWorld এমন একটি বেঞ্চমার্ক যা AI এজেন্টের বাস্তব কম্পিউটার ব্যবহারের দক্ষতা পরিমাপ করে। এখানে এজেন্টকে ফাইল ম্যানেজ করা, সফটওয়্যার ইনস্টল করা, ওয়েব ব্রাউজ করা এবং বিভিন্ন সিস্টেম লেভেলের কাজ সম্পন্ন করতে হয়। InAgent সিস্টেম-লেভেলের সব কাজে 100% সাফল্য পেয়েছে, যা আগের কোনো মডেল করতে পারেনি।
InAgent-এর এই সাফল্যের মূল রহস্য কিন্তু বিশাল মডেল পাওয়ার নয়। গবেষকরা বলছেন, এটি মূলত হারনেস ইঞ্জিনিয়ারিংয়ের ফল। হারনেস ইঞ্জিনিয়ারিং মানে হলো এজেন্টের চারপাশের টুল, প্রম্পট স্ট্রাকচার এবং কাজ সম্পাদনের কৌশলগুলোকে এত নিখুঁতভাবে সাজানো যে মডেলটি নিজের সেরা ক্ষমতা দেখাতে পারে। OpenAI, Google বা Anthropic-এর মডেলগুলো যেখানে 80 থেকে 85% এর মধ্যে আটকে ছিল, সেখানে InAgent 90.2% এ পৌঁছেছে।
এই ফলাফল AI এজেন্টের বাণিজ্যিক ব্যবহারে নতুন দিগন্ত খুলে দিয়েছে। এখন AI এজেন্ট শুধু চ্যাট বা টেক্সট জেনারেশনেই নয়, বরং পুরো কম্পিউটার পরিচালনার কাজও করতে পারবে। অফিসের রুটিন কাজ, ডেটা এন্ট্রি, সফটওয়্যার টেস্টিং বা এমনকি জটিল সিস্টেম ম্যানেজমেন্টও AI-এর হাতে তুলে দেওয়া সম্ভব হবে। বিশেষ করে যেসব প্রতিষ্ঠান প্রতিদিন হাজার হাজার কম্পিউটার পরিচালনা করে, তাদের জন্য এই প্রযুক্তি খরচ ও সময় দুটোই বাঁচাতে পারে।
বাংলাদেশের ডেভেলপার ও ফ্রিল্যান্সারদের জন্যও এই খবর অত্যন্ত তাৎপর্যপূর্ণ। যারা আউটসোর্সিং বা সফটওয়্যার ডেভেলপমেন্টে কাজ করেন, তারা এই ধরনের AI এজেন্ট ব্যবহার করে ক্লায়েন্টের কাজ দ্রুত ও নির্ভুলভাবে করতে পারবেন। বিশ্ববিদ্যালয়ের শিক্ষার্থীরা গবেষণা বা প্রজেক্টের কাজে AI এজেন্টকে সহকারী হিসেবে ব্যবহার করতে পারবে। তবে বিশেষজ্ঞরা মনে করিয়ে দিচ্ছেন, এই প্রযুক্তি এখনও গবেষণা পর্যায়ে আছে এবং বাস্তব বিশ্বে প্রয়োগের আগে আরও পরীক্ষা প্রয়োজন।
InAgent-এর এই সাফল্য প্রমাণ করে যে AI-এর ভবিষ্যত শুধু বড় মডেল তৈরিতে নয়, বরং সেই মডেলকে কাজে লাগানোর কৌশলেও। যখন মডেল পাওয়ার ও হারনেস ইঞ্জিনিয়ারিং একসাথে কাজ করবে, তখন AI এজেন্ট আরও শক্তিশালী হয়ে উঠবে। আগামী বছরগুলোতে আমরা হয়তো এমন AI এজেন্ট দেখতে পাব যা মানুষের ন্যূনতম সাহায্যে পুরো কম্পিউটার পরিচালনা করতে পারবে।
আরও পড়ুন
এই সংবাদটি আন্তর্জাতিক সূত্রের তথ্য অবলম্বনে AI-সহায়তায় বাংলায় উপস্থাপন ও বাংলাদেশের প্রেক্ষাপটে সম্পাদিত। মূল তথ্যের জন্য নিচের সূত্র দেখুন।
মূল প্রতিবেদন: dev.to ML
সোর্স দেখুন ↗মন্তব্য০
লোড হচ্ছে...