Apple-এর নতুন প্রযুক্তিতে Siri আরও স্মার্ট, ফোনের মেমরি বাঁচবে
Apple তার Siri Expressive Voices-এর জন্য একটি মেমরি-সাশ্রয়ী অডিও সিন্থেসিস আর্কিটেকচার চালু করেছে। এই প্রযুক্তি সেম্যান্টিক অডিও টোকেনকে রিয়েল টাইমে উচ্চ-মানের অডিওতে রূপান্তর করে, যা সম্পূর্ণ ডিভাইসের ভেতরেই কাজ করে।
Apple তার Siri Expressive Voices-এর জন্য একটি মেমরি-সাশ্রয়ী অডিও সিন্থেসিস আর্কিটেকচার চালু করেছে। এই প্রযুক্তি সেম্যান্টিক অডিও টোকেনকে রিয়েল টাইমে উচ্চ-মানের অডিওতে রূপান্তর করে, যা সম্পূর্ণ ডিভাইসের ভেতরেই কাজ করে।
Apple তাদের গবেষণা বিভাগ থেকে ঘোষণা করেছে একটি নতুন মেমরি-সাশ্রয়ী অডিও সিন্থেসিস আর্কিটেকচার, যা Siri Expressive Voices-এর ক্ষমতা বাড়াবে। এই প্রযুক্তি Siri-কে রিয়েল টাইমে সমৃদ্ধ ও কাস্টমাইজযোগ্য বক্তব্য তৈরি করতে সাহায্য করবে, যা সম্পূর্ণ ডিভাইসের ভেতরেই ঘটবে।
এই আর্কিটেকচারের মূল অংশ হলো একটি ডিটোকেনাইজার, যা ফাউন্ডেশন মডেল থেকে আসা সেম্যান্টিক অডিও টোকেনকে উচ্চ-মানের অডিওতে রূপান্তর করে। এটি Apple-এর সবচেয়ে শক্তিশালী অন-ডিভাইস মডেল AFM 3 Core Advanced-এর সাথে সংযুক্ত। ফলে Siri এখন আরও স্বাভাবিক ও আবেগপূর্ণ কণ্ঠে কথা বলতে পারবে, যা আগের চেয়ে অনেক বেশি বাস্তবসম্মত।
এই সিস্টেমটি Apple Matrix Coprocessor (AMX)-এর জন্য অপ্টিমাইজ করা হয়েছে, যা খুব সীমিত কম্পিউট এবং মেমরি সম্পদে কাজ করতে পারে। অর্থাৎ, এই প্রযুক্তি ব্যবহার করতে কোনো ভারী ক্লাউড সার্ভারের প্রয়োজন নেই। সবকিছুই ব্যবহারকারীর ডিভাইসের ভেতরে ঘটে, যা গোপনীয়তা রক্ষা করে এবং দ্রুত সাড়া দেয়।
Apple বলছে, এই পদ্ধতি আগের তুলনায় অনেক বেশি মেমরি-সাশ্রয়ী। তারা সেম্যান্টিক অডিও টোকেনকে সরাসরি অডিওতে রূপান্তর করার একটি কার্যকর উপায় বের করেছে, যা প্রচলিত পদ্ধতির তুলনায় কম শক্তি খরচ করে। এই প্রযুক্তি বিশেষ করে ছোট ডিভাইসের জন্য গুরুত্বপূর্ণ, যেখানে মেমরি এবং ব্যাটারির সীমাবদ্ধতা থাকে।
বাংলাদেশের ডেভেলপার এবং ফ্রিল্যান্সারদের জন্য এই খবর অত্যন্ত প্রাসঙ্গিক। যারা মোবাইল অ্যাপ বা ভয়েস-ভিত্তিক সেবা তৈরি করেন, তারা এই প্রযুক্তির ধারণা থেকে শিখতে পারেন কীভাবে সীমিত সম্পদে উচ্চ-মানের অডিও প্রসেসিং করা যায়। এটি বিশেষ করে যারা লোকাল মার্কেটে ভয়েস অ্যাসিস্ট্যান্ট বা অডিও কনটেন্ট অ্যাপ বানাতে চান, তাদের জন্য একটি উদাহরণ হয়ে দাঁড়াতে পারে।
ভবিষ্যতে Apple এই প্রযুক্তি আরও প্রসারিত করবে বলে আশা করা যায়। এই আর্কিটেকচার শুধু Siri-এর জন্যই নয়, বরং অন্যান্য অডিও-সংক্রান্ত অ্যাপ্লিকেশনেও ব্যবহার হতে পারে। গবেষণা প্রতিবেদনটি Apple ML Research থেকে প্রকাশিত হয়েছে, যা প্রযুক্তি বিশ্বে নতুন দিগন্ত খুলতে পারে।
আরও পড়ুন
এই সংবাদটি আন্তর্জাতিক সূত্রের তথ্য অবলম্বনে AI-সহায়তায় বাংলায় উপস্থাপন ও বাংলাদেশের প্রেক্ষাপটে সম্পাদিত। মূল তথ্যের জন্য নিচের সূত্র দেখুন।
মূল প্রতিবেদন: Apple ML Research
সোর্স দেখুন ↗মন্তব্য০
লোড হচ্ছে...