ওপেনএআইয়ের আসন্ন ‘আস্ত্রা’ (Astra) মডেলে একটি নতুন রিজিনিং বা চিন্তন কৌশল ব্যবহারের খবরে কৃত্রিম বুদ্ধিমত্তা বা এআই নিরাপত্তা গবেষকদের মধ্যে নতুন করে উদ্বেগ তৈরি হয়েছে। ‘দ্য ইনফরমেশন’-এর প্রতিবেদনের বরাত দিয়ে টেকক্রাঞ্চ জানিয়েছে, আস্ত্রা মডেলে ‘রেকুরেন্ট ডেপথ’ বা ‘অপেক রিকারেন্স’ (Opaque Recurrence) নামক সীমিত একটি কৌশল ব্যবহার করা হতে পারে। চিরাচরিত বা অনুক্রমিক (sequential) প্রক্রিয়ার পরিবর্তে এই কৌশলের মাধ্যমে কোনো মডেল লুপ বা চক্রাকারে বারবার কোনো সমস্যা প্রক্রিয়াজাত করতে পারে।
এআই নিরাপত্তা গবেষক ও রেডউড রিসার্চের বাক শ্লেজেরিস (Buck Shlegeris) এবং রায়ান গ্রিনব্লাট (Ryan Greenblatt) সতর্ক করে জানিয়েছেন, ভবিষ্যতের এআই সিস্টেমে এ ধরনের অস্বচ্ছ রিজিনিং পদ্ধতি বাড়লে মডেলের মধ্যবর্তী চিন্তন প্রক্রিয়া বা ‘চেইন-অফ-থট’ (chain-of-thought) মনিটরিং করা অত্যন্ত কঠিন হয়ে পড়বে। সাধারণত মডেলের ক্ষতিকর বা ঝুঁকিপূর্ণ আচরণ পরীক্ষা করার জন্য এই চেইন-অফ-থট মনিটরিং ব্যবহার করা হয়। এছাড়া নিরাপত্তা বিশেষজ্ঞ জিভি মোশোভিত্জ (Zvi Mowshowitz) মন্তব্য করেছেন যে, বিভিন্ন এআই কোম্পানির মধ্যকার প্রতিযোগিতার কারণে এমন প্রযুক্তি গ্রহণের চাপ তৈরি হতে পারে যা মডেলগুলোকে কম স্বচ্ছ করে তোলে।
তবে ওপেনএআই এই আশঙ্কার বিরুদ্ধে শক্ত অবস্থান নিয়েছে। তাদের মতে, আস্ত্রা মডেলে সামগ্রিকভাবে অস্বচ্ছ রিজিনিংয়ের দিকে যাওয়ার কোনো সুযোগ নেই; এই রিকারেন্স বা লুপের ব্যবহার অত্যন্ত সীমিত এবং মডেলটির চিন্তন প্রক্রিয়া পর্যবেক্ষণের জন্য উন্মুক্ত থাকবে। এমনকি ওপেনএআইয়ের প্রধান বিজ্ঞানী জাকুব পচোতস্কি (Jakub Pachocki) জানিয়েছেন যে, চেইন-অফ-থট মনিটরিং সংরক্ষণ এবং তার সঠিক ব্যবহার তাদের গবেষণা কার্যক্রমের অন্যতম প্রধান লক্ষ্য।
মন্তব্য করুন