পাঁচ বছরেরও বেশি সময়ের মধ্যে নিজেদের প্রথম প্রধান ওপেন-সোর্স মডেল GPT-OSS চালু করার মাধ্যমে OpenAI অপ্রত্যাশিতভাবে কৃত্রিম বুদ্ধিমত্তার জগতে আলোড়ন সৃষ্টি করেছে । এই পদক্ষেপটি কোম্পানির সাম্প্রতিক কৌশল থেকে একটি বিচ্যুতিকে চিহ্নিত করে, যা মূলত মালিকানাধীন মডেল এবং ক্লোজড সার্ভিসের উপরই কেন্দ্রীভূত ছিল। GPT-OSS-এর মাধ্যমে OpenAI তার মূলে ফিরে এসেছে, যা যেকোনো ব্যক্তি বা সংস্থাকে তাদের ক্লাউড প্ল্যাটফর্ম বা ইন্টারনেট সংযোগের উপর নির্ভর না করেই একটি শক্তিশালী ল্যাঙ্গুয়েজ মডেল অ্যাক্সেস, রান এবং কাস্টমাইজ করার সুযোগ করে দিয়েছে।
নতুন মডেলটি দুটি সংস্করণে পাওয়া যায়: একটিতে ১২০ বিলিয়ন প্যারামিটার এবং অন্যটিতে ২০ বিলিয়ন প্যারামিটার । অধিক শক্তিশালী সংস্করণটি কমপক্ষে ৮০ জিবি মেমোরির একটিমাত্র প্রফেশনাল জিপিইউ-তে চলতে পারে, অন্যদিকে ছোট সংস্করণটি ১৬ জিবি র্যামের সাধারণ ডেস্কটপ ও ল্যাপটপ কম্পিউটারের জন্য তৈরি, যা উন্নত এআই সক্ষমতার ব্যবহারকে ব্যাপকভাবে সহজলভ্য করে । উভয় সংস্করণই হাগিং ফেস-এর মতো প্ল্যাটফর্ম থেকে বিনামূল্যে ডাউনলোড করা যায় এবং অ্যাজুর বা এডব্লিউএস-এর মতো জনপ্রিয় পরিষেবাগুলিতে স্থাপন করা যায়।
প্রযুক্তিগত বৈশিষ্ট্য এবং ব্যবহৃত প্রযুক্তি
GPT-OSS- এর মাধ্যমে OpenAI ট্রান্সফরমার-ভিত্তিক আর্কিটেকচার এবং মিক্সচার-অফ-এক্সপার্টস (MoE) ব্যবহার করে ডিজাইন করা দুটি মডেল চালু করেছে । এটি প্রতিটি ইনপুট টোকেনের জন্য শুধুমাত্র একটি নির্দিষ্ট সংখ্যক এক্সপার্ট সক্রিয় করার মাধ্যমে মেমরি ব্যবহার এবং ল্যাটেন্সি অপ্টিমাইজ করে , ফলে পাওয়ার না কমিয়েই কার্যকারিতা বৃদ্ধি পায়। ১২০-বাইট সংস্করণটি ৩৬টি ব্লক ব্যবহার করে এবং প্রতিটি টোকেনের জন্য ৫.১ বিলিয়ন প্যারামিটার সক্রিয় করে, অন্যদিকে ২০-বাইট সংস্করণটি ২৪টি ব্লক ব্যবহার করে এবং ৩.৬ বিলিয়ন প্যারামিটার সক্রিয় করে, যা এটিকে আরও সাশ্রয়ী হার্ডওয়্যারের জন্য উপযুক্ত করে তোলে।
উভয় মডেলকেই প্রাথমিকভাবে STEM ক্ষেত্র, প্রোগ্রামিং এবং সাধারণ জ্ঞান থেকে সংগৃহীত ইংরেজি ভাষার ডেটার উপর প্রশিক্ষণ দেওয়া হয়েছিল । মানুষের নির্দেশনার সাথে তাদের সামঞ্জস্য উন্নত করার জন্য সুপারভাইজড টিউনিং এবং রিইনফোর্সমেন্টের একটি অতিরিক্ত পর্যায়ও অন্তর্ভুক্ত ছিল । তাদের সক্ষমতার মধ্যে রয়েছে চিন্তার ধারাবাহিকতার ভিত্তিতে যুক্তি প্রদান , প্রতিক্রিয়া জানানোর আগে মধ্যবর্তী ধাপগুলোকে ভেঙে বিশ্লেষণ করার ক্ষমতা এবং ওয়েব ব্রাউজিং ও পাইথন কোড এক্সিকিউশনের মতো বাহ্যিক সরঞ্জাম ব্যবহার করার ক্ষমতা।
প্রাপ্যতা, লাইসেন্সিং এবং ইন্টিগ্রেশন বিকল্পগুলি
GPT-OSS-এর অন্যতম প্রধান সুবিধা হলো এর অ্যাপাচি ২.০ লাইসেন্স , যা অন্যান্য মালিকানাধীন মডেলের অনেক প্রচলিত সীমাবদ্ধতা দূর করে: এটি ছোট স্টার্টআপ থেকে শুরু করে বড় সরকারি সংস্থা বা গবেষণা ও উন্নয়ন (R&D) উদ্যোগ পর্যন্ত সব ধরনের প্রকল্পে বাণিজ্যিক ব্যবহার, পুনঃবন্টন এবং একীকরণের অনুমতি দেয় । মডেল ওয়েটগুলো MXFP4 ফরম্যাটে পাওয়া যায় এবং এতে PyTorch ও Apple Metal-এ রেফারেন্স ইমপ্লিমেন্টেশন অন্তর্ভুক্ত রয়েছে। এছাড়াও এটি Ollama, llama.cpp, LM Studio, এবং vLLM- এর মতো টুলগুলোর সাথে সম্পূর্ণ সামঞ্জস্যপূর্ণ , যা পেশাদার এবং ঘরোয়া উভয় পরিবেশে এর ব্যবহারকে সহজ করে তোলে।
এলএম স্টুডিও-এর মতো ইউটিলিটিগুলোর কারণে GPT-OSS-20B ইনস্টল এবং ডেপ্লয় করা বিশেষভাবে সহজ, যা প্রোগ্রামিং অভিজ্ঞতা ছাড়াই ব্যবহারকারীদের একটি গ্রাফিক্যাল ইন্টারফেস ব্যবহার করে মডেলটি ডাউনলোড ও স্থানীয়ভাবে পরীক্ষা করার সুযোগ দেয়। এছাড়াও, ওপেনএআই মডেলগুলোকে সূক্ষ্মভাবে সমন্বয় ও অভিযোজিত করার জন্য সুপারিশ এবং বিস্তারিত ডকুমেন্টেশন প্রকাশ করেছে, পাশাপাশি ক্লাউড এবং অন-প্রিমিসেস প্ল্যাটফর্মের জন্য তৈরি ইন্টিগ্রেশনও সরবরাহ করেছে।
নিরাপত্তা, পরীক্ষা এবং দায়িত্বশীল পদ্ধতি
GPT-OSS-এর সূচনায় শুধু উন্মুক্ততার উপরই নয়, বরং নিরাপত্তা এবং মডেলগুলোর দায়িত্বশীল ব্যবহারের উপরও গুরুত্ব দেওয়া হয়েছে । অপব্যবহারের সাথে সম্পর্কিত ঝুঁকি প্রতিরোধ করার জন্য, বিশেষ করে সাইবার নিরাপত্তা এবং ক্ষতিকারক এজেন্ট তৈরির মতো সংবেদনশীল ক্ষেত্রগুলোতে, OpenAI নতুন পর্যালোচনা এবং যাচাইকরণ ব্যবস্থা অন্তর্ভুক্ত করেছে। এই লক্ষ্যে, এটি একটি প্রতিপক্ষীয় পরীক্ষা পদ্ধতি (রেড টিমিং) প্রয়োগ করেছে, যেখানে স্বাধীন বিশেষজ্ঞদের দ্বারা বাহ্যিক পর্যালোচনা এবং চরম শোষণ পরিস্থিতি অনুকরণের জন্য প্রোটোকল রয়েছে।
মডেলগুলো প্রকাশের পাশাপাশি, ওপেনএআই একটি নেটওয়ার্ক টিমিং চ্যালেঞ্জ চালু করেছে , যেখানে দুর্বলতা বা সমস্যাজনক আচরণ শনাক্তকারীদের জন্য আর্থিক পুরস্কারের ব্যবস্থা রয়েছে এবং ঝুঁকি শনাক্তকরণে বিশ্ব সম্প্রদায়ের সক্রিয় সহযোগিতা চাওয়া হয়েছে। এছাড়াও, GPT-OSS তার রিজনিং চেইন উন্মোচন করেছে , যা প্রতিক্রিয়াগুলোর নিরীক্ষা এবং পক্ষপাত বা গুরুতর ত্রুটি প্রতিরোধের জন্য পর্যবেক্ষণকে সহজতর করে।
অন্যান্য উন্মুক্ত মডেলের সাথে কর্মক্ষমতা এবং তুলনা
অ্যাকাডেমিক বেঞ্চমার্ক এবং রিজনিং টেস্টে , GPT-OSS-120B সাম্প্রতিক মালিকানাধীন OpenAI মডেল যেমন o4-mini-এর সমকক্ষ পারফর্ম করে, এমনকি কিছু ক্ষেত্রে সেগুলোকে ছাড়িয়েও যায়, এবং নির্দিষ্ট কিছু ক্ষেত্রে DeepSeek R1 বা Llama সিরিজের মতো অন্যান্য মডেলকেও ছাড়িয়ে যায়। হোম ডিভাইসের জন্য অপ্টিমাইজ করা 20B সংস্করণটি দক্ষতা এবং পারফরম্যান্সের মধ্যে একটি চমৎকার ভারসাম্য বজায় রাখে , এবং গণিত, কোডিং ও স্বাস্থ্য সংক্রান্ত কাজগুলোতে অত্যন্ত প্রতিযোগিতামূলক স্কোর অর্জন করে।
ওপেনএআই সতর্ক করেছে যে, প্রশিক্ষণ এবং পর্যবেক্ষণের পার্থক্যের কারণে, এই ওপেন মডেলগুলো তাদের ক্লাউড-ভিত্তিক মডেলগুলোর তুলনায় 'হ্যালুসিনেশন' (তথ্যগত ত্রুটি)-এর প্রতি বেশি সংবেদনশীল হতে পারে । তবে, ব্যবহারকারীদের কাছে এখন অনলাইন পরিষেবা ছাড়াই উচ্চ-স্তরের মডেল ব্যবহার করার সুযোগ রয়েছে।