জুলাই ২০২৬-এ তিন সপ্তাহের ব্যবধানে চারটি উচ্চ-প্রোফাইল কৃত্রিম বুদ্ধিমত্তা (AI) ল্যাব ফ্রন্টিয়ার ভাষা মডেল প্রকাশ করেছে, এবং মানব হস্তক্ষেপ ছাড়াই এসব সিস্টেম যা সম্পন্ন করতে পারে ও আগের প্রজন্ম যা পারত—এই দুয়ের মধ্যে ব্যবধান দ্রুতই সংকুচিত হয়েছে।
এআই জায়ান্টরা ৩ সপ্তাহে ৪টি ফ্রন্টিয়ার মডেল উন্মোচন করল, প্রতিযোগিতা যখন অতিরিক্ত গতিতে প্রবেশ করছে

মূল বিষয়গুলো
- xAI ৮ জুলাই Grok 4.5 পাঠিয়েছে প্রতি মিলিয়ন টোকেনে $2/$6 দামে, যা Opus 4.8-এর দামের তুলনায় ৬০%-এরও বেশি কম।
- Anthropic ২৪ জুলাই Claude Opus 5 প্রকাশ করেছে, যা Claude Max সাবস্ক্রিপশনে নতুন ডিফল্ট মডেল।
- Moonshot AI তাদের সবচেয়ে বড় ২.৮ ট্রিলিয়ন প্যারামিটারের মডেল Kimi K3 প্রকাশ করেছে।
xAI-এর Grok 4.5, Anthropic-এর Claude Opus 5, OpenAI-এর GPT-5.6 পরিবার, এবং Moonshot AI-এর Kimi K3—প্রতিটি একই সমস্যাকে লক্ষ্য করছে: গবেষণা থেকে কোডিং থেকে কাঠামোবদ্ধ রিপোর্টিং পর্যন্ত বহু-ঘণ্টার কাজ একটি AI সিস্টেমকে পরিকল্পনা না হারিয়ে বহন করানো, মানব হস্তক্ষেপ ছাড়াই।
Grok 4.5 বাস্তব ডেভেলপার সেশনে ট্রেন হয়েছে
xAI ৮ জুলাই Grok 4.5 প্রকাশ করেছে। মডেলটি ১.৫ ট্রিলিয়ন প্যারামিটারের একটি বেসে চলে এবং আংশিকভাবে Cursor থেকে বাস্তব ব্যবহার ডেটার ওপর প্রশিক্ষিত—এটি সেই কোডিং প্ল্যাটফর্ম যা SpaceXAI এ বছর শুরুর দিকে অধিগ্রহণ করেছিল। মূল্য নির্ধারণ করা হয়েছে প্রতি মিলিয়ন ইনপুট টোকেনে $2 এবং প্রতি মিলিয়ন আউটপুট টোকেনে $6, সঙ্গে ৫০০,০০০ টোকেন কনটেক্সট উইন্ডো।

এলন মাস্ক Grok 4.5-কে বর্ণনা করেছেন একটি Opus-শ্রেণির মডেল হিসেবে, যা দ্রুততর এবং কম খরচে চলে। স্বাধীন ট্র্যাকাররা এটিকে Artificial Analysis Intelligence Index-এ চতুর্থ স্থানে রেখেছে, সব ওপেন-ওয়েট মডেলের ওপরে, এবং Claude Opus 4.8 এবং GPT-5.5-এর তুলনায় ৬০%-এরও বেশি কম দামে। Terminal-Bench 2.1-এ—যে পরীক্ষাটি কমান্ড-লাইন ইঞ্জিনিয়ারিং টাস্ক কতটা ভালোভাবে মডেল সম্পন্ন করে তা স্কোর করে—Grok 4.5 স্কোর করেছে ৮৩.৩%।
বড় পরিবর্তনটি হলো টোকেন দক্ষতা। xAI বলছে, তুলনীয় কাজের ক্ষেত্রে Opus 4.8 যে পরিমাণ আউটপুট টোকেন লাগাত, তার প্রায় এক-পঞ্চমাংশ আউটপুট টোকেনই এই মডেলের প্রয়োজন, ফলে দীর্ঘ এজেন্ট সেশন চালানোর খরচ কমে।
Claude Opus 5 দামের ক্ষেত্রে অবস্থান ধরে রেখেছে
Anthropic ২৪ জুলাই Claude Opus 5 প্রকাশ করেছে, এবং এটিকে এমন একটি মডেল হিসেবে উপস্থাপন করেছে যা কোম্পানির সবচেয়ে সক্ষম রিলিজ Claude Fable 5-এর পারফরম্যান্সের কাছাকাছি পৌঁছায়, অথচ Fable-এর প্রতি মিলিয়ন টোকেনে $10 ইনপুট এবং $50 আউটপুট দামের অর্ধেক খরচে। Opus 5 নিজে তার পূর্বসূরি Opus 4.8-এর মতোই প্রতি মিলিয়ন টোকেনে $5 ইনপুট এবং $25 আউটপুট মূল্য বহন করছে।

মডেলটি ১ মিলিয়ন টোকেন কনটেক্সট উইন্ডো, সর্বোচ্চ ১,২৮,০০০ আউটপুট টোকেন, এবং একটি সমন্বয়যোগ্য reasoning effort সেটিং নিয়ে আসে, যা low থেকে নতুন xhigh মোড পর্যন্ত বিস্তৃত। Anthropic বলছে Opus 5 Frontier-Bench এবং GDPval-AA-তে নতুন মানদণ্ড স্থাপন করেছে—এ দুটি কোডিং ও জ্ঞানভিত্তিক কাজের মূল্যায়ন—যদিও সাইবারসিকিউরিটি টাস্কে এটি সীমাবদ্ধ (restricted) Claude Mythos 5 মডেলের তুলনায় পিছিয়ে। Opus 5 এখন Claude Max-এ ডিফল্ট মডেল এবং Claude Pro-এ সবচেয়ে শক্তিশালী বিকল্প।
OpenAI GPT-5.6-কে তিনটি স্তরে ভাগ করেছে
OpenAI ৯ জুলাই GPT-5.6-কে সাধারণভাবে উপলব্ধ করেছে, দুই সপ্তাহের একটি প্রিভিউয়ের পর, যা মার্কিন সরকার যাচাই করা (vetted) প্রায় ২০টি প্রতিষ্ঠানের মধ্যে সীমিত ছিল—ফ্রন্টিয়ার মডেল সেফটি রিভিউ সংশ্লিষ্ট একটি নির্বাহী আদেশ অনুসরণ করে। এই পরিবারটি তিনটি স্তর হিসেবে প্রকাশিত: Sol, ফ্ল্যাগশিপ, প্রতি মিলিয়ন টোকেনে $5 ইনপুট ও $30 আউটপুট; Terra, মধ্য-স্তরের মডেল $2.50 ও $15 দামে, যা OpenAI বলছে অর্ধেক খরচে GPT-5.5-এর সমমানের; এবং Luna, দ্রুত ও কম-খরচের স্তর $1 ও $6 দামে।

OpenAI জানায়, Sol Artificial Analysis Coding Agent Index-এ শীর্ষে এবং Terminal-Bench 2.1-এ ৮৮.৮% অর্জন করেছে, যা নতুন ultra মোডে চারটি সাব-এজেন্ট সমান্তরালে চালালে ৯১.৯%-এ ওঠে। তিনটি স্তরই সাইবার এবং জৈবিক অপব্যবহারের সম্ভাবনার জন্য OpenAI-এর সর্বোচ্চ অভ্যন্তরীণ ঝুঁকি রেটিং বহন করে, যা সরকার-নিয়ন্ত্রিত প্রিভিউ চলাকালে অতিরিক্ত রিভিউ ট্রিগার করেছিল।
Kimi K3 ওপেন-ওয়েট মডেলগুলোকে ফ্রন্টিয়ারের দিকে ঠেলে দিচ্ছে
Moonshot AI ১৬ জুলাই Kimi K3 প্রকাশ করেছে, ২.৮ ট্রিলিয়ন প্যারামিটারের একটি mixture of experts মডেল, যেখানে মোট ৮৯৬টি এক্সপার্ট এবং প্রতি টাস্কে ১৬টি সক্রিয় থাকে। মডেলটি ১ মিলিয়ন টোকেন কনটেক্সট উইন্ডো ও নেটিভ মাল্টিমোডাল ইনপুট বহন করে, API প্রাইসিং প্রতি মিলিয়ন টোকেনে $3 ইনপুট ও $15 আউটপুট। Moonshot ২৭ জুলাইয়ের মধ্যে পূর্ণ ওপেন ওয়েট প্রকাশে অঙ্গীকার করেছে।

K3 এখন পর্যন্ত প্রকাশিত সবচেয়ে বড় ওপেন-ওয়েট মডেল, আগের সর্ববৃহৎ ও ব্যাপকভাবে ব্যবহৃত ওপেন মডেলের তুলনায় প্রায় ৭৫% বড়। স্বাধীন ট্র্যাকাররা বর্তমান ফ্রন্টিয়ার সিস্টেমগুলোর মধ্যে K3-কে চতুর্থ স্থানে রেখেছে, Claude Fable 5 এবং GPT-5.6 Sol-এর পিছনে, তবে Claude Opus 4.8-এর সামনে।
পুরোনো মডেলগুলোর সঙ্গে ব্যবধান কেন গুরুত্বপূর্ণ
২০০,০০০ টোকেনের নিচের কনটেক্সট উইন্ডো আগে ডেভেলপারদের বড় কোডবেস বা গবেষণা প্যাকেটকে খণ্ডে খণ্ডে ভাগ করতে বাধ্য করত। এই গ্রুপের প্রতিটি মডেল এখন ৫০০,০০০ টোকেন বা তার বেশি সমর্থন করে, চারটির মধ্যে তিনটি ১ মিলিয়নে, ফলে একটি একক সেশনেই পুরো রিপোজিটরি বা প্রাথমিক উৎস নথির একটি স্তূপ ধরে রাখা যায়।
এজেন্টের নির্ভরযোগ্যতাও বদলেছে। ২০২৩ ও ২০২৪ সময়কালের সিস্টেমগুলো কয়েকটি টুল কলের পর প্রায়ই তাদের পরিকল্পনা হারিয়ে ফেলত। এ মাসে প্রকাশিত মডেলগুলো এমনভাবে তৈরি যে তারা ডজন ডজন সমন্বিত ধাপ ধরে রাখতে পারে এবং কোনো টুল কল খারাপ ডেটা ফেরত দিলেও থেমে না থেকে পুনরুদ্ধার করতে পারে।
ডেভেলপারদের জন্য বাস্তব প্রভাবটি হলো কোনো একক বেঞ্চমার্কে উচ্চতর সর্বোচ্চ সীমা নয়, বরং প্রতি সম্পন্ন টাস্কে কম খরচ। Opus 5-এর effort control, GPT-5.6-এর স্তরভিত্তিক প্রাইসিং, এবং Grok 4.5-এর পেছনের দক্ষতার দাবি—সবই একই লক্ষ্যের দিকে ইঙ্গিত করে: প্রতিটি অনুরোধে ফ্ল্যাগশিপ মূল্য না দিয়ে দলগুলোকে সিদ্ধান্ত নিতে দেওয়া যে কোনো কাজ কতটা compute পাওয়ার যোগ্য।
এন্টারপ্রাইজ এবং নীতিনির্ধারকদের জন্য, GPT-5.6-এর সরকার-নিয়ন্ত্রিত রোলআউট দেখায় যে সবচেয়ে বড় মডেলগুলোর রিলিজ শিডিউলেই এখন তদারকি অন্তর্ভুক্ত, পরে যোগ করা নয়। Anthropic-এর জুন মাসে সরকার-নির্দেশিত স্বল্পমেয়াদি Fable এবং Mythos অ্যাক্সেস স্থগিতকরণ ছিল একই প্যাটার্নের আগের একটি সংস্করণ।
এই নিবন্ধটি AI ব্যবহার করে ইংরেজি থেকে অনুবাদ করা হয়েছে। মূল ইংরেজি সংস্করণটি নির্ভরযোগ্য উৎস; স্বয়ংক্রিয় অনুবাদে ভুল থাকতে পারে, বিশেষ করে আইনি ও নিয়ন্ত্রক পরিভাষায়।

















