বার্ষিক ফি 20,000 ছাড়িয়ে গেছে! কস্তুরী সবেমাত্র সবচেয়ে ব্যয়বহুল এআই প্রকাশ করেছে, গ্রোক 4 সমস্ত ক্ষেত্রে পিএইচডিকে চূর্ণ করার দাবি করেছে

কস্তুরী প্রায় অর্ধ বছর ধরে ধরে রেখেছে এবং অবশেষে গ্রোক 4 টেবিলে নিয়ে এসেছে।

এবারও তার সুরটা বেশ শক্ত ছিল। তিনি লঞ্চের আগে একটি সাহসী বিবৃতি দিয়েছিলেন, দাবি করেছিলেন যে Grok 4 "মানব জ্ঞানের ভিত্তি পুনর্লিখন করবে।" লঞ্চের সময়, মাস্ক আবারও জোর দিয়েছিলেন যে Grok 4 বর্তমানে বিশ্বের সবচেয়ে স্মার্ট এআই।

হ্যাঁ, পরিচিত স্বাদ, পরিচিত রেসিপি।

অবশ্যই, সবাই মুস্ককে তার নিজের পণ্যের প্রশংসা করতে দেখে অভ্যস্ত, কিন্তু নেটিজেনরা যেমন রসিকতা করেছে, আপনি xAI কর্মীদের অফিসের তাঁবুতে ঘুমাচ্ছেন বা সপ্তাহান্তে সকাল 4:20 পর্যন্ত কাজ করছেন দেখে হাসতে পারেন, তবে আপনাকে স্বীকার করতে হবে যে তারা সত্যিই দ্রুত বর্ধনশীল AI ল্যাবগুলির মধ্যে একটি।

Grok 4 কে "স্মার্টেস্ট এআই" বলা যেতে পারে কিনা তা নির্ভর করে প্রকৃত অভিজ্ঞতার উপর। যাইহোক, একটি জিনিস নিশ্চিত: এটি বাজারে সবচেয়ে ব্যয়বহুল AI হয়ে উঠেছে, যার বার্ষিক সাবস্ক্রিপশন মূল্য $3,000 পর্যন্ত। মূল্য কৌশল বেশ অনৈতিক।

বিশ্বের সবচেয়ে স্মার্ট এআই? বিশ্বের সবচেয়ে দামি এআই!

গ্রোকের প্রশিক্ষণের পথটি দুটি মূল পর্যায়ে বিভক্ত: প্রাক-প্রশিক্ষণ এবং শক্তিবৃদ্ধি শিক্ষা। Grok 2 থেকে Grok 3, এটি প্রধানত প্রাক-প্রশিক্ষণের উপর নির্ভর করে; যখন Grok 3 থেকে Grok 4, মূল হিসাবে যুক্তির ক্ষমতা সহ শক্তিবৃদ্ধি শেখার প্রশিক্ষণ ব্যাপকভাবে চালু করা হয়েছে।

কস্তুরী ঘটনাটিকে ছোট করেছেন, তবে প্রশিক্ষণটি কোনও ছোট কৃতিত্ব ছিল না।

Grok 2-এর তুলনায়, Grok 4-এর প্রশিক্ষণ গণনা 100-গুণ বৃদ্ধির সমতুল্য মাত্রার দুটি অর্ডার বৃদ্ধি পেয়েছে-এবং এটি প্রসারিত হতে থাকে।

মাস্ক বলেছেন যে গ্রোক 4 সমস্ত প্রধান শাখায় ডক্টরেট স্তরকে ছাড়িয়ে গেছে। যদিও এটি বর্তমানে নতুন তত্ত্ব উদ্ভাবন বা মূল প্রযুক্তি নিয়ে আসার ক্ষমতা রাখে না, তার মতে, এটি সময়ের ব্যাপার মাত্র।

তিনি এমনকি বলেছিলেন যে এই বছরের শেষের দিকে, গ্রোক নতুন প্রযুক্তি উদ্ভাবন করতে সক্ষম হতে পারে এবং পরের বছর এটি প্রায় নিশ্চিতভাবে পদার্থবিজ্ঞানের নতুন আইন আবিষ্কার করতে সক্ষম হবে।

অবশ্যই, আসল চাবিকাঠি হল AI কে বাস্তব জগতের সাথে সংযুক্ত করা।

তিনি বলেছিলেন যে গ্রোক এবং হিউম্যানয়েড রোবট অপটিমাসের সংমিশ্রণ একটি ক্লোজ-লুপ যুক্তি ব্যবস্থা তৈরি করবে – অনুমান প্রস্তাব করা, অনুমান যাচাই করা এবং বাস্তবতা অন্বেষণ করা। এটি বুদ্ধিমত্তা বিস্ফোরণের একটি যুগের সূচনা করবে এবং এটি মানব ইতিহাসের সবচেয়ে উত্তেজনাপূর্ণ নোড।

পণ্য ফর্মের পরিপ্রেক্ষিতে, Grok 4 একটি একক-এজেন্ট মডেল, যখন Grok 4 হেভি একটি মাল্টি-এজেন্ট সংস্করণ।

আগেরটি বোঝা সহজ, যখন পরেরটি একাধিক এজেন্টকে সমান্তরালভাবে চিন্তা করতে সমর্থন করে, যুক্তি প্রক্রিয়া চলাকালীন অনুভূমিক তুলনা এবং উল্লম্ব সহযোগিতা পরিচালনা করে এবং আরও জটিল এবং পরিশীলিত কাজগুলি সম্পূর্ণ করার জন্য বৃহত্তর-স্কেল কম্পিউটিং সংস্থানগুলিকে কল করে।

লাইভ প্রদর্শনের সময়, Grok 4 Heavy একাধিক দৃশ্যকল্পের ক্ষমতা প্রদর্শন করেছে।

উদাহরণস্বরূপ, Grok 4 Heavy কে এই বছরের MLB ওয়ার্ল্ড সিরিজ জেতার সম্ভাবনা সম্পর্কে ভবিষ্যদ্বাণী করা যাক। তথ্য পুনরুদ্ধার, ডেটা মডেলিং এবং সম্ভাব্যতা গণনার মাধ্যমে, এটি অনুমান করে যে লস অ্যাঞ্জেলেস ডজার্সের চ্যাম্পিয়নশিপ জেতার সম্ভাবনা 21.6%, এবং 4.5 মিনিটের মধ্যে পুরো ভবিষ্যদ্বাণী প্রক্রিয়াটি আউটপুট করে।

আরেকটি উদাহরণ হল একটি আপাতদৃষ্টিতে অযৌক্তিক কাজ: xAI টিমে অদ্ভুত অবতারের সাথে একজনকে খুঁজুন। এক্স প্ল্যাটফর্মের ডাটাবেসের উপর নির্ভর করে, মডেলটি স্বয়ংক্রিয়ভাবে অবতার শৈলীটি ক্যাপচার করে এবং বিশ্লেষণ করে এবং অবশেষে সহ-প্রতিষ্ঠাতা গ্রেগ ইয়াংকে লক করা হয়।

মজার বিষয় হল, যদিও মডেলটি "অদ্ভুত" এর বিষয়গত ধারণাটি সঠিকভাবে বোঝে এবং অনুরূপ লোকেদের মধ্যে আপেক্ষিক বিচার করতে পারে, যখন আমি ডেমোর মাধ্যমে সোয়াইপ করেছি, তখন আমি নৃতাত্ত্বিক কর্মচারী জান লেইকের প্রোফাইল ছবি দেখতে পেয়েছি, তাই মনে হচ্ছে সঠিকতা উন্নত করা দরকার।

যুক্তি এবং অনুসন্ধান ছাড়াও, Grok সামগ্রীর সময়রেখা তৈরি করতে পারে।

উদাহরণস্বরূপ, X প্ল্যাটফর্মে পাবলিক পোস্টের উপর ভিত্তি করে, এটি একাধিক AI মডেলের বেঞ্চমার্ক পরীক্ষার স্কোর, বিক্রেতার আপডেটের গতি এবং সম্প্রদায়ের প্রতিক্রিয়াগুলি সাজাতে পারে। ব্যবহারকারীরা এক নজরে ওপেনএআই-এর স্কোর পারফরম্যান্স, জেমিনীর আপডেট পুনরাবৃত্তি এবং এমনকি মডেলগুলির মধ্যে সূক্ষ্ম প্রতিযোগিতামূলক পরিস্থিতি দেখতে পারেন।

অন্য কথায়, Grok একজন বুদ্ধিমান নন যিনি শুধুমাত্র পরীক্ষা দিতে জানেন, কিন্তু এমন একজন AI যার সত্যিকার অর্থেই পরিস্থিতি বোঝার এবং কার্যকর করার ক্ষমতা রয়েছে।

বর্তমানে, Grok এর সবচেয়ে বড় ঘাটতি হল এখনও এর মাল্টিমোডাল বোঝার ক্ষমতা, বিশেষ করে ইমেজ বোঝার এবং জেনারেশনে, যা এখনও শক্তিশালী করা দরকার। সুসংবাদটি হল যে প্রাথমিক মডেল প্রশিক্ষণের পরবর্তী পর্যায়ের পথে রয়েছে এবং এটি কয়েক সপ্তাহের মধ্যে সম্পন্ন হবে বলে আশা করা হচ্ছে।

প্রদর্শনের সময়, "দুটি ব্ল্যাক হোলের সংঘর্ষের প্রক্রিয়া" এর ভিজ্যুয়ালাইজেশন কাজটি পরীক্ষা করার সময়, গ্রোক একটি সরলীকৃত গণনা পদ্ধতি গ্রহণ করেছিলেন – সম্পূর্ণ সাধারণ আপেক্ষিকতা কাঠামোর পরিবর্তে পোস্ট-নিউটনিয়ান অনুমান ব্যবহার করে।

সরলীকরণ সত্ত্বেও, মডেলটি এখনও "সর্পিল পদ্ধতি", "একত্রীকরণ" এবং "রিংিং স্টেজ" সহ ব্ল্যাক হোল একত্রিতকরণের মূল ভৌত পর্যায়গুলি সঠিকভাবে উপস্থাপন করে এবং ব্যবহৃত আনুমানিক পদ্ধতিগুলি স্পষ্টভাবে ব্যাখ্যা করতে পারে। উপরন্তু, এটি যুক্তি সমর্থনের জন্য প্রাসঙ্গিক পাঠ্যপুস্তক, সর্বজনীন অনুসন্ধান ফলাফল এবং প্রকৃত শারীরিক ধ্রুবক ব্যবহার করে এবং সামগ্রিক লজিক্যাল চেইন কঠোর এবং ব্যাখ্যাটি স্পষ্ট।

কাগজের প্যারামিটারের ক্ষেত্রে, Grok 4 একটি চিত্তাকর্ষক উত্তরও দিয়েছে।

হিউম্যানিটি'স লাস্ট এক্সাম (এইচএলই) মোট 2,500টি বন্ধ-বই প্রশ্ন সহ গণিত, পদার্থবিদ্যা, কম্পিউটার বিজ্ঞান, চিকিৎসা, মানবিক এবং সামাজিক বিজ্ঞান সহ 100 টিরও বেশি বিষয় কভার করে। পরীক্ষাটি অত্যন্ত কঠিন এবং সত্যিকার অর্থে সাধারণ জ্ঞান এবং জটিল যুক্তিতে মডেলের ব্যাপক কর্মক্ষমতা প্রতিফলিত করতে পারে।

xAI তথ্য অনুযায়ী, Grok 4 কোনো টুল ব্যবহার না করে 25.4% স্কোর করেছে, Google Gemini 2.5 Pro-এর 21.6% এবং OpenAI o3 (হাই-এন্ড সংস্করণ) এর 21%কে ছাড়িয়ে গেছে।

টুল ব্যবহার করার সময়, Grok 4 Heavy 44.4% স্কোর করেছে, যা টুল ব্যবহার করার পরে Gemini 2.5 Pro-এর 26.9% থেকে অনেক বেশি। সামগ্রিক প্রবণতা থেকে, Grok 4 প্রশিক্ষণ সংস্থান প্রসারিত করার সময় সরঞ্জামের ব্যবহার এবং চেইন চিন্তাভাবনা প্রবর্তন করে জটিল কাজগুলির প্রক্রিয়াকরণ ক্ষমতাকে কেবল উন্নত করে না, তবে মডেল বুদ্ধিমত্তা এবং সাধারণ জ্ঞানের মধ্যে ব্যবধানও ধীরে ধীরে সংকুচিত করে।

অলাভজনক আর্ক প্রাইজ আরও উল্লেখ করেছে যে গ্রোক তার ARC-AGI-2 পরীক্ষায় একটি নতুন রেকর্ড স্থাপন করেছে, একটি ভিজ্যুয়াল রিজনিং বেঞ্চমার্ক যেখানে AI চিত্রের প্যাটার্নগুলিকে স্বীকৃতি দেয়। Grok-এর স্কোর 16.2% বর্তমান রানার আপ, Claude Opus 4-এর থেকে প্রায় দ্বিগুণ।

কিছু সাধারণ বেঞ্চমার্ক পরীক্ষায়, Grok 4 Heavy-এর স্কোর প্রায় পূর্ণ। ডক্টরাল-স্তরের সমস্যা GBQA সেটে, যদিও সামগ্রিক অসুবিধা HLE এর থেকে সামান্য কম, Grok 4 Heavy এখনও একটি পূর্ণ স্কোর অর্জন করেছে, শক্তিশালী যুক্তি এবং বোঝার ক্ষমতা দেখিয়েছে।

এছাড়াও, Grok 4 Heavy লাইভ কোডিং, এইচএমএমটি (এমআইটি গণিত প্রতিযোগিতা) এবং ইউএসএএমও (মার্কিন যুক্তরাষ্ট্র গাণিতিক অলিম্পিয়াড) সহ অনেকগুলি প্রোগ্রামিং-সম্পর্কিত পরীক্ষাগুলিতেও ভাল পারফর্ম করে, বর্তমান দ্বিতীয়-র্যাঙ্কের মডেলকে ছাড়িয়ে গেছে এবং এর প্রযুক্তিগত সুবিধাগুলি বেশ স্পষ্ট।

এছাড়াও, সুপরিচিত বিশ্লেষণ সংস্থা কৃত্রিম বিশ্লেষণ 7টি যুক্তি-সম্পর্কিত বেঞ্চমার্কে (MMLU-Pro, GPQA Diamond, Humanity's Last Exam, LiveCodeBench, SciCode, AIME, এবং MATH-500) একাধিক মূলধারার বড় মডেলের ব্যাপক কর্মক্ষমতা মূল্যায়ন করেছে।

তথ্য দেখায় যে Grok 4 73 স্কোর নিয়ে প্রথম স্থানে রয়েছে, যা বর্তমানে যুক্তির ক্ষমতার সর্বোচ্চ ব্যাপক স্কোর সহ মডেল। এটি 71 পয়েন্ট সহ o3-pro (আনুমানিক মান) দ্বারা ঘনিষ্ঠভাবে অনুসরণ করে৷

কস্তুরী আরও জোর দিয়েছিলেন:

"ভবিষ্যতে, Grok সব পরীক্ষায় প্রায় প্রতিটি প্রশ্নের সঠিক উত্তর দেবে। যখন এটি একটি প্রশ্নের উত্তর দিতে পারে না, তখন এটি প্রশ্নের ত্রুটি নির্দেশ করবে, বা প্রশ্নের অস্পষ্টতা নির্দেশ করবে, এবং বিভিন্ন পরিস্থিতিতে সম্ভাব্য উত্তর দেবে। ততক্ষণে, ঐতিহ্যগত পরীক্ষাগুলি তাদের অর্থ হারাবে। AI-এর জন্য একমাত্র পরীক্ষার মান হবে বাস্তব বিশ্ব: এটি কার্যকরী প্রযুক্তি উদ্ভাবন করতে পারে এবং HLE ব্যাঙ্কের মতো পরীক্ষামূলক ব্রেকথ্রো প্রশ্নগুলিকে আপডেট করতে হবে। যত তাড়াতাড়ি সম্ভব, কারণ AI অগ্রগতির বর্তমান হারে, তারা শীঘ্রই পুরানো হয়ে যাবে।"

বর্তমানে, Grok 4 এবং Grok 4 Heavy সম্পূর্ণরূপে চালু হয়েছে। ব্যবহারকারীরা সাবস্ক্রিপশনের মাধ্যমে সেগুলি অ্যাক্সেস করতে পারেন, কিন্তু সাবস্ক্রিপশনের মূল্য কিছুটা "অন্যায়", প্রতি বছর $3,000 পর্যন্ত, যা অনেক ব্যবহারকারীর অভিযোগের কেন্দ্রবিন্দুতে পরিণত হয়েছে৷

তুলনায়, OpenAI, Anthropic এবং Perplexity-এর $200/মাস প্যাকেজগুলি অনেক বেশি সাশ্রয়ী মনে হয়।

এটি উল্লেখযোগ্য যে মুক্তির পরপরই, কিছু নেটিজেন বলেছেন যে Grok-4 এবং Grok-4-হেভি মডেলগুলি সফলভাবে "জেলব্রোকেন" হয়েছে। জেলব্রোকেন ক্ষমতা অত্যন্ত বিপজ্জনক, এবং নিরাপত্তা বেড়া এবং আউটপুট সংবেদনশীল বা অবৈধ তথ্য বাইপাস করতে পারে, যেমন রাসায়নিক অস্ত্র সংশ্লেষণ পদক্ষেপ, "স্টার ওয়ার্স 1" এর সম্পূর্ণ স্ক্রিপ্ট (কপিরাইট সন্দেহজনক), এবং এমনকি র্যানসমওয়্যার (দূষিত কোড)।

গ্রোক ভয়েস শুধু কথা বলে না, আত্মাও আছে

শক্তিশালী যুক্তির ক্ষমতা এবং বৃহত্তর বুদ্ধিমত্তা ছাড়াও, Grok 4 আরও মানুষের মতো হয়ে উঠতে একটি বড় পদক্ষেপ নিয়েছে।

আমরা পরিচিত ভয়েস অ্যাসিস্ট্যান্টদের থেকে ভিন্ন, xAI-এর নতুন ভয়েস অ্যাসিস্ট্যান্ট "ইভ" শুধুমাত্র প্রশ্নের উত্তর দিতে পারে না, আবেগ প্রকাশ করতে পারে, টোন পরিবর্তন করতে পারে, এমনকি ঘটনাস্থলেই "গান" করতে পারে।

লাইভ ডেমোনস্ট্রেশানে, এটি একটি মার্জিত ব্রিটিশ উচ্চারণে একটি অবিলম্বে "ডায়েট কোক আরিয়া" গেয়েছিল, "ও ডায়েট কোক, তুমি অমৃত দিব্য…" এটি সত্যিই AI এর মতো শোনাচ্ছে না, বরং লন্ডনের একটি থিয়েটারে অভিনয় করা একজন মঞ্চ অভিনেতার মতো।

এই ভয়েস মডেলটিতে মোট পাঁচটি ভয়েস চালু করা হয়েছিল, যার মধ্যে রয়েছে সাল, লাইভ সম্প্রচারের শুরুতে "সিনেমার মতো ট্রেলার পুরুষ ভয়েস" এবং ইভ, যা কম বিলম্ব, স্বাভাবিক বিরতি, মানসিক উত্থান-পতন ইত্যাদি সমর্থন করে।

ChatGPT ভয়েসের সাথে একটি তুলনামূলক প্রদর্শনীও সাইটের ব্যবস্থা করা হয়েছিল, যেখানে দু'জন পালা করে সংখ্যার পুনরাবৃত্তি করে। ChatGPT মাঝে মাঝে প্রশ্নের "উত্তর" দেয়, কিছুটা সহপাঠীর মতো যে কথোপকথনটি স্পষ্টভাবে না শুনেই গ্রহণ করেছিল। গ্রোকের কর্মক্ষমতা মসৃণ ছিল, মানুষের কথা বলার অভ্যাসের কাছাকাছি, এবং এটি ব্যবহারকারীকে বাধা দেবে না।

সংবাদ সম্মেলনে, এটি উল্লেখ করা হয়েছিল যে ভয়েস মডেলটি চালু হওয়ার পর থেকে গ্রোক ভয়েসের এন্ড-টু-এন্ড লেটেন্সি দুই গুণ কমানো হয়েছে এবং সক্রিয় ব্যবহারকারীর সংখ্যা 10 গুণ বেড়েছে। Grok ভয়েস দ্রুত বিকশিত হয়.

কস্তুরী: অর্থ উপার্জনের জন্য গ্রোককে এক মিলিয়ন ভেন্ডিং মেশিন খুলতে দিন

আমি Grok 4 API এর বেশ কয়েকটি অ্যাপ্লিকেশন পরিস্থিতি দ্বারা খুব প্রভাবিত হয়েছিলাম।

উদাহরণস্বরূপ, একটি ভেন্ডিং মেশিন ব্যবসায়িক সিমুলেশন ভেন্ডিং-বেঞ্চে, Grok-কে স্বাধীনভাবে সম্পূর্ণ করতে হবে: সরবরাহকারীর আলোচনা, ইনভেন্টরি ম্যানেজমেন্ট, মূল্য নির্ধারণের কৌশল, এবং সেগুলি ক্রমাগত সম্পূর্ণ করা এবং দীর্ঘমেয়াদে লাভজনকতা বজায় রাখা।

▲দ্রষ্টব্য: ভেন্ডিং-বেঞ্চ হল একটি বেঞ্চমার্ক যা বিশেষভাবে LLM-ভিত্তিক এজেন্টদের একটি সহজ কিন্তু দীর্ঘমেয়াদী ব্যবসায়িক পরিস্থিতি পরিচালনা করার ক্ষমতা পরীক্ষা করার জন্য ডিজাইন করা হয়েছে: একটি ভেন্ডিং মেশিন পরিচালনা করা।

পরীক্ষার ফলাফল দেখায় যে Grok 4 শুধুমাত্র তালিকার শীর্ষে নয়, অন্যান্য মডেলের তুলনায় দ্বিগুণ নেট সম্পদ অর্জন করেছে। এমনকি মাস্ক কৌতুক করতে শুরু করেছিলেন যে "ভবিষ্যতে গ্রাফিক্স কার্ড কেনার অর্থ Grok এক মিলিয়ন ভেন্ডিং মেশিন স্থাপন এবং পরিচালনা করে ফেরত পেতে পারে।"

বৈজ্ঞানিক গবেষণার ক্ষেত্রে, Grok 4 ব্যবহার করা হয়েছে CRISPR জিন গবেষণা এবং বুকের এক্স-রে বিশ্লেষণে। এটি কয়েক সেকেন্ডের মধ্যে লক্ষ লক্ষ পরীক্ষামূলক রেকর্ড এবং লগ পড়তে পারে এবং স্বয়ংক্রিয়ভাবে সবচেয়ে সম্ভাব্য অনুমানগুলিকে স্ক্রীন করতে পারে।

এছাড়াও, অর্থ এবং গেম ডেভেলপমেন্টের মতো প্রকল্পগুলিকে xAI API-এর মাধ্যমে Grok 4 ব্যবহার করে বাস্তবায়িত করা যেতে পারে। সংবাদ সম্মেলনে একজন গেম ডিজাইনারকে বিশেষভাবে উল্লেখ করা হয়। xAI Grok 4 প্রিভিউ API প্রকাশ করার পর, তিনি অবিলম্বে পরীক্ষায় অংশগ্রহণ করেন। তারপর, তিনি মাত্র 4 ঘন্টার মধ্যে একটি প্রথম ব্যক্তি শ্যুটার গেম তৈরি করেছিলেন।

Grok 4 শেষ হয় না. প্রেস কনফারেন্স অবশেষে পরবর্তী রোডম্যাপ ঘোষণা করেছে এবং প্রতিটি আইটেম অপেক্ষা করার মতো।

  • কোড মডেল: Grok কোড এই সময় প্রকাশ করা হয়নি, কিন্তু xAI উল্লেখ করেছে যে এটি বর্তমানে প্রশিক্ষিত হচ্ছে এবং একটি "দ্রুত এবং স্মার্ট" কোড মডেল কয়েক সপ্তাহের মধ্যে চালু করা হবে।
  • মাল্টিমোডাল ক্ষমতা: Grok 4 এর এখনও চিত্র বোঝার ক্ষেত্রে সীমিত কর্মক্ষমতা রয়েছে। দলটি আরও বলেছে যে তারা পরবর্তী সংস্করণটি বৃহত্তর স্কেলে প্রশিক্ষণ দিচ্ছে এবং এটি চিত্র, ভিডিও এবং অডিও বোঝার গুণগত পরিবর্তনের সূচনা করবে বলে আশা করা হচ্ছে। ততক্ষণে, গ্রোক "মানুষের মতো পৃথিবী দেখতে" সক্ষম হবে।
  • ভিডিও জেনারেশন: xAI বলেছে যে এটি ভিডিও জেনারেশন মডেলদের প্রশিক্ষণের জন্য বড় আকারের কম্পিউটিং রিসোর্স ব্যবহার করবে। তাদের চূড়ান্ত লক্ষ্য হল ছবি থেকে ভিডিও তৈরি করা এবং ইন্টারেক্টিভ "অন্তহীন ভিডিও স্ট্রীম" তৈরি করা যাতে ব্যবহারকারীরা প্লট দেখতে এবং অংশ নিতে পারে।

আপনারা অনেকেই হয়তো লক্ষ্য করেছেন যে এই সম্মেলনে দুটি পরিচিত চীনা মুখ রয়েছে। তারা হল xAI-এর সহ-প্রতিষ্ঠাতা – জিমি বা এবং ইউহুয়াই উ।

তাদের মধ্যে, ইউহুয়াই উ কানাডার ইউনিভার্সিটি অফ নিউ ব্রান্সউইক থেকে সম্পূর্ণ ক্রেডিট সহ স্নাতক হন এবং পিএইচডি লাভ করেন। 2021 সালে টরন্টো বিশ্ববিদ্যালয় থেকে মেশিন লার্নিংয়ে। এই সময়ের মধ্যে, তিনি "গভীর শিক্ষার জনক" জিওফ্রে হিন্টনের অধীনে অধ্যয়ন করেছিলেন।

তার ডক্টরেট অধ্যয়নের সময়, তিনি গুগল ডিপমাইন্ড এবং ওপেনএআই-এ ইন্টার্ন করেছেন। স্নাতক হওয়ার পর, তিনি গুগলে কাজ করেন এবং স্ট্যানফোর্ড বিশ্ববিদ্যালয়ে পোস্টডক্টরাল গবেষণা পরিচালনা করেন।

উ ইউহুয়াই এর গবেষণা শক্তিশালী যুক্তি ক্ষমতা সহ কৃত্রিম বুদ্ধিমত্তা সিস্টেম নির্মাণের উপর দৃষ্টি নিবদ্ধ করে। তিনি স্ব-প্রশিক্ষণের যুক্তি মডেল স্টার, ভাষার মডেল মিনার্ভা এবং আলফা জ্যামিতির উপপাদ্যের মতো প্রকল্পগুলিতে নেতৃত্ব দিয়েছেন বা অংশগ্রহণ করেছেন। তিনি নেচারের মতো শীর্ষ জার্নালে গবেষণাপত্রও প্রকাশ করেছেন, গাণিতিক যুক্তির ক্ষেত্রে এআই-এর অগ্রগতি প্রচার করে।

▲ উ ইউহুয়াই (বাম থেকে দ্বিতীয়) এবং জিমি বা (বাম থেকে তৃতীয়)

তার পাশে বসে আছেন জিমি বা, টরন্টো বিশ্ববিদ্যালয়ের কম্পিউটার সায়েন্স বিভাগের একজন সহকারী অধ্যাপক এবং ডক্টরেট অধ্যয়নের সময় উ ইউহুয়াইয়ের একজন পরামর্শদাতা।

তিনি হিন্টনের স্কুল থেকেও এসেছেন এবং গভীর শিক্ষার প্রশিক্ষণ অপ্টিমাইজেশানের ক্ষেত্রে একজন গুরুত্বপূর্ণ ব্যক্তিত্ব।

তিনি অ্যাডাম অপটিমাইজার (অ্যাডাপ্টিভ মোমেন্ট এস্টিমেটর) এর জন্য সর্বাধিক পরিচিত যা তিনি এবং তার সহযোগীরা প্রস্তাব করেছিলেন, যা এখন গভীর নিউরাল নেটওয়ার্ক প্রশিক্ষণের জন্য প্রায় ডিফল্ট অ্যালগরিদম। এটা বলা যেতে পারে যে তার ডক্টরাল থিসিস আধুনিক এআই প্রশিক্ষণ প্রক্রিয়ার জন্য একটি দৃঢ় তাত্ত্বিক ভিত্তি স্থাপন করেছে।

এটা বলতে হবে যে গোর্ক 4 সঠিক সময়ে পৌঁছেছে।

পূর্ববর্তী প্রজন্মের Grok 3 এর জনপ্রিয়তা দ্রুত এসেছিল, কিন্তু দ্রুত বিবর্ণ হয়ে যায়।

9 মে পর্যন্ত সুপরিচিত বাজার বিশ্লেষণ সংস্থা SimilarWeb দ্বারা প্রকাশিত "গ্লোবাল জেনারেটিভ এআই ইন্ডাস্ট্রি ট্রেন্ড রিপোর্ট 2025" অনুসারে, মার্চ মাসে গ্রোকের ট্র্যাফিক 1 মিলিয়নেরও বেশি বার বেড়েছে, কিন্তু মে মাসে বৃদ্ধির হার 5,200% এ ফিরে এসেছে।

পূর্ববর্তী প্রজন্মের সাথে তুলনা করে, যা দ্রুত চালু এবং সম্পন্ন করা হয়েছিল, এবার Grok 4 স্পষ্টতই এর গতি কমিয়ে দিয়েছে এবং পণ্য পলিশিংয়ে আরও বেশি প্রচেষ্টা করেছে। চূড়ান্ত বিশ্লেষণে, মাস্কের হ্যালো ট্র্যাফিকের প্রথম তরঙ্গ আনতে গ্রোককে সাহায্য করতে পারে, তবে এটি ব্যবহারকারীদের ধরে রাখতে পারে কিনা তা নির্ভর করে মডেলের কঠোর শক্তির উপর।

যাইহোক, যদি আমি সঠিকভাবে মনে করি, মাস্ক যখন Grok 3 প্রকাশ করেছিলেন, তখন তিনি Grok 2 ওপেন সোর্স করার প্রতিশ্রুতি দিয়েছিলেন। পাঁচ মাস অতিবাহিত হয়েছে, কিন্তু এই বিষয়ে কোন অগ্রগতি হয়নি, এবং কেউ প্রেস কনফারেন্সে এটি উল্লেখ করেনি।

বুড়ো মা, আপনি নিজের সাথে খুব বেশি নম্র হতে পারেন না এবং অন্যদের সাথে কঠোর হতে পারেন না।

লেখক: ঝাং জিহাও, মো চংইউ

#iFanr: iFanr (WeChat ID: ifanr) এর অফিসিয়াল WeChat পাবলিক অ্যাকাউন্ট অনুসরণ করতে স্বাগতম, যেখানে যত তাড়াতাড়ি সম্ভব আরও উত্তেজনাপূর্ণ বিষয়বস্তু আপনার কাছে উপস্থাপন করা হবে।

iFanr | মূল লিঙ্ক · মন্তব্য দেখুন · সিনা ওয়েইবো