স্ট্যানফোর্ড দলটি সিংহুয়া বিশ্ববিদ্যালয় থেকে একটি বড় মডেলের চুরি করেছে এবং গভীর রাতে ক্ষমা চেয়েছে।

কিছু সময় আগে, স্ট্যানফোর্ড ইউনিভার্সিটি আর্টিফিশিয়াল ইন্টেলিজেন্স ইনস্টিটিউট (স্ট্যানফোর্ড এইচএআই) একটি প্রতিবেদন প্রকাশ করে যে মার্কিন যুক্তরাষ্ট্র বড় মডেলের ক্ষেত্রে অনেক এগিয়ে রয়েছে। প্রতিবেদনে উল্লেখ করা হয়েছে যে 2023 সালে 61টি সুপরিচিত কৃত্রিম বুদ্ধিমত্তা মডেল মার্কিন প্রতিষ্ঠান থেকে এসেছে, যা ইউরোপীয় ইউনিয়নের 21টি এবং চীনে 15টি ছাড়িয়ে গেছে।

ওপেনএআই-এর প্রাথমিক বিনিয়োগকারী বিনোদ খোসলাও গত বছর X-তে একটি নিবন্ধ প্রকাশ করেছিলেন যে আমেরিকান ওপেন সোর্স মডেলগুলি চীন দ্বারা অনুলিপি করা হবে।

যাইহোক, যে বৃহৎ দেশীয় মডেলটিকে সর্বদা "মার্কিন যুক্তরাষ্ট্রের সাথে ধরা" বলে মনে করা হয় তা এখন চুরির লক্ষ্যবস্তুতে পরিণত হয়েছে এবং চুরি করা এআই দলটি স্ট্যানফোর্ড ইউনিভার্সিটির, যেটি উপরের প্রতিবেদনটি প্রকাশ করেছে।

স্ট্যানফোর্ড এআই টিমের নেতৃত্বে Llama3-V ওপেন সোর্স মডেলটি সিংহুয়া বিশ্ববিদ্যালয় এবং ওয়াল-ফেসিং ইন্টেলিজেন্সের গার্হস্থ্য ওপেন সোর্স মডেল "লিটল স্টিল ক্যানন" MiniCPM-Llama3-V 2.5 চুরি করার সন্দেহজনক বলে মনে করা হয়েছিল, যা তাত্ক্ষণিকভাবে আলোড়ন সৃষ্টি করেছিল। এআই সার্কেলে।

আসল হাতুড়ির নীচে, স্ট্যানফোর্ড দলকেও জরুরিভাবে ক্ষমা চাইতে হয়েছিল।

ওয়াল-ফেসিং ইন্টেলিজেন্সের সিইও লি ডাহাই রসিকতার সাথে প্রতিক্রিয়া জানিয়েছিলেন, এটি একটি "আন্তর্জাতিক দল দ্বারা স্বীকৃত পদ্ধতি।" আমরা শীর্ষ বড় মডেল থেকে যতই দূরে থাকি না কেন, দেশীয় বড় মডেলগুলি এমন একটি পর্যায়ে পৌঁছেছে যেখানে তাদের আর উপেক্ষা করা যায় না।

চলুন সংক্ষেপে টাইমলাইনটি তুলে ধরা যাক:

  • স্ট্যানফোর্ড এআই টিম Llama3-V প্রকাশ করেছে, যা SOTA মাল্টি-মোডাল বড় মডেল হিসাবে পরিচিত
  • নেটিজেনরা প্রশ্ন করেছেন যে মডেলটি ঘরোয়া প্রাচীর-মুখী স্মার্ট MiniCPM-Llama3-V2.5 অনুলিপি করেছে
  • প্রশ্নবিদ্ধ প্রমাণ আবির্ভূত হয়েছে, Llama3-V লেখক "ডাটাবেস মুছে ফেলা এবং পালিয়ে যাওয়া" মঞ্চস্থ করেছেন
  • ফেস ওয়াল ইন্টেলিজেন্স অফিসিয়াল চৌর্যবৃত্তি, গভীর রাতে একটি বিবৃতি জারি
  • Llama3-V লেখক আনুষ্ঠানিকভাবে ক্ষমাপ্রার্থী, নেটিজেনদের বিভিন্ন মতামত আছে

প্রাচীরমুখী বুদ্ধিমান "ছোট ইস্পাত কামান" চুরি করে, স্ট্যানফোর্ড এআই দল "ডাটাবেস মুছুন এবং পালিয়ে যান" মঞ্চস্থ করে

সম্প্রতি, একটি স্ট্যানফোর্ড এআই টিম ঘোষণা করেছে যে GPT-4V-কে ছাড়িয়ে যাওয়া একটি SOTA মাল্টি-মডেল বড় মডেলের প্রশিক্ষণ দিতে এটির খরচ মাত্র $500৷

কিন্তু শীঘ্রই, একজন X ব্যবহারকারী @yangzhizheng1 উল্লেখ করেছেন যে এই প্রকল্পে ব্যবহৃত মডেলের কাঠামো এবং কোড আশ্চর্যজনকভাবে ওয়ালফেস ইন্টেলিজেন্স দ্বারা প্রকাশিত MiniCPM-Llama3-V2.5-এর মতো।

এই লক্ষ্যে, X ব্যবহারকারী @yangzhizheng1 সংশ্লিষ্ট প্রশ্নমূলক প্রমাণও প্রকাশ করেছে।

প্রমাণ এক:

Llama3-V এবং MiniCPM-Llama3-V 2.5-এর মডেল গঠন এবং কোড প্রায় অনুরূপ কপি-পেস্ট স্তরের পার্থক্য সম্ভবত তারা ন্যস্ত পরিবর্তন করেছে – পরিবর্তনশীল নাম পরিবর্তন করা হয়েছে।

এটা একই পোষাক মত, কিন্তু বিভিন্ন রঙের বোতাম সঙ্গে আপনি এটা একটি কাকতালীয়?

প্রমাণ দুই:

যখন Llama3-V-এর লেখকদের জিজ্ঞাসা করা হয়েছিল যে তারা কেন MinicPM-Llama3-V2.5 টোকেনাইজার ব্যবহার করতে পারে যা এখনও আগে থেকে প্রকাশিত হয়নি, তারা ব্যাখ্যা করেছিল যে তারা ওয়াল-ফেসিং-এর পূর্ববর্তী প্রজন্মের MinicPM-V-2 প্রকল্প ব্যবহার করছে। বুদ্ধিমত্তা।

যাইহোক, কিছু মিডিয়া ওয়ালফেস ইন্টেলিজেন্স আধিকারিকদের কাছ থেকে নিশ্চিতকরণ চেয়েছে, HuggingFace-এ MiniCPM-V2 এবং MiniCPM-Llama3-V 2.5 শব্দ সেগমেন্টারগুলি যথাক্রমে দুটি ফাইল এবং ফাইলের আকার সম্পূর্ণ আলাদা৷

আরও কি, MiniCPM-Llama3-V 2.5 এর টোকেনাইজারটি Llama3 টোকেনাইজার এবং MiniCPM-V সিরিজের মডেলের বিশেষ টোকেন দ্বারা গঠিত।

MiniCPM-V2 Llama3 এর আগে প্রকাশ করা হয়েছিল তা বিবেচনা করে, এটির পক্ষে Llama3 টোকেনাইজার প্রযুক্তি অন্তর্ভুক্ত করা তাত্ত্বিকভাবে অসম্ভব যা এখনও প্রকাশ করা হয়নি।

প্রমাণ তিন:

এর চেয়েও আপত্তিকর বিষয় হল যে llama3-V প্রকল্পের লেখক যখন ব্যবহারকারীদের সন্দেহের সম্মুখীন হন এবং দেখেন যে কিছু ভাল হচ্ছে না, তখন তিনি কেবল "লাইব্রেরি মুছে ফেলা এবং পালিয়ে যাওয়ার" একটি ভাল অনুষ্ঠান মঞ্চস্থ করেছিলেন।

এমনকি গিটহাবের প্রজেক্ট পেজটিও মুছে ফেলা হয়েছে, যাকে প্রতারণামূলক সংস্করণ 2.0 বলা যেতে পারে।

আলিঙ্গন মুখের ঠিকানাটি বর্তমানে, যখন আমরা পৃষ্ঠাটি খুলি, আমরা কেবল "404" দেখতে পাব।

https://huggingface.co/mustafaaljadery/llama3v/commit/3bee89259ecac051d5c3e58ab619e3fafef20ea6

এটি এখনও শেষ হয়নি, আরও প্রমাণ বেরিয়ে আসছে:

X ব্যবহারকারী @yangzhizheng1 বলেছেন যে যদি MiniCPM-Llama3-V 2.5 এর চেকপয়েন্টে গাউসিয়ান শব্দ (একটি স্কেলার দ্বারা প্যারামিটারাইজড) যোগ করা হয়, ফলস্বরূপ মডেলটি Llama3-V এর মতো একই ছাঁচ থেকে খোদাই করা হবে।

শুধু তাই নয়, এই মডেলটি ওয়ারিং স্টেটস পিরিয়ডের গভীর প্রাচীন লেখাগুলিকেও চিনতে পারে যেমন "সিংহুয়া স্লিপস" এবং ওয়াল-ফেসিং ইন্টেলিজেন্সের অফিসিয়াল ভাষায় ত্রুটিগুলি ঠিক একই রকম:

তারা শুধু সঠিক নয়, তারা ভুলও।

আপনি অবশ্যই জানেন যে এই প্রাচীন লেখার তথ্যটি স্ক্যানিং এবং ম্যানুয়ালি টিসিংহুয়া ইউনিভার্সিটি দ্বারা সংগৃহীত টীকা দ্বারা প্রাপ্ত করা হয়েছিল, এটি কখনও প্রকাশ করা হয়নি।

তাহলে স্ট্যানফোর্ড এআই দল কীভাবে এটিকে পাতলা বাতাস থেকে বের করে আনল?

এটা বলা যেতে পারে যে ওয়ালফেস ইন্টেলিজেন্সের 2 জুন গভীর রাতের বিবৃতিকে স্ট্যানফোর্ড এআই গবেষণা দলের একটি সম্পূর্ণ চুরি হিসাবে গণ্য করা যেতে পারে।

আজ সকাল পর্যন্ত, Stanford Llama3-V দলের দুই লেখক সিদ্ধার্থ শর্মা এবং অক্ষ গর্গ, সামাজিক প্ল্যাটফর্ম X-এ এই একাডেমিক অসদাচরণের জন্য প্রাচীর-মুখী MiniCPM টিমের কাছে আনুষ্ঠানিকভাবে ক্ষমা চেয়েছেন, বলেছেন যে সমস্ত Llama3-V মডেল মুছে ফেলা হবে৷

বিখ্যাত স্কুলের শীর্ষ ছাত্ররাও কি চুরি করে? চীনের ওপেন সোর্স বড় মডেলগুলি ধরছে

এই বিষয়টি ইন্টারনেটে আলোড়ন সৃষ্টি করার একটি গুরুত্বপূর্ণ কারণ হ'ল চুরিকারীর পটভূমি এত গ্ল্যামারাস।

জনসাধারণের তথ্য দেখায় যে সিদ্ধার্থ শর্মা এবং অক্ষ গর্গ উভয়েই স্ট্যানফোর্ড ইউনিভার্সিটির কম্পিউটার সায়েন্স বিভাগের স্নাতক ছাত্র এবং মেশিন লার্নিং ক্ষেত্রে অনেক কাগজপত্র প্রকাশ করেছেন। তাদের মধ্যে, সিদ্ধার্থ শর্মা একটি নির্দিষ্ট সময়ের জন্য অ্যামাজনে ইন্টার্ন করেছেন এবং বর্তমানে প্রধানত এআই এবং ডেটা-সম্পর্কিত কাজে নিযুক্ত রয়েছেন।

স্পেসএক্স, স্ট্যানফোর্ড ইউনিভার্সিটি এবং ক্যালিফোর্নিয়া ইনস্টিটিউট অফ টেকনোলজির মতো সুপরিচিত সংস্থাগুলিকে কভার করে অক্ষ গর্গের ইন্টার্নশিপ জীবনবৃত্তান্ত সমৃদ্ধ৷

মুস্তাফা আলজাদেরির জন্য, যাকে উপরে উল্লিখিত দুই লেখক দ্বারা "কোড পোর্টার" বলা হয়, তিনি জনমতের পর, X অ্যাকাউন্টটি ব্যক্তিগত মর্যাদায় সেট করা হয়েছে।

তীক্ষ্ণ দৃষ্টিসম্পন্ন নেটিজেনরা স্ট্যানফোর্ড লামা 3-ভি দলের ক্ষমা চাওয়ার বিবৃতি গ্রহণ করেনি।

উদাহরণস্বরূপ, দ

স্ট্যানফোর্ড এআই ল্যাবরেটরির ডিরেক্টর ক্রিস্টোফার ডেভিড ম্যানিংও এই চুরির নিন্দা করতে দাঁড়িয়েছেন এবং মিনিসিপিএমের প্রশংসা করেছেন, একটি চমৎকার চীনা ওপেন সোর্স মডেল।

যাইহোক, এমন কিছু নেটিজেনও আছেন যারা "অন্যদেরকে ক্ষমা করতে হবে যখন তাদের করুণা করতে হবে" মনোভাব পোষণ করেন এবং তাদের অবসরে উৎসাহিত করেন:

প্রযুক্তি জগতে উন্মুক্ততা এবং সততা অত্যন্ত গুরুত্বপূর্ণ মূল্যবোধ, এবং আমি আপনার নতুন কাজের অপেক্ষায় আছি।

গুগল ডিপমাইন্ড গবেষক লুকাস বেয়ার বলেছেন যে চীনের ওপেন সোর্স বড় মডেলগুলিতে MiniCPM এর মতো ভাল মডেল রয়েছে, তবে আন্তর্জাতিক সম্প্রদায় তাদের যথেষ্ট মনোযোগ দেয়নি …

ওয়াল-ফেসিং ইন্টেলিজেন্স টিমও গতকাল এ বিষয়ে প্রতিক্রিয়া জানিয়েছে।

ফেসওয়াল ইন্টেলিজেন্সের সিইও লি ডাহাই বলেছেন: "প্রযুক্তিগত উদ্ভাবন সহজ নয়। প্রতিটি কাজই দলের দিনরাত প্রচেষ্টার ফল এবং সীমিত কম্পিউটিং ক্ষমতা সহ বিশ্বব্যাপী প্রযুক্তিগত অগ্রগতি এবং উদ্ভাবনী উন্নয়নে আন্তরিক অবদানের ফল।

আমরা আশা করি যে দলের ভাল কাজগুলি আরও বেশি লোকের দ্বারা লক্ষ্য করা এবং স্বীকৃত হবে, তবে এভাবে নয়। "

ওয়াল-ফেসিং ইন্টেলিজেন্সের প্রধান বিজ্ঞানী লিউ ঝিউয়ানও ঝিহুতে পোস্ট করেছেন, বলেছেন যে এই ঘটনাটি অন্য দৃষ্টিকোণ থেকে চীনের উদ্ভাবনী অর্জনের আন্তর্জাতিক প্রভাবকে প্রমাণ করেছে, ওপেন সোর্স শেয়ারিংয়ের গুরুত্ব এবং মৌলিকতার চেতনার প্রতি শ্রদ্ধার উপর জোর দিয়েছে।

এটা বলতে হবে যে এআই সার্কেলের এই চুরির নাটকটি একটি পাঠ্যপুস্তক ব্যাখ্যা "উদ্ভাবন সহজ নয়, এটি অবশ্যই করা উচিত এবং লালন করা উচিত, একাডেমিক সততা প্রত্যেকের দায়িত্ব।"

আপনি জানেন, যদি আপনি কোডের আকৃতি অনুকরণ করেন, আপনি আসল অনুগ্রহ অনুলিপি করতে পারবেন না।

প্রকৃতপক্ষে, গত বছর থেকে, চীনের বড় মডেলগুলি বসন্তের বৃষ্টির পরে মাশরুমের মতো উন্মুক্ত হয়েছে তারা সুবিধাভোগী থেকে অবদানকারীতে রূপান্তরিত হয়েছে এবং বিশ্বকে আরও অসামান্য ওপেন সোর্স ফলাফল প্রদানে কৃপণ নয়।

আলিবাবা এবং টেনসেন্টের মতো জায়ান্ট থেকে শুরু করে প্রাচীর-মুখী বুদ্ধিমত্তা, ঝিপু এআই এবং কুনলুন তিয়াংগং-এর মতো এআই স্টার্ট-আপগুলিও ওপেন সোর্স সম্প্রদায়ের সক্রিয় সদস্য, যা চীনের বড় আকারের মডেলগুলির বিকাশে অবদান রাখছে।

আমরা আশা করি যে খোলামেলা এবং ভাগ করে নেওয়ার এই বসন্তের হাওয়া আরও শক্তিশালী হবে।

ঠিক যেমন লি ডাহাই, ফেস ওয়াল ইন্টেলিজেন্সের সিইও, একটি উন্মুক্ত, সহযোগিতামূলক এবং বিশ্বস্ত সম্প্রদায়ের পরিবেশ তৈরি করতে সবাইকে একসঙ্গে কাজ করার আহ্বান জানিয়েছেন৷ শুধুমাত্র একসাথে কাজ করলেই AGI এর আগমনের সাথে বিশ্ব একটি ভাল জায়গা হয়ে উঠতে পারে!

# aifaner এর অফিসিয়াল WeChat পাবলিক অ্যাকাউন্ট অনুসরণ করতে স্বাগতম: aifaner (WeChat ID: ifanr) যত তাড়াতাড়ি সম্ভব আপনাকে আরও উত্তেজনাপূর্ণ সামগ্রী সরবরাহ করা হবে।

Ai Faner | মূল লিঙ্ক · মন্তব্য দেখুন · Sina Weibo