DeepSeek AI DeepSeek-Prover-V2 প্রকাশ করেছে, একটি গ্রাউন্ডব্রেকিং ওপেন-সোর্স বৃহৎ ভাষার মডেল যা বিশেষভাবে লীন 4 পরিবেশে প্রমাণ করার জন্য আনুষ্ঠানিক উপপাদ্যের জন্য ডিজাইন করা হয়েছে। এই সর্বশেষ পুনরাবৃত্তিটি একটি উদ্ভাবনী পুনরাবৃত্ত উপপাদ্য-প্রমাণকারী পাইপলাইন প্রবর্তন করে পূর্ববর্তী কাজের উপর ভিত্তি করে তৈরি করে, যখন DeepSeek-V3 এর নিজস্ব উচ্চ-মানের বুটস্ট্র্যাপ ডেটা তৈরি করার শক্তি ব্যবহার করে। ফলস্বরূপ মডেলটি স্নায়ু উপপাদ্য প্রমাণে উন্নত কর্মক্ষমতা অর্জন করে এবং এর সাথে প্রোভারবেঞ্চের প্রবর্তন, গাণিতিক যুক্তির ক্ষমতা মূল্যায়নের জন্য একটি নতুন বেঞ্চমার্ক।
অগ্রণী কোল্ড স্টার্ট ডেটা জেনারেশন
DeepSeek-Prover-V2-এর একটি মূল উদ্ভাবন এর অনন্য কোল্ড-স্টার্ট প্রশিক্ষণ পদ্ধতির মধ্যে রয়েছে। এই প্রক্রিয়াটি শুরু হয় শক্তিশালী ডিপসিক-ভি3 মডেলকে জটিল গাণিতিক বাক্যগুলিকে পরিচালনাযোগ্য উপগোলগুলির একটি সিরিজে ভেঙে ফেলার নির্দেশ দিয়ে। একই সময়ে, DeepSeek-V3 লীন 4-এ এই উচ্চ-স্তরের প্রমাণ পদক্ষেপগুলিকে প্রাতিষ্ঠানিক করে তোলে, কার্যকরভাবে উপ-সমস্যাগুলির একটি কাঠামোগত ক্রম তৈরি করে।
প্রতিটি উপগোলের জন্য গণনামূলকভাবে নিবিড় প্রমাণ অনুসন্ধান পরিচালনা করতে, গবেষকরা একটি ছোট 7B প্যারামিটার মডেল ব্যবহার করেছেন। একবার একটি চ্যালেঞ্জিং সমস্যার সমস্ত পচনশীল পদক্ষেপ সফলভাবে প্রমাণিত হলে, সম্পূর্ণ ধাপে ধাপে আনুষ্ঠানিক প্রমাণটি DeepSeek-V3-এর চিন্তার যুক্তির সমান্তরাল চেইনের সাথে যুক্ত করা হয়। এই বুদ্ধিমান পদ্ধতিটি মডেলটিকে একটি সংশ্লেষিত ডেটা সেট থেকে শেখার অনুমতি দেয় যা অনানুষ্ঠানিক উচ্চ-স্তরের গাণিতিক যুক্তি এবং কঠোর আনুষ্ঠানিক প্রমাণ উভয়কে একত্রিত করে, যা পরবর্তী শক্তিবৃদ্ধি শেখার জন্য একটি শক্তিশালী ঠান্ডা শুরু প্রদান করে।
উন্নত যুক্তির জন্য শক্তিবৃদ্ধি শিক্ষা
কোল্ড স্টার্ট সিন্থেটিক ডেটার উপর ভিত্তি করে, ডিপসিক টিম চ্যালেঞ্জিং সমস্যাগুলির একটি নির্বাচন করেছে যা 7B প্রমাণকারী মডেলটি শেষ থেকে শেষ পর্যন্ত সমাধান করতে পারেনি, কিন্তু যার জন্য সমস্ত উপ-উদ্দেশ্য সফলভাবে সমাধান করা হয়েছে। এই উপগোলগুলির আনুষ্ঠানিক প্রমাণগুলিকে একত্রিত করে, মূল সমস্যাটির একটি সম্পূর্ণ প্রমাণ তৈরি করা হয়। এই আনুষ্ঠানিক প্রমাণটি তখন DeepSeek-V3 এর চিন্তাধারার সাথে যুক্ত হয় যা লেমা পচন বর্ণনা করে, আনুষ্ঠানিককরণের পরে অনানুষ্ঠানিক যুক্তির একীভূত প্রশিক্ষণ উদাহরণ তৈরি করে।
প্রুফ মডেলটি তারপর এই সিন্থেটিক ডেটার উপর সূক্ষ্ম সুর করা হয়, তারপরে একটি শক্তিবৃদ্ধি শেখার পর্যায় হয়। এই ধাপটি পুরষ্কার সংকেত হিসাবে বাইনারি সত্য বা মিথ্যা প্রতিক্রিয়া ব্যবহার করে, অনানুষ্ঠানিক গাণিতিক অন্তর্দৃষ্টি এবং আনুষ্ঠানিক প্রমাণগুলির সুনির্দিষ্ট নির্মাণের মধ্যে ব্যবধান পূরণ করার মডেলের ক্ষমতাকে আরও পরিমার্জিত করে।
অত্যাধুনিক পারফরম্যান্স
এই উদ্ভাবনী প্রশিক্ষণ প্রক্রিয়ার সমাপ্তি হল DeepSeek-Prover-V2–671B, একটি মডেল যা 671 বিলিয়ন প্যারামিটার নিয়ে গর্ব করে। এই মডেলটি অসাধারণ ফলাফল অর্জন করেছে, নিউরাল থিওরেম প্রমাণে অত্যাধুনিক কর্মক্ষমতা প্রদর্শন করেছে। এটি একটি চিত্তাকর্ষক পর্যায়ে পৌঁছেছেMiniF2F পরীক্ষায় পাস করার অনুপাত 88.9%এবং সফলভাবে সমাধান করা হয়েছেPutnamBench থেকে 658টি সমস্যার মধ্যে 49টি. miniF2F ডেটাসেটের জন্য DeepSeek-Prover-V2 দ্বারা উত্পন্ন প্রমাণগুলি ডাউনলোডের জন্য সর্বজনীনভাবে উপলব্ধ, আরও পরীক্ষা এবং বিশ্লেষণের অনুমতি দেয়৷

প্রোভারবেঞ্চ প্রবর্তন: মূল্যায়নের জন্য একটি নতুন স্ট্যান্ডার্ড
মডেল প্রকাশের পাশাপাশি, ডিপসিক এআই প্রবর্তন করেছেপ্রোভারবেঞ্চসামগ্রিক বেঞ্চমার্কের একটি নতুন ডেটাসেট325 সমস্যা. এই বেঞ্চমার্কের উদ্দেশ্য হল অসুবিধার বিভিন্ন স্তর জুড়ে গাণিতিক চিন্তা করার ক্ষমতার আরও ব্যাপক মূল্যায়ন।
প্রোভারবেঞ্চ সহসাম্প্রতিক AIME (আমেরিকান ইনভাইটেশন টু ম্যাথমেটিক্স) প্রতিযোগিতা থেকে 15টি সমস্যা যোগ করা হয়েছে (AIME 24 এবং 25)উচ্চ বিদ্যালয় প্রতিযোগিতার স্তরে খাঁটি চ্যালেঞ্জ প্রদান। অবশিষ্টপাঠ্যপুস্তক বা শিক্ষামূলক টিউটোরিয়ালের উদাহরণ থেকে 310টি সমস্যা তৈরি করা হয়েছেযা বিভিন্ন ক্ষেত্রে বিস্তৃত আনুষ্ঠানিক গাণিতিক সমস্যার একটি বৈচিত্র্যময় এবং শিক্ষাগতভাবে সত্য সংগ্রহ সরবরাহ করে:

ProverBench স্নাতক স্তরে চ্যালেঞ্জিং প্রতিযোগিতার সমস্যা এবং মৌলিক গণিত উভয় বিষয়ে নিউরাল থিওরেম প্রোভারগুলির আরও পুঙ্খানুপুঙ্খ মূল্যায়ন সহজতর করার লক্ষ্য রাখে।
প্রাপ্যতা
ডিপসিক এআই ডিপসিক-প্রোভার-ভি2কে দুটি মডেল আকারে প্রকাশ করে বিভিন্ন কম্পিউটেশনাল রিসোর্স প্রদান করতে: 7B প্যারামিটার মডেল এবং বৃহত্তর 671B প্যারামিটার মডেল। DeepSeek-Prover-V2–671B ডিপসিক-ভি3-বেসের শক্তিশালী ভিত্তির উপর নির্মিত। ছোট DeepSeek-Prover-V2–7Bটি DeepSeek-Prover-V1.5-Base-এ নির্মিত এবং এতে 32K টোকেন পর্যন্ত বর্ধিত প্রসঙ্গ দৈর্ঘ্য রয়েছে, যা এটিকে দীর্ঘ এবং আরও জটিল চিন্তার ক্রম প্রক্রিয়া করার অনুমতি দেয়।
DeepSeek-Prover-V2-এর প্রকাশ এবং ProverBench-এর প্রবর্তন নিউরো-ফরেনসিক প্রমাণের ক্ষেত্রে একটি গুরুত্বপূর্ণ পদক্ষেপকে চিহ্নিত করে৷ একটি রিকার্সিভ প্রুফ-অফ-সাইট পাইপলাইন ব্যবহার করে এবং একটি চ্যালেঞ্জিং নতুন বেঞ্চমার্ক প্রবর্তন করে, ডিপসিক এআই সম্প্রদায়কে আনুষ্ঠানিক গণিতের জন্য আরও পরিশীলিত এবং সক্ষম AI সিস্টেম বিকাশ ও মূল্যায়ন করার ক্ষমতা দেয়।
লিঙ্ক: https://huggingface.co/deepseek-ai/DeepSeek-Prover-V2-671B
The post DeepSeek উন্মোচন করেছে DeepSeek-Prover-V2: রিকার্সিভ প্রুফ সার্চ এবং একটি নতুন বেঞ্চমার্কের সাথে অ্যাডভান্সিং নিউরাল থিওরেম প্রুভিং প্রথম সিঙ্ক করা হয়েছে৷
Source link