வாத மதிப்பீடு என்பது AI மாதிரிகள் மற்ற AI மாதிரிகள் உருவாக்கிய வாதங்களின் வலிமை, செல்லுபடியாக்கம் மற்றும் தரத்தை மதிப்பீடு செய்யும் செயல்முறை. Argumentree.AI இல், ஒவ்வொரு மாதிரியும் (GPT, Claude, Gemini, Grok, Perplexity, மற்றும் பிற) தனித்தனியாக வாதங்களை உருவாக்குகிறது, பின்னர் ஒவ்வொரு மாதிரியிலிருந்து ஒவ்வொரு வாதத்தையும் மதிப்பீடு செய்கிறது. இந்த குறுக்கு மதிப்பீடு ஒரு சரிபார்ப்பு மாடலை உருவாக்குகிறது: அனைத்து மாதிரிகளாலும் உயர்ந்த மதிப்பீடு செய்யப்பட்ட வாதங்களுக்கு அதிக ஒப்புதல் உள்ளது; பல மாதிரிகளால் குறைவாக மதிப்பீடு செய்யப்பட்ட வாதங்கள் சாத்தியமாக பிரச்சினை உள்ளதாகக் குறிக்கப்படுகின்றன. இந்த அமைப்பு மயக்கம், தர்க்க பிழைகள் மற்றும் எந்த ஒரு மாதிரியின் கவனத்தை தவிர்க்கும் பலவீனமான கோரிக்கைகளை பிடிக்கிறது.
வாத மதிப்பீடு AI மாதிரிகள் ஒருவருக்கொருவர் வாதங்களை மதிப்பீடு செய்ய உதவுகிறது. குறுக்கு மாதிரி மதிப்பீடுகள் சுய மதிப்பீடு மற்றும் ஒற்றை மாதிரி கருவிகள் தவறவிடும் பிழைகளை பிடிக்கிறது.
வாத மதிப்பீடு ஒவ்வொரு AI மாதிரியும் மற்ற மாதிரிகளின் ஒவ்வொரு வாதத்தையும் மதிப்பீடு செய்கிறது. உயர்ந்த மதிப்பீடு செய்யப்பட்ட வாதங்களுக்கு அதிக ஒப்புதல் உள்ளது. குறைவாக மதிப்பீடு செய்யப்பட்ட வாதங்கள் மனித மதிப்பீட்டிற்காகக் குறிக்கப்படுகின்றன.
வாத மதிப்பீட்டு அமைப்பு சுயாதீன மதிப்பீட்டை உறுதி செய்யும் கட்டமைக்கப்பட்ட செயல்முறையை பின்பற்றுகிறது:
ஒவ்வொரு AI மாதிரியும் மற்ற மாதிரிகளின் வேலைகளைப் பார்க்காமல் ஒரு ஆராய்ச்சி கேள்விக்கான வாதங்களை உருவாக்குகிறது
ஒவ்வொரு மாதிரியும் மற்ற அனைத்து மாதிரிகளிடமிருந்து அனைத்து வாதங்களையும் பெறுகிறது மற்றும் ஒவ்வொன்றையும் மதிப்பீடு செய்கிறது
மாதிரிகள் அளவுகோல்களில் மதிப்பீடு செய்கின்றன: தர்க்கமான செல்லுபடியாக்கம், ஆதார ஆதரவு, தொடர்பு, ஒத்திசைவு
தனிப்பட்ட மதிப்பீடுகள் ஒவ்வொரு வாதத்திற்கும் ஒரு ஒப்பந்த மதிப்பெணாக இணைக்கப்படுகின்றன
குறைந்த மதிப்பீடு செய்யப்பட்ட வாதங்கள் மனித மதிப்பீட்டிற்காக குறிக்கோளாகக் குறிக்கப்படுகின்றன; உயர்ந்த மதிப்பீடு செய்யப்பட்ட வாதங்கள் நம்பிக்கையைப் பெறுகின்றன
தர்க்கம் சரியாக ஓடுகிறதா? தவறுகள் அல்லது தொடர்பில்லாத வாதங்கள் உள்ளனவா?
கூறுகள் ஆதாரங்களால் ஆதரிக்கப்படுகிறதா? மேற்கோள்கள் உண்மையான மற்றும் தொடர்புடையவையா?
வாதம் கேள்வியை உண்மையில் அணுகுகிறதா?
வாதம் தன்னைத் த contradict செய்கிறதா அல்லது மோதலான கூற்றுகளை உருவாக்குகிறதா?
வித்தியாசமான AI மாதிரிகளுக்கு வித்தியாசமான பயிற்சி தரவுகள், கட்டமைப்புகள் மற்றும் கண்ணூட்டுகள் உள்ளன. GPT ஒரு மயக்கம் உருவாக்கும் போது, Claude அந்த பிழையை "மரபு" செய்யாது - அது அந்த கோரிக்கையை புதியதாக மதிப்பீடு செய்கிறது. இந்த சுயாதீனத்தே குறுக்கு மதிப்பீட்டின் மதிப்பை உருவாக்குகிறது. ஐந்து மாதிரிகள் ஒப்புக்கொண்டால், ஐந்து சுயாதீன மதிப்பீடுகள் ஒரே முடிவுக்கு வந்தன.
GPT, Claude, Gemini, Grok, Perplexity—எல்லாம் ஒருவருக்கொருவர் மதிப்பீடு செய்கின்றன
ஒவ்வொரு வாதமும் அதன் சொந்த ஒப்பந்த மதிப்பீட்டை காட்டுகிறது
வாத மரத்தில் ஒரு பார்வையில் மதிப்பீடுகளைப் பார்க்கவும்
எந்த மாதிரி எந்த மதிப்பீட்டை வழங்கியது என்பதைப் பார்க்கவும், வெறும் சேர்க்கைகள் அல்ல
வாத மதிப்பீடு என்பது AI மாதிரிகள் மற்ற AI மாதிரிகள் உருவாக்கிய வாதங்களின் வலிமை, செல்லுபடியாக்கம் மற்றும் தரத்தை மதிப்பீடு செய்யும் போது ஆகிறது. பல மாதிரி ஆராய்ச்சியில், ஒவ்வொரு மாதிரியும் மற்ற அனைத்து மாதிரிகளிடமிருந்து ஒவ்வொரு வாதத்தையும் மதிப்பீடு செய்கிறது, இது எந்த வாதங்கள் மிக வலிமையானவை மற்றும் எந்தவைகள் சிக்கலானவை என்பதை வெளிப்படுத்தும் ஒரு மாறுபட்ட சரிபார்ப்பு அட்டவணையை உருவாக்குகிறது.
AI மாதிரிகள் வாதங்களை தர்க்கமான செல்லுபடியாக்கம், ஆதார ஆதரவு, கேள்விக்கு தொடர்பு மற்றும் உள்ளக ஒத்திசைவு போன்ற அளவுகோல்களில் மதிப்பீடு செய்கின்றன. ஒவ்வொரு மாதிரியும் ஒரு மதிப்பீட்டை (பொதுவாக 1-5 அல்லது 1-10) வழங்குகிறது மற்றும் அதன் மதிப்பீட்டிற்கான காரணத்தை வழங்கலாம். இந்த மதிப்பீடுகளின் சேர்க்கை வாதத்தின் ஒப்பந்த மதிப்பெண்களை உருவாக்குகிறது.
சுய மதிப்பீடு நம்பகமல்ல, ஏனெனில் AI மாதிரிகள் தங்களின் சொந்த மயக்கங்களை அல்லது தர்க்கமான தவறுகளை கண்டுபிடிக்க முடியாது. மாறுபட்ட மாதிரி மதிப்பீடு வேலை செய்கிறது, ஏனெனில் வித்தியாசமான மாதிரிகளுக்கு வித்தியாசமான குருட்டு புள்ளிகள் உள்ளன—ஒரு மாதிரி செய்யும் தவறுகள் மற்றவர்களால் அடிக்கடி பிடிக்கப்படுகின்றன. மதிப்பீட்டாளர்களின் சுயாதீனத்தே இந்த அமைப்பை செயல்படுத்துகிறது.
பல மாதிரிகளிடமிருந்து குறைந்த மதிப்பீடு ஒரு வாதம் உள்ளடக்கலாம்: ஒரு மயக்கம், தர்க்கமான தவறு, ஆதரிக்கப்படாத கூற்று, அல்லது உண்மையான தவறு. குறைந்த மதிப்பீடு செய்யப்பட்ட வாதங்களை ஆராய்ச்சி அல்லது முடிவெடுக்க பயன்படுத்துவதற்கு முன் மனித மதிப்பீட்டிற்காக குறிக்கோளாகக் குறிக்க வேண்டும்.
இல்லை. AI மதிப்பீடு மனித கவனத்தை முன்னுரிமை அளிக்க உதவும் ஒரு மூன்றாம் கருவியாகும். உயர்ந்த ஒப்பந்த வாதங்கள் செல்லுபடியாக இருக்க வாய்ப்பு அதிகம்; குறைந்த ஒப்பந்த வாதங்களுக்கு மனித சரிபார்ப்பு தேவை. குறிக்கோள் AI-ஆயிரம் தரமான சிக்னல்களுடன் மனித தீர்மானத்தை மேம்படுத்துவது, அதை மாற்றுவது அல்ல.
குறுக்கு மாதிரி மதிப்பீடு பலவீனமான வாதங்களை பிடிக்கிறது மற்றும் வலுவானவற்றில் நம்பிக்கையை உருவாக்குகிறது.
இலவச ஆராய்ச்சியை தொடங்குங்கள்