Mojo.az Banner
14:27 DİM sədri: "Ali təhsil müəssisələrinin qəbul planı 97.07% dolub"  |     14:26 Azərbaycana qanunsuz yolla gətirilən 866 qutu qəlyan tütünü aşkarlanıb  |     14:21 Azyaşlının ögey anası tərəfindən zorakılığa məruz qalması faktı araşdırılır  |     13:02 ABŞ tarixində ən böyük kütləvi viza ləğvinə hazırlaşır  |     12:55 Ağdamda sahibkar və şirkət işçisi narkotik vasitə ilə tutulublar  |     12:27 Bakı metrosunun iş rejimi dəyişdiriləcək - SƏBƏB  |     12:19 Bakıda bədbəxt hadisə: Uşaq dəmir barmaqlıqlara ilişərək öldü  |     12:17 Ağdamdakı qətllə bağlı ŞOK İDDİA: Pəncərədən daxil olaraq qayınatasını öldürüb (Yenilənib)  |     12:14 Bakıda piyada keçidində maşınla vurulan kişi öldü  |     12:04 Robert Koçaryanın saxlanılmasının görüntüləri yayıldı - VİDEO (Yenilənib)  |     12:00 Azərbaycan nefti ucuzlaşıb  |     11:54 Oman sahillərində neft tankeri vuruldu  |     11:35 Göygöldə yük avtomobili piyadanı vurub öldürdü  |     11:33 Venesuelada zəlzələ nəticəsində ölənlərin sayı 6 500-ü keçdi  |     11:33 Hər gün banan yemək təhlükəlidir? - Mütəxəssisdən CAVAB  |     11:30 Şəhid anası tələbə adını qazandı  |     11:28 İt burnunu dişlədi, müalicə olunmasa çürüyəcək - Video  |     11:17 Faiz müqabilində borc verənlərə SƏRT XƏBƏRDARLIQ  |     11:13 Qaradağda 45 yaşlı kişini elektrik cərəyanı vuraraq öldürüb  |     23:03 “Windows 11”də donmaların səbəbi bəlli oldu  |    
Left Banner
Right Banner

"DeepSeek" süni intellekt sahəsində daha bir inqilabi yenilik elan etdi

08.04.2025 13:02 1 230
Çinin "R1" modeli ilə tanınan "DeepSeek" startapı süni intellektin effektivliyini əhəmiyyətli dərəcədə artıracaq yeni təlim metodunu elan edib.

Median.Az
-ın "South China Morning Post"a istinadən verdiyi məlumata görə, "DeepSeek" komandası Sinhua Universitetinin tədqiqatçıları ilə birlikdə innovativ yanaşmanın təfərrüatını açıqlayan elmi məqalə dərc ediblər.

İşlənib hazırlanmış metod süni intellekt modellərinin insan seçimlərinə uyğunluğunu yaxşılaşdırmağa yönəlib. O, daha dəqiq və anlaşılan cavabların yaradılmasını stimullaşdıran mükafatlandırma mexanizmindən istifadə edir. Möhkəmləndirici təlim artıq ixtisaslaşmış tapşırıqlarda faydasını sübut edib, lakin daha ümumi tapşırıqlara tətbiq edildikdə onun effektivliyi azalırdı.

"DeepSeek" komandası generativ mükafatlandırma modelləşdirməsini prinsiplərə əsaslanan özünütənqidi tənzimləmə ilə birləşdirən həll təklif edib.

Tədqiqata görə, yeni yanaşma böyük dil modellərinin (LLM) mühakimə qabiliyyətlərini yaxşılaşdırmaq üçün mövcud metodları üstələyir. Testlər göstərib ki, GRM istifadə edərək təlim keçmiş modellər ümumi sorğuların emalında maksimum məhsuldarlıq nümayiş etdirir və eyni zamanda daha az hesablama resursları tələb edir.

Yeni modellər "DeepSeek-GRM" adlandırılıb, bu ad "Generalist Reward Modeling" (universal mükafatlandırma modelləşdirməsi) abbreviaturasından götürülüb. Şirkət modelləri açıq mənbəli etmək planlarını elan edib, lakin dəqiq buraxılış tarixləri hələ açıqlanmayıb.скачать dle 11.3
Mojo.az Banner