Mojo.az Banner
20:50 Toyota отзовет более 508 000 автомобилей  |     18:36 В Венгрии избрали нового президента  |     16:46 В Азербайджане более 1 200 должников по алиментам ограничили в выезде  |     13:00 В некоторых районах Азербайджана идут дожди с грозами - ФАКТИЧЕСКАЯ ПОГОДА  |     12:40 В связи с гибелью водителя главы ИВ Загатальского района возбуждено уголовное дело  |     12:33 Возросло число погибших в ДТП в Балакенском районе: скончался глава семьи  |     12:07 В Бразилии человеческие волосы используют для защиты океана  |     12:01 Трамп заявил о полном разминировании Ормузского пролива  |     11:54 В Колумбии приостановили чемпионат страны по футболу  |     11:43 На Филиппинах из-за тропических штормов и муссонных дождей погибли 19 человек  |     11:43 ГУГДП обратилось к участникам дорожного движения  |     11:25 Цена нефти Brent превысила 88 долларов впервые с 31 июля  |     22:29 Азербайджан, США и Армения опубликовали совместное заявление в годовщину саммита в Белом доме  |     21:23 Федерация футбола США призвала к изменениям в управлении ФИФА  |     19:56 Пезешкиан: США просчитались в оценке ситуации в Иране, так как полагались на ИИ  |     19:28 В Шахбузском районе перевернулся автомобиль: погибла 76-летняя женщина  |     17:11 В Стамбуле азербайджанку нашли мёртвой в квартире - ФОТО  |     16:40 Ведущие футбольные федерации призвали к проверке действий Инфантино  |     16:36 В Баку в море утонули две женщины  |     16:25 В Азербайджане произошло землетрясение - ФОТО  |    
Left Banner
Right Banner

DeepSeek анонсировал еще одну революцию в сфере ИИ

08.04.2025 13:02 1 212
DeepSeek анонсировал еще одну революцию в сфере ИИ
Китайский стартап DeepSeek, получивший известность благодаря своей рассуждающей ИИ-модели R1, анонсировал новый метод обучения, обещающий значительное увеличение эффективности искусственного интеллекта. Совместно с исследователями из университета Цинхуа, DeepSeek опубликовал статью, раскрывающую детали инновационного подхода к обучению моделей посредством позитивного подкрепления результата, сообщает Median.Az со ссылкой на издание South China Morning Post.

Разработанный метод нацелен на улучшение соответствия ИИ-моделей человеческим предпочтениям. Он использует механизм вознаграждения, стимулирующий генерацию более точных и понятных ответов. Обучение с подкреплением уже доказало свою пользу в узкоспециализированных задачах, однако его эффективность снижалась при применении к более общим задачам. Команда DeepSeek предложила решение, объединив генеративное моделирование вознаграждения (GRM) с самокритичной настройкой на основе принципов.

Согласно исследованию, новый подход превосходит существующие методы улучшения рассуждающих способностей больших языковых моделей (LLM). Тестирование показало, что модели, обученные с использованием GRM, демонстрируют максимальную производительность при обработке общих запросов, при этом требуя меньших вычислительных ресурсов.

Новые модели получили название DeepSeek-GRM, от аббревиатуры Generalist Reward Modeling (универсальное моделирование вознаграждения). Компания заявила о планах сделать модели с открытым исходным кодом, однако точные сроки релиза пока не объявлены.скачать dle 11.3
Mojo.az Banner