# Топовые работы на ICLR 2025

DevFeed: [Топовые работы на ICLR 2025](<https://devfeed.tech/articles/iclr-2025-24018.md>)

Original publisher: [Read original article](<https://habr.com/ru/companies/redmadrobot/articles/911228/>)

Author: redmadrobot (red\_mad\_robot)

Published: 2025-05-20T17:20:00Z

Content type: article

Language: ru

Sources: [Redmadrobot EN](<https://devfeed.tech/sources/redmadrobot-en.md>), [Redmadrobot RU](<https://devfeed.tech/sources/redmadrobot-ru.md>)

Topics: [Large Language Model](<https://devfeed.tech/topics/llm.md>), [Language models](<https://devfeed.tech/topics/language-models.md>), [Machine Intelligence](<https://devfeed.tech/topics/machine-intelligence.md>), [Learning](<https://devfeed.tech/topics/learning.md>), [Jailbreak](<https://devfeed.tech/topics/jailbreak.md>)

Tags: [2025](<https://devfeed.tech/tags/2025.md>), [ai](<https://devfeed.tech/tags/ai.md>), [alignment](<https://devfeed.tech/tags/alignment.md>), [china](<https://devfeed.tech/tags/china.md>), [conference](<https://devfeed.tech/tags/conference.md>), [dpo](<https://devfeed.tech/tags/dpo.md>), [iclr](<https://devfeed.tech/tags/iclr.md>), [language-models](<https://devfeed.tech/tags/language-models.md>), [llm](<https://devfeed.tech/tags/llm.md>), [ml](<https://devfeed.tech/tags/ml.md>), [safety](<https://devfeed.tech/tags/safety.md>), [science](<https://devfeed.tech/tags/science.md>), [tag-fa773991fb10](<https://devfeed.tech/tags/tag-fa773991fb10.md>), [university](<https://devfeed.tech/tags/university.md>)

## AI overview

This Russian-language article reviews highly rated papers from ICLR 2025 on artificial intelligence and machine learning. It discusses deepening safety alignment to improve resistance to jailbreak attacks, findings about SFT and DPO fine-tuning dynamics, and AlphaEdit, a method for targeted knowledge editing in large language models.

## Source excerpt

Аналитический центр red_mad_robot продолжает обозревать топовые технологические конференции. В этот раз подготовили для вас инсайты с прошедшей в Сингапуре International Conference on Learning Representations (ICLR), посвящённой искусственному интеллекту и машинному обучению. На ICLR 2025 из более 3 тыс. работ наивысшие оценки получили 36 статей, из которых три были отмечены как "outstanding papers". Разберём выдающиеся, достойные упоминания и получившие высокие оценки работы этого года. Читать далее