P.S. См. также другие публикации по теме adversarial, посвященные устойчивому машинному обучению
технические проблемы и идеи, родившиеся в бурных водах реки Abava (а равно как и на ее берегах, далеких и близких), выставленные на всеобщее обсуждение
Wednesday, May 27, 2026
Состязательное машинное обучение сегодня
Sunday, November 09, 2025
Нет веры ничему
См. также другие публикации, посвященные LLM
Saturday, August 30, 2025
Красные в городе
Генеративные модели быстро набирают популярность и интегрируются в повседневные приложения, что вызывает опасения по поводу их безопасного использования, поскольку выявляются различные уязвимости. В связи с этим область «red team» переживает стремительный рост, что подчеркивает необходимость комплексного исследования, охватывающего весь процесс разработки и затрагивающего новые темы. Наш обширный обзор, в котором рассматривается более 120 статей, представляет собой классификацию детализированных стратегий атак, основанных на внутренних возможностях языковых моделей. Кроме того, мы разработали фреймворк «поисковика» для унификации различных подходов к автоматическому тестированию (read team). Более того, наш обзор охватывает новые области, включая мультимодальные атаки и защиту, риски, связанные с агентами на основе LLM, избыточное использование безвредных запросов и баланс между безвредностью и полезностью. - Against The Achilles' Heel: A Survey on Red Teaming for Generative Models
См. также другие публикации по теме Red team
Wednesday, July 09, 2025
SHAP для LLM
Интересная идея - построение состязательных примеров для LLM с использованием SHAP
P.S. См. также другие публикации по теме adversarial, посвященные устойчивому машинному обучению
Monday, February 10, 2025
Атаки в тексте
P.S. См. также другие публикации по теме adversarial, посвященные устойчивому машинному обучению
Saturday, January 25, 2025
Advanced Natural Language Processing
См. также другие публикации, посвященные NLP
Friday, June 14, 2024
Tuesday, April 16, 2024
Улучшение робастности
См. также другие публикации по теме adversarial, посвященные устойчивому машинному обучению
Thursday, June 08, 2023
Бэкдоры в NLP
См. также другие публикации по теме adversarial, посвященные устойчивому машинному обучению
Friday, March 03, 2023
Transfer learning и тонкая настройка моделей
Wednesday, December 01, 2021
Thursday, September 09, 2021
ML ресурсы
https://paperswithcode.com - соответствует названию. Статьи, изложение которых сопровождается кодом. Cвежие решения задач, ссылки на тестирование проектов на разных референсных датасетах.
https://distill.pub - журнал по ML с хорошо иллюстрированными статьями
https://ruder.io - блог NLP разработчика из DeepMind (Sebastian Ruder)
http://colah.github.io - еще один блог (Christopher Olah) с объяснениями разных прооблем ML
Wednesday, July 07, 2021
Wednesday, March 10, 2021
Saturday, February 08, 2020
ML NLP
См. также другие публикации, посвященные NLP
Thursday, January 09, 2020
Wednesday, January 01, 2020
Wednesday, July 24, 2019
Monday, January 21, 2019
Tuesday, April 17, 2018
О сверточных сетях
Есть еще один пример - автоматическая генерация кода. В статье рассматриваются вопросы, связанные с использованием методов анализа данных применительно к программным репозиториям. И CNN здесь вполне употребимы.
См. также другие публикации по теме convolutional neural networks
