Видео и подкасты для разработчиков
Как «думают» LLM: внутренняя механика языковых моделей
В своём докладе автор рассказывает, как работают языковые модели, опираясь на механику их функционирования и актуальные исследования.
Большие языковые модели часто воспринимаются как чёрный ящик с магическими способностями, но на самом деле их поведение можно объяснить с точки зрения науки о данных, архитектур моделей, методов обучения и математики.
В своём докладе автор рассказывает, как работают языковые модели, опираясь на механику их функционирования и актуальные исследования. Например, обсудим, чем полезны метод Chain-Of-Thought и архитектура Mixture of Experts (MoE), а также почему для языковой модели так сложно посчитать количество букв в слове. В общем, погрузимся в «секреты волшебства» LLM.
-
Новости4 недели назадВидео и подкасты о мобильной разработке 2026.35
-
GitHub3 недели назадLucide Swift — типобезопасные Lucide иконки с векторным рендерингом
-
Устройства4 недели назадHugging Face представил Microduck — небольшого двуногого робота в форме утёнка
-
Разработка4 недели назадНадежное выполнение фоновых задач в iOS: часть 1
