авг. 27, 2026
Данные подключены, но модель отвечает в общем стиле? Разбираем иерархию адаптации: от промпта и RAG до fine-tuning, LoRA и PEFT....
авг. 26, 2026
Модель может быть очень умной и при этом ничего не знать о вашей компании. Разбираем RAG, embeddings, vector DB и chunking: как дать AI доступ к знаниям компании без дообучения....
авг. 25, 2026
AI-продукт — это не модель. Разбираем, с чего начать: API, свой инференс или edge, и как устроена карта из 8 блоков AI-системы....
авг. 06, 2026
Статья 2017 года «Attention Is All You Need» легла в основу почти всех современных LLM — от GPT до Claude и DeepSeek. Разбираем механизм Attention....
авг. 05, 2026
DeepSeek-V3 весит 671 млрд параметров, но на каждый токен считает только 37 млрд. Разбираем архитектуру Mixture of Experts....
авг. 04, 2026
Дистилляция передаёт знания огромной модели компактной. Модель в 1,5 млрд параметров обгоняет GPT-4o на олимпиадной математике....