, сентябрь 30, 2026

Как модель понимает контекст: механизм Attention
ru

  авг. 06, 2026

Как модель понимает контекст: механизм Attention

Статья 2017 года «Attention Is All You Need» легла в основу почти всех современных LLM — от GPT до Claude и DeepSeek. Разбираем механизм Attention....

Читать далее
Почему мир внезапно поверил в гуманоидных роботов
ru

  авг. 06, 2026

Почему мир внезапно поверил в гуманоидных роботов

Как совпадение зрелой механики, ИИ и падения цен создало новую индустрию — и почему США строят «мозг» робота, а Китай — его «тело»....

Читать далее
Китай запускает автономный отель с нулевым линейным персоналом: 44 люкс-номера
ru

  авг. 05, 2026

Китай запускает автономный отель с нулевым линейным персоналом: 44 люкс-номера

Pudu Robotics тестирует embodied AI в люксе. Разбор экономики CAPEX/OPEX, рисков интеграции и B2B-модели showcase....

Читать далее
Что такое Mixture of Experts и почему огромные модели работают быстрее, чем кажется
ru

  авг. 05, 2026

Что такое Mixture of Experts и почему огромные модели работают быстрее, чем кажется

DeepSeek-V3 весит 671 млрд параметров, но на каждый токен считает только 37 млрд. Разбираем архитектуру Mixture of Experts....

Читать далее
DeepSeek снизил цену API на 75% — и показал, куда движется вся индустрия ИИ
ru

  авг. 04, 2026

DeepSeek снизил цену API на 75% — и показал, куда движется вся индустрия ИИ

DeepSeek снизил цену API на 75%, объясняя это эффективностью архитектуры. Дефицит HBM-памяти сдерживает индустрию MoE годами....

Читать далее
Китайские военные институты дистиллировали знания Claude и GPT-3.5 для оборонных ИИ-систем
ru

  авг. 04, 2026

Китайские военные институты дистиллировали знания Claude и GPT-3.5 для оборонных ИИ-систем

Reuters: китайские военные институты обучали оборонные ИИ-системы на выходах Claude и GPT-3.5 — от дронов до мониторинга соцсетей....

Читать далее
↑