Блог об AI
Заметки о нейросетях, промпт-инжиниринге и том, как искусственный интеллект меняет всё вокруг.
Последние записи
Weight banding: странные полосы в весах нейросетей
Исследователи OpenAI и Distill нашли в весах ImageNet-моделей паттерн, который сначала приняли за баг. Оказалось, сети так компенсируют потерю пространственной информации.
WearableQA: как LLM читают данные фитнес-трекеров
Новый бенчмарк WearableQA показал: большинство языковых моделей не умеют рассуждать над данными фитнес-браслетов. Gemini 3.1 Pro лидирует с 72.9%, но даже агентный режим с Python не решает задачу до конца.
Нью-Йорк запретил ИИ в школах: разбор эксперимента
Крупнейший школьный округ США на год отключил 600 000 учеников от генеративного ИИ. Разбираем аргументы сторон: исследование MIT об атрофии памяти, мета-обзор Stanford и проблему двух сигм Блума.
ES vs GRPO: как эволюция лечит коллапс энтропии LLM
Статья «Understanding Evolution Strategies for LLM Reasoning» показывает: GRPO вызывает коллапс энтропии и убивает pass@k, а эволюционные стратегии решают это за счёт разреженных обновлений в слоях маршрутизации.
Alibaba, Cambricon и Ant Group вошли в PyTorch Foundation
8 сентября в Шанхае PyTorch Foundation объявила о вступлении Alibaba Cloud и Cambricon на платиновом уровне и Ant Group на золотом. Пока чипы расходятся по санкционным контурам, софтверный слой AI остаётся общим.
Модель возраста мозга решает 6 задач МРТ при Альцгеймере
Исследователи из McGill показали: компактная модель, обученная предсказывать возраст мозга по МРТ, с адаптацией в 1% параметров справляется с диагностикой деменции, прогнозом MCI и морфометрией.
WorldSculpt: генерация 3D-сцен из видео с сотнями объектов
Новый метод генерирует композиционные 3D-сцены с сотнями объектов из обычного видео, обучаясь при этом только на одиночных предметах.
Atlas от World Labs: 3D-мир из одной фотографии
Atlas от World Labs восстанавливает пространство из одной фотографии, снимает bullet time на три смартфона и генерирует минуту видео в 1440p с точным контролем камеры. Видеогенераторы перестают быть игровыми автоматами.
PyTorch Conference 2026: программа и главные темы
Программа PyTorch Conference North America 2026 опубликована: агентное RL стало продакшн-требованием, vLLM переписывает работу с KV-кэшом, а PyTorch идёт на TPU, Trainium и IBM Spyre. Разбираем главное.
On-policy distillation: одного примера достаточно для обучения
Исследователи обучили модель по on-policy distillation на одном запросе, и она продолжала расти сотни шагов, восстановив большую часть прироста полного датасета. Оказывается, OPD перекормлена данными, но ограничена алгоритмом.