Блог об AI

Заметки о нейросетях, промпт-инжиниринге и том, как искусственный интеллект меняет всё вокруг.

Последние записи

HORIZON: как NVIDIA учит AI-агентов проектировать чипы

HORIZON: как NVIDIA учит AI-агентов проектировать чипы

NVIDIA представила HORIZON — агентный фреймворк, который генерирует и проверяет RTL-код для чипов в полностью автоматическом цикле. Без единого ручного шага.

DanceOPD: как одна модель научилась делать и T2I, и редактирование изображений

DanceOPD: как одна модель научилась делать и T2I, и редактирование изображений

Современные модели генерации изображений умеют делать многое: создавать картинки по тексту, локально менять детали, применять глобальные стили. Но объединить всё это в одной модели долго не удавалось — возможности конфликтовали друг с другом. DanceOPD решает эту проблему через «танцующие» velocity fields.

ActCam: jointly control camera and character motion in AI video

ActCam: jointly control camera and character motion in AI video

ActCam позволяет одновременно управлять движением камеры и персонажа в AI-видео без дополнительного обучения модели. Система принимает три входа: референс-изображение, видео-источник движения и траекторию камеры.

VISE: как заставить мультимодальную модель смотреть на изображение, а не угадывать

VISE: как заставить мультимодальную модель смотреть на изображение, а не угадывать

Мультимодальные модели часто генерируют текст на основе языковых паттернов, а не реального изображения. Исследователи из MBZUAI предложили VISE — фреймворк, заставляющий модель обращать внимание на визуальные токены.

AI-чипы 2026: OpenAI Jalapeno и IBM sub-1nm — гонка за энергоэффективность

AI-чипы 2026: OpenAI Jalapeno и IBM sub-1nm — гонка за энергоэффективность

OpenAI и IBM одновременно объявили о прорывах в AI-железе: 9-месячная разработка чипа Jalapeno и 3D-архитектура с 100 млрд транзисторов на площади ногтя.

NeuROK: как модель научилась предсказывать движение объекта по одному снимку

NeuROK: как модель научилась предсказывать движение объекта по одному снимку

NeuROK решает задачу, которую физики считали невозможной без экспертных priors: по одному 3D-снимку объекта модель предсказывает, как он будет деформироваться при приложении силы. Conditional VAE + Lagrangian mechanics = kinematic state space.

Гибридные LLM против трансформеров: токенный разбор

Гибридные LLM против трансформеров: токенный разбор

Токенный анализ показал: гибридные модели выигрывают у трансформеров на open-class словах и открытых разделителях, но проигрывают на копировании n-грамм и закрывающих скобках.

FID — золотой стандарт генерации картинок — оказался неправ

FID — золотой стандарт генерации картинок — оказался неправ

Fréchet Inception Distance десять лет определял развитие генеративных моделей. Новое исследование показало, что FID можно оптимизировать напрямую — и результат опровергает сам FID.

AI, ML, Deep Learning и Generative AI: объяснение в одной картинке

AI, ML, Deep Learning и Generative AI: объяснение в одной картинке

Четыре термина, которые все путают: AI, машинное обучение, deep learning и генеративный ИИ. Объясняем разницу через洋葱-слои и реальные задачи — от детектирования аномалий до генерации текста.

Weave Router: модель-роутер для Claude Code, Codex и Cursor за 40-70% экономии

Weave Router: модель-роутер для Claude Code, Codex и Cursor за 40-70% экономии

Weave Router — это open-source модель-роутер, который подключается к Claude Code, Codex и Cursor и автоматически перенаправляет каждый запрос нужной модели с экономией 40-70% на API-бюджете.