4DAnyone: открытый фреймворк строит 4D-модель человека из видео, снятого одной камерой
24 августа 2026
4DAnyone: открытый фреймворк строит 4D-модель человека из видео, снятого одной камерой
Исследователи из Zhejiang University, Robbyant, Ant Group и HKUST представили 4DAnyone — фреймворк для превращения снятого одной камерой видео с участием человека в 4D-модель этого человека, которую можно крутить и…
Microsoft выпустила Agent Lightning v1.0 для обучения агентов внутри их собственной обвязки
20 августа 2026
Microsoft выпустила Agent Lightning v1.0 для обучения агентов внутри их собственной обвязки
Исследователи Microsoft вместе с коллегами из Fudan University, Zhejiang University и University of Edinburgh опубликовали Agent Lightning v1.0 — фреймворк для обучения LLM-агентов с подкреплением, который целиком умещается примерно в 3,500…
JoyAI-Video-Edit: 16B-модель редактирует видео в реальном времени, выдавая 30 FPS в 720p на одной B200
11 августа 2026
JoyAI-Video-Edit: 16B-модель редактирует видео в реальном времени, выдавая 30 FPS в 720p на одной B200
Команда Joy Future Academy опубликовала JoyAI-Video-Edit — открытую авторегрессионную диффузионную модель на 16 млрд параметров, которая редактирует видеопоток по текстовой инструкции в реальном времени без доступа к будущим кадрам и…
Kimi K3: большой обзор нейросети от Moonshot AI — архитектура, бенчмарки, открытые веса, сравнение с Fable 5
3 августа 2026
Kimi K3: большой обзор нейросети от Moonshot AI — архитектура, бенчмарки, открытые веса, сравнение с Fable 5
Moonshot AI опубликовала Kimi K3 — первую открытую модель класса 3 триллионов параметров и контекстом 1 миллион токенов. Она уже доступна в чат-боте Kimi и по API. Модель принимает на…
TurboVLA: робот получает команды в разы быстрее при 97% успешных выполнений благодаря замене LLM на BERT
3 августа 2026
TurboVLA: робот получает команды в разы быстрее при 97% успешных выполнений благодаря замене LLM на BERT
Исследователи из Хуачжунского университета науки и технологий и Huawei опубликовали TurboVLA — компактную vision-language-action модель, которая выдаёт действия для робота за 31.2 мс на потребительской RTX 4090 и набирает 97.7% на…
Bonsai 27B: модель с 27 миллиардами параметров впервые запустили на смартфоне благодаря 1-битным весам
15 июля 2026
Bonsai 27B: модель с 27 миллиардами параметров впервые запустили на смартфоне благодаря 1-битным весам
Стартап PrismML, основанный исследователями из Caltech, представил Bonsai 27B — это бинарная и тернарная версии модели Qwen3.6-27B, которые сохраняют 90–95% качества исходной модели при сжатии весов в 9.4–14.2 раза. Тернарная…
MIRA: модель мира целиком симулирует Rocket League, не требуя установки самой игры
8 июля 2026
MIRA: модель мира целиком симулирует Rocket League, не требуя установки самой игры
Команды General Intuition, Kyutai и Epic Games представили MIRA — мировую модель (world model), которая целиком симулирует игровую среду Rocket League для четырёх игроков одновременно и рисует каждому свою картинку…
Claude Sonnet 5: сильный агентный апгрейд, но не очевидная замена Opus
1 июля 2026
Claude Sonnet 5: сильный агентный апгрейд, но не очевидная замена Opus
Anthropic представила Claude Sonnet 5 — новую модель из линейки Claude, доступную в том числе пользователям бесплатного тарифа. Она ориентирована на агентные задачи, программирование, работу с инструментами и корпоративную автоматизацию.…
LFM2.5-230M: ультракомпактная модель работает на Raspberry Pi и почти любом современном телефоне
29 июня 2026
LFM2.5-230M: ультракомпактная модель работает на Raspberry Pi и почти любом современном телефоне
Команда Liquid AI выпустила LFM2.5-230M — одну из самых маленьких языковых моделей на сегодня, всего на 230 миллионов параметров. Она настолько компактная, что без проблем запускается на небольшом устройстве: ей…
DreamX-World 1.0: открытая модель генерации мира с контролем камеры, текстовым управлением и запоминанием локаций
17 июня 2026
DreamX-World 1.0: открытая модель генерации мира с контролем камеры, текстовым управлением и запоминанием локаций
Команда AMAP-ML опубликовала DreamX-World 1.0 — интерактивную генеративную модель мира, которая превращает текст или изображение в управляемое видео с точным контролем камеры, памятью о ранее посещённых сценах и поддержкой событий…
VibeThinker: 3B-модель рассуждает и кодит на уровне флагманских моделей
16 июня 2026
VibeThinker: 3B-модель рассуждает и кодит на уровне флагманских моделей
Команда Sina Weibo AI опубликовала VibeThinker-3B — компактную языковую модель всего с 3 миллиардами параметров, которая на задачах верифицируемых рассуждений (математика, программирование, STEM) вплотную приближается к результатам флагманских моделей DeepSeek…
ESM Cambrian: модель для предсказания и дизайна белков превзошла AlphaFold3 от Google и построила крупнейший атлас белкового мира
4 июня 2026
ESM Cambrian: модель для предсказания и дизайна белков превзошла AlphaFold3 от Google и построила крупнейший атлас белкового мира
Команда исследователей из Biohub опубликовала ESM Cambrian (ESMC) — языковую модель для предсказания и дизайна белков, которая обошла AlphaFold3 от Google по точности предсказания структур, спроектировала молекулы, которые крепко связываются…
LLaVA-OneVision-2-8B: мультимодальная модель анализирует сжатый видеопоток через кодек вместо нарезки кадров
28 мая 2026
LLaVA-OneVision-2-8B: мультимодальная модель анализирует сжатый видеопоток через кодек вместо нарезки кадров
Исследователи из Glint Lab, AIM for Health Lab и MVP Lab опубликовали LLaVA-OneVision-2 (LLaVA-OV-2) — мультимодальную модель нового поколения, которая переосмысливает то, как нейросеть «смотрит» видео. Вместо того чтобы нарезать видео…
LongLive-2.0: NVIDIA научила модель генерировать длинное видео в реальном времени с квантованием NVFP4
20 мая 2026
LongLive-2.0: NVIDIA научила модель генерировать длинное видео в реальном времени с квантованием NVFP4
Исследователи из NVIDIA опубликовали LongLive-2.0 — инфраструктуру для обучения и запуска моделей генерации длинного видео с использованием квантования до 4-битной точности NVFP4. Квантование — это сжатие весов модели за счёт…
OpenAI Codex: полный гайд по установке и начале работы на 2026 год, плюсы и минусы агента
18 мая 2026
OpenAI Codex: полный гайд по установке и начале работы на 2026 год, плюсы и минусы агента
За последние два года AI-инструменты для разработки успели пройти путь от «умного автодополнения» до полноценных агентных систем. Если ранние Copilot-подобные решения в основном помогали дописывать код строчка за строчкой, то…
SenseNova-U1: мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE
14 мая 2026
SenseNova-U1: мультимодальная архитектура NEO-unify работает напрямую с пикселями без VAE
Команда SenseNova представила новую мультимодальную архитектуру SenseNova-U1, которая объединяет понимание изображений, генерацию и редактирование внутри единого трансформера без отдельного визуального энкодера и вариационного автокодировщика. Такой подход убирает необходимость постоянно переводить…
Claude Code: полное руководство по установке и начале работы
8 мая 2026
Claude Code: полное руководство по установке и начале работы
Claude Code — агентный инструмент для разработки от Anthropic, который работает прямо в терминале или десктопном приложении. В отличие от инструментов автодополнения, он действует на уровне всего проекта: читает файлы,…
OpenSeeker-v2: лучший в своем классе Deep Research агент, созданный академической командой всего на 10600 примерах
7 мая 2026
OpenSeeker-v2: лучший в своем классе Deep Research агент, созданный академической командой всего на 10600 примерах
Исследователи из Шанхайского университета Цзяо Тун доказали, что для создания лучшего в своём классе deep research агента не нужны сотни миллиардов токенов предобучения и дорогостоящее обучение с подкреплением. Достаточно 10…
OpenGame: ИИ-агент создает браузерные 2D-игры с нуля по текстовому описанию
22 апреля 2026
OpenGame: ИИ-агент создает браузерные 2D-игры с нуля по текстовому описанию
Команда исследователей из CUHK MMLab опубликовала OpenGame — первый агентный фреймворк для создания браузерных 2D-игр по текстовому описания. Проект полностью открытый: код фреймворка, веса модели GameCoder-27B и датасеты доступны на…
ChatGPT Images 2.0: OpenAI запустила обновление модели генерации изображений с рассуждениям, 2K-разрешением и мультиязычным текстом
22 апреля 2026
ChatGPT Images 2.0: OpenAI запустила обновление модели генерации изображений с рассуждениям, 2K-разрешением и мультиязычным текстом
21 апреля 2026 года OpenAI выпустила ChatGPT Images 2.0 на базе модели gpt-image-2. По данным LM Arena, новая модель сразу заняла первое место во всех категориях генерации изображений с отрывом…
ClawGUI: первый открытый фреймворк полного цикла для GUI-агентов от обучения до реального устройства
15 апреля 2026
ClawGUI: первый открытый фреймворк полного цикла для GUI-агентов от обучения до реального устройства
Исследователи из Чжэцзянского университета опубликовали ClawGUI — полностью открытый фреймворк для разработки GUI-агентов, которые управляют приложениями через визуальный интерфейс, как это делает человек: касаниями, свайпами и вводом текста. На практике…




















