Хроника

Хроника

Каждое датированное событие на линии, от свежего к старому. Фильтр — по ветви и вехе.

Архив релизов моделей

От GPT и BERT до современных текстовых, мультимодальных, графических, видео- и аудиомоделей. Здесь учитываются публичные релизы и значимые research preview; ссылка ведёт на первичный блог, документацию или публикацию команды.

2026-09-03
Мультимодальная · OpenAI
GPT-6 Astra

Анонсирована модель для сложной работы, кода и управления компьютером. Доступ расширяется поэтапно.

НОВОЕподтвержденоOpenAI · релиз
2026-09-02
Мультимодальная · Google
Gemini 3.8 Flash

GA-релиз Flash для программирования, агентов и сложных рабочих процессов; текстовый вывод и мультимодальный ввод.

НОВОЕподтвержденоGoogle · релиз
2026-09-02
Мультимодальная · Meta
Muse Spark 1.3

Meta обновила модель для длительной агентной работы и программирования. Доступна в Muse Code и Meta Model API.

НОВОЕподтвержденоMeta · релиз
2026-09-01
Мультимодальная · Anthropic
Claude Fable 5.1

Обновление для кода и длительных проектов в платных продуктах Claude и API. При чтении тестов учитывайте safeguards и fallback.

НОВОЕподтвержденоAnthropic · релиз
2026-08-14
Текст / LLM · Z.ai
GLM-5.3

Z.ai выпустила post-training обновление базы GLM-5.2 с крупным приростом в сложном программировании, терминальных задачах и длительной агентной работе.

НОВОЕподтвержденоZ.ai · релиз
2026-08-13
Мультимодальная · Google
Gemini 3.7 Flash

Google выпустила GA-версию быстрой reasoning-модели с миллионным контекстом и улучшениями для программирования, веб-разработки и агентных процессов.

НОВОЕподтвержденоGoogle · релиз
2026-08-13
Текст / LLM · DeepSeek
DeepSeek-V4-Pro-0813

Финальный checkpoint V4-Pro заменил preview-версию, заметно усилил агентные задачи и вышел с открытыми весами под лицензией MIT.

НОВОЕподтвержденоDeepSeek · релиз
2026-08-12
Мультимодальная · xAI
Grok 4.6

Grok 4.6 усилил длительные агентные задачи, программирование и создание интерактивных продуктов; модель вышла в Cursor, Grok Build, API и у партнёров.

НОВОЕподтвержденоxAI · релиз
2026-08-10
Мультимодальная · Meta
Muse Glimmer 30B

Meta выпустила под Apache 2.0 локальную 30B agentic-модель с восприятием изображений, инструментами, восстановлением после ошибок и официальными GGUF-сборками.

НОВОЕподтвержденоMeta · релиз
2026-08-05
Мультимодальная · Meta
Muse Spark 1.2

Meta обновила проприетарную coding- и agentic-модель Muse Spark: версия 1.2 усилила многофайловую разработку, использование компьютера и длительные рабочие процессы.

подтвержденоMeta · релиз
2026-07-27
Текст / LLM · Moonshot AI
Kimi K3

Moonshot AI опубликовала веса Kimi K3 вместе с инструкциями для Transformers, vLLM и SGLang. Это open-weights релиз для серверной инфраструктуры: масштаб 2,8T параметров не подразумевает обычный локальный запуск.

подтвержденоMoonshot AI · релиз
2026-07-23
Мультимодальная · Black Forest Labs
FLUX 3

Black Forest Labs открыла Early Access к мультимодальной основе для изображений, видео, аудио и action prediction; отдельные возможности запускаются поэтапно.

подтвержденоBlack Forest Labs · релиз
2026-07-09
Мультимодальная · OpenAI
GPT-5.6 Sol

Флагман OpenAI усилил агентные задачи в программировании, биологии и кибербезопасности.

подтвержденоOpenAI · релиз
2026-06-01
Текст / LLM · MiniMax
MiniMax M3

Модель с миллионным контекстом сделала упор на более дешёвое вычисление и ускоренные prefill и decoding.

подтвержденоMiniMax · релиз
2026-03-18
Текст / LLM · OpenAI
GPT-5.4 mini

Компактная reasoning-модель стала резервным быстрым вариантом GPT-5.4 Thinking в ChatGPT.

подтвержденоOpenAI · релиз
2026-02-05
Текст / LLM · OpenAI
GPT-5.3-Codex

Специализированная агентная модель объединила обучение Codex и GPT-5 для длинных задач программирования.

подтвержденоOpenAI · релиз
2026-01-13
Видео · Google
Veo 3.1

Обновление улучшило согласованность персонажей и объектов, вертикальное видео и вывод до 4K.

подтвержденоGoogle · релиз
2025-08-07
Мультимодальная · OpenAI
GPT-5

OpenAI объединила быстрый ответ, глубокое рассуждение и маршрутизацию между режимами в одной продуктовой системе.

подтвержденоOpenAI · релиз
2025-08-04
Изображения · Alibaba
Qwen-Image

20B MMDiT-модель сделала особый упор на сложную типографику и точное редактирование текста внутри изображений.

подтвержденоAlibaba · релиз
2025-05-22
Мультимодальная · Anthropic
Claude 4

Opus 4 и Sonnet 4 усилили длительное программирование, использование инструментов и агентные сценарии.

подтвержденоAnthropic · релиз
2025-05-20
Видео · Google
Veo 3

Видеомодель получила нативную генерацию звука, речи и фоновых шумов вместе с изображением.

подтвержденоGoogle · релиз
2025-05-20
Изображения · Google
Imagen 4

Новое поколение генерации изображений улучшило детализацию, типографику и скорость.

подтвержденоGoogle · релиз
2025-05-20
Аудио · Google
Lyria 2

Google расширила доступ к музыкальной модели и встроила её в инструменты для авторов.

подтвержденоGoogle · релиз
2025-04-29
Текст / LLM · Alibaba
Qwen3

Открытое семейство объединило обычный и thinking-режимы и включило плотные и MoE-модели разных размеров.

подтвержденоAlibaba · релиз
2025-04-16
Мультимодальная · OpenAI
OpenAI o3 / o4-mini

Reasoning-модели впервые начали совместно рассуждать по изображениям и пользоваться полным набором инструментов ChatGPT.

подтвержденоOpenAI · релиз
2025-04-05
Мультимодальная · Meta
Llama 4

Нативно мультимодальное MoE-семейство Scout и Maverick расширило контекст и работу с изображениями.

подтвержденоMeta · релиз
2025-03-25
Мультимодальная · Google
Gemini 2.5 Pro

Thinking-модель Google объединила рассуждение, код и мультимодальное понимание с длинным контекстом.

подтвержденоGoogle · релиз
2025-02-27
Текст / LLM · OpenAI
GPT-4.5

Крупнейшая на тот момент модель OpenAI для чата стала исследовательским превью масштабирования предобучения без отдельного reasoning-режима.

подтвержденоOpenAI · релиз
2025-02-24
Текст / LLM · Anthropic
Claude 3.7 Sonnet

Anthropic объединила быстрые ответы и видимое расширенное рассуждение в одной модели.

подтвержденоAnthropic · релиз
2025-01-26
Мультимодальная · Alibaba
Qwen2.5-VL

Vision-language семейство научилось разбирать документы, интерфейсы, диаграммы и длинные видеопоследовательности.

подтвержденоAlibaba · релиз
2025-01-20
Текст / LLM · DeepSeek
DeepSeek-R1

Открытая reasoning-модель и её дистилляты показали, что усиленное обучение может конкурировать с закрытыми системами рассуждения.

подтвержденоDeepSeek · релиз
2024-12-26
Текст / LLM · DeepSeek
DeepSeek-V3

Открытая MoE-модель с 671B общих и 37B активных параметров резко снизила стоимость сильной языковой модели.

подтвержденоDeepSeek · релиз
2024-12-11
Мультимодальная · Google
Gemini 2.0

Google сделала упор на нативную работу с инструментами, потоковое мультимодальное взаимодействие и будущих агентов.

подтвержденоGoogle · релиз
2024-12-09
Видео · OpenAI
Sora Turbo

Sora вышла из исследовательского превью в отдельный продукт с генерацией и редактированием роликов.

подтвержденоOpenAI · релиз
2024-09-25
Мультимодальная · Meta
Llama 3.2

В семейство вошли vision-модели 11B/90B и компактные текстовые 1B/3B для локальных устройств.

подтвержденоMeta · релиз
2024-09-19
Текст / LLM · Alibaba
Qwen2.5

Семейство открытых моделей от 0.5B до 72B расширило многоязычность, код, математику и структурированный вывод.

подтвержденоAlibaba · релиз
2024-09-12
Текст / LLM · OpenAI
OpenAI o1

Модель получила отдельное вычисление перед ответом и заметно улучшила математику, код и сложное рассуждение.

подтвержденоOpenAI · релиз
2024-08-01
Изображения · Black Forest Labs
FLUX.1

Новое семейство генераторов изображений объединило открытую модель Schnell и более мощные коммерческие версии.

подтвержденоBlack Forest Labs · релиз
2024-07-23
Текст / LLM · Meta
Llama 3.1 405B

Meta выпустила 405B-модель с 128K контекста и разрешила использовать её выводы для улучшения других моделей.

подтвержденоMeta · релиз
2024-06-21
Мультимодальная · Anthropic
Claude 3.5 Sonnet

Средняя по размеру модель обошла прежний Opus во многих задачах и усилила работу с кодом и изображениями.

подтвержденоAnthropic · релиз
2024-05-14
Видео · Google
Veo

Google представила генератор 1080p-видео с кинематографическими стилями и более длинными сценами.

подтвержденоGoogle · релиз
2024-05-14
Изображения · Google
Imagen 3

Новое поколение Imagen улучшило фотореализм, детали и уменьшило количество визуальных артефактов.

подтвержденоGoogle · релиз
2024-05-13
Мультимодальная · OpenAI
GPT-4o

Единая модель начала принимать и генерировать текст, зрение и речь с низкой задержкой.

подтвержденоOpenAI · релиз
2024-04-18
Текст / LLM · Meta
Llama 3

Открытые 8B и 70B модели подняли качество диалога, рассуждений и программирования.

подтвержденоMeta · релиз
2024-03-04
Мультимодальная · Anthropic
Claude 3

Семейство Haiku, Sonnet и Opus добавило зрение и разделило модели по скорости, цене и максимальному качеству.

подтвержденоAnthropic · релиз
2024-02-22
Изображения · Stability AI
Stable Diffusion 3 · preview

Новая MMDiT-архитектура улучшила текст в изображениях и следование сложным запросам.

подтвержденоStability AI · релиз
2024-02-15
Мультимодальная · Google
Gemini 1.5

Модель получила контекст до миллиона токенов и могла совместно анализировать длинные документы, код, аудио и видео.

подтвержденоGoogle · релиз
2024-02-15
Видео · OpenAI
Sora · research preview

OpenAI показала генерацию длинных видеосцен как задачу моделирования динамики визуального мира.

подтвержденоOpenAI · релиз
2023-12-11
Текст / LLM · Mistral AI
Mixtral 8×7B

Открытая смесь экспертов активировала лишь часть параметров на каждом токене и сделала крупную модель дешевле в работе.

подтвержденоMistral AI · релиз
2023-12-06
Мультимодальная · Google
Gemini 1.0

Google представила семейство, изначально обученное работать с текстом, изображениями, аудио и видео.

подтвержденоGoogle · релиз
2023-11-21
Видео · Stability AI
Stable Video Diffusion

Открытая research-preview модель перенесла диффузионную генерацию из изображений в короткое видео.

подтвержденоStability AI · релиз
2023-09-27
Текст / LLM · Mistral AI
Mistral 7B

Компактная открытая модель показала, что архитектура и качество данных могут конкурировать с более крупными моделями.

подтвержденоMistral AI · релиз
2023-09-20
Изображения · OpenAI
DALL·E 3

Генератор изображений встроили в ChatGPT: модель стала точнее понимать сложные текстовые инструкции.

подтвержденоOpenAI · релиз
2023-07-18
Текст / LLM · Meta
Llama 2

Открытые веса стали доступны для исследований и большинства коммерческих сценариев.

подтвержденоMeta · релиз
2023-07-11
Текст / LLM · Anthropic
Claude 2

Claude получил 100K контекста, более сильное программирование и широкую публичную доступность.

подтвержденоAnthropic · релиз
2023-03-14
Текст / LLM · Anthropic
Claude

Первая публичная версия Claude предложила длинные ответы и отдельный подход к обучению безопасному поведению.

подтвержденоAnthropic · релиз
2023-03-14
Мультимодальная · OpenAI
GPT-4

Флагман OpenAI получил ввод изображений, более сильное рассуждение и заметно более устойчивое следование инструкциям.

подтвержденоOpenAI · релиз
2023-02-24
Текст / LLM · Meta
LLaMA

Meta выпустила исследовательское семейство от 7B до 65B и усилила движение к доступным весам моделей.

подтвержденоMeta · релиз
2022-11-30
Текст / LLM · OpenAI
ChatGPT

Диалоговый интерфейс и обучение по человеческой обратной связи сделали большие языковые модели массовым продуктом.

подтвержденоOpenAI · релиз
2022-09-21
Аудио · OpenAI
Whisper

Открытая модель распознавания речи объединила много языков, перевод и устойчивость к шуму.

подтвержденоOpenAI · релиз
2022-08-22
Изображения · Stability AI
Stable Diffusion

Открытая модель перенесла качественную генерацию изображений на пользовательские GPU и породила большую экосистему дообучений.

подтвержденоStability AI · релиз
2022-05-23
Изображения · Google
Imagen

Крупный текстовый энкодер и каскад диффузионных моделей заметно улучшили соответствие изображения запросу.

подтвержденоGoogle · релиз
2022-04-28
Мультимодальная · Google DeepMind
Flamingo

Одна visual-language модель научилась решать много задач по нескольким примерам из текста и изображений.

подтвержденоGoogle DeepMind · релиз
2022-04-06
Изображения · OpenAI
DALL·E 2

Диффузионная генерация повысила разрешение, реализм и управляемость редактирования изображений.

подтвержденоOpenAI · релиз
2021-08-10
Текст / LLM · OpenAI
Codex

Модель, обученная на коде, превратила естественный язык в программные конструкции и стала основой первого GitHub Copilot.

подтвержденоOpenAI · релиз
2021-01-05
Изображения · OpenAI
DALL·E

Текстовая команда впервые управляла генерацией изображений через крупную модель семейства GPT.

подтвержденоOpenAI · релиз
2021-01-05
Мультимодальная · OpenAI
CLIP

Совместное пространство текста и изображений позволило распознавать новые визуальные категории без отдельного обучения.

подтвержденоOpenAI · релиз
2020-05-28
Текст / LLM · OpenAI
GPT-3

175 млрд параметров сделали обучение по примерам в промпте заметной способностью большой языковой модели.

подтвержденоOpenAI · релиз
2019-10-23
Текст / LLM · Google
T5

Google свела разные языковые задачи к единому формату «текст на входе — текст на выходе».

подтвержденоGoogle · релиз
2019-02-14
Текст / LLM · OpenAI
GPT-2

Масштабирование языковой модели дало связный длинный текст и первые убедительные zero-shot-переносы между задачами.

подтвержденоOpenAI · релиз
2018-11-02
Текст / LLM · Google
BERT

Двунаправленное предобучение сделало контекст слова доступным сразу слева и справа и изменило поиск, классификацию и извлечение ответов.

подтвержденоGoogle · релиз
2018-06-11
Текст / LLM · OpenAI
GPT

Первая модель семейства GPT показала, что один предобученный Transformer можно адаптировать к нескольким языковым задачам.

подтвержденоOpenAI · релиз