На линию
Способности на главной линии · ПЛАНИРОВАНИЕ + ИНСТРУМЕНТЫ

Автономное выполнение задач

СутьВ 2025–2026 годах модели объединили рассуждение с поиском, кодом, файлами и управлением приложениями. Теперь им можно поручать не только вопрос, но и многошаговую задачу.

Это начало перехода от помощника к агенту. Сегодня такие системы требуют контроля человека: они накапливают ошибки, теряют цель на длинных задачах и почти не учатся на собственном опыте.

СтатусСЕЙЧАС
ТипСпособности на главной линии
Отметка2026
Событий в досье15
Хронология развития

Исследовано

2024

Рассуждение как отдельный режим

О событииo1 показал, что дополнительное вычисление во время ответа заметно улучшает решение сложных задач.

подтвержденоОтдельная страница
2024-11

Model Context Protocol

О событииAnthropic открыла стандарт, через который модели подключаются к данным и рабочим инструментам.

подтвержденоОтдельная страница
2025-03

Платформа для агентов

О событииResponses API и Agents SDK объединили рассуждение, инструменты, оркестрацию и наблюдаемость.

подтвержденоОтдельная страница
2025-03

Горизонт автономной задачи

О событииMETR предложила измерять агентов длительностью человеческой задачи, которую они завершают с заданной надёжностью.

подтвержденоОтдельная страница
2025-04

Agent2Agent

О событииGoogle открыла протокол, позволяющий агентам разных поставщиков обмениваться задачами и результатами.

подтвержденоОтдельная страница
2025-10

Проектирование агентных процессов

О событииAgentKit оформил агентные приложения как отдельный инженерный слой с версиями, оценками и трассировкой.

подтвержденоОтдельная страница
2026-06-09

Claude Fable 5

О событииAnthropic выпустила модель для длительных задач в коде и интеллектуальной работе, рассчитанных уже не на один ответ, а на многочасовой или многодневный агентный процесс.

подтвержденоОтдельная страница
2026-06-30

Claude Sonnet 5

О событииAnthropic обновила массовую модель для кода, агентных процессов и повседневной интеллектуальной работы.

подтвержденоОтдельная страница
2026-07

Длинная работа в готовом продукте

О событииChatGPT Work выполняет более продолжительные задачи с файлами, приложениями и готовыми результатами.

подтвержденоОтдельная страница
2026-09-01

Fable 5.1: длительные проекты

О событииВыпущено обновление Claude для многошаговой работы; при оценке важно учитывать fallback.

НОВОЕподтвержденоОтдельная страница
2026-09-02

Gemini 3.8 Flash: агентная работа

О событииGA-релиз расширяет возможности быстрых моделей для программирования и рабочих процессов.

НОВОЕподтвержденоОтдельная страница
2026-09-03

GPT-6 Astra: работа с компьютером

О событииOpenAI анонсировала новое поколение для сложной работы и управления приложениями. Доступ поэтапный.

НОВОЕподтвержденоОтдельная страница

В процессе

сейчас

Надёжность длинных задач

О событииЧем длиннее цепочка действий, тем выше шанс накопить ошибку или неверно понять цель.

В планах

в планах

Память и обучение на результате

О событииАгенту нужно сохранять опыт между задачами и улучшаться без полного переобучения модели.

Дальние перспективы

впереди

Проверяемая автономность

О событииСистема выполняет долгую задачу самостоятельно, но её план, действия и результат можно проверить.

Источники и исследования

Первоисточники, на которых основано досье: научные публикации, материалы лабораторий и официальные отчёты.

Направления
Способности на главной линии