Универсальные агенты, которые доводят работу до конца, а не до демо.
AGI-Proto — экспериментальная лаборатория. Мы делаем агентов для длинных задач: они планируют, вызывают инструменты, проверяют собственный результат и отдают готовую работу — с трейсом, который можно прочитать.
Свои раннеры · 20+ интеграций с инструментами · SOC 2 в процессе
Агент, который ведёт себя как аккуратный коллега
Большинство ассистентов отвечают. AGI-Proto доводит задачу до конца: разбирает цель на шаги, выполняет их по очереди и останавливается там, где нужно решение человека.
Многошаговое планирование
Задачи на часы, а не на один запрос. При сбое агент перепланирует, а не сдаётся.
Настоящая работа с инструментами
Файлы, таблицы, SQL, HTTP, терминал и ваши внутренние API — через типизированные права доступа.
Долговременная память
Контекст проекта живёт между сессиями и машинами: не нужно объяснять одно и то же заново.
Самопроверка
Каждый прогон сверяется с исходной целью, прежде чем попасть к вам. Расхождения показываются.
Работает там, где лежат данные
Свои раннеры держат исходные данные внутри вашего периметра. Наружу уходят только трейсы — и вы решаете, какие.
Аккуратная передача человеку
Когда уверенности не хватает, агент останавливается и задаёт один конкретный вопрос вместо догадки.
Спросите что-нибудь практичное
На этой странице работает сценарный превью цикла агента — те же трейсы, что и в продукте, только с видимыми промежуточными шагами.
Выберите задачу, чтобы увидеть, как агент её разбирает. В закрытой бете можно подключить свои инструменты и источники данных.
Технические заметки
Публикуем то, что сработало, и то, что нет. Раскройте заметку, чтобы прочитать аннотацию.
14.09.2026Заметка 004 — поиск с верификатором на длинных задачах+
Мы обучили лёгкий верификатор оценивать промежуточные состояния и используем его, чтобы отсекать ветки поиска вместо слепого сэмплирования. На внутреннем наборе из 300 задач это подняло успех с 71,4 % до 94,1 % и сократило медианное время на 38 %. Верификатор в 40 раз дешевле политики, так что почти весь выигрыш — это просто вычисления, потраченные там, где они важны.
02.07.2026Заметка 003 — долговременная память между сессиями+
Состояние проекта хранится как компактный журнал событий плюс индекс для поиска, поэтому новая сессия продолжает задачу, не переигрывая всю историю. Разбираем политику уплотнения, грабли со устаревшими фактами и правило, к которому мы пришли: память может быть неполной, но не должна молча ошибаться.
19.05.2026Заметка 002 — безопасность инструментов в автономных прогонах+
Каждый вызов инструмента типизирован, ограничен по правам и обратим по умолчанию. Описываем модель доступа, почему агент не может расширить собственные права и как протокол передачи ведёт себя, когда действие пересекает границу, помеченную оператором как чувствительная.
Куда всё идёт
Двигаемся маленькими шагами и честно говорим, что ещё не готово.
Сейчас
- Закрытая бета, партии приглашений раз в две недели
- 20+ инструментов: файлы, SQL, HTTP, терминал, почта
- Проверяемые трейсы по каждому прогону
Дальше
- Свой раннер с вашей моделью на вашем железе
- Командные пространства, роли и точки согласования
- Просмотр памяти и сравнение трейсов
Потом
- Мультиагентная оркестрация для длинных проектов
- Развёртывание на своих серверах для регуляторных команд
- Открытый стенд для замеров и таблица результатов
Небольшая намеренно
Четыре человека и один исследовательский вопрос: может ли агент довести реальную работу до конца без няньки?
Запросить доступ в закрытую бету
Подключаем небольшими партиями, чтобы каждый прогон проходил ревью. Ответ обычно в течение двух недель.
Без рассылок и передачи данных. Одно письмо, когда откроется ваша партия.