Главная › 03-Инструменты › Инструменты

🗺 карта всего сайта

Разделы
00-Главная 1
Агент = LLM + Контекст + Инструменты
01-Wiki 131
Глоссарий
01-Основы-агентов 15
Harness-инженерия Агентный цикл в коде Вызов инструментов Контекст как глаза агента Ограждения Оркестрация - рабочий процесс и автономный агент Проектирование ACI Пространства наблюдений и действий Пять категорий инструментов Пять функций Harness Архитектура агента — сводка Три уровня обновления способностей Формула агента Цикл ReAct Эволюция инженерных парадигм
02-Инженерия-контекста 12
Agent Skills Chat Template KV Cache Prompt Cache Инженерия контекста Инженерия промптов Инъекция промпта Пять компонентов контекста Сжатие контекста Строка состояния агента Три правила дружественности к KV Cache Четыре роли сообщений API
03-Память-и-база-знаний 15
GraphRAG RAG RAPTOR User as Code Агентный RAG Гибридный поиск Иерархия памяти Когнитивные типы памяти Контекстно-зависимый поиск Плотный эмбеддинг Разбиение документов Разреженный поиск BM25 Структурированная индексация Трёхуровневая оценка памяти Форматы памяти пользователя
04-Инструменты 14
Баланс гранулярности инструментов Динамическая загрузка инструментов Достоверность передачи параметров Искусство описания инструментов Классификация инструментов Механизм Sidecar Предложитель-рецензент Прерывание и заполнители Проактивное обнаружение инструментов Протокол MCP Риски безопасности MCP Событийно-управляемый асинхронный агент Специализированный инструмент против Skill Человек в контуре
05-Кодинг-агент 13
Sessionless Генеративный UI Код как инструмент мышления Код как метаспособность Код как ограничение бизнес-правил Лояльность агента Парадигма файловой системы для знаний Самозагрузка агента Сбои и восстановление Семантический разбор команд Семь базовых инструментов Смертельная триада Файловая система как центр агента
06-Оценка 10
LLM-as-a-Judge Анализ стоимости агента Метрики оценки агентов Наблюдаемость агента От бенчмарка к улучшениям Симуляционная среда Среды оценки Статистическая значимость оценки Три уровня системы оценки Четыре принципа рубрики
07-Постобучение 11
GRPO KL - mode-seeking против mass-covering On-Policy Distillation RLHF RLVR и проверяемые награды SFT запоминает - RL обобщает Данные и среда важнее алгоритма Награда за процесс и награда за результат Самодистилляция OPSD Сначала SFT потом RL Три этапа постобучения
08-Непрерывная-эволюция 11
Границы безопасности самомодификации Два контура эволюции Непрерывная эволюция агента Обновление Prompt и Skill Обновление параметров модели Обучающие сигналы из траекторий Обучение во сне От опыта к знаниям От опыта к программам Проверка - выпуск - откат Четыре носителя обновления
09-Мультимодальность 11
Computer Use Sim2Real VLA-модели Архитектура мышления быстрое и медленное Визуальная локализация GUI Голосовые парадигмы Двухуровневая архитектура планирование-управление Каскадный голосовой конвейер Полный дуплекс Потоковое речевое восприятие Синтез речи подобный человеку
10-Мультиагентность 14
Децентрализованная модель и handoff Запрос состояния и персистентность траектории Межагентная коммуникация Модель оркестрации Мультиагентная смена ролей Мультиагентное взаимодействие без общего контекста Мультиагентность против одного агента Общество агентов Общий и раздельный контекст Протокол A2A Режимы отказа мультиагентных систем Топологии взаимодействия Файловая система в мультиагентных системах Эмерджентное поведение агентов
11-Послесловие 4
Harness постепенно поглощается моделью Два облака агентного неба Маховик модель-агент Совместная эволюция модели и агента
02-Обучение 7
Обучение
Курс-агент-с-нуля 6
00. О курсе Урок 1. Формула агента Урок 2. Цикл ReAct Урок 3. Harness и ограждения Урок 4. Инструменты Урок 5. Сборка CLI-агента
03-Инструменты 1
Инструменты
04-Блог 1
Блог
05-О-проекте 1
О проекте
12-Телеграм 1
Как работает Телеграм-мост

Инструменты

Раздел готовится: каталог недорогих LLM, сравнение моделей, готовые шаблоны агентов и калькулятор стоимости.

Базовые понятия уже разобраны в книге: Классификация инструментов, Протокол MCP.

Связано: Классификация инструментов, Протокол MCP

// связанные заметки
←О проекте ←Агент = LLM + Контекст + Инструменты →Классификация инструментов →Протокол MCP
// edges: 4
Классификация инструментов Протокол MCP О проекте Агент = LLM + Контекст + Инструменты
исходящие входящие двустор.