Вторая часть стрима про AI-агентов: архитектура, инференс и тестирование
К@kdoronin_blogAI-инженер
1 недЗапись стрима о разработке AI-агентов: архитектура SECS, запуск Qwen через vLLM, спекулятивное декодирование и тестирование на виртуальных машинах.
Стрим дает практический обзор инструментов для запуска и оптимизации локальных AI-агентов.
- Разбор архитектуры пайплайна для кодовых AI-агентов.
- Практические советы по ускорению инференса через спекулятивное декодирование.
- Сравнение аппаратных решений для запуска нейросетей.
Запись второй части нашего стрима про сбегающих AI-агентов.
Посмотреть на YouTube можно здесь.
Таймкоды:
0:00:00 — Приветствие и обсуждение планов на стрим
0:02:13 — Архитектура проекта SECS и схема пайплайна
0:06:42 — Интеграция навыков для кодовых AI-агентов
0:10:00 — Локальный запуск модели Qwen и vLLM
0:18:05 — Ускорение инференса через спекулятивное декодирование
0:28:20 — Воспоминания о культовых играх и компьютерах
0:33:45 — Настройка контекстного окна и параметров модели
0:44:00 — Сравнение видеокарт для инференса нейросетей
0:50:40 — Обсуждение генерации музыки в нейросетях
1:08:05 — Тестирование AI-агента на тестовой виртуальной машине
1:23:45 — Автоматизированный анализ и поиск путей эскалации
1:54:30 — Подведение итогов стрима и завершение трансляции
Каналы участников стрима, чтобы подписаться:
Павел Рыков
Константин Доронин
Кратко (AI)
Опубликована запись второй части стрима, посвященного созданию и запуску AI-агентов. В видео подробно разбираются архитектура проекта SECS, настройка локального инференса моделей Qwen с использованием vLLM, а также методы ускорения работы нейросетей и практическое тестирование агентов в изолированной среде.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖