← к ленте

Вторая часть стрима про AI-агентов: архитектура, инференс и тестирование

К@kdoronin_blogAI-инженер
1 нед

Запись стрима о разработке AI-агентов: архитектура SECS, запуск Qwen через vLLM, спекулятивное декодирование и тестирование на виртуальных машинах.

Стрим дает практический обзор инструментов для запуска и оптимизации локальных AI-агентов.

  • Разбор архитектуры пайплайна для кодовых AI-агентов.
  • Практические советы по ускорению инференса через спекулятивное декодирование.
  • Сравнение аппаратных решений для запуска нейросетей.
Запись второй части нашего стрима про сбегающих AI-агентов. Посмотреть на YouTube можно здесь. Таймкоды: 0:00:00 — Приветствие и обсуждение планов на стрим 0:02:13 — Архитектура проекта SECS и схема пайплайна 0:06:42 — Интеграция навыков для кодовых AI-агентов 0:10:00 — Локальный запуск модели Qwen и vLLM 0:18:05 — Ускорение инференса через спекулятивное декодирование 0:28:20 — Воспоминания о культовых играх и компьютерах 0:33:45 — Настройка контекстного окна и параметров модели 0:44:00 — Сравнение видеокарт для инференса нейросетей 0:50:40 — Обсуждение генерации музыки в нейросетях 1:08:05 — Тестирование AI-агента на тестовой виртуальной машине 1:23:45 — Автоматизированный анализ и поиск путей эскалации 1:54:30 — Подведение итогов стрима и завершение трансляции Каналы участников стрима, чтобы подписаться: Павел Рыков Константин Доронин

Кратко (AI)

Опубликована запись второй части стрима, посвященного созданию и запуску AI-агентов. В видео подробно разбираются архитектура проекта SECS, настройка локального инференса моделей Qwen с использованием vLLM, а также методы ускорения работы нейросетей и практическое тестирование агентов в изолированной среде.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖