Pokee представила агентную модель Isaac 28B с контекстом 10 млн токенов
M@machinelearning_interviewAI-инженер
3 недКомпания Pokee выпустила Isaac 28B — агентную модель с поддержкой 10 млн токенов, оптимизированную для работы на одном GPU.
Появление эффективных моделей с огромным контекстом позволяет локально анализировать целые базы кода и архивы документов.
- Возможность работы с 10 млн токенов на одном GPU снижает порог входа для анализа больших данных.
- Низкая стоимость API-доступа делает агентные решения более доступными для бизнеса.
- Модель оптимизирована для специфических задач: анализа логов, кода и истории вызовов инструментов.
🚀 Pokee представила Isaac 28B - агентную модель с контекстом до 10 миллионов токенов
Компания называет её первой frontier-класс моделью такого размера, способной работать на одном GPU. Isaac использует собственную non-decoder-only архитектуру и рассчитана на долгие агентные задачи: анализ больших кодовых баз, документов, логов и истории вызовов инструментов.
Главные результаты:
93,3% на RULER при контексте 10M токенов
до 137 200 токенов/с на этапе prefill на одной NVIDIA B200
около 335 токенов/с при генерации
первое место среди протестированных моделей на BFCL v4 и τ³-bench
самый низкий combined attack success rate в сравнении DTAP
Саму 28B-модель можно развернуть на одной RTX 4090 или RTX 5090, внутри VPC, on-premises или локально. Но важно: рекордные показатели для полного 10M-контекста измерялись именно на B200, а не на потребительской видеокарте.
Есть и важная оговорка: все сравнительные бенчмарки проведены самой Pokee в собственном harness. Поэтому результаты ещё требуют независимой проверки.
На странице запуска указана предварительная цена $0,15 за миллион входных токенов и $1 за миллион выходных токенов!
Technical blog: https://console.pokee.ai/model Technical report: https://console.pokee.ai/pokee-isaac-28b-v0-technical-report.pdf API: https://console.pokee.ai

Кратко (AI)
Компания Pokee анонсировала Isaac 28B, агентную модель с поддержкой контекста до 10 миллионов токенов, использующую уникальную архитектуру. Модель ориентирована на работу с большими объемами данных и может быть развернута на потребительских видеокартах, хотя пиковые показатели производительности требуют серверного оборудования.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖