nlpСбросить фильтр ×

Сбер выпустил новое поколение эмбеддинг-моделей GigaEmbeddings

Сбер открыл в открытом доступе новую линейку GigaEmbeddings — моделей, которые переводят текст в числовые векторы для семантического поиска, RAGi-систем, классификации и кластеризации. Линейка состоит из трёх моделей — 480M, 3B и 10B-A1.8Bi — и распространяется бесплатно под лицензией MIT на HuggingFace и GitVerse.

Качество таких эмбеддингов напрямую влияет на точность ответов ИИ-ассистентов и снижает риск галлюцинаций, что критично в поддержке клиентов, работе с юридическими и финансовыми документами и внутренними базами знаний. Новое поколение стало заметно быстрее и сильнее в английском языке и коде, при этом не потеряв качество на русском.

74,99результат флагмана 10B-A1.8B в ruMTEB
14,5 пунктаприрост модели 3B в обработке кода
2 разаускорение инференса 10B-A1.8B на vLLM

Полный разбор →

Обзор поискового агента Context-1: метрики и обучение

Д@stuffyNLPAI-инженер
1 нед
Обзор поискового агента Context-1: метрики и обучение

Context-1: поисковый агент с механизмом самоочистки контекста

Д@stuffyNLPAI-инженер
2 нед

AgentFold: метод динамического управления контекстом для AI-агентов

Д@stuffyNLPAI-инженер
4 нед
AgentFold: метод динамического управления контекстом для AI-агентов

SafetyBench: бенчмарк безопасности LLM на русском языке

Н@navuka_i_jiznAI-инженер
4 нед
SafetyBench: Russian-language LLM safety benchmark for toxicity evaluation and jailbreak robustness testing grounded in Russian law #AINL2026 #NLP 📺 https://www.youtube.com/watch?v=6SvzoQHfd7w ▶️ https://vkvideo.ru/video-38193760_456239047?list=ln-KERAZuWKiz49sZCjNZ

Особенности работы с токенайзерами BPE в моделях NLLB

̶@izolenta_mebiusaAI-инженер
1 мес

AsyncReasoning: метод асинхронного рассуждения для LLM от Yandex Research

Д@stuffyNLPAI-инженер
1 мес

ICML 2026: новые бенчмарки для агентов-кодеров — SWE-rebench V2 и CoDA-Bench

На ICML 2026 представили два бенчмарка для оценки AI-агентов в задачах разработки и анализа данных. Nebius обновили SWE-rebench до версии V2, сделав его языково-агностичным и заточенным под сбор данных для RL-обучения агентов на реальных задачах из репозиториев. Параллельно появился CoDA-Benchi — бенчмарк, проверяющий умение агентов находить нужные данные среди связанных файлов и анализировать их на материале Kaggle-ноутбуков.

Оба проекта решают одну проблему: как получить чистые, автоматически проверяемые задачи для тренировки и оценки кодовых агентов в масштабе, без ручной разметки каждого случая.

ВыводВ SWE-rebench V2 окружение под каждый репозиторий собирает собственный интерактивный агент: читает README/конфиги, ставит зависимости, запускает тесты и чинится по логам ошибок; полный цикл удался лишь для 20% проектов

30 млнисходный пул пул-реквестов
32 тысячиитоговых задач после фильтрации
20%доля проектов с успешно собранным окружением

Полный разбор →

Тренды бенчмарков на ICML 2026: агенты и проблемы оценки

Д@stuffyNLPAI-инженер
1 мес

Обзор ключевых докладов с конференции ICML 2026

Д@stuffyNLPAI-инженер
1 мес

ICML 2026: методы управления контекстом в агентных системах

Д@stuffyNLPAI-инженер
1 мес

TG-RAG: фреймворк для борьбы с когнитивным дрейфом LLM

Д@stuffyNLPAI-инженер
1 мес

Обзор методов обучения и инференса LLM с конференции ICML 2026

Д@stuffyNLPAI-инженер
1 мес

Анализ эффективности поиска информации агентами и людьми на ICLR 2026

Д@stuffyNLPAI-инженер
1 мес

Обзор методов Diffusion Language Models с ICLR 2026

Д@stuffyNLPAI-инженер
1 мес

Обзор агентских систем с конференции ICML 2026

Д@stuffyNLPAI-инженер
1 мес

Рецензирование статей в цикле ACL ARR

A@abstractDLAI-инженер
1 мес
Ревьюю научные статьи в майском ACL ARR-цикле, и среди сабмитов попалась работа, которая очень приятно цитирует мои старые публикации про анизотропию и внутреннюю размерность трансформеров. Теперь, конечно, хочется накинуть авторам пару баллов просто за хороший вкус 😁 Держусь изо всех

Планы по развитию инструментов оценки перевода и моделей для языков Кавказа

̶@izolenta_mebiusaAI-инженер
1 мес

Ускорение генерации роллаутов в GRPO через спекулятивный декодинг

Д@stuffyNLPAI-инженер
1 мес

Новая роль Senior NLP Researcher

Т@tech_priestessAI-инженер
1 мес
Карьерное обновление: сегодня начинаю работу в 💳 в роли так называемого Senior NLP Researcher в управлении экспериментальных систем машинного обучения 😌 Пока что просто сижу на стуле и жду, когда выдадут ноутбук, держу в курсе 😌 #о_себе

Это всё на сейчас.