ggufСбросить фильтр ×

Muse V2: чат-панель с LLM для ComfyUI

Н@GreenNeuralRobotsAI-инженер
1 нед
Muse V2: чат-панель с LLM для ComfyUI

Qwen выпустила веса модели-гиганта Qwen3.8-2.4T-A95B на 2,4 трлн параметров

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 2 нед назад

Разработчики Qwen опубликовали на Hugging Facei открытые веса новой модели Qwen3.8-2.4T-A95Bi — с общим числом параметров 2,4 трлн. Это один из крупнейших публично доступных весовых релизов ИИ-модели на сегодня.

Сообщество уже подготовило квантованные GGUFi-версии для локального запуска (через unsloth), хотя большинство пользователей отмечают, что запустить модель такого масштаба у себя просто негде.

2,4 трлнвсего параметров модели
95Bактивных параметров (A95B)
27Bожидаемая меньшая модель

Полный разбор →

Появился каталог ресурсов Awesome MiniMax-H3

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 3 нед назад

В открытом доступе появился постоянно обновляемый репозиторий awesome-minimax-H3 на GitHub — единая точка сбора всех материалов по модели MiniMax H3i. Ресурс собирает веса моделей, LoRAi, квантизации, VAEi, текстовые энкодеры, кастомные ноды для ComfyUI, а также гайды и туториалы, освобождая пользователей от необходимости искать разрозненные материалы по разным каналам.

Полный разбор →

Выпущены GGUF-версии модели Qwen3-TTS

Н@GreenNeuralRobotsAI-инженер
3 нед
Qwen3-TTS-12Hz-1.7B-Base-GGUF Пачка GGUF версий говорилки Qwen3-TTS с клонированием голоса и управлением через текстовые инструкции.  - 4-bit Q4_K_M: размер файла 1.04 ГБ - 8-bit Q8_0: размер файла 1.85 ГБ - 16-bit BF16: размер файла 3.47 ГБ Спасибо @Endorpheen #tts #gguf

Оптимизация модели Qwen-Image-2512 от ByteShape

Н@GreenNeuralRobotsAI-инженер
3 нед
Qwen-Image-2512 GGFU/Humming Пока Алибаба зажал новые квены, ByteShape оптимизировали старый. • шесть уровней квантизации для GGUF от 8 до 17 ГБ • Humming - экспериментальная интеграция, но быстрее GGUF • для vLLM-Omni: 8–17 ГБ, ускорение в 2–3 раза сравнение с оригинальной моделью #qi2512 #gguf #humming
Оптимизация модели Qwen-Image-2512 от ByteShape

Релиз POCKET-35B-GGUF: LLM для запуска на смартфонах

Н@GreenNeuralRobotsAI-инженер
1 мес
POCKET-35B-GGUF Модель на 35B параметровна базе Darwin-36B-Opus, которая запускается без GPU на смартфоне! • Поддержка английского и корейского языков • Интеграция с популярными инструментами (Ollama, LM Studio) • Размер модели от 8.2 до 21 ГБ в зависимости от квантизации Демо Коллекция компактных моделей Спасибо @m_franz #gguf #compact #mobile
Релиз POCKET-35B-GGUF: LLM для запуска на смартфонах

Релиз компактной агентной модели Nanbeige4.2-3B

Н@GreenNeuralRobotsAI-инженер
1 мес
Nanbeige4.2‑3B Компактная агентная модель на 3B параметров, показывает сильные результаты - Превосходит более крупные модели. По бенчмаркам в задачах для агентов (в том числе общих и кодовых), а также в рассуждениях она обходит Qwen3.5‑9B и Gemma4‑12B. - Агентные сценарии. Заточена под работу в роли агента, может планировать шаги, выполнять цепочки действий и взаимодействовать с инструментами. - Подходит для локального использования - 269★ за 1 час HF Квантизации Демо #gguf #agent #compact

Релиз весов LingBot для ComfyUI

Н@GreenNeuralRobotsAI-инженер
1 мес
LingBot_ComfyUI Веса видеогенератора LingBot Video 1.3B, переупакованые для #ComfyUI В чате пишут что хорошо квантуется ——— LingBot-World-v2 14B causal-fast GGUF генератора миров ——— Обе должны работать на 8ГБ VRAM Спасибо @m_franz #t2v #i2v

Релиз модели Qwen3.6-34B-80L-Fable-5-Heretic

Н@GreenNeuralRobotsAI-инженер
1 мес
Qwen3.6-34B-80L-Fable-5-Heretic Продолжаем парад дистилляций Fable-5 основана на Qwen3.6-27B, снята цензура. Фокус на агентные сценарии и сложные логические цепочки • 34B параметров, 80 слоев рассуждения • дистилляция из Fable-5 Agentic Traces • дообучение на 4665 CoT-траекториях через QLoRA • формат 4-bit NF4, rank=64 GGUF #reasoning #gguf

Это всё на сейчас.