ИИ

Wan-Dancer: генератор танца по фото и музыке

Н@GreenNeuralRobotsAI-инженер
1 мес

Предрелизный обзор нового LLM бенчмарка

L@llm_under_hoodAI-инженер
1 мес
Я почти закончил делать первую версию нового LLM бенчмарка, вместе с отчетом. Скоро все будет. Но пока вот картинка для исторических целей про то, как выглядела картина до выхода ChatGPT 5.6. Там очень много антропика! Sonnet 5 (high) на 4м месте, а low - на 6м, Opus 4.8 на 8м, Sonnet 4.6 на 10м. DeepSeek v4 Pro на 7 месте Fable легко мог бы занять топовое место, если бы не паниковал и не бросал трубку на каждую угрозу, вместо отрабатывания штатно. Ваш, @llm_under_hood 🤗

Влияние ИИ на рабочую нагрузку и выгорание сотрудников

Д@evidencebasedmanавтор про «it»
1 мес

Почему привязанность к одной AI-модели — ошибка для стартапа

И@dindexмедиа / агрегатор
1 мес

Разработка системы гардрейлов для LinkedIn-постинга через Паблора

С@sergiobulaevAI-инженер
1 мес

Почему Claude Sonnet 5 оказался дороже Opus 4.8 в реальных задачах

N@neuro_art0AI-инженер
1 мес

Anthropic и OpenAI расширяют доступ к лимитам моделей

e@cryptoEssayAI-инженер
1 мес
Антропик продлил Fable 5 в подписке еще на неделю до 19 числа, а OpenAI вообще отменил 5-часовые лимиты для 5.6 в Codex / GPT for Work Аттракцион невиданной щедрости продолжается, но это будет не долго.

ИИ как катализатор кризиса системы образования

T@techsparksAI-инженер
1 мес

Нейродайджест: обновления моделей и новости индустрии

э@ai_newzAI-инженер
1 мес

Создание нейросетевого клипа на музыку Грига: опыт работы с Grok

М@cgeventAI-инженер
1 мес

Продажа пользовательских данных для обучения ИИ

v@vcnewsмедиа / агрегатор
1 мес
ИИ-разработчики практически исчерпали открытые данные для обучения, ещё в конце 2024 года говорил соучредитель OpenAI Илья Суцкевер. Так появился рынок, на котором пользователям продают идею о лёгком заработке, а ИИ-компаниям — их данные. Какие данные можно продать для обучения ИИ, сколько за это платят и платят ли вообще — в обзоре vc.ru/ai/3004349

Сравнение облачных моделей для перевода отзывов

S@saas_foundersAI-инженер
1 мес

Оптимистичный взгляд на будущее к 2050 году

T@thefutureofworkкарьера / HR
1 мес

Связка моделей GPT-5.6 и Fable 5 для автоматизации задач

T@tips_aiAI-инженер
1 мес

Google AI Studio добавил интеграцию с GitHub

1 мес

Почему документация кода избыточна при работе с LLM

С@svyatamestoAI-инженер
1 мес

Промышленный шпионаж в эпоху AI: от кражи данных до дистилляции моделей

М@maxvotekмедиа / агрегатор
1 мес

Google DeepMind представили GenCeption

Н@GreenNeuralRobotsAI-инженер
1 мес
GenCeption от Google DeepMind Единая feed-forward модель мультизадачного зрения. Заменяет зоопарк специализированных моделей • оценка глубины, нормалей поверхности, позы камеры • сегментация, 2D/3D ключевые точки • работа с плотными и разреженными задачами Обучена на синтетических видео, работает на реальных данных. Использует замороженную диффузионную text-to-video основу плюс лёгкие задачи-специфичные головы Код/веса ждем #vlm #video2depth #video2normals #tracking #video2camera #video2pose

Ant Group открыла код генеративной игровой модели LingBot-World 2.0

Robbyant — подразделение китайского холдинга Ant Groupi — выложила в открытый доступ модель LingBot-World 2.0i, способную генерировать интерактивные виртуальные миры длительностью до часа без потери качества картинки. Система формирует геймплейный видеопоток в 720p при 60 кадрах в секунду и держит визуальную стабильность на протяжении всей сессии.

Это заметный шаг в области генеративных игровых миров: модель поддерживает действия (атаки, заклинания, стрельбу), реагирует на пользователя менее чем за секунду и позиционируется как основа для симуляций и прогнозирования, в том числе в робототехнике.

1 часдлительность генерации мира без падения качества
720p/60fpsразрешение и частота кадров генерации
<1 секвремя отклика при генерации сцен

Полный разбор →

Ещё ↓