ИИ

Ограничения ИИ в поиске истины

С@startupofthedayавтор про «startups»
2 нед

Исследовательская версия Claude улучшила рекорд по гипотезе Риммана, хотя саму гипотезу не доказала

Сотрудник Anthropic — по данным нескольких источников, это Джаред Самнер, создатель bun, — попросил неопубликованную исследовательскую версию Claude «серьёзно взяться» за гипотезу Римана, открытую с 1859 года и оценённую в миллион долларов премии. Модель не смогла доказать саму гипотезу, но за полтора дня работы улучшила ключевую оценку: доля нулей дзета-функции, лежащих на критической линии, поднялась с 41,6% до 67,2%.

Это значимый прогресс: с 1974 по 2020 год математики сдвинули эту границу лишь с 33,3% до 41,6% — за 46 лет коллективной работы десятков учёных. Claude добился скачка втрое большего масштаба за одну попытку, при этом всё «руководство» человека сводилось к фразам вроде «продолжай» и «верь в себя».

ВыводСначала Claude перебрал, по разным данным, 600+ (Data Secrets) или 650 (AI Central Александра Горного) идей и не смог найти рабочий подход

41,6% → 67,2%рост доли доказанных нулей дзета-функции
31 млнвыходных токенов потрачено
60субагентов координировала модель

Полный разбор →

Как научить ИИ-ассистента писать в вашем стиле

И@moremarketingisaidAI-инженер
2 нед

JoyAI-Video-Edit: 16B-модель для редактирования видео в реальном времени

N@neurohiveAI-инженер
2 нед

AIRI, FusionBrain и SberAI выпустили большой разбор диффузионных языковых моделей (dLLM)

Команды «Интерпретируемый ИИ» лаборатории FusionBrain, «Основы генеративного ИИ» Института AIRI и «Генеративная поэзия» Сергея Маркова (SberAI) опубликовали на Хабре итог годичной совместной работы над диффузионными языковыми моделями (dLLMi). Они воспроизводили чужие методы, обучали свои модели и ускоряли инференс, чтобы разобраться, какие подходы к dLLM реально работают, а какие пока не стоят вложенного времени.

В отличие от классических LLM, генерирующих текст токен за токеном слева направо, dLLM раскрывают замаскированные позиции параллельно по всей последовательности — отсюда обещание кратного ускорения генерации. Но на практике эффект ограничен тем, что классический KV-кэшi в диффузионных моделях нормально не работает.

ВыводРазобраны три подхода к dLLM: адаптация готовой LLM в диффузионную, обучение с нуля и дистилляция уже обученной модели

2,7×ускорение ReFusion+GigaChat 3B по wall-clock
1024 → 16сокращение шагов расшумления методом IDLM
3Bразмер модели GigaChat в эксперименте ReFusion

Полный разбор →

Spotify представил Xirp — единую среду разработки для ИИ-агентов

v@vcnewsмедиа / агрегатор
2 нед
Spotify сделал единую среду разработки для Claude Code, Codex и Gemini — Xirp. В ней одновременно можно вайбкодить с разными ИИ-агентами, контекст не придётся переносить в новую сессию вручную. Это разработка инженеров стриминга, которую сначала использовали внутри компании vc.ru/ai/3072904

Memora: структурированная память для ИИ-агентов

Н@GreenNeuralRobotsAI-инженер
2 нед
Memora Tot одна память для агентов Структурированное хранение, семантический поиск, граф знаний, RAG-чат. MIT-лицензия, 636 звёзд на GitHub. Фишки: typed edges между воспоминаниями (implements, supersedes, contradicts), авто-связывание по семантической близости, защита документных фрагментов от случайного удаления/мtрджа. • Встраивается как MCP-сервер • Векторный поиск: OpenAI (по умолчанию), локальные sentence-transformers (~2 ГБ) или TF-IDF • Облачные бэкенды: Cloudflare D1, R2, S3-совместимые • LLM и эмбеддинги конфигурируются раздельно - можно OpenRouter для чата + Cloudflare для векторов #agent #memory

Дайджест новостей ИИ: обновления Anthropic, планы Microsoft, возвращение Брина и новые модели

2 нед

Новый выпуск подкаста «на Вайбе»: ИИ-тренды и поездка в США

А@itbeardавтор про «it»
2 нед
⚡️ Долгожданный новый выпуск "на Вайбе" уже онлайн! Месяц в США по AI-программе Госдепа показал: американский технооптимизм трещит по швам, а разработка уже превращается в Dark Factory, где человек почти не видит код. Разбираем GPT-5.6, Opus 5, Kimi K3, DeepSeek V4, AI Act, взлом Hugging Face, авторское право и интернет, который захватывают AI-агенты. Большое возвращение «ПНВ» — с поездкой по Америке, главными новостями ИИ и спором о том, останется ли в сети место для людей. 👉 YouTube 👉 Apple Podcasts 👉 Spotify 👉 Скачать mp3 👉 RSS 💬 Обсудить в чате

ИИ требует смены подхода к управлению

Г@glebkudrмедиа / агрегатор
2 нед
Рынок неровно дышит к «ИИ сотрудникам», именно такая формулировка залетает в сердечки собственников. Но правда в том, что на ИИ в первую очередь нужно менять не сотрудников, а руководителей.

Revelio Labs запустили AI Labor Market Tracker

T@thefutureofworkмедиа / агрегатор
2 нед
Revelio Labs запустили свой AI Labor Market Tracker. И в отличии от других подобных трекеров, собранных на клоде, — с гораздо более качественными данными и аналитикой. Если попробовать сделать обобщенный вывод по их инсайтам, то ситуация выглядит примерно так... AI пока не вызывает массового сокращения занятости. Но меняет структурные элементы рынка труда: сокращает точки входа, перестраивает содержание некоторых профессий, повышает ценность senior-специалистов и одновременно в целом ухудшает эффективность метчинга между соискателями и работодателями. → https://www.reveliolabs.com/ai-labor-market-tracker
Revelio Labs запустили AI Labor Market Tracker

Почему попытки «очеловечить» или сжать ответы LLM вредят качеству

Б@blognotAI-инженер
2 нед
Ещё ↓