данныеСбросить фильтр ×

Figure AI собрала крупнейший в мире датасет видео для обучения роботов через приложение Index

Стартап человекоподобных роботов Figure AI четыре месяца в закрытом режиме тестировал приложение Indexi, через которое обычные люди записывают видео повседневных бытовых задач — мытьё посуды, уборка, работа по дому — и получают за это деньги. Собранные ролики уже используются для обучения модели Helixi, лежащей в основе роботов Figure.

Проблема, которую решает Index: если языковые модели обучают на текстах, которых в интернете полно, то для роботов не хватает данных в формате POV о том, как человек выполняет обычные бытовые действия. Приложение уже доступно в AppStore и GooglePlay, а масштаб сбора данных Figure планирует увеличить ещё в 100 раз.

$15 млнвыплачено пользователям за видео
264 000скачиваний приложения Index
>$1 млрдпланируемые расходы на данные и вычисления в след. году

Полный разбор →

Google планирует купить данные обанкротившейся Spirit Airlines для обучения AI

G@aiofthedayAI-инженер
2 дн

Анонс публикации собственного исследования

T@kryak_startupAI-инженер
4 дн
изучите исследования - ваще свежак а я скоро пришлю свое - abstract и графиками. Буду думать как без компрометации деталей про это можно открыто рассказать
Анонс публикации собственного исследования

Google купила у банкрота Spirit Airlines архив писем и чатов сотрудников за $10 млн — данные пойдут на обучение ИИ

$10 млнцена, за которую Google купил данные Spirit Airlines

Обанкротившийся 1 мая крупнейший американский лоукостер Spirit Airlines стал источником нового вида актива: его внутренние корпоративные данные — письма, чаты, финансы, код — были проданы на банкротном аукционе. Победителем стал Google, предложивший $10 млн; данные пойдут на разработку продуктов и обучение ИИ-моделей.

Случай показывает, что рынок ИИ-данных переходит от бесплатного скрапинга публичного интернета и лицензирования качественного контента (как у News Corp или Financial Times) к покупке операционных данных умерших компаний — переписки, регламентов, истории решений. Это нужно, чтобы учить не просто отвечающие модели, а ИИ-агентов, способных управлять реальными бизнес-процессами.

100 млнколичество корпоративных писем в пакете данных
$12,5 млнконкурирующая ставка стартапа Micro1

Полный разбор →

Визуализация правок в Википедии в реальном времени

D@denissexyAI-инженер
6 дн
Все изменения в Википедии в реальном времени 🤩 Кажый кирпичик – какое-то изменение, цвет зависит от языка. Можно еще прям каждое изменение и посмотреть.

OpenAI передала ФБР логи переписки пользователя с угрозами

C@cyberyozh_officialAI-инженер
1 нед

Риск потери данных при переполнении Яндекс Диска

И@brainshareмедиа / агрегатор
1 нед
Оказывается, если не купить больше места на Яндекс диске, когда текущее место закончилось - можно потерять все свои данные. Удобно
Риск потери данных при переполнении Яндекс Диска

DecryptAds: сервис для отслеживания рекламных сетей и брокеров данных

Б@blognotAI-инженер
1 нед

Разработчики ИИ скупают корпоративные данные для обучения моделей

3@ru3dnewsавтор про «tech»
1 нед
В интернете кончились тексты: разработчики ИИ начали скупать корпоративные чаты и письма OpenAI, Anthropic и другие разработчики ИИ всё активнее ищут доступ к корпоративным данным. Публичной информации в интернете для обучения моделей становится недостаточно. Поэтому растёт спрос на переписки в мессенджерах, электронные письма и записи видеоконференций. Также компании интересуются историей изменений программного кода. #искусственныйинтеллект #нейросети #данные 📎Подробнее 🔖 3DNews в TG | MAX | VK
Разработчики ИИ скупают корпоративные данные для обучения моделей

Совет по тестированию импорта и экспорта данных

A@qachanellавтор про «it»
1 нед
Совет от тестировщика 75/∞ : Экспорт-импорт по кругу. Выгрузите данные в CSV или Excel, ничего не меняя, и загрузите обратно. Сравните с оригиналом посимвольно. Кодировка, разделители и даты – самое частое место, где что-то теряется именно на этом круге.
Совет по тестированию импорта и экспорта данных

Хакерская атака на сеть фитнес-клубов DDX Fitness

К@d_codeавтор про «tech»
2 нед
🤫 Позанимались Популярная сеть фитнес клубов DDX Fitness подверглась хакерской атаке. По данным Baza, в сеть утекли фото посетителей со стоек регистрации, а также даты визитов, покупки и адреса клубов. Подробности: ↖️ https://kod.ru/ddx-fitness-utechka-dannyh
Хакерская атака на сеть фитнес-клубов DDX Fitness

Ограничения ИИ в поиске истины

С@startupofthedayавтор про «startups»
2 нед

AI-стартапы скупают редкие книги для обучения моделей

Д@disruptors_officialмедиа / агрегатор
2 нед

Гайд по работе с хранилищами в Kubernetes

Х@habr_comмедиа / агрегатор
3 нед
Гайд по работе с хранилищами в Kubernetes

Почему ИИ-агенты ошибаются в финансовых отчетах

Х@habr_comмедиа / агрегатор
3 нед
Ситуация SOS: ИИ сообщил руководству, что выручка выросла на 15%. Потом финансовый директор сказал: «Не гоните лошадей, какие 15%? А учтены ли налоги и возвраты, когда обновились данные и откуда вообще взялась эта цифра». Ответов не оказалось. Отчет собрали за несколько секунд, а проверять его пришлось полдня. Дело в том,, что ИИ-агент не замечает, что разные отделы считают один показатель по-разному. Он может взять устаревшие данные или уверенно выдать ноль, когда нужная таблица просто не загрузилась. Автор предлагает 5 вопросов, на которые должны отвечать ваши данные, прежде чем с ними начнет работать ИИ-агент.

Почему цифры на слайдах врут: ловушки метрик

К@Kruzhok_kroyki_bytiyaкарьера / HR
3 нед

Samsung блокирует Smart TV приложения для сбора данных

v@vcnewsмедиа / агрегатор
3 нед
Samsung заблокирует приложения для Smart TV, которые позволяли третьим лицам получать доступ к трафику пользователей. Сеть использовали для массового сбора данных из профилей LinkedIn и получения информации для обучения ИИ vc.ru/services/3061354
Samsung блокирует Smart TV приложения для сбора данных

Автор канала запустил свой ресторанный проект МИРА бистро

Н@not_boring_dsAI-инженер
3 нед
Автор канала запустил свой ресторанный проект МИРА бистро
Ещё ↓