Cursor оптимизировала работу агентов, снизив стоимость в 8 раз

N@v_neuroAI-инженер
1 мес
📱 Cursor удешевила рой агентов в 8 раз Несколько моделей вместе переписали SQLite с нуля по документации. Результат один и тот же, а цена то 1339 $, то 10565 $. Что цепляет: ✧ Старый рой - 70К конфликтов слияния, а новый - меньше 1К ✧ Дорогая модель нужна только для планирования, дешёвая тянет 90% работы ✧ Код выложили в открытый доступ на GitHub Экономия в чёткой постановке задачи для дешёвой модели. 🔗 Как рой сам чинит свои конфликты и почему скачет цена #cursor Читайте нас в MAX

Обзор слухов о новых iPhone 18 Pro и iPhone 18 Pro Max

К@d_codeавтор про «tech»
1 мес
😏 Вы зря ждёте iPhone 18 Pro и iPhone 18 Pro Max Собрали все 12 известных новшеств новых Айфонов, которые сулят нам слухи и утечки за 2 месяца до презентации. С учётом того, что новые iPhone наверняка будут дороже, разобрались, стоит ли ждать новинки или разумнее купить iPhone 17 Pro (Max) уже сейчас: ☀️ https://kod.ru/iphone-18-pro-max-12-novshestv-stoit-li-zhdat

Unity внутри Unreal: Epic Games трансформирует Fortnite

C@CGIT_Vinesгеймдев
1 мес
Наконец-то XZIBIT добрался до геймдева. Теперь можно посмотреть первую презентацию Unity внутри Unreal. Напомню, что фортнайт скоро перестанет быть просто фортнайтом а будет хабом для других игр. Не как сейчас геймслоп, хотя и он тоже останется, а тик-ток для игр или метаверс (слово, которое фонит и его уже никто не использует). Но факт в том, что индустрия меняется и эпики хотят быть впереди изменений. И как водится они должны сделать игру которая будет полигоном этих изменений. Не ждем, а готовимся. @CGIT_Vines

Избыточность мобильных приложений для простых задач

Х@habr_comмедиа / агрегатор
1 мес

Почему зарплаты $500,000 в Meta не хватает на жизнь

В@ventureStuffмедиа / агрегатор
1 мес
Почему зарплаты $500,000 в мете не хватает на жизнь? Говорят, что когда находишь формат, нужно на него double down. Видео про оффер в Lovable собрало очень неплохо просмотров. Оно с другой стороны понятно, ибо людей, кто хотят получать четенькую зарплату примерно в 10х больше, чем людей которые какой-нить бизнес хотят замутить. Но решил копнуть и пошел искать по друзьям. И нашел друга с ЗП $500K и он мне обьяснил почему этого еле хватает на жизнь, а ЗП $300K на семью - это почти за гранью нищеты. Я видео конечно сниму, а хотел вас спросить а вам такое интересно? :)

Психология предпринимателя-берсерка: ловушка незаменимости

B@blackproductпродакт / фаундер
1 мес

Почему препятствия в продукте могут быть полезны на раннем этапе

П@vladimir_merkushevпродакт / фаундер
1 мес

Перу: политический парадокс, экономика меди и наследие инков

n@nonamevcавтор про «finance»
1 мес

Опыт использования Fable 5 и оркестратора soerdev

S@softwareengineervlogAI-инженер
1 мес

Исследование: LLM снижают точность ответов, но повышают уверенность пользователей

Учёные из трёх ведущих университетов провели эксперимент: участникам задавали сложные вопросы (в том числе о деталях фильмов) и разрешали в любой момент ответить «не знаю». Одной группе давали доступ к языковой модели Step 3.5 Flashi — по данным источников, она справлялась с этими вопросами хуже всех.

Результат: с помощью LLMi люди отвечали на больше вопросов, но точность резко упала, а уверенность в своих (часто неверных) ответах выросла. Модель не заполняла пробелы в знаниях, а превращала верные интуитивные догадки и восстанавливаемые из памяти ответы в ошибки.

ВыводПо данным @kyrillic: точность ответов упала с 28% до 9%, уверенность выросла с 30% до 76%

28% → 9%точность ответов без/с LLM (по @kyrillic)
30% → 76%уверенность в ответах без/с LLM
40% → 3-6%доля ответов «не знаю» без/с LLM

Полный разбор →

Новые хоррор-видео Spencer Lackey

Р@remediaгеймдев
1 мес
Хоррор-видосы блогера Spencer Lackey продолжают взрывать интернет — в этот раз он выпустил серию про семью и получилось очень крипово. Смотрим и спать😒😒😒

Иностранные SDK в приложениях армии США

C@campcodeAI-инженер
1 мес
У американских военных нашли нового "союзника"... китайские и российские SDK 😂 Исследователи проверили 220 приложений для армии США — каждое восьмое содержало иностранный код, а 40% собирали больше данных, чем обещали. Среди находок — Huawei и российский бигтех, включая софт с трекерам, способными палить геолокацию. В итоге данные о перемещении подразделений, графики дежурств и геопозиции персонала на секретных объектах спокойно утекали через обычные рекламные сети. Пентагон можно не взламывать 😁

Состояние 5G-сетей в Африке: скорость против инфраструктурных проблем

Х@habr_comмедиа / агрегатор
1 мес

Квантизованные reasoning-модели «переосмысливают» ответы — и это можно вылечить занижением 50 токенов

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 1 мес назад

Команда из Meta исследовала, почему квантизованные reasoning-модели теряют в качестве сильнее, чем модели, квантизованные для обычных задач. Оказалось, что дело не только в потере точности вычислений, а в специфическом эффекте overthinkingi: модель зацикливается в рассуждениях и даже получив верный ответ на промежуточном шаге, в итоге выдаёт другой, ошибочный.

Авторы нашли простой и эффективный способ борьбы с этим: заниженные логиты для 50 вручную отобранных «overthinking-токенов» (вроде «Wait», «But», «Alternatively») одновременно сокращают длину ответа и повышают качество — важный практический результат для тех, кто использует квантизацию reasoning-моделей в проде.

ВыводРассмотрены варианты квантизации: weight-only AWQ и GPTQ в 3 и 4 бита, а также weight+activation+KV-cache квантизация в 4 и 8 бит через FlatQuant

5–15%прирост качества после занижения логитов
10–20%сокращение длины ризонинга
50число вручную отобранных overthinking-токенов

Полный разбор →

Как Алекс Либерман использует Claude для создания контента

K@karpovaventuresавтор про «startups»
1 мес

Философский взгляд на машинные доказательства

Т@tech_priestessAI-инженер
1 мес
машинные доказательства это очень хорошо потому что они нам указывают на наши грехи: тщеславие, гордыню, алчность, уныние, зависть думаю в этом и есть смысл Машины

Проблема статичных диалогов в современных играх

G@GameDEVгеймдев
1 мес
And games are even worse with 99% of the modern dialogues are either static or done while walking. The rare dynamic cutscenes in the dining hall from Cyberpunk are priceless in modern world: https://www.youtube.com/watch?v=kQBWPGYGJkk

Анализ нарративных дыр в Still Wakes the Deep

В@whatalevelгеймдев
1 мес

Разработка визуальной новеллы Deliberate AI Slop

G@GameDEVгеймдев
1 мес
I'm gonna make a visual novel named Deliberate AI Slop, but it will be 100% handcrafted with all the work captured on stream to cause butthurt for both camps. Sleep well!
Ещё ↓