ИИ

Промпт для Claude для улучшения стиля текста

П@badTechProjectкарьера / HR
1 мес
Ладно, вот вам скилл для клода, который вам поможет ваши тексты из бюроркатичных превратить в человечные.

Влияние будущих открытых ИИ-моделей на кибербезопасность

e@cryptoEssayAI-инженер
1 мес
Пока что, по последним новостям, выглядит так, что мы получим модель уровня Mythos в открытом доступе в течении 3-6 месяцев. Что будет означать довольно серьезные перемены в плане кибербезопасности. Количество крипто хаков выросло примерно на 100% по сравнению с 6 месяцами назад. И я думаю это только продолжит расти, и далеко за пределами крипты. Для любого CSO / CIO это большой вызов и неспособность адаптироваться может привести к очень печальным последствиям, но сложность в том, что никто не знает как точно должен выглядеть этот процесс адаптации.

Утечка личных данных через память Claude

Х@habr_comмедиа / агрегатор
1 мес

Alibaba выпустила Qwen-Image 3.0 — генератор изображений с промптами до 4500 токенов

Alibaba представила новую версию модели генерации изображений Qwen-Image 3.0. Главное отличие — длина промптiа выросла до 4500 токенiов (против 1000 у версии 2.0, то есть в 4,5 раза), что позволяет давать модели почти техническое задание с описанием структуры, текста, стиля и верстки. Модель научилась за один запрос собирать сложные инфографики, интерфейсы, газетные полосы, слайды, страницы научных работ с формулами и математические материалы.

Особое внимание уделили генерации мелкого текста — модель разборчиво рисует текст размером от 10 пикселей, поддерживает более 20 шрифтов и 12 языков (есть ли русский — неизвестно). Улучшили и фотореализм: передачу текстур кожи, тканей, пор и волосков. Однако релиз вышел без весов, кода, технического отчёта и независимых тестов — только черрипикиi от самой Alibaba, что нарушает традицию серии Qwen выпускать открытые веса и отчёт «день в день» с релизом.

4500 токеновмаксимальная длина промпта
1000 токеновлимит промпта у версии 2.0
10 pxминимальный разборчивый размер текста

Полный разбор →

Влияние формы подачи на подверженность LLM галлюцинациям

1 мес

Bonsai: запуск 1-битной модели Qwen 27B на iPhone

N@neurohiveAI-инженер
1 мес

IGGT4D: онлайн-понимание 4D-сцен в видеопотоке

Н@GreenNeuralRobotsAI-инженер
1 мес
IGGT4D Онлайн-понимание 4D-сцен в видеопотоке. Строит единую модель сцены на лету - геометрия, движение камеры, объекты. • сегментирование и олтслеживание объектов, глубина • обрабатывает кадры по очереди • переиспользует прошлый контекст через causal spatial-temporal modeling. Всю историю не хранит для экономии памяти • обновляет представление сцены инкрементально • чётко выделяет отдельные объекты. код / веса ждем #vlm #tracking #segmentation #videoto4d #vidfeo2depth

Google разрабатывает чип Frozen v2, который «вшивает» архитектуру Gemini прямо в кремний

Google готовит специализированный серверный ИИ-чип с внутренним названием Frozen v2i, в котором часть архитектуры модели Gemini будет аппаратно закреплена в кремнии, а не выполняться как обычная программа. По данным The Information, это должно дать в 6–10 раз больше обработанных токенов на единицу энергии по сравнению с нынешними TPUi и снизить дефицит вычислительных мощностей у Google. Первое развёртывание ожидается не раньше 2028 года.

Плата за эффективность — потеря гибкости: если ключевые элементы модели зафиксированы в кремнии, будущие версии Gemini должны сохранять совместимую архитектуру, а крупные изменения модели потребуют разработки нового чипа. Это ещё теснее свяжет модели Google и его инфраструктуру, и без того менее зависимую от Nvidia благодаря TPU.

ВыводЧип предназначен прежде всего для инференса — генерации ответов уже обученной моделью, а не для её тренировки.

6–10 разрост энергоэффективности (токенов на энергию) против нынешних TPU
2028 годожидаемый срок первого развёртывания чипа

Полный разбор →

Переписки пользователей DeepSeek оказались доступны в поиске Google

SEO-специалист Дэвид Коницни обнаружил, что часть чатов пользователей китайского ИИ-бота DeepSeeki можно найти через поиск Google. Речь о диалогах, которые люди делились с помощью встроенной функции публичной ссылки, полагая, что доступ к ним получат только те, у кого есть эта ссылка.

Проблема оказалась массовой: Google проиндексировал такие переписки, и теперь любой может найти чужие разговоры с ботом через обычный поисковый запрос. О находке написали «Коммерсантъ» и РБК, позже новость подхватили ТАСС и профильные каналы.

31%доля русскоязычных чатов среди проиндексированных

Полный разбор →

Размышления о пределах метагентности будущих ASI-систем

Т@tech_priestessAI-инженер
1 мес

Использование Aesty как MCP-сервера для управления гардеробом

П@neural_proseccoмедиа / агрегатор
1 мес
интересный юзкейс aesty как MCP гардероба - анализ того что есть и рекомендации что докупить, чтобы заполнить пробелы

ByteDance выпустила Seed Audio 1.0 — модель для генерации целых звуковых сцен

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 1 мес назад

ByteDance Seed представила Seed Audio 1.0 — аудиомодель, которая по одному промпту генерирует целую звуковую сцену: речь, атмосферу и звуковые эффекты одновременно. Доступ к модели открыт через платформу BytePlusi.

Модель ориентирована на озвучку, подкасты и дубляж: она позволяет жёстко задавать тайминг репликi с точностью до 100 мс и создавать голоса как по текстовому описанию, так и по аудио- или визуальному референсу.

100 мсточность тайминга реплик
2 минутымаксимум аудио за один проход
20+ языковподдерживаемых моделью

Полный разбор →

Выход модели генерации изображений Qwen Image 2

e@cryptoEssayAI-инженер
1 мес
Картинки в посте - это не скриншоты или фотографии, а генерации Qwen Image 2. Вчера вышла последняя модель от Алибабы для генерации картинок, которая по реализму не уступает GPT Image Gen 2 (на моих личных тестах), при этом скорее всего будет значительно дешевле.

Количество умных помощников превысило число людей на планете

Р@remediaгеймдев
1 мес
Умных помощников на планете уже больше, чем людей — почти 8,5 млрд устройств на 8,3 млрд человек. То есть если бы Алиса, Siri и Alexa вдруг устроили перекличку, людей на ней банально бы не хватило. В последнем выпуске подкаста «Тоже люди» — как раз разложили по полочкам, почему эти штуки скоро будут в кольцах, очках, наушниках, даже несмотря на дорожающие чипы памяти. Скоро общаться с ИИ на ходу, не доставая телефон из кармана, станет нормой. Причем быстрее, чем мы успеем привыкнуть к текущим гаджетам. Так что телефон, похоже, доживает свои последние спокойные годы.

Poolside выпустила модель Laguna S 2.1 для программирования и агентных задач

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 1 мес назад

Компания Poolside представила Laguna S 2.1 — MoEi-модель, ориентированную на кодинг и длительные агентные сценарии. По данным одного из источников, на Terminal-Bench модель показывает результат лучше, чем только что вышедшая Gemini Flash 3.6.

Модель компактна по вычислительным требованиям (запускается на одном DGX Sparki) при контексте до 1 млн токенов, что делает её привлекательной для локального и агентного использования разработчиками.

118Bобщее число параметров модели
8Bактивных параметров на токен
1 млн токеновмаксимальный контекст

Полный разбор →

Ограничения ИИ в задачах с индивидуальными предпочтениями

Г@gmorevaAI-инженер
1 мес
Чтобы далеко не ходить. Как успешный предприниматель, я сейчас жду доставку от дикси, где мне привезут куриный доширак. И даже с дошиками недостаточно "просто добавить воды". Пропорции специй, не передержать лапшу в кипятке, слить лишнюю воду вовремя и оставить чуток для сочности. По настроению добавить сухариков, доп соустов. Все это индивидуально под каждого человека. И никакой ИИ через "просто сделай вкусно" не сможет такого "вкусно" достичь. Тут нужны профессионалы вроде меня.
Ещё ↓