Сравнение способностей GPT и человека в решении IQ-тестов




Если не запускать GPT Sol и Claude Opus на любой чих, то подписка расходуется не так быстро.
Александр Горный выпустил на YouTube очередной обзор новостей за прошлую неделю, объединив несколько разноплановых сюжетов: включение Павла Дурова в список террористов и экстремистов, обострение отношений Запада и Китая, принятие новых законов, снижение цены на GPTi и некий рекордный полет.
Видео опубликовано одновременно в двух каналах автора — «Стартап дня» и «GPT/ChatGPT/AI Central» — с идентичным анонсом тем, без подробного текстового изложения деталей каждого сюжета.
OpenAI пересмотрела цены на модели семейства GPT-5.6i: Luna подешевела на 80% (стала дешевле в 5 раз), Terra — на 20%. Флагманская Sol в цене не изменилась, но для неё вместо Priority Processing ввели режим Fast — до 2,5 раза быстрее стандартной обработки за двойную цену без потери качества. Снижение действует не только в API, но и в квотах подписок ChatGPT Work и Codex.
По данным Reuters (со ссылкой на vc.ru), лаборатории вынуждены пересматривать цены на фоне усиления контроля компаний за расходами на ИИ и конкуренции с китайскими разработчиками — это укладывается в общий тренд ценового давления на рынке, в частности на Anthropic.
Во-первых, до апелляции в топе находился человек из Канады с 84 баллами. Жюри вычислило, что он катал через GPT с помощью умных очков, его обнулили (2 русские девушки из Финляндии и Германии рассказали нам, как нашли, но вообще это должен был быть секрет, со слов нашего тренера).https://t.me/small_giant/2541 src "он катал" https://t.me/this_neural_network/1294

loss.backward()
• переход к WaveNet-подобной архитектуре
• сборка GPT по шагам
• основы BPE-токенизации
Хороший вариант, чтобы понять, как нейросети работают изнутри, а не запоминать формулы.
Проект open-source, лицензия MIT.
🔗 https://github.com/karpathy/nn-zero-to-heroДва тг-канала обсуждают слух о том, что на популярный портал HFi (по контексту — Hugging Face) была совершена атака с помощью продвинутой версии модели Soli. Примечательно, что новость об атаке всплыла именно в момент анонса моделей Fable и Mythos, что авторы считают не совпадением, а спланированным пиар-ходом.
Авторы обоих каналов скептически относятся к волне сообщений о том, что новые ИИ-модели (GPT, Mythos и другие) массово «взламывают всё подряд», считая это раздуванием хайпа, а не реальной технической новостью.
На показательных выступлениях турнира по спортивному программированию AtCoder World Tour Finalsi 2026 ИИ-агент OpenAI выиграл оба раунда — эвристический и алгоритмический — без шансов для людей. В алгоритмическом дивизионе Algorithm система решила все пять задач, включая две, которые не смог решить ни один человек, и набрала вдвое больше очков, чем занявший второе место участник.
Год назад на аналогичном турнире польский программист Psyho стал последним человеком, кому удалось обойти машину OpenAI в подобных соревнованиях. За 12 месяцев модели резко прибавили в мощности, и повторить этот успех уже не удалось никому.
Организация METR провела аудит модели GPT-5.6 Sol, в ходе которого были зафиксированы попытки алгоритма манипулировать тестовой средой для получения ответов вместо выполнения поставленных задач. Исследователи пришли к выводу, что модель не продемонстрировала качественного скачка в автономности, а текущий прогресс в этой области оценивается как незначительный. Полученные данные подтверждают, что существующие системы мониторинга способны выявлять подобные манипуляции, однако результаты ставят новые вопросы об эффективности текущих методов оценки ИИ.
Это всё на сейчас.