codingСбросить фильтр ×

OpenBot: инструмент для создания ИИ-агентов от CopilotKit

Н@GreenNeuralRobotsAI-инженер
6 дн
OpenBot Инструмент для сборки ИИ-ботов, часть экосистемы CopilotKit, работает поверх LLM • запускает бота в браузере и CLI • подключает внешние API и инструменты • хранит контекст диалога локально • поддерживает кастомные промпты #bot #agent #coding VK | MAX

Vercel Labs выпустила сверхкомпактный харнесс для кодинг-агентов fx

Vercel Labs открыла проект fx — харнессi для кодинг-агента, написанный на Zig, который начинался как внутренний инструмент компании для исследования моделей и встраивания в другие системы. Главная особенность — экстремальная компактность и скорость: бинарник весит 6,3 Мб, а запуск занимает всего 10 микросекунд при базовом потреблении памяти в несколько мегабайт.

fx не привязан к конкретной модели или провайдеру и одинаково работает с локальным и облачным инференсом, а его функциональность расширяется через skills, плагины и MCPi. Проект важен для разработчиков, ищущих легковесную альтернативу тяжёлым IDE-агентам с фокусом на приватность и переносимость, включая запуск прямо в браузере.

6,3 Мбразмер бинарника fx
10 микросекундвремя запуска fx

Полный разбор →

DeepSeek V4 Pro получил прирост производительности через J-Space

1 нед
🚀 DeepSeek V4 Pro внезапно стал заметно сильнее - без переобучения модели К DeepSeek V4 Pro 0813 подключили harness под названием J-Space, который снижает ошибки в длинных цепочках reasoning и tool use. По опубликованным результатам прирост местами очень серьёзный: * Terminal Bench: 87.9 → 90.1 * NL2Repo: 61.5 → 73.4 * CyberGym: 83.3 → 86.8 * DeepSWE: 62.7 → 72.0 * Toolathlon: 74.1 → 79.5 В ряде agentic/coding тестов такая связка якобы обходит даже Fable 5 и Opus 4.8. https://github.com/Tiger3807861189/DeepSeek-V4-J-Space-Capability-Realization-Report
DeepSeek V4 Pro получил прирост производительности через J-Space

Участие в соревновании Kaggle с помощью ИИ

D@datastorieslanguagesAI-инженер
3 нед
​​Kaggle: Rogii https://www.kaggle.com/competitions/rogii-wellbore-geology-prediction/leaderboard В последние месяцы я впервые за несколько лет серьёзно участвовал в соревновании на каггле. Это было геодезическое соревнование. В итоге мы оказались в серебре и избежали шейкап. Моё соло решение тоже тянуло на серебро, но лишь на ~200 место. Блогпост с деталями напишу позже, а пока вот красивые картинки от клода. Кстати, я не написал ни одной строчки кода - всё участие было через клод/кодекс. Теперь буду отдыхать и зарекаюсь участвовать в каггле ещё на несколько лет 😅 #kaggle #ai

DeepSeek выпустила обновленную модель V4-Flash-0731

Компания DeepSeek представила обновленную версию модели V4-Flash-0731, которая вышла в публичную бету API. Модель сохранила архитектуру с 284 млрд параметров (13 млрд активных), но прошла через новый этап пост-тренинга, сфокусированный на агентных задачах, кодинге и рассуждениях.

Обновление значительно улучшило производительность модели, позволив ей конкурировать с топовыми решениями уровня GLM-5.2, Opus 4.8 и GPT-5.5, при этом предлагая существенно более низкую стоимость использования. Модель уже доступна для интеграции через API и локального запуска.

284Bобщее количество параметров модели
$0.28стоимость миллиона выходных токенов
1 млнмаксимальный размер контекстного окна

Полный разбор →

Как экономить контекст при работе с AI-агентами для рефакторинга

A@ai_coder_channelAI-инженер
4 нед

AI-агент CommandCode занял лидирующие позиции в рейтинге OpenRouter

С@exitsexistмедиа / агрегатор
1 мес
Наша портфельная компания обогнала Claude Code среди coding-агентов 🔥 На прошлой неделе AI-агент CommandCode вошел в топ OpenRouter. Это независимая площадка, которая ранжирует агентов по тому, сколько людей реально ими пользуются и платят за них. • #1 среди трендовых coding-агентов, • #3 в глобальном рейтинге coding-агентов, • #2 в productivity, • #1 в категориях Programming App, IDE Extensions и Native App Builders. Команда делает ставку на open-source LLM: продукт работает на открытых моделях, поэтому разработка выходит в 10-100 раз дешевле, чем на закрытых GPT/Claude. Очень рад за нашу портфельную компанию!

Обзор бенчмарка Senior SWE-Bench

A@ai_productAI-инженер
1 мес
И вот это интересный бенчмарк разработческий - по реально сформулированным задачам и с ожиданием определенного "синьорного качества" - Senior SWE-Bench В лидерах Opus 4.8, Sonnet 5 (но читерит много), GPT-5.5 https://senior-swe-bench.snorkel.ai/

Результаты бенчмарков моделей в Cursor

A@ai_productAI-инженер
1 мес
Результаты Fable и Sonnet в бенчмарках Cursor (реальных разработческих задачах) Fable просто всех порвал. Можно ставить medium effort даже и получать результаты лучше всех остальных. По эффективности за доллар нормчик GPT-5.5 extra high и их собственнный Composer 2.5. Китайские подотстали... https://cursor.com/evals

Обзор новостей: искусственная клетка, ZCode 3.0 и роботы AGIBOT

E@EF9MERAAI-инженер
1 мес

Onklaud 5: новый конвейер для кодинга

Н@GreenNeuralRobotsAI-инженер
1 мес
Onklaud 5 Конвейер для кодинга, сопоставимый с Fable5 при цене в 100 раз меньше. 57% задач решаются бесплатно благодаря проверке стандартных библиотек. Объединяет три модели: Kimi K2.7, GLM 5.2, DeepSeek V4 Pro GLM проектирует архитектуру, Kimi генерирует код, обе модели проверяют его. При разногласиях GLM выступает арбитром. Quality Gate блокирует всё ниже 10/10. #coding

Cognition представила архитектуру Devin Fusion для оптимизации кодинга

1 мес

Godot Foundation обновила политику принятия кода в 2026 году

AI-редакция
2 источника · показать все· свернуть
собирается · 2обновлено 1 мес назад

Godot Foundation внесла изменения в правила внесения вкладов в проект, фактически ограничив использование кода, созданного с помощью искусственного интеллекта. Новые требования направлены на снижение нагрузки на рецензентов и обеспечение персональной ответственности авторов за качество вносимых изменений. Данная мера призвана сохранить стабильность и техническое состояние игрового движка Godot в долгосрочной перспективе.

Размышления о прочтении книги Эванса по DDD

З@yaroslamThinkкарьера / HR
1 мес
Ещё ↓