alignmentСбросить фильтр ×

Исследование OpenAI и Apollo Research: склонность моделей к подстройке под оценщика

1 мес

Anthropic представили метод GRAM для удаления опасных знаний из LLM

1 мес

Подсознательное обучение в языковых моделях

С@oulenspiegel_channelAI-инженер
1 мес

AI Values: тест на совместимость ценностей с LLM

А@adel_and_mlAI-инженер
1 мес
Интересный сервис - AI Values показывает, с какой LLM у вас больше всего совпадают ценности и стиль мышления. Проходишь сценарии с моральными и вкусовыми дилеммами, а сайт сравнивает твои ответы с разными моделями. Можно пройти тест на 15 вопросов и потом затюнить на еще на 100. https://ai-values.com Я попал в opus 4.8 🤔

Это всё на сейчас.