Кейс 1. Claude.
Разрабатываем решение на базе модели Gemini 3.1 flash-lite. Opus планирует разработку, опираясь на мои вводные данные о модели / логике работы и пр. В какой-то момент в ходе рассуждений Opus решает, что я ошиблась, ведь модели 3.1 flash lite не существует✨
Последний известный опусу релиз gemini был 2.5. Opus с таким убеждением и завершает работу, вкручивает в архитектуру не ту модель, и уже в результатах я вижу ошибку. Он ни в интернет не сходил, ни меня не переспросил, чтобы перепроверить несостыковку. Просто решил и сделал. Такой он, высокомерный, бесящий, но часто полезный клод.
Кейс 2. Codex.
Хочу продумать интерфейс страницы, чтобы показывать пользователю много-много источников в dailyn. Ставлю задачу Sol, прошу подумать как всё отобразить и сгенерить пример страницы. После этого в рассуждениях он выбирает несколько моих конкурентов, ходит к ним, делает competitive research по UI и в итоге генерит html на основе собранного исследования, о котором я не просила. Wow.
Это иллюстрации к одному глобальному отличию, которое я из раза в раз наблюдаю за моделями: Claude замкнут на задаче, на контексте, GPT много смотрит вовне.
- Замкнутость может быть хороша для безопасности - не сделает лишнего, не лезет в другую папку на всякий случай.
- Замкнутость заставляет быть креативнее в условиях ограниченных ресурсов. GPT сильнее “усредняет”.
Да, звучит как требующая эмпатии разница между интроверотом/экстравертом.
Вывод: и с обращением к llm вместо человека иметь дело с тонким устройством души разработчика всё равно придется
Дискуссия