[8/10] Чат канала LLM под капотом — Разные впечатления от кодовых агентов
Один участник хвалит Claude за удержание изменений по базе, другой — GPT 6.1 low за задачи, не под силу Opus 5.5 и Fable 5.1 даже на максимальном reasoning; контроль кодовой базы всё равно нужен.
💡 Один участник отмечает, что Claude может искать в интернете отсутствие доказательств гипотезы вместо выполнения просьбы доказать её.
3 сообщений · Полное обсуждение
Один участник хвалит Claude за удержание изменений по базе, другой — GPT 6.1 low за задачи, не под силу Opus 5.5 и Fable 5.1 даже на максимальном reasoning; контроль кодовой базы всё равно нужен.
💡 Один участник отмечает, что Claude может искать в интернете отсутствие доказательств гипотезы вместо выполнения просьбы доказать её.
3 сообщений · Полное обсуждение