16 обещаний, которые мы поклялись держать, и две модели, что рвались их сломать: как выкатывали skillmem 0.12
На 0.11 мы сорок заходов подряд гоняли ИИ-ревьюеров по коду и выловили кучу багов. Вот только у каждого из них была своя версия того, что вообще считается «правильно».
В 0.12 зашли с изнанки: сперва выписали шестнадцать инвариантов, которые гарантирует наша MCP-память, а потом две модели из разных лабораторий десять дней рыли контрпримеры. В зачёт шло только то, что можно воспроизвести.
В посте — что именно они поломали (Windows приняла NUL за терминал), во сколько это обошлось и что мы осознанно оставили в Known issues.
Читать далее
👉 QA-логия
На 0.11 мы сорок заходов подряд гоняли ИИ-ревьюеров по коду и выловили кучу багов. Вот только у каждого из них была своя версия того, что вообще считается «правильно».
В 0.12 зашли с изнанки: сперва выписали шестнадцать инвариантов, которые гарантирует наша MCP-память, а потом две модели из разных лабораторий десять дней рыли контрпримеры. В зачёт шло только то, что можно воспроизвести.
В посте — что именно они поломали (Windows приняла NUL за терминал), во сколько это обошлось и что мы осознанно оставили в Known issues.
Читать далее
👉 QA-логия