Vercy · executable evidence
Первый результат — паритет, а не заявление о победе.
Claude Sonnet 5 правильно ответил на все 15 вопросов в трёх свежих прогонах в обоих условиях. Vercy передал 43 456 символов контекста против 103 213 у плоских заметок — на 57,9% меньше, но этот тест не доказывает всеобщего превосходства.
Методика
Использовались одинаковые синтетические факты и вопросы. Vercy выбирал типизированные и битемпоральные записи для каждого вопроса; условие с заметками получило один хронологический документ и 1000 детерминированных отвлекающих записей. Инструменты отключены, сессии не сохранялись.
Опубликованный результат
Точность: 100% против 100%. Размер контекста меньше у retrieval. Кэширование провайдера сделало сравнение стоимости зависимым от порядка, поэтому заявления об экономии нет. Сырые синтетические ответы, вопросы и runner опубликованы.