Vercy · executable evidence

Первый результат — паритет, а не заявление о победе.

Claude Sonnet 5 правильно ответил на все 15 вопросов в трёх свежих прогонах в обоих условиях. Vercy передал 43 456 символов контекста против 103 213 у плоских заметок — на 57,9% меньше, но этот тест не доказывает всеобщего превосходства.

100%Vercy retrieval
100%flat notes
−57.9%context characters

Методика

Использовались одинаковые синтетические факты и вопросы. Vercy выбирал типизированные и битемпоральные записи для каждого вопроса; условие с заметками получило один хронологический документ и 1000 детерминированных отвлекающих записей. Инструменты отключены, сессии не сохранялись.

Опубликованный результат

Точность: 100% против 100%. Размер контекста меньше у retrieval. Кэширование провайдера сделало сравнение стоимости зависимым от порядка, поэтому заявления об экономии нет. Сырые синтетические ответы, вопросы и runner опубликованы.

Открыть result.jsonОткрыть вопросыПрочитать методику