OpensourceИнструменты разработчика чтения

pxpipe: опенсорс-инструмент, который прячет текст в PNG и снижает расходы на Claude Code до 70%

pxpipe — опенсорс-прокси, который кодирует текстовые промпты в PNG и отправляет их в Claude Code как картинки. Из-за разницы в тарифах Anthropic на текст и изображения расходы падают на 59–70%.

pxpipe: опенсорс-инструмент, который прячет текст в PNG и снижает расходы на Claude Code до 70%

Разработчик Стивен Чонг выпустил опенсорс-инструмент pxpipe, который снижает стоимость работы с Claude Code через нестандартный трюк с изображениями. Проект уже доступен среди opensource-нейросетей и инструментов для разработчиков.

Всё дело в том, как Anthropic считает токены. Текст тарифицируется примерно по одному токену за символ, а изображения — фиксированным количеством токенов исходя из размера в пикселях, без учёта того, сколько информации на них содержится. Если отрендерить плотный текст — код или JSON — как картинку, в один токен изображения влезает около 3,1 символа.

pxpipe работает как локальный прокси: перехватывает запросы к Claude Code и превращает объёмные статичные части в PNG — системные промпты, документацию инструментов, старую историю переписки. Свежие сообщения и ответы модели проходят как обычный текст.

Пример системного промпта Claude Code, сжатого в PNG через pxpipe
Так выглядит то, что видит модель: около 48 000 символов системного промпта и документации уместились на одной плотной PNG-странице. В виде текста это ~25 000 токенов, в виде изображения — примерно 2 700.

По данным Чонга, средняя экономия составляет 59–70%. В одной из демонстраций с Fable 5 стоимость сессии упала с $42,21 до $6,06. Если трюк станет популярным, AI-компании вполне могут отреагировать повышением цен на обработку изображений.

Компромисс: точность и скорость

Минусы у подхода есть. Точные строки вроде хэшей могут возвращаться искажёнными после распознавания с картинки. Скорость тоже страдает: модели приходится прогонять изображения через визуальный энкодер вместо прямого чтения текста.

По умолчанию pxpipe поддерживает Claude Fable 5 и GPT 5.6. Бенчмарки там же: Fable 5 показывает 100% точность на математических задачах со свежими случайными числами. Opus 4.7 и 4.8 ошибаются примерно в 7% случаев при чтении отрендеренных изображений, GPT 5.5 тоже хуже справляется с таким контекстом — они отключены по умолчанию и включаются вручную.

Идея подавать текст моделям в виде сжатых изображений появилась раньше. Deepseek построил OCR-систему, которая обрабатывает текстовые документы как картинки и, по данным технического отчёта, сжимает их до десяти раз с сохранением 97% информации. pxpipe идёт тем же путём, но применительно к инструментам разработчика на базе Claude.

Смотрите также

Каталог приложений Telegram Mini Apps

340+ проверенных мини-приложений: нейросети, утилиты, игры. Открываются прямо в мессенджере — без установки.

Открыть →

Поддержите Ailibri

Если наш каталог оказался полезным, вы можете оставить небольшой донат. Это поможет нам развивать проект.

♥ Поддержать

Будьте в курсе новых нейросетей — подпишитесь на наш Telegram-канал

Ежедневные обзоры свежих AI-инструментов, лайфхаки и инструкции прямо в вашем мессенджере.

Подписаться
Бесплатно · Нейросеть

Генерация изображений прямо в Telegram

3 бесплатные генерации в день через нейросеть nano banana — просто подпишись на канал @n_seti

Быстро Точно Качественно
Попробовать @gen_neurosila_bot

Нейросети и ИИ-инструменты

Все теги →
github220 text-to-text140 text-to-image117 image-to-image32 каталог31 tool28 удалить фон19 курсы19 text-to-sound17 браузер17 создание чат-ботов15 desktop-приложение15 api14 text-to-video14 замена лица13 генератор голоса13 ии-музыка12 удалить объект с фото11 voice-to-text11 селфи10
AILibri – главная страница
Ctrl / ⌘+K