avatar
Поляков считает: AI, код и кейсы
@countwithsasha
04.06.2026 12:09
Поляков считает: AI, код и кейсы Фото: Перешел на DeepSeek v4 Pro для своих агентов, полёт нормальный В марте я писал, что у меня на Mac Mini живет OpenClaw, который тратит 100 рублей в неделю. Логика была в покупке очень дешевых Plus подписок через https://lzt.market/llm/?order_by=price_to_up и подключение Codex подписок в CLIProxyAPI который прикрыт Cloudflare Warp. С начала апреля к моей коллекции агентов добавился Hermes (и я точно могу сказать, что он не всегда круче глючного OpenClaw) потребление токенов увеличивалось. 🩼 Конечно это не могло нравится OpenAI Такая схема у нас во внутренних кругах называется «абьюз подписок» — получение сервиса через нарушение условий его использования. Anthropic за такое ранее банил аккаунты, OpenAI подключили смс-верификацию. Для получения смс и одноразовых номеров телефона я использовал https://smsfast.cc, в совокупности в конце мая уходило порядка 300-400 рублей на один аккаунт с подпиской Plus + подтверждение. 🤔 Короче я понял, что у меня уходит неприятно много времени на такой абьюз-менеджмент и стал морально готовиться к тому, чтобы платитить за API. Осталось найти кому. 🐳 DeepSeek продлил дисконт навсегда Когда делал барбершоп тесты, я отметил DeepSeek v4 Pro как реальный конкурент SOTA моделей за супер-низкую цену. Тогда было майское промо — 1 доллар за миллион токенов. 22 мая DeepSeek написал твит, что промо продлевается навсегда. Вот тогда я решил, что можно смело мигрировать своих агентов с OpenAI GPT 5.4 на Deepseek. Короче уже 5 дней я работаю через Дипсик и траты в сутки составляют в среднем полтора доллара. Месяц использования будет стоить около 50 долларов: дороже одной подписки плюс, но по лимитам на одной такой подписке было бы тесно. ⚠️ Я не использую OpenClaw и Hermes для кодинга и какого либо ассистирования в работе — только рутина: тулы для бронирования парковок, запись на стрижку и т д 🔬 Пара проверок Основной работой агентов в моем случае является вызов различных тулов: заказ пропусков, парковок для гостей, стрижки, поэтому я решил проверить не только DeepSeek, но и локальные модели на бенчмарке PAC1 — чтобы сравнить, насколько они будут хорошо справляться с вызовом инструментов. Тут есть еще и профессиональный интерес, так как я активно тестирую MCP для бронирования путешествий, там есть бенчмарк с эвалами и один из прогонов я делаю локальными моделями — чтобы понимать, как они держат большой контекст с кучей инструкций. Короче сравнил на этом бенчмарке Опус без ризонинга и другие модели. Вывод — Дипсик близок к SOTA, надо брать. Из интересного — результаты квантованного Qwen 3.6, я был очень удивлен, когда увидел, что он обходит полносвязную Gemma 4 — кажется отличный кандидат для туристического бенчмарка. Короче говоря ставка на дорогих агентов, кажется будет скомпенсированна Китаем. Хочется верить, что осенью Сбер всё-таки выпустит обновление и сделает цены на свои модели преемлемыми. Если у вас был опыт запуска агентов на локальных или недорогих моделях — буду рад отзывам в комментариях. ---- Поляков считает — AI, код и кейсы
В комментариях к предыдущему посту мне посоветовали посмотреть DeepSeek v4 flash как более дешевый аналог.

Уверен, что еще надо тестировать эту модель на больших контекстах, обычно именно от величины контекстного окна зависит деградация маленьких моделей. Но на бенчмарке она показала себя достаточно хорошо. Можно попробовать и сэкономить

---

Поляков считает — AI, код и кейсы
🔥 9
6
39 17 3.3K

Обсуждение 39

Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.

Обсудить в Telegram

Поляков считает: AI, код и кейсы

6.4K
Пишу про AI, вайбкодинг и кейсы применения. Связаться: @polyakovbest
Открыть в Telegram