Анализ затрат
📅 2026-09-28 ⏱️ 12 мин Dean Dean

Стоимость токенов ИИ-агента на задачу: формула, пример и проверка Android-действий

Как считать стоимость ИИ-агента за завершенную Android-задачу: входные токены, кэш, выход, повторы, инструменты, проверка результата и роль FoneClaw.

Концептуальная иллюстрация смартфона с облачными циклами рассуждения, телефонным маршрутом задачи, щитами и декоративным нисходящим графиком
📋 Ключевые выводы
  • Стоимость ИИ-агента нужно считать за проверенно завершенную задачу, а не только по цене миллиона токенов.
  • В расчет входят разные категории: обычный вход, чтение кэша, выход, возможные записи кэша, хранение, внешние инструменты и неудачные попытки.
  • Телефонное выполнение в FoneClaw может менять объем контекста, повторов и ручных шагов, но не доказывает нулевые вызовы модели, бесплатную обработку или полностью локальный вывод.
  • Экономить стоит через ясный вход, короткий контекст, подтвержденное попадание в кэш и диагностику сбоев, а не через отключение разрешений, проверок получателя или подтверждений.

Считайте стоимость за завершенную задачу

Стоимость токенов ИИ-агента на задачу имеет смысл считать не по одному запросу, а по проверенному результату. Если 100 попыток дали 90 реально завершенных Android-задач, то знаменатель — 90, а не 100. Иначе неудачные циклы, повторы, непроверенные черновики и ручные исправления исчезают из расчета, хотя именно они часто делают агентный сценарий дорогим.

Начните с определения завершения. Для черновика это может быть «текст помещен в видимое поле, получатель проверен, отправка еще не выполнена». Для календаря — «событие создано в выбранном календаре, фактическое время совпадает». Для маршрута — «карта открыта с нужным адресом и способом поездки». Подробная рамка завершенного телефонного шага есть в статье Управление Android ИИ-агентом: намерение, подтверждение и проверка результата.

Затем разделите расходы. Модельные токены, подписка или кредитный пакет, внешние инструменты, ручное время и энергия устройства — разные категории. Если подписка уже оплачена или кредит входит в пакет, не считайте его второй раз как отдельный платеж за каждую задачу. Если провайдер отдельно тарифицирует кэш, изображения, поиск или инструменты, эти строки добавляются только когда они действительно применяются.

Соберите журнал расходов по данным провайдера

Рабочая формула выглядит так: стоимость модели = (обычные входные токены / 1 000 000 × ставка обычного входа за миллион) + (токены чтения кэша / 1 000 000 × ставка чтения кэша за миллион) + (оплачиваемые выходные токены / 1 000 000 × ставка выхода за миллион). Дальше добавляются только применимые строки: создание кэша, хранение кэша, поиск, внешние инструменты, сервисные сборы, подписка или лимит кредитов. Важно, чтобы категории не пересекались: кэшированные токены не считаются повторно как обычный вход, а изображения не считаются дважды, если провайдер уже включил их в оплачиваемый вход.

Для Gemini Google описывает подсчет токенов для текста и других модальностей, включая изображения, а также поля фактического использования запроса: вход, выход, токены рассуждения и кэшированный контекст; это полезно сверять с документацией Gemini о токенах. В ценах Gemini API Google также разделяет модели, модальности, уровни сервиса и отдельные строки вроде кэширования или grounding там, где они применимы.

У других провайдеров структура может отличаться. Например, документация Claude о кэшировании подсказок отдельно различает запись кэша, чтение кэша и обычный вход. Поэтому не переносите одну формулу ставок между поставщиками. Берите фактические поля использования и текущие цены провайдера, а затем приводите все к одной таблице попыток, включая повторы и неудачные завершения.

Токены рассуждения, скриншоты, текстовое дерево интерфейса и история диалога считаются по правилам конкретного провайдера. Если цена выхода уже включает токены рассуждения, не добавляйте их второй раз. Если изображение уже превратилось в оплачиваемый вход, не создавайте отдельную «плату за картинку» без основания в счете.

Пересчитайте один условный пакет задач

Ниже — учебный пример с вымышленными ставками в долларах США. Это не цены Google, Claude, FoneClaw или любого другого поставщика. Он нужен только для того, чтобы показать, как считать стоимость за завершенный результат.

СтрокаОбъемУсловная ставкаРасчетСтоимость
Обычный вход1 000 000 токенов$2 за 1 млн1 × $2$2.00
Чтение кэша200 000 токенов$0.20 за 1 млн0.2 × $0.20$0.04
Оплачиваемый выход150 000 токенов$8 за 1 млн0.15 × $8$1.20
Итого модельВсе попытки и повторы уже внутри объемов—$2.00 + $0.04 + $1.20$3.24
Внешний инструментУсловная плата за пакет—Добавить, если применяется$0.10
Итого пакет100 попыток—$3.24 + $0.10$3.34

В этом пакете было 100 попыток и 90 проверенно завершенных задач. Стоимость за завершение: $3.34 / 90 = примерно $0.0371 за задачу. Не добавляйте повторы еще раз: они уже включены в суммарные 1 млн входных, 0.2 млн кэшированных и 0.15 млн выходных токенов.

В примере нет платы за создание кэша, хранение кэша, подписку, grounding, поиск, обменный курс или энергию устройства. В реальном расчете эти строки добавляются только при наличии в счете или в выбранной методике. Если завершений ноль, стоимость за завершение не равна нулю; метрика становится неопределенной, а пакет нужно разбирать как сбойный.

Что может изменить выполнение на телефоне

Выполнение на телефоне может изменить стоимость, но не гарантирует экономию. FoneClaw выполняет поддерживаемые Android-действия, а настроенная модель помогает понять цель и спланировать шаги. Это значит, что часть знакомых действий можно выполнять через поддерживаемый телефонный маршрут: прочитать доступное состояние текущего экрана, найти видимое поле, ввести текст, открыть поддерживаемый путь. Но сам факт телефонного выполнения не доказывает отсутствие модельных вызовов, бесплатную обработку или полностью локальный вывод.

Пример: нужно подготовить ответ клиенту в текущем приложении. FoneClaw может использовать актуальное состояние экрана, найти доступное редактируемое поле и ввести черновик. Такой ввод не отправляет сообщение, не нажимает Enter и не обходит разрешения. Стоимость будет зависеть от того, сколько контекста ушло модели, понадобились ли повторы, использовался ли кэш и как провайдер тарифицирует экранный или текстовый контекст. Если выбрана онлайн-модель, она может обрабатывать переданный контекст задачи.

Сохраненные сценарии могут хранить повторяемые поддерживаемые шаги, но это не означает, что будущие запуски всегда обходятся без модели. Если экран изменился, нужно обновить состояние. Если действие чувствительное, сохраняются проверки и политика подтверждения. Разницу между локальным выполнением и модельной обработкой подробнее разбираем в статье AI agent trust: локальный AI-агент на Android против облачной безопасности. Текущие возможности FoneClaw описаны на странице возможностей FoneClaw.

Проведите небольшую повторяемую проверку

Для собственной оценки возьмите 10 одинаковых низкорисковых задач. Например: открыть одно и то же приложение, подготовить один и тот же нейтральный черновик в видимом поле, проверить получателя, но не отправлять. Используйте одинаковое устройство, аккаунт, приложение, сеть, модельный маршрут и исходный текст. Это не доказывает общую экономию, но показывает, как ведет себя именно ваш сценарий.

  1. Определите завершение: например, «черновик появился в правильном поле, получатель проверен, отправки нет».
  2. Запишите фактические поля использования провайдера: обычный вход, кэш, выход, токены рассуждения, изображения или другие модальности, если они выделены.
  3. Отметьте повторы: изменился экран, не найдено поле, пользователь уточнил, получатель был неоднозначен.
  4. Запишите внешний инструмент или сервисный сбор, если он есть в счете.
  5. Измерьте время проверки владельца отдельно от цены модели.
  6. Если хотите учитывать энергию, измеряйте прирост Wh и умножайте на локальную цену кВт⋅ч / 1000.

Сравнивайте общую стоимость / проверенные завершения. Если одна настройка тратит меньше токенов, но чаще требует ручного исправления, она может быть хуже в реальной работе. Если результат неопределенный, сначала диагностируйте сбой, а не повторяйте платный шаг. Для этого полезно руководство Диагностика и восстановление телефонного ИИ-агента: как найти причину сбоя и безопасно повторить шаг.

Сокращайте лишнее без отказа от проверок

Самые надежные способы уменьшить лишние расходы простые: давать короткий вход, не отправлять всю историю без нужды, ограничивать экранный контекст, проверять фактическое попадание в кэш по данным провайдера и разбирать сбой перед повтором. Если экран изменился, обновите состояние; если получатель неоднозначен, уточните; если отправка неизвестна, проверьте приложение, а не отправляйте заново.

Не экономьте на разрешениях, получателях и подтверждениях. Отключение проверок может уменьшить один запрос, но повысить риск неверного сообщения, лишней отправки или ручного восстановления. В многошаговых сценариях считайте не только токены, но и статус выполнения, подтверждение действия и восстановление после ошибки; практическая схема есть в материале Автоматизация многошаговых задач Android: подтверждение, выполнение и восстановление.

Итог: стоимость ИИ-агента на Android — это журнал попыток, а не рекламный процент экономии. Измеряйте фактическое использование, считайте только проверенные завершения и отделяйте поддерживаемое телефонное действие от модельной обработки.