AI-spend быстро растёт; agentic workflows создают большой разброс; в 7/8 bounded company cases granular tracking отсутствует или существенно неполон.
Считать токены поздно. Пора считать принятую работу.
Агенты превращают AI из дешёвого API в переменный операционный расход. Компании уже ставят caps и approvals, но пока чаще управляют токенами и seats вместо полной стоимости принятого результата.
Independent audit → cross-provider reconciliation → fully loaded cost per accepted outcome → approved eval-gated intervention с rollback.
Продолжать validation, но не строить full platform. Сейчас: 0 quantified loss, 0 measured savings, 0 WTP, 0 artifacts и 0 paid pilots.
Шесть чисел, которые выдерживают вопрос «откуда это?»
У каждой цифры есть provenance и ограничение. Они поддерживают urgency и проблему измерения, но не заменяют buyer proof.
FinOps-команд уже управляют AI-spend
Рост с 31% в 2024 до 63% в 2025 и 98% в 2026. Это category-formation signal, не спрос на наш продукт.
оценка enterprise GenAI spend в 2025
Menlo: 3,2× год к году. Survey + market model, не audited revenue и не наш TAM.
прогноз роста model/platform spend в 2026
Gartner: $39,31B → $64,25B. Denominator отличается от Menlo, поэтому ряды нельзя складывать.
токенов на одну agentic coding task в среднем
В исследовании восьми frontier-моделей на SWE-bench Verified; примерно 1000× code chat/reasoning.
разброс токенов на одинаковой задаче
Больше токенов не означало выше accuracy. Вариативность траектории — часть экономики агента.
cases с отсутствующим или неполным tracking
Bounded convenience sample Spend Management. Это pattern внутри выборки, не market prevalence.
Не одна находка, а связная причинная цепочка.
Большой denominator есть; standalone category пока нет
Enterprise/model-platform spend растёт, а AI уже вошёл в FinOps scope. Но воспроизводимого revenue pool для AI work economics пока не существует.
Menlo и Gartner дают разные, несовместимые spend series; category attach rate и standalone budget остаются primary-evidence question.
Control surface шире API-токенов
Subscriptions, accounts, seats, repos, reimbursements и shadow AI входят в реальный расход. API-only product пропустит существенную часть observed workflow.
6/8 case-like reports включают account/seat/personal surface; 5/8 — caps, eligibility, запреты или approvals.
Generic controls уже commodity
Claude Enterprise документирует member-level limits и approval workflow. Cloudflare AI Gateway — dollar budgets по provider/model/user/team/application.
Hard budgets, team allocation и generic gateway control нельзя выдавать за defensible wedge.
Правильная единица — принятый результат
Fully loaded cost per accepted successful workflow включает failed runs, retries, review, integration, latency и reliability; quality остаётся guardrail.
Public benchmarks частично считают API cost, но не закрывают human-accepted business outcome.
Audit first. Control layer later.
Чем ближе к outcome и безопасному действию, тем меньше commodity. Но одновременно выше требования к данным, deployment и доверию.
Reconcile
Свести invoices, credits, seats/accounts, private pricing и telemetry до finance-grade факта.
Attribute
Привязать расход к owner, repo, task, workflow и принятому outcome.
Diagnose
Найти retries, loops, duplicated context, wrong tier, missing cache и unused seats.
Intervene
Проверить bounded change под eval, approval, verification и rollback.
Subscription / entitlement audit
Admin exports, seats/accounts, dormant licenses, shared-pool fairness, eligibility и approvals — без prompt export.
Workflow economics audit
Bill + traces + accepted outcome + review/failure cost + одно bounded intervention.
Customer-side / VPC / local execution, read-only по умолчанию, prompt export не нужен для первого offer. Публичные cases не подтверждают, что компании готовы дать artifact или заплатить.
Мы прямо на пути крупных игроков
Token dashboard, team allocation, hard budgets, generic gateway и prompt-level routing уже выпускают providers, hyperscalers, gateways, observability и FinOps platforms.
- Single-provider product не нейтрален между rivals и не видит negotiated bills/credits других vendors.
- Gateway видит только routed traffic и добавляет critical-path trust risk.
- Observability видит traces/evals, но обычно не finance-grade bills, seats и procurement context.
- FinOps видит invoices и allocation, но не task quality и runtime trajectory.
- Что incumbents технически не смогут скопировать отдельную feature.
- Что публичное отсутствие end-to-end loop означает отсутствие private enterprise functionality.
- Что structural conflict автоматически создаёт WTP или distribution advantage.
- Что internal platform team — слабый substitute. Часто это самый сильный substitute.
Понятно, но без магии «40 агентов согласились».
Модели помогали искать и атаковать claims. Доказательствами оставались source chains, а согласие моделей само по себе не считалось независимым подтверждением.
Определили denominator
Не token price, а fully loaded cost per accepted successful workflow.
Разделили evidence
Market estimates, official capabilities, company cases, respondent opinions и private data не смешиваются.
Добавили primary company patterns
8 case-like reports отделены от 3 generalizations; names и private snapshot не публикуются.
Атаковали moat
Official docs подтвердили member limits и multi-provider budgets; generic controls убраны из wedge.
Поставили коммерческие гейты
15 authority conversations → artifacts/signers → paid audit → два pilots в одном wedge → только затем MVP.
Вот где заканчиваются факты и начинается следующая работа.
Боль критична?
Реконструировать последний incident, budget consequence и workflow change.
Кто покупатель?
Finance + CTO/Platform + Security как buying coalition; проверить direct authority.
Дадут ли artifact?
Redacted admin export/invoice или customer-controlled zero-export join.
Заплатят ли?
Fixed-fee audit, budget commitment или signer intro — не concept interest.
Продукт или feature?
Два paid pilots в одном wedge + recurring pull до narrow MVP.
Что прочитать сегодня вечером — в порядке полезности.
Не 611 ссылок. Шесть материалов, после которых можно уверенно объяснить тезис и его ограничения.
Новый market/category thesis, venture score, incumbent reality и validation gates.
15 минВосемь bounded company cases, три generalizations и коммерческие нули.
15 минПочему AI-spend уже оказался в FinOps scope и какая tooling capability запрашивается чаще всего.
15 минЧисловая база для масштаба и вариативности agentic trajectories.
12 минПрямое опровержение тезиса, что member limits и approvals свободны как wedge.
10 минПрямое опровержение thesis про generic multi-provider dollar budgets.
Пятнадцать слайдов. Привычный pitch-deck arc.
Vision → problem → alternatives → why now → market → solution → product → evidence → business model → GTM → competition → moat → team → scale → ask. Research caveats остаются, но больше не управляют всей драматургией.
AI Work Economics
Считать токены поздно. Пора считать принятую работу: customer-controlled system связывает spend с accepted outcome и безопасным изменением workflow.
Bill + seats/accounts + traces + review → accepted result
Vision / category thesis; PMF не заявляется
Что говорить — и где лучше не разгоняться.
- Большой и растущий spend denominator подтверждён несовместимыми, но направленно согласующимися рядами.
- Новые reports показывают account/seat gap, policy tightening и multi-stakeholder conflict.
- Generic controls crowded; surviving wedge — customer-side outcome economics and approved control.
- Distribution и WTP пока hypotheses с двухнедельными gates.
- M&A precedents показывают стратегическую adjacency, а не обещают нашу valuation.
- «$64B или $37B — наш TAM».
- «11 компаний подтвердили проблему».
- «Интервью подтвердили WTP».
- «Никто это не делает».
- «У incumbents конфликт, поэтому они не смогут скопировать».
- «Есть очевидный IPO/acquisition path».