AI Work Economics · investor briefingПрезентация · 17 августа 2026

Считать токены поздно. Пора считать принятую работу.

Агенты превращают AI из дешёвого API в переменный операционный расход. Компании уже ставят caps и approvals, но пока чаще управляют токенами и seats вместо полной стоимости принятого результата.

Что доказано

AI-spend быстро растёт; agentic workflows создают большой разброс; в 7/8 bounded company cases granular tracking отсутствует или существенно неполон.

Текущий wedge

Independent audit → cross-provider reconciliation → fully loaded cost per accepted outcome → approved eval-gated intervention с rollback.

Decision · 62,5/100

Продолжать validation, но не строить full platform. Сейчас: 0 quantified loss, 0 measured savings, 0 WTP, 0 artifacts и 0 paid pilots.

/01
Цифры для первых слайдов

Шесть чисел, которые выдерживают вопрос «откуда это?»

У каждой цифры есть provenance и ограничение. Они поддерживают urgency и проблему измерения, но не заменяют buyer proof.

98%

FinOps-команд уже управляют AI-spend

Рост с 31% в 2024 до 63% в 2025 и 98% в 2026. Это category-formation signal, не спрос на наш продукт.

Сильный отраслевой сигнал
CLM-0029 · State of FinOps 2026
+63,4%

прогноз роста model/platform spend в 2026

Gartner: $39,31B → $64,25B. Denominator отличается от Menlo, поэтому ряды нельзя складывать.

Авторитетный forecast, другой denominator
CLM-0512 · Gartner · August 2026
4,17M

токенов на одну agentic coding task в среднем

В исследовании восьми frontier-моделей на SWE-bench Verified; примерно 1000× code chat/reasoning.

Независимое измерение
CLM-0088 · How Do AI Agents Spend Your Money?
30×

разброс токенов на одинаковой задаче

Больше токенов не означало выше accuracy. Вариативность траектории — часть экономики агента.

Независимое измерение
CLM-0298 · Bai et al. · repeated runs
7/8

cases с отсутствующим или неполным tracking

Bounded convenience sample Spend Management. Это pattern внутри выборки, не market prevalence.

/02
Что мы знаем

Не одна находка, а связная причинная цепочка.

01

Большой denominator есть; standalone category пока нет

Enterprise/model-platform spend растёт, а AI уже вошёл в FinOps scope. Но воспроизводимого revenue pool для AI work economics пока не существует.

Основание

Menlo и Gartner дают разные, несовместимые spend series; category attach rate и standalone budget остаются primary-evidence question.

02

Control surface шире API-токенов

Subscriptions, accounts, seats, repos, reimbursements и shadow AI входят в реальный расход. API-only product пропустит существенную часть observed workflow.

Основание

6/8 case-like reports включают account/seat/personal surface; 5/8 — caps, eligibility, запреты или approvals.

03

Generic controls уже commodity

Claude Enterprise документирует member-level limits и approval workflow. Cloudflare AI Gateway — dollar budgets по provider/model/user/team/application.

Основание

Hard budgets, team allocation и generic gateway control нельзя выдавать за defensible wedge.

04

Правильная единица — принятый результат

Fully loaded cost per accepted successful workflow включает failed runs, retries, review, integration, latency и reliability; quality остаётся guardrail.

Основание

Public benchmarks частично считают API cost, но не закрывают human-accepted business outcome.

/03
Surviving thesis

Audit first. Control layer later.

Чем ближе к outcome и безопасному действию, тем меньше commodity. Но одновременно выше требования к данным, deployment и доверию.

01

Reconcile

Свести invoices, credits, seats/accounts, private pricing и telemetry до finance-grade факта.

02

Attribute

Привязать расход к owner, repo, task, workflow и принятому outcome.

03

Diagnose

Найти retries, loops, duplicated context, wrong tier, missing cache и unused seats.

04

Intervene

Проверить bounded change под eval, approval, verification и rollback.

Offer 01

Subscription / entitlement audit

Admin exports, seats/accounts, dormant licenses, shared-pool fairness, eligibility и approvals — без prompt export.

Offer 02

Workflow economics audit

Bill + traces + accepted outcome + review/failure cost + одно bounded intervention.

Enterprise boundary

Customer-side / VPC / local execution, read-only по умолчанию, prompt export не нужен для первого offer. Публичные cases не подтверждают, что компании готовы дать artifact или заплатить.

/04
Incumbent reality

Мы прямо на пути крупных игроков

Token dashboard, team allocation, hard budgets, generic gateway и prompt-level routing уже выпускают providers, hyperscalers, gateways, observability и FinOps platforms.

Где остаётся structural gap
  • Single-provider product не нейтрален между rivals и не видит negotiated bills/credits других vendors.
  • Gateway видит только routed traffic и добавляет critical-path trust risk.
  • Observability видит traces/evals, но обычно не finance-grade bills, seats и procurement context.
  • FinOps видит invoices и allocation, но не task quality и runtime trajectory.
Чего конфликт не доказывает
  • Что incumbents технически не смогут скопировать отдельную feature.
  • Что публичное отсутствие end-to-end loop означает отсутствие private enterprise functionality.
  • Что structural conflict автоматически создаёт WTP или distribution advantage.
  • Что internal platform team — слабый substitute. Часто это самый сильный substitute.
/05
Как проводилось исследование

Понятно, но без магии «40 агентов согласились».

Модели помогали искать и атаковать claims. Доказательствами оставались source chains, а согласие моделей само по себе не считалось независимым подтверждением.

01

Определили denominator

Не token price, а fully loaded cost per accepted successful workflow.

02

Разделили evidence

Market estimates, official capabilities, company cases, respondent opinions и private data не смешиваются.

03

Добавили primary company patterns

8 case-like reports отделены от 3 generalizations; names и private snapshot не публикуются.

04

Атаковали moat

Official docs подтвердили member limits и multi-provider budgets; generic controls убраны из wedge.

05

Поставили коммерческие гейты

15 authority conversations → artifacts/signers → paid audit → два pilots в одном wedge → только затем MVP.

/06
Открытые гейты

Вот где заканчиваются факты и начинается следующая работа.

0/8 quantified loss

Боль критична?

Реконструировать последний incident, budget consequence и workflow change.

0 buyer-grade interviews

Кто покупатель?

Finance + CTO/Platform + Security как buying coalition; проверить direct authority.

0 customer artifacts

Дадут ли artifact?

Redacted admin export/invoice или customer-controlled zero-export join.

0 paid/budgeted pilots

Заплатят ли?

Fixed-fee audit, budget commitment или signer intro — не concept interest.

Не решено

Продукт или feature?

Два paid pilots в одном wedge + recurring pull до narrow MVP.

/07
Reading list

Что прочитать сегодня вечером — в порядке полезности.

Не 611 ссылок. Шесть материалов, после которых можно уверенно объяснить тезис и его ограничения.

/08
Classic investor pitch

Пятнадцать слайдов. Привычный pitch-deck arc.

Vision → problem → alternatives → why now → market → solution → product → evidence → business model → GTM → competition → moat → team → scale → ask. Research caveats остаются, но больше не управляют всей драматургией.

Cover / Vision · слайд 011 / 15

AI Work Economics

Считать токены поздно. Пора считать принятую работу: customer-controlled system связывает spend с accepted outcome и безопасным изменением workflow.

Визуал

Bill + seats/accounts + traces + review → accepted result

Основание

Vision / category thesis; PMF не заявляется

/09
Формулировки

Что говорить — и где лучше не разгоняться.

Говорить
  • Большой и растущий spend denominator подтверждён несовместимыми, но направленно согласующимися рядами.
  • Новые reports показывают account/seat gap, policy tightening и multi-stakeholder conflict.
  • Generic controls crowded; surviving wedge — customer-side outcome economics and approved control.
  • Distribution и WTP пока hypotheses с двухнедельными gates.
  • M&A precedents показывают стратегическую adjacency, а не обещают нашу valuation.
Не говорить
  • «$64B или $37B — наш TAM».
  • «11 компаний подтвердили проблему».
  • «Интервью подтвердили WTP».
  • «Никто это не делает».
  • «У incumbents конфликт, поэтому они не смогут скопировать».
  • «Есть очевидный IPO/acquisition path».
Keynote briefing · 17 августа 2026

External facts resolve through canonical claim IDs. Spend Management counts use 8 case-like reports, not 11 rows; company names and private snapshot stay off the public site. Reachability is not content verification; public absence is not proof of absent private enterprise capability.