Полная стоимость одного принятого успешного workflow
Токены, seats и экономия по list price — промежуточные переменные, а не бизнес-результат.
Unreal Labs · evidence-программа
Проверяем, готовы ли компании платить за стоимость принятой AI-работы — а не за ещё один dashboard токенов и лимитов.
Качество treatment должно оставаться в preregistered non-inferiority ε.
Как мы к этому пришлиКаждый этап убирает отдельный класс самообмана: от иллюзии согласия до ложной экономии и выдуманного спроса покупателей.
Данные от покупателей и операторов
Spend Management добавил 8 company-like reports и 3 respondent generalizations поверх двух ListenLabs ответов. Выборка показывает account/seat surface, неполный tracking и policy tightening, но всё ещё не даёт buyer-grade authority, artifacts, WTP или paid pilot.
Это не финальное решение о продукте, а текущий набор тезисов, которые не сломались после независимого аудита и попыток опровержения.
Токены, seats и экономия по list price — промежуточные переменные, а не бизнес-результат.
Subscription/entitlement audit проще проверить; workflow economics сильнее как moat, но требует outcome data.
6/8 bounded cases явно содержат account/seat/personal surface; это pattern внутри выборки, не prevalence.
Claude Enterprise уже даёт member limits; Cloudflare — multi-provider dollar budgets. Generic enforcement не wedge.
Выбери гипотезу: справа — текущая оценка, контргипотеза и конкретный признак опровержения. Открытая гипотеза означает ровно «открыта», а не «почти доказана».
Компании видят общий AI-spend, но не могут надёжно связать его с workflow, фичей, пользователем, агентом или инженерным решением.
Текущие billing, gateway и observability-системы уже дают покупателям достаточную атрибуцию.
Несколько репрезентативных компаний распределяют spend по принятым бизнес-результатам с минимальным ручным трудом в текущих инструментах.
Восемь bounded company cases показывают account/seat surface, неполный tracking и restrictive controls. Но это convenience sample: quantified loss, measured savings, buyer authority, artifacts, WTP и paid pilots всё ещё на нуле.
API-only продукт пропустит заметную часть наблюдаемой картины
Это visibility gap, не доказательство готовности покупать
Текущий job часто governance, а не model optimization
8 case-like reports + 3 generalizations. Convenience sample; per-case names скрыты, counts не являются процентами рынка.
62,5/100: validation opportunity, не build-now decision
Сначала сравнить два bounded audit offer. Платформу строить только после paid/budgeted evidence в одном wedge.
“Internal visibility уже отвечает «где возник расход», но в ответах нет систематической связи с accepted outcome — «было ли оно того». Это directionally поддерживает outcome-aware accounting, не доказывая demand.”
Два режима: invoice-led forensics через logs/reports и launch-time containment через monitoring/caps; дальше — homegrown attribution и manual quality review.
Internal-build momentum, сомнение в incremental net savings и отсутствие приемлемого способа передать даже redacted artifacts.
Private investor предположил CFO и запросил deep insights + monitoring. Product owner из CASE-011 назвал CTO владельцем бюджета и signatory, а internal attribution — уже достаточным.
Проверять CFO/Finance и CTO/AI Platform как отдельные buying paths; generic reconciliation dashboard стал ещё слабее, external tool должен доказать incremental net savings.
Это один investor opinion и два non-buyer interviews. WTP, authority, urgency, customer artifact и пилот по-прежнему не подтверждены.
Одиннадцать рычагов: безопасные структурные ограничения, изменения за гейтом оценки и решения, зависящие от загрузки и операционной экономики.
Исследование по открытым источникам закончено. Остальные доказательства нельзя получить ещё одним красивым отчётом — нужны люди, приватные данные и парный эксперимент.
15 authority conversations; ≥3 recent incidents; ≥2 artifact/signer commitments
≥1 redacted sample или customer-controlled zero-export join
База против изменения на 50–100 реальных задачах
≥1 paid/budgeted audit для proof; ≥2 pilots в одном wedge до narrow MVP
Модели дешевеют быстрее, чем растёт полезное потребление.
Существующие инструменты уже закрывают достаточно workflow.
Провайдеры коммодитизируют независимые cost controls.
Central proxy видит слишком мало трафика или создаёт security risk.
Цена task-specific evals съедает найденную экономию.
Нет владельца одновременно с болью и бюджетом.
Data access и terms блокируют deployment.
Dashboard и recommendations легко копируются и не создают moat.
Возможная ниша — customer-controlled reconciliation, cost per accepted outcome и approved intervention. Generic limits, dashboards и gateway budgets уже закрываются incumbents. Покупатель, signer, WTP и recurring budget пока не доказаны.
Вернуться к этапам