Почему продвинутые модели ИИ могут поднять цены на вычисления в 10 раз

Dwarkesh Patel3 августа 202690 3652 29111 мин чтения12 августа, 21:13

Коротко

Anthropic три года подряд удесятеряет выручку: с $9 млрд в прошлом году до прогнозных $100–150 млрд в этом. Компьют лабораторий при этом растёт только втрое в год, и разрыв обязан чем-то закрыться. Спикер раскладывает его на три клапана: маржа лабораторий, цена компьюта и доля инференса против тренировки, и говорит, что все три уже сдвигаются. Наращивать инференс лаборатории не хотят: это равносильно признанию, что прогресс встал и ты теперь просто облачный провайдер. Значит, реально работает один клапан: цена компьюта пойдёт вверх. Модели умнеют, и один и тот же H100 монетизируется всё дороже: человекоуровневый ИИ-инженер на нём стоил бы $250K в год, в 15 раз выше нынешней спотовой аренды. А предложение компьюта неэластично: 3x упирается в закон Мура, стройку фабрик и уже почти исчерпанное переключение пластин с телефонов на ИИ.

Главный тезис

Вычислительные мощности растут только втрое в год, а полезность ИИ гораздо быстрее. Цена компьюта вынуждена расти, и побеждает умнейшая модель, потому что она выжимает больше ценности из этого дефицитного ресурса.

Ключевые идеи

  • 0:04: выручка Anthropic росла в 10 раз три года подряд, с $9 млрд до прогнозных $100–150 млрд, и для продолжения тренда нужен $1 трлн к концу следующего года
  • 0:37: при этом компьют лабораторий растёт лишь в 3 раза, и разрыв между выручкой и мощностью физически обязан чем-то закрываться
  • 0:46: закрыть разрыв могут только три вещи: рост маржи, рост цены компьюта или сдвиг доли компьюта в сторону инференса
  • 1:05: маржа на инференсе Anthropic по слухам выросла с 40% в середине прошлого года до 80%+ сейчас
  • 1:38: лаборатории не хотят наращивать долю инференса, потому что смысл выручки с инференса: убедить инвесторов дать денег на следующую модель, а не стать облачным провайдером
  • 1:56: перекос в инференс читается рынком как сигнал, что прогресс ИИ встал, а это бизнес слабее, чем строить AGI
  • 3:02: маржа выше 90% на интеллекте маловероятна, потому что конкуренция сжимает маржу, если только лидер не оторвался от всех радикально
  • 0:53: остаётся единственный реальный клапан: цена компьюта растёт, и спот уже на 40%+ выше февральского дна
  • 3:47: Google платит SpaceX $900 млн в месяц за 110 000 GPU (GB200/GB300), вдвое дороже спота, потому что фронтир-лабам нужен масштаб, гибкость и безопасность весов
  • 4:21: если человекоуровневый ИИ-инженер помещается на H100, тот должен сдаваться за $250K в год, в 15 раз выше нынешнего спота, и это без учёта работы по ночам
  • 4:52: довод «10 млн лишних инженеров обвалят ценность труда» это lump of labor fallacy: иммиграция в долгую не роняет зарплаты из-за специализации
  • 5:49: эффект Алчиана-Аллена: на дорогом компьюте глупо гонять слабую модель, поэтому лаба с эффективной моделью берёт премию за экономию дефицитного входа
  • 6:16: часть нынешних дешёвых применений ИИ вытеснят по цене: Google заплатит за токены на автоматизацию ИИ-ресёрча больше, чем ты за «AI slop»
  • 6:53: спикер сам сомневается: анализ пахнет ставкой Саймона-Эрлиха, где думеры о дефиците проиграли, но с компьютом аналогия скорее не работает
  • 8:01: сам 3x разложен на 1.4x закона Мура, 1.2x новых фабрик и 1.8x переключения пластин с телефонов на ИИ, и ни один компонент не ускорить
  • 10:39: 10x выручки на 3x компьюта показывает мощнейший эффект масштаба: модель учат один раз, навык делится на всех пользователей

Почему это важно

Если анализ верен, деньги и власть стекаются к тому, кто обучит самую эффективную модель, потому что именно он способен перебить всех на аукционе за дефицитный компьют и брать за него премию. Проигрывают все, кто снизу по стеку и кто рассчитывал на дешёвый инференс: мелкие лабы, стартапы поверх API, дешёвые массовые применения. В кадре Anthropic, OpenAI, Google, SpaceX как арендодатель мощностей, ASML с монополией на EUV и TSMC с фронтир-узлами N3: каждому из них выгодно, чтобы дефицит компьюта сохранялся. Сам спикер признаётся, что не рад такому миру: сильный эффект масштаба на интеллекте означает концентрацию власти, но факты, похоже, ведут именно туда.

Идеи

  • Выручка и компьют это два тренда, которые расходятся математически, и всё интересное происходит в щели между ними
  • «Стать облачным провайдером» здесь ругательство: это статусное поражение лаборатории, а не смена бизнес-модели
  • Инференс-выручка ценна не сама по себе, а как аргумент в разговоре с инвесторами про следующую модель
  • Маржа существует, только пока твой продукт заметно лучше того, чем тебя могут заменить на рынке
  • 90%+ маржа на интеллекте почти невозможна именно потому, что интеллект слишком ценен, чтобы не привлечь конкурентов
  • Фронтир-лаба не может просто купить спотовый инстанс: ей нужен масштаб, эффективность, гибкость и безопасность весов
  • Контракт Google со SpaceX как замочная скважина в реальную цену компьюта для тех, кто должен его накапливать
  • Аренда H100 в $250K/год выводится не из железа, а из зарплаты инженера, которого это железо заменяет
  • Способность ИИ работать ночами и в выходные вообще не заложена в оценку, а значит потолок ещё выше
  • Перенос экономических интуиций с людей на ИИ может быть ловушкой, а может и нет, спикер честно не знает
  • Шок предложения труда может оказаться таким большим и быстрым, что стандартная эвристика перестанет работать
  • Модель, которая тем же результатом жжёт меньше токенов, «создаёт» компьют из воздуха
  • Дорогой компьют делает выбор модели чисто экономическим: слабая модель это трата дорогого ресурса на тот же результат
  • Дешевизна ИИ сегодня это артефакт его неумелости, а не устойчивое свойство
  • Автоматизация ИИ-ресёрча перебьёт по цене развлекательные применения, и «слоп» станет роскошью
  • Спикер сам проверяет себя на паттерн вечно ошибающихся думеров о дефиците и не прячет сомнение
  • Ставка Эрлиха выиграла бы, если сыграть её в другое десятилетие, то есть «дефицит всегда проигрывает» само по себе миф
  • Компьют менее эластичен и хуже замещается субститутами, чем добыча металлов, поэтому аналогия с сырьём хромает
  • Разложение 3x на три множителя показывает, что даже удержать этот темп будет чудом, не то что ускорить
  • Закон Мура сейчас не источник роста, а то, что чудом ещё живо
  • Стройка фабрик упирается не в бетон, а в машины EUV от ASML вплоть до 2030-го и дальше
  • Переключение пластин с телефонов на ИИ имеет жёсткий потолок: с 60% до 86% на N3, а 100% это стена
  • Когда-нибудь роботы будут делать чипы из песка и меди, и компьют снова подешевеет, но это другой режим
  • Обучение модели это разовая стоимость, размазанная на всех пользователей, в отличие от человека, которого учат заново каждый раз

Инсайты

  • Разрыв между двумя экспонентами не исчезает, он лишь выбирает, кто оплатит его: маржа лабы, кошелёк арендатора или отказ от инференса, и вся стратегия сводится к тому, какой клапан откроется
  • Цена дефицитного ресурса определяется ценностью лучшего альтернативного применения, поэтому по мере поумнения ИИ пол цены компьюта задаёт уже не железо, а замещаемый человеческий труд
  • Технологическое преимущество монетизируется дважды: прямой выручкой и правом переплатить за общий дефицитный вход, вытеснив с аукциона всех менее эффективных
  • Эффективность становится оружием рынка, когда вход дорог: экономия дефицитного ресурса конвертируется в ценовую премию, а не только в снижение издержек
  • Массовое удешевление одного фактора (труда через ИИ) не гарантирует падения его ценности, если рынок способен переварить его через специализацию, но скорость шока может сломать это правило
  • «Дешёвое» часто означает «пока неспособное», и всякий раз, когда способность догоняет человека, дешевизна испаряется
  • Эффект масштаба на интеллекте структурно ведёт к концентрации власти, потому что единожды выученный навык делится на всех бесплатно, а человек так не умеет
  • Неэластичное предложение с жёсткими физическими бутылочными горлышками нельзя лечить рыночными сигналами так же, как эластичную добычу сырья, поэтому исторические аналогии про «изобретательность победит дефицит» переносятся с осторожностью
  • Честная самопроверка на исторический паттерн ошибки это не слабость аргумента, а часть его: спикер отделяет «звучит как думер» от «на этот раз механика другая»
  • Композитный тренд роста живёт ровно настолько, насколько живёт слабейший из его множителей, и удержать его труднее, чем кажется по гладкой экспоненте

Фреймворки

Три клапана для разрыва выручка/компьют (10x против 3x закрывается только этим или их комбинацией):

  1. Растёт маржа лабораторий, тогда профицит достаётся лабе
  2. Растёт цена компьюта, тогда профицит достаётся всем, кто ниже лабы в стеке
  3. Растёт доля компьюта на инференс против тренировки, но лаборатории избегают этого клапана намеренно

Разложение 3x годового роста компьюта (ни один множитель не ускорить):

  • 1.4x от закона Мура (удержать бы ещё пару лет)
  • 1.2x от строительства новых фабрик (упирается в EUV-машины ASML до 2030+)
  • 1.8x от переключения пластин с телефонов и ПК на ИИ (потолок: с 60% до 86% на узлах N3 у TSMC)

Цитаты

«For a lab to keep 10Xing revenue year over year while compute only three Xs, one of the following three things needs to happen» 0:41 Чтобы лаба удесятеряла выручку в год, пока компьют растёт лишь втрое, должно случиться одно из трёх

«If you're spending most of your compute on inference, you're basically declaring that AI progress has stalled and you're just now in the business of being a cloud provider» 1:51 Тратя большую часть компьюта на инференс, ты по сути объявляешь, что прогресс ИИ встал, и ты теперь просто облачный провайдер

«They'll have built models that make the current ones look extremely shitty» 2:08 Они построят модели, на фоне которых нынешние выглядят полным дерьмом

«As AI models get smarter, they'll be better able to monetize the same amount of compute» 4:09 Чем умнее модели, тем лучше они монетизируют тот же объём компьюта

«That H100 should rent for over $250K a year. That's over 15x the current spot price» 4:21 Этот H100 должен сдаваться за $250K в год, это в 15 раз выше нынешнего спота

«This is not even accounting for the fact that your AI can work nights and weekends» 4:28 И это даже без учёта того, что твой ИИ работает ночами и в выходные

«If we apply this argument to people instead of AIs, then this would be the classic lump of labor fallacy» 4:49 Примени этот довод к людям вместо ИИ, и это была бы классическая lump of labor fallacy

«If it costs $20 an hour to rent an H100, then it would be extremely stupid to use a weaker, less efficient model» 5:52 Если H100 стоит $20 в час, использовать слабую неэффективную модель крайне глупо

«If you have a model that can get the same result by using less compute, then you've, in some sense, created more compute» 6:16 Модель, дающая тот же результат на меньшем компьюте, в каком-то смысле создала больше компьюта

«Google or Anthropic or OpenAI will be willing to pay more for the tokens to automate AI research than you or I will be willing to pay to make more AI slop» 6:34 Google, Anthropic или OpenAI заплатят за токены на автоматизацию ИИ-ресёрча больше, чем мы с тобой за очередной ИИ-слоп

«This kind of analysis honestly pattern matches a lot onto the ways that people in the past have been wrong about scarcity» 6:46 Такой анализ честно сильно похож на то, как в прошлом ошибались насчёт дефицита

«I think it'll be a miracle if we can just keep it going for a few more years» 8:04 Будет чудом, если мы просто удержим это ещё пару лет

«At some point, you have just absorbed all leading edge wafer capacity for AI, and you can't keep increasing this number» 8:41 В какой-то момент ты поглотил всю фронтир-мощность пластин под ИИ, и дальше это число не растёт

«I wish we didn't live in a world with such strong economies of scale for intelligence, because I'm worried about power concentration, but it seems we do» 10:57 Хотел бы я, чтобы мы не жили в мире с таким сильным эффектом масштаба на интеллекте, я боюсь концентрации власти, но, похоже, живём

Факты

  • Anthropic удесятеряла выручку три года подряд; прошлый год закрыла на $9 млрд
  • Прогноз спикера на текущий год: $100–150 млрд выручки Anthropic
  • Для продолжения тренда нужен $1 трлн выручки к концу следующего года; спикер называет вывод «диким» и упирающимся в вопрос способностей ИИ
  • Компьют лабораторий растёт примерно втрое в год
  • Маржа на инференсе Anthropic по сообщениям выросла с 40% в середине прошлого года до 80%+ (спикер подаёт как «reportedly»)
  • Спотовые цены на компьют более чем на 40% выше февральского дна этого года
  • По данным EPOCH, в 2024 OpenAI тратила на инференс лишь четверть компьюта, сейчас скорее около 50%+
  • Google платит SpaceX $900 млн в месяц за 110 000 GPU (смесь GB200 и GB300), вдвое дороже почасового спота
  • Оценка: человекоуровневый ИИ-инженер на H100 при нынешних зарплатах оправдал бы аренду $250K/год, в 15 раз выше спота
  • Ставка Саймона-Эрлиха: Пол Эрлих, думер по росту населения, спорил, что корзина сырья подорожает к 1990-му, и проиграл; другой анализ показывает, что в иное десятилетие он бы выиграл
  • Разложение 3x: 1.4x закон Мура, 1.2x новые фабрики, 1.8x переключение пластин с телефонов/ПК на ИИ
  • Доля ИИ на фронтир-узлах N3 у TSMC («TFMC» в транскрипте) идёт с 60% к 86% к концу следующего года
  • Стройку фабрик до 2030 и дальше бутылочит производство EUV-машин ASML; про это подробно рассказывал Dylan в подкасте несколько месяцев назад
  • Спикер оговаривает, что когда-нибудь роботы будут превращать кремниевый песок и медь в чипы, и компьют снова подешевеет; он говорит только про нынешний режим 3x/год
  • Это озвучка блог-поста, опубликованного на dwarkesh.com

Источники

  • EPOCH (EPOCH AI): данные о доле компьюта OpenAI на инференс в 2024
  • Ставка Саймона-Эрлиха и Мальтузианская картина мира Пола Эрлиха
  • Эффект Алчиана-Аллена («Alkin-Allen» в транскрипте): экономический принцип
  • Lump of labor fallacy: заблуждение о фиксированном объёме труда
  • Dylan (Дилан Патель / SemiAnalysis): выпуск подкаста об узком месте EUV/ASML
  • Закон Мура; ASML (EUV-литография), TSMC (узлы N3), Nvidia GB200/GB300, H100
  • Блог автора: dwarkesh.com

Итог

Компьют растёт втрое, ценность ИИ куда быстрее. Дефицит вычислений сам становится главным активом, и выигрывает тот, кто выжимает из него больше всех.

readmint Pro

То, что вы только что прочитали —это саммари readmint

Оформите доступ — и получайте такой же разбор по любому своему видео. Вставляете ссылку, через 2–3 минуты готов пересказ с главными тезисами и цитатами. Без воды и без перемотки.

  • Безлимит саммари — сколько угодно видео
  • Главные тезисы и цитаты без воды
  • Приоритет в очереди обработки
  • Без рекламы и сторонних блоков
Получить такое же саммари
Доступ откроется сразу после оплаты — вставите ссылку и начнёте.

Или 4 900 ₽/год — доступ откроется сразу после оплаты.

Ещё с канала «Dwarkesh Patel»

Все видео