У бесплатного ИИ-кодинга есть секрет: вы уже проиграли
Бесплатное программирование ИИ — это не бизнес-модель, а субсидия со сроком действия, и лежащая в её основе токеновая экономика незаметно сговаривается, чтобы положить ей конец. Вот математика, которую план за 20 долларов не хочет, чтобы вы видели. Каждый запрос и каждая сгенерированная строка оплачиваются токенами в обоих направлениях. Но реальная стоимость — это не точность, а контекст. Поскольку внимание имеет квадратичную зависимость, удвоение окна контекста примерно в четыре раза увеличивает вычислительную нагрузку, поэтому «загрузить весь мой репозиторий» — это самая дорогая задача, которую вы можете поручить LLM. Лаборатории намеренно заполняют этот пробел: наводняют рынок ниже себестоимости, заманивают вас, а затем переоценивают. Если вы обычный пользователь, вы дешевы. Если вы продвинутый пользователь — агенты в фоновом режиме, полный контекст репозитория, рассуждения за 30 секунд — вы перестаёте быть клиентом и становитесь платой. В этом видео рассказывается о деньгах, вложенных в стоимость инференции LLM, о захвате рынка ИИ за счет венчурных инвестиций и о том, что происходит в день, когда включается счетчик: раскол между разработчиками, которые работают локально (модели с открытым исходным кодом, такие как Qwen и Llama на Ollama), и новым направлением, которое становится предметом роскоши — где эффективность использования токенов становится самым ценным навыком для опытного инженера. ☕ Поддержите Macro Lens на Patreon → https://www.patreon.com/c/MacroLens Независимые, с минимальным количеством рекламы, подробные обзоры. Patreon позволяет им оставаться такими. ━━━━━━━━━━━━━━━━━━━ ВИДЕО, СВЯЗАННОЕ С КАНАЛОМ ━━━━━━━━━━━━━━━━━━ Прежде чем беспокоиться о счете за токены, есть более тихий налог, который платит ваша машина, прежде чем модель запишет хотя бы одну строку: ▸ «Невидимый раздутый код, портящий наши компьютеры» — посмотрите это видео дальше. ━━━━━━━━━━━━━━━━━━━ РАЗДЕЛЫ ━━━━━━━━━━━━━━━━━━━ 0:00 Два инженера, один счет 0:39 Сколько на самом деле стоит токен 1:29 Почему контекст — настоящий монстр 3:01 Субсидия, о которой никто не говорит 4:09 Вы не клиент. Вы — стоимость. 5:28 Развилка: Переход на местный уровень 6:13 Граница становится роскошью 7:15 Счет приближается ━━━━━━━━━━━━━━━━━━━ УКАЗАННЫЕ КОНЦЕПЦИИ ━━━━━━━━━━━━━━━━━━━ ▸ Токены и тарификация по объему — вы платите за токен, вход и выход ▸ Квадратичная функция внимания — удвоение контекста ≈ 4-кратное увеличение вычислительных ресурсов ▸ Окно контекста в миллион токенов — самый дорогой запрос, который вы можете сделать ▸ Субсидирование венчурных капиталистов / захват земли — лаборатории тратят меньше себестоимости, чтобы закрепить за собой вас в ▸ Отрицательная операционная маржа — трата более 2 долларов на каждый заработанный доллар (начало 2026 г.) ▸ Клиент против стоимости — точка пересечения интересов опытного пользователя ▸ Локальные/открытые модели — Ollama, Qwen (qwen2.5-coder), Llama, Mistral ▸ Эффективность токенов — правильный ответ в одном кратком запросе против агента, сжигающего 10 000 токенов ━━━━━━━━━━━━━━━━━━━ ЧАСТО ЗАДАВАЕМЫЕ ВОПРОСЫ ━━━━━━━━━━━━━━━━━━ Почему сейчас так дешево программировать ИИ? Лаборатории работают в убыток намеренно — это субсидируемый венчурными капиталистами захват рынка, чтобы сделать вас зависимыми, прежде чем они пересмотрят цены на API с оплатой за использование. Почему контекст стоит так дорого? Механизм внимания сравнивает каждый токен с каждым другим токеном, поэтому удвоение окна контекста примерно в четыре раза увеличивает необходимые вычислительные ресурсы и память. Вы клиент или затраты? Если вы используете автозаполнение всего несколько раз в день, вы дешевы. Если вы запускаете агентов и загружаете полные репозитории, вы, вероятно, обходитесь лаборатории дороже, чем платите. Что произойдет, когда закончится бесплатное программирование ИИ? Рынок разделится: повседневная работа перейдет к локальным моделям с открытыми весами (Qwen, Llama через Ollama), а передовые технологии станут предметом роскоши с оплатой за использование. Что такое эффективность токенов? Получение правильного ответа в одном четко определенном запросе вместо того, чтобы позволять модели сжигать тысячи токенов — самый дешевый токен — это тот, который вы никогда не потратите. А как насчет раздутого кода, который уже тратит вычислительные ресурсы моей машины? Это отдельный налог, о котором мы поговорим в следующем видео: «Невидимое раздувание, губящее наши компьютеры». #AICoding #TokenEconomics #LLM #Ollama #DeveloperTools
Название:
У бесплатного ИИ-кодинга есть секрет: вы уже проиграли
Категория:
Разное