Wireva

SemiAnalysis: підписка Claude дає у 4–5 разів більше цінності, ніж ChatGPT

Аналітики SemiAnalysis протестували ліміти популярних ШІ-підписок і з'ясували, що на моделях середнього рівня Claude забезпечує приблизно в 4–5 разів більше API-еквівалентної вартості, ніж OpenAI. Після скорочення лімітів у ChatGPT розрив став ще помітнішим.

Аналітична компанія SemiAnalysis провела порівняльне тестування лімітів популярних підписок на сервіси штучного інтелекту, зокрема від Anthropic, OpenAI, Meta, MiniMax, Moonshot, Cursor і Cognition. Головний висновок дослідження: на моделях середнього рівня підписка Claude дає приблизно в 4–5 разів більше API-еквівалентної вартості, ніж пропозиції OpenAI. Після останніх урізань у ChatGPT цей розрив став ще помітнішим.

Підписки залишаються головним способом оплати доступу до штучного інтелекту для користувачів і малого бізнесу. Вони досі значною мірою субсидуються, оскільки працюють як інструмент залучення клієнтів і маркетингу. Наприклад, щедрі «скидання лімітів» від OpenAI допомогли Codex здобути популярність. Anthropic через це кілька разів відмовлялася від запланованого скорочення лімітів, щоб не програти битву за репутацію.

Для фінансів компаній підписки означають більше, ніж їхня частка в доходах. За оцінкою SemiAnalysis, в Anthropic вони дають лише близько 10% виручки, але забирають понад 40% обчислень для інференсу. Через це середній дохід на мегават знижується приблизно на 36 мільйонів доларів. Для OpenAI, де частка підписок у виручці більша, ефект сильніший. Тому, щоб порівнювати фінансові стратегії компаній, потрібно розуміти логіку лімітів.

Механіка лімітів виглядає так: користувач платить щомісяця й отримує певну кількість «кредитів». Кожна комбінація «модель + тип токена» списує їх по-різному, і співвідношення цін у кредитах може сильно відрізнятися від співвідношення API-тарифів. Тому тариф за 200 доларів не має єдиної ціни. Його цінність залежить від трійки «тариф, модель, тип навантаження». До того ж провайдери можуть тихо змінювати ліміти, просто коригуючи вартість кредитів. Аби відстежувати це щодня, SemiAnalysis запустили дашборд підписок.

Методика замірів не показує точних тарифів за токени. Користувач бачить лише шкалу від 0 до 100% на 5-годинному та 7-денному вікнах. Іноді для окремої моделі, наприклад Fable, є додатковий лічильник. Експерименти SemiAnalysis влаштовані так: окремі серії запитів «навантажують» лише один тип токенів — свіжий вхід, запис у кеш, читання з кешу або вихід. Для вхідних токенів брали уривки з «Війни і миру», бо деякі моделі відмовляються відповідати на безглуздий набір символів. Для виходу використовували технічне есе, щоб примусити модель писати довго. Один запит рідко зрушує лічильник, тому фіксують «кроки»: скільки токенів витрачено між двома стрибками шкали. Перший і останній неповні кроки відкидають. Крок додають, доки похибка не опуститься до ±5%. Якщо після 500 млн токенів читання з кешу лічильник не зрушив, кешове читання вважають безкоштовним. Далі відсотки ліміту переводять у токени на вікно й на місяць. Місячну суму обмежують тижневі ліміти. Потім обчислюють API-еквівалент: 1% від тарифу за 200 доларів дорівнює 2 доларам. Для «агентного» навантаження використали власні співвідношення токенів SemiAnalysis за вересень.

Під час доопрацювання методики одна з трьох однакових підписок одного провайдера показувала ліміти приблизно на 20% нижчі. Акаунт був найстарішим, тож аналітики запідозрили залежність лімітів від віку облікового запису. Провайдер пояснив, що це «надзвичайно малий» A/B-тест, у якому перевіряли, як краще збалансувати момент досягнення лімітів. Вони наголосили, що ліміти загалом не знижували. Висновок SemiAnalysis: провайдери можуть непомітно міняти ліміти, а їхня методика достатньо чутлива, щоб це виявити.

Порівняння флагманських моделей показало, що GPT-6 Astra та Fable 5.1 мають схожі ліміти, але Fable дозволено використовувати лише для половини загального ліміту. Тому на тарифі Claude за 200 доларів після використання 2485 доларів у Fable 5.1 ще залишається 50% ліміту. Еквівалентний тариф OpenAI вичерпується після 2897 доларів в Astra. Для робочих моделей Opus 5.5 проти GPT 6.1 Sol різниця разюча: Anthropic дає приблизно в 5 разів більше API-еквівалентної цінності. Може здатися, що це несправедливо щодо OpenAI, адже Sol дешевший за токен. Але розрив лишається значним і за кількістю токенів. Підсумок для Opus 5.5: приблизно в 4 рази вигідніше, ніж будь-що від OpenAI.

Аналітики вважають API-еквівалентну вартість найкращим єдиним показником цінності підписки. Але якщо модель за API-цінами надто вигідна або невигідна, цей показник може вводити в оману, і тоді доречніше дивитися на сирий обсяг токенів. Єдиний аргумент на користь OpenAI: у їхніх Pro-тарифах немає 5-годинного ліміту, тож простіше вибрати більшу частку місячної квоти. Втім, SemiAnalysis не вважає, що це компенсує чотирикратну різницю на користь Opus 5.5.

OpenAI урізала 200-доларовий тариф і запустила 500-доларовий. SemiAnalysis підтвердили скорочення цінності тарифу за 200 доларів удвічі, про яке оголосив представник OpenAI. Підписки, куплені до змін, зберігають старі ліміти до 29 жовтня, а нові одразу діють за новими правилами. OpenAI вдвічі скоротила кількість токенів для кожного рівня моделей. API-еквівалентна цінність для моделей класу Sol впала більш ніж на 50%, бо компанія ще й здешевила кешований вхід для 6.1 Sol. Новий тариф за 500 доларів дає лише на 21% більше Astra, ніж давав старий за 200. Для Sol цінність навіть знизилася. Головна фішка тарифу — швидкість Ultrafast на 300 токенів за секунду. Її ліміти тестують, результати підуть передплатникам Tokenomics Model. Також триває перевірка лімітів при використанні підписки ChatGPT у сторонніх застосунках, зокрема Devin. До змін тарифи OpenAI були вигідними саме на максимальних тарифах: Pro 100 давав приблизно вдвічі більше цінності за долар, ніж Plus на Astra, а Pro 200 ще вдвічі більше. Тепер Pro 100, 200 і 500 дають однакову кількість токенів за долар для всіх моделей. Plus порівнянний для Sol, але гірший для Astra.

Same event, other desks

Story file →