Claude виявився у 4–5 разів вигіднішим за ChatGPT на середніх моделях — дослідження
Аналітики SemiAnalysis протестували ліміти популярних ШІ-підписок і з'ясували, що на моделях середнього рівня Claude дає приблизно в 4–5 разів більше API-еквівалентної вартості, ніж OpenAI. Після скорочення лімітів у ChatGPT розрив став ще помітнішим.
Аналітична компанія SemiAnalysis провела масштабне тестування лімітів популярних ШІ-підписок, серед яких Anthropic, OpenAI, Meta, SpaceXAI, MiniMax, Moonshot, Z.ai, Cursor і Cognition. Головний висновок дослідження: на моделях середнього рівня Claude забезпечує приблизно в 4–5 разів більше API-еквівалентної вартості, ніж OpenAI. Після останніх урізань у ChatGPT цей розрив став ще помітнішим.
Підписки залишаються головним способом оплати доступу до штучного інтелекту для користувачів і малого бізнесу. Вони все ще сильно субсидуються, оскільки працюють як інструмент залучення клієнтів і маркетингу. Наприклад, щедрі «скидання лімітів» від OpenAI допомогли Codex здобути популярність. Anthropic через це кілька разів відмовлялася від запланованого скорочення лімітів, щоб не програти битву за репутацію.
Для фінансів компаній підписки означають більше, ніж їхня частка в доходах. За оцінкою SemiAnalysis, у Anthropic вони дають лише близько 10% виручки, але забирають понад 40% обчислень для інференсу. Через це середній дохід на мегават знижується приблизно на $36 млн. Для OpenAI, де частка підписок у виручці більша, ефект сильніший. Тому, щоб порівнювати фінансові стратегії компаній, потрібно розуміти логіку лімітів.
Користувач платить щомісяця й отримує певну кількість «кредитів». Кожна комбінація «модель + тип токена» списує їх по-різному, і співвідношення цін у кредитах може сильно відрізнятися від співвідношення API-тарифів. Тому тариф за $200 не має єдиної ціни. Його цінність залежить від трійки «тариф, модель, тип навантаження». До того ж провайдери можуть тихо змінювати ліміти, просто коригуючи вартість кредитів. Аби відстежувати це щодня, SemiAnalysis запустили дашборд підписок.
Підписки не показують точних тарифів за токени. Користувач бачить лише шкалу від 0 до 100% на 5-годинному та 7-денному вікнах. Іноді для окремої моделі, наприклад Fable, є додатковий лічильник. Експерименти SemiAnalysis влаштовані так: окремі серії запитів «навантажують» лише один тип токенів — свіжий вхід, запис у кеш, читання з кешу або вихід. Для вхідних токенів брали уривки з «Війни і миру», бо деякі моделі відмовляються відповідати на безглуздий набір символів. Для виходу використовували технічне есе, щоб примусити модель писати довго.
Один запит рідко зрушує лічильник, тому фіксують «кроки»: скільки токенів витрачено між двома стрибками шкали. Перший і останній неповні кроки відкидають. Крок додають, доки похибка не опуститься до ±5%. Якщо після 500 млн токенів читання з кешу лічильник не зрушив, кешове читання вважають безкоштовним. Далі відсотки ліміту переводять у токени на вікно й на місяць. Місячну суму обмежують тижневі ліміти. Потім обчислюють API-еквівалент: 1% від тарифу за $200 дорівнює $2. Для «агентного» навантаження використали власні співвідношення токенів SemiAnalysis за вересень.
Під час доопрацювання методики одна з трьох однакових підписок одного провайдера показувала ліміти приблизно на 20% нижчі. Акаунт був найстарішим, тож аналітики запідозрили залежність лімітів від віку облікового запису. Провайдер пояснив, що це «надзвичайно малий» A/B-тест, у якому перевіряли, як краще збалансувати момент досягнення лімітів. Вони наголосили, що ліміти загалом не знижували. Висновок SemiAnalysis: провайдери можуть непомітно міняти ліміти, а їхня методика достатньо чутлива, щоб це виявити.
Флагмани. GPT-6 Astra та Fable 5.1 мають схожі ліміти, але Fable дозволено використовувати лише для половини загального ліміту. Тому на тарифі Claude за $200 після використання $2485 у Fable 5.1 ще залишається 50% ліміту. Еквівалентний тариф OpenAI вичерпується після $2897 в Astra. Робочі моделі. Для Opus 5.5 проти GPT 6.1 Sol різниця разюча. Anthropic дає приблизно в 5 разів більше API-еквівалентної цінності. Може здатися, що це несправедливо щодо OpenAI, адже Sol дешевший за токен. Але розрив лишається значним і за кількістю токенів.
Аналітики вважають API-еквівалентну вартість найкращим єдиним показником цінності підписки. Але якщо модель за API-цінами надто вигідна або невигідна, цей показник може вводити в оману, і тоді доречніше дивитися на сирий обсяг токенів. Єдиний аргумент на користь OpenAI: у їхніх Pro-тарифах немає 5-годинного ліміту, тож простіше вибрати більшу частку місячної квоти. Втім, SemiAnalysis не вважає, що це компенсує чотирикратну різницю на користь Opus 5.5.
SemiAnalysis підтвердили скорочення цінності тарифу за $200 удвічі, про яке оголосив представник OpenAI. Підписки, куплені до змін, зберігають старі ліміти до 29 жовтня, а нові одразу діють за новими правилами. OpenAI вдвічі скоротила кількість токенів для кожного рівня моделей. API-еквівалентна цінність для моделей класу Sol впала більш ніж на 50%, бо компанія ще й здешевила кешований вхід для 6.1 Sol. Новий тариф за $500 дає лише на 21% більше Astra, ніж давав старий за $200. Для Sol цінність навіть знизилася. Головна фішка тарифу — швидкість Ultrafast на 300 токенів за секунду. Її ліміти тестують, результати підуть передплатникам Tokenomics Model. Також триває перевірка лімітів при використанні підписки ChatGPT у сторонніх застосунках, зокрема Devin.
До змін тарифи OpenAI були вигідними саме на максимальних тарифах: Pro 100 давав приблизно вдвічі більше цінності за долар, ніж Plus на Astra, а Pro 200 ще вдвічі більше. Тепер Pro 100, 200 і 500 дають однакову кількість токенів за долар для всіх моделей. Plus порівнянний для Sol, але гірший для Astra.
4



