GPT-6.1 Sol: $2 за вхід, $0,10 за кеш і $10 за вихід на мільйон токенів

GPT‑6.1 Sol здешевлює агентні задачі. Як порахувати, наскільки

Sol коштує вп'ятеро менше за GPT‑6 Astra, але рахунок за агента залежить від кешу, довжини контексту і кількості кроків. Розбираємо тарифи і рахуємо на прикладі.

OpenAI додала в API модель GPT‑6.1 Sol для програмування, роботи з комп'ютером і професійних задач. На сторінці моделі її позиціонують як дешевшу заміну GPT‑6 Astra з близькою якістю. Різниця в ціні велика: $2 і $10 за мільйон вхідних і вихідних токенів проти $10 і $50 у Astra.

Тарифи

Стандартні ціни за 1 млн токенів для запиту до 272 тис. вхідних токенів:

  • вхідні токени: $2;
  • кешовані вхідні: $0,10, це 5% від звичайної ціни;
  • запис у кеш: $2,50, у 1,25 раза дорожче за звичайний вхід;
  • вихідні токени: $10.
Стовпчикова діаграма тарифів GPT-6.1 Sol для коротких і довгих запитів
Ціни Standard за 1 млн токенів. Дані: таблиця цін OpenAI API.

Якщо у запиті понад 272 тис. вхідних токенів, дорожче рахують увесь запит: вхід і кеш удвічі, вихід у півтора раза. Batch і Flex коштують наполовину менше за Standard, режим Fast удвічі дорожчий. Повна таблиця є на сторінці цін OpenAI.

Що вміє модель

Контекстне вікно 1,05 млн токенів, з них до 922 тис. на вхід, відповідь до 128 тис. Модель приймає текст і зображення, відповідає текстом.

Sol працює через Responses API і Chat Completions, але інструменти викликає тільки через Responses API. Агентові, який ходить у пошук, shell або MCP-сервери, Chat Completions не підійде.

Модель може роздавати частини роботи субагентам. У гайді до моделей GPT‑6 OpenAI попереджає, що робить вона це рідше, ніж іноді треба. Якщо задачу вигідно паралелити, напишіть це в промпті прямо: коли і скільки субагентів запускати.

Вартість агента, а не запиту

Ціна за мільйон токенів мало що каже про рахунок за агентну задачу. Агент на кожному кроці заново надсилає майже весь контекст, повторює виклики інструментів, перевіряє власні результати. Кожен субагент теж платить за свій контекст.

Ми порахували умовний приклад: агент робить 30 кроків, на кожному отримує 50 тис. токенів контексту, з яких нових лише 5 тис., і пише 2 тис. токенів відповіді. Без кешу задача коштує $3,60. Якщо незмінну частину контексту один раз записати в кеш, а далі читати за кешованим тарифом, виходить близько $1,15. Та сама задача на GPT‑6 Astra без кешу коштувала б $18.

Порівняння вартості агента на 30 кроків: $3,60 без кешу і $1,15 з кешем
Наш розрахунок за тарифами Standard. Реальна сума залежить від того, скільки контексту справді потрапляє в кеш.

Перш ніж переносити на Sol великий SEO-аудит чи розбір серверних логів, проженіть одну реальну задачу на обох моделях і порівняйте суму в дашборді використання. Окремо стежте, чи не виходять запити за 272 тис. токенів. На довгих логах це стається швидко, і тоді дорожчає весь запит, а не лише його хвіст.

No comments yet