OpenAI додала в API модель GPT‑6.1 Sol для програмування, роботи з комп'ютером і професійних задач. На сторінці моделі її позиціонують як дешевшу заміну GPT‑6 Astra з близькою якістю. Різниця в ціні велика: $2 і $10 за мільйон вхідних і вихідних токенів проти $10 і $50 у Astra.
Тарифи
Стандартні ціни за 1 млн токенів для запиту до 272 тис. вхідних токенів:
- вхідні токени: $2;
- кешовані вхідні: $0,10, це 5% від звичайної ціни;
- запис у кеш: $2,50, у 1,25 раза дорожче за звичайний вхід;
- вихідні токени: $10.

Якщо у запиті понад 272 тис. вхідних токенів, дорожче рахують увесь запит: вхід і кеш удвічі, вихід у півтора раза. Batch і Flex коштують наполовину менше за Standard, режим Fast удвічі дорожчий. Повна таблиця є на сторінці цін OpenAI.
Що вміє модель
Контекстне вікно 1,05 млн токенів, з них до 922 тис. на вхід, відповідь до 128 тис. Модель приймає текст і зображення, відповідає текстом.
Sol працює через Responses API і Chat Completions, але інструменти викликає тільки через Responses API. Агентові, який ходить у пошук, shell або MCP-сервери, Chat Completions не підійде.
Модель може роздавати частини роботи субагентам. У гайді до моделей GPT‑6 OpenAI попереджає, що робить вона це рідше, ніж іноді треба. Якщо задачу вигідно паралелити, напишіть це в промпті прямо: коли і скільки субагентів запускати.
Вартість агента, а не запиту
Ціна за мільйон токенів мало що каже про рахунок за агентну задачу. Агент на кожному кроці заново надсилає майже весь контекст, повторює виклики інструментів, перевіряє власні результати. Кожен субагент теж платить за свій контекст.
Ми порахували умовний приклад: агент робить 30 кроків, на кожному отримує 50 тис. токенів контексту, з яких нових лише 5 тис., і пише 2 тис. токенів відповіді. Без кешу задача коштує $3,60. Якщо незмінну частину контексту один раз записати в кеш, а далі читати за кешованим тарифом, виходить близько $1,15. Та сама задача на GPT‑6 Astra без кешу коштувала б $18.

Перш ніж переносити на Sol великий SEO-аудит чи розбір серверних логів, проженіть одну реальну задачу на обох моделях і порівняйте суму в дашборді використання. Окремо стежте, чи не виходять запити за 272 тис. токенів. На довгих логах це стається швидко, і тоді дорожчає весь запит, а не лише його хвіст.


No comments yet