Карточка модели
Карточка модели
Карточка модели — это страница с подробной информацией о конкретной AI-модели, доступной на платформе Arka AI. Она помогает понять возможности модели, сравнить цены от разных поставщиков и сразу начать использовать модель — либо через встроенный чат-интерфейс, либо через API.
В этом руководстве мы рассмотрим карточку модели на примере DeepSeek-V3.1 — одной из популярных моделей для генерации текста и решения аналитических задач.
Основные характеристики
Откройте карточку любой модели из каталога, и вы увидите несколько ключевых блоков информации.
Название и описание модели
В верхней части карточки отображается название модели (например, «DeepSeek-V3.1» или «Qwen3.5-27B») и её краткое описание. Описание объясняет, для каких задач модель предназначена: чат, генерация кода, анализ длинных документов, работа с JSON или вызов внешних функций (function calling).
Категория
Под названием указана категория модели: Текст, Изображение, Аудио, Embeddings и др. Категория определяет, какие задачи модель решает и какой формат входных/выходных данных она поддерживает.
Поставщики GPU
Карточка модели показывает список поставщиков — GPU-кластеров, на которых работает модель. Каждый поставщик имеет свои характеристики:
- Название: NVIDIA, AutoDL или другой кластер.
- Цена за токены: стоимость входных и выходных токенов в рублях — может отличаться у разных поставщиков.
- Задержка (latency): среднее время отклика модели — важно для приложений, требующих быстрого ответа.
Вы можете выбрать поставщика, который даёт оптимальное соотношение цены и скорости для вашей задачи.
Цены и контекстное окно
Входные и выходные токены
Платформа Arka AI тарифицирует модели по количеству обработанных токенов. Токен — это единица текста, которую модель считывает или генерирует (в русском тексте один токен — это, как правило, 1-3 символа).
- Входные токены — это текст вашего запроса (системное сообщение, история диалога, документ для анализа). Вы платите за объём данных, который отправляете модели.
- Выходные токены — это текст ответа модели. Обычно они дороже входных, поскольку генерация требует больше вычислительных ресурсов.
Цены указаны в рублях (₽) за 1 миллион токенов и зависят от модели и поставщика GPU. Актуальные цены всегда отображаются в карточке модели в каталоге.
Контекстное окно
Контекстное окно — это максимальная длина ввода, которую модель может обработать за один вызов. Измеряется в токенах. Например, контекстное окно DeepSeek-V3.1 составляет 128 тысяч токенов (128K) — этого достаточно, чтобы передать модели книгу объёмом ~200 страниц за один запрос.
Модели с большим контекстным окном (256K, 1M токенов) подходят для анализа объёмных документов и длинных диалогов. Модели с меньшим окном (8K, 32K) оптимизированы для быстрых ответов.
Быстрый старт в браузере
Карточка модели позволяет попробовать модель прямо в браузере:
- Откройте карточку модели из каталога.
- Нажмите кнопку «Попробовать» — откроется встроенный чат-интерфейс.
- Введите ваш запрос (промпт) на русском или английском языке.
- Нажмите «Отправить» — модель сгенерирует ответ, который вы увидите в чате.
Это быстрый способ проверить, подходит ли модель для ваших задач, без настройки API-клиентов и написания кода.
API-вызов
Для программного использования модели через API вам потребуется API-ключ. Модели Arka AI доступны через OpenAI-совместимый эндпоинт Chat Completions.
cURL
curl -X POST "https://api.arka-ai.ru/api/v1/chat/completions" \
-H "Authorization: Bearer ВАШ_API_КЛЮЧ" \
-H "Content-Type: application/json" \
-d '{
"model": "DeepSeek-V3.1",
"messages": [
{"role": "user", "content": "Напиши краткую сводку по рыночному отчёту объёмом 50 страниц"}
],
"max_tokens": 4000
}'
Python
import requests
headers = {
"Authorization": "Bearer ВАШ_API_КЛЮЧ",
"Content-Type": "application/json"
}
data = {
"model": "DeepSeek-V3.1",
"messages": [
{"role": "user", "content": "Напиши краткую сводку по рыночному отчёту объёмом 50 страниц"}
],
"max_tokens": 4000
}
response = requests.post(
"https://api.arka-ai.ru/api/v1/chat/completions",
json=data,
headers=headers
)
print(response.json()["choices"][0]["message"]["content"])
Node.js
const response = await fetch('https://api.arka-ai.ru/api/v1/chat/completions', {
method: 'POST',
headers: {
Authorization: 'Bearer ВАШ_API_КЛЮЧ',
'Content-Type': 'application/json',
},
body: JSON.stringify({
model: 'DeepSeek-V3.1',
messages: [
{
role: 'user',
content: 'Напиши краткую сводку по рыночному отчёту объёмом 50 страниц',
},
],
max_tokens: 4000,
}),
});
const data = await response.json();
console.log(data.choices[0].message.content);
API Arka AI совместимо с форматом OpenAI Chat Completions — вы можете использовать любую существующую OpenAI-совместимую клиентскую библиотеку.
Похожие модели
В нижней части карточки модели может отображаться блок с рекомендациями похожих моделей — альтернативных вариантов с близкими характеристиками. Это помогает быстро найти замену, если текущая модель не подходит по цене или функциональности.
Скриншот карточки модели будет добавлен в Phase 25.