Карточка модели

Карточка модели

Карточка модели — это страница с подробной информацией о конкретной AI-модели, доступной на платформе Arka AI. Она помогает понять возможности модели, сравнить цены от разных поставщиков и сразу начать использовать модель — либо через встроенный чат-интерфейс, либо через API.

В этом руководстве мы рассмотрим карточку модели на примере DeepSeek-V3.1 — одной из популярных моделей для генерации текста и решения аналитических задач.

Основные характеристики

Откройте карточку любой модели из каталога, и вы увидите несколько ключевых блоков информации.

Название и описание модели

В верхней части карточки отображается название модели (например, «DeepSeek-V3.1» или «Qwen3.5-27B») и её краткое описание. Описание объясняет, для каких задач модель предназначена: чат, генерация кода, анализ длинных документов, работа с JSON или вызов внешних функций (function calling).

Категория

Под названием указана категория модели: Текст, Изображение, Аудио, Embeddings и др. Категория определяет, какие задачи модель решает и какой формат входных/выходных данных она поддерживает.

Поставщики GPU

Карточка модели показывает список поставщиков — GPU-кластеров, на которых работает модель. Каждый поставщик имеет свои характеристики:

  • Название: NVIDIA, AutoDL или другой кластер.
  • Цена за токены: стоимость входных и выходных токенов в рублях — может отличаться у разных поставщиков.
  • Задержка (latency): среднее время отклика модели — важно для приложений, требующих быстрого ответа.

Вы можете выбрать поставщика, который даёт оптимальное соотношение цены и скорости для вашей задачи.

Цены и контекстное окно

Входные и выходные токены

Платформа Arka AI тарифицирует модели по количеству обработанных токенов. Токен — это единица текста, которую модель считывает или генерирует (в русском тексте один токен — это, как правило, 1-3 символа).

  • Входные токены — это текст вашего запроса (системное сообщение, история диалога, документ для анализа). Вы платите за объём данных, который отправляете модели.
  • Выходные токены — это текст ответа модели. Обычно они дороже входных, поскольку генерация требует больше вычислительных ресурсов.

Цены указаны в рублях (₽) за 1 миллион токенов и зависят от модели и поставщика GPU. Актуальные цены всегда отображаются в карточке модели в каталоге.

Контекстное окно

Контекстное окно — это максимальная длина ввода, которую модель может обработать за один вызов. Измеряется в токенах. Например, контекстное окно DeepSeek-V3.1 составляет 128 тысяч токенов (128K) — этого достаточно, чтобы передать модели книгу объёмом ~200 страниц за один запрос.

Модели с большим контекстным окном (256K, 1M токенов) подходят для анализа объёмных документов и длинных диалогов. Модели с меньшим окном (8K, 32K) оптимизированы для быстрых ответов.

Быстрый старт в браузере

Карточка модели позволяет попробовать модель прямо в браузере:

  1. Откройте карточку модели из каталога.
  2. Нажмите кнопку «Попробовать» — откроется встроенный чат-интерфейс.
  3. Введите ваш запрос (промпт) на русском или английском языке.
  4. Нажмите «Отправить» — модель сгенерирует ответ, который вы увидите в чате.
Карточка модели с ценой за токены, контекстом и поставщиками

Это быстрый способ проверить, подходит ли модель для ваших задач, без настройки API-клиентов и написания кода.

API-вызов

Для программного использования модели через API вам потребуется API-ключ. Модели Arka AI доступны через OpenAI-совместимый эндпоинт Chat Completions.

cURL

curl -X POST "https://api.arka-ai.ru/api/v1/chat/completions" \
  -H "Authorization: Bearer ВАШ_API_КЛЮЧ" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "DeepSeek-V3.1",
    "messages": [
      {"role": "user", "content": "Напиши краткую сводку по рыночному отчёту объёмом 50 страниц"}
    ],
    "max_tokens": 4000
  }'

Python

import requests
 
headers = {
    "Authorization": "Bearer ВАШ_API_КЛЮЧ",
    "Content-Type": "application/json"
}
 
data = {
    "model": "DeepSeek-V3.1",
    "messages": [
        {"role": "user", "content": "Напиши краткую сводку по рыночному отчёту объёмом 50 страниц"}
    ],
    "max_tokens": 4000
}
 
response = requests.post(
    "https://api.arka-ai.ru/api/v1/chat/completions",
    json=data,
    headers=headers
)
 
print(response.json()["choices"][0]["message"]["content"])

Node.js

const response = await fetch('https://api.arka-ai.ru/api/v1/chat/completions', {
  method: 'POST',
  headers: {
    Authorization: 'Bearer ВАШ_API_КЛЮЧ',
    'Content-Type': 'application/json',
  },
  body: JSON.stringify({
    model: 'DeepSeek-V3.1',
    messages: [
      {
        role: 'user',
        content: 'Напиши краткую сводку по рыночному отчёту объёмом 50 страниц',
      },
    ],
    max_tokens: 4000,
  }),
});
 
const data = await response.json();
console.log(data.choices[0].message.content);

API Arka AI совместимо с форматом OpenAI Chat Completions — вы можете использовать любую существующую OpenAI-совместимую клиентскую библиотеку.

Похожие модели

В нижней части карточки модели может отображаться блок с рекомендациями похожих моделей — альтернативных вариантов с близкими характеристиками. Это помогает быстро найти замену, если текущая модель не подходит по цене или функциональности.


Скриншот карточки модели будет добавлен в Phase 25.