api.tokenpony.cn

Платформа агрегации AI-моделей, предоставляющая унифицированный API-доступ к нескольким большим языковым моделям с функциями оптимизации стоимости.

Модели
45 моделей
От
--
Скорость
85 tok/s
Обновлено
6/8/2026
Задержка
0.00 s
Дата создания
12/7/2025

Конечные точки API

  • Конечная точка 1
    api.tokenpony.cn
Подтвердить права на провайдера

Подтвердите право собственности, чтобы получить доступ к управлению провайдером:

  • Редактировать название, контент и ссылки провайдера
  • Получить продвижение с приоритетным трафиком и повышенной видимостью
  • Отображать значок верификации для повышения доверия пользователей

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.

О TokenPony

TokenPony (小马算力) — это агрегатор AI-моделей, предоставляющий унифицированный API-интерфейс, совместимый со спецификациями OpenAI и Claude. Платформа позволяет разработчикам получать доступ к различным большим языковым моделям через единую конечную точку, поддерживая балансировку нагрузки и оптимизацию затрат.

Доступные ключевые модели включают:

  • Deepseek-v3-0324: улучшенные возможности рассуждения для математических задач и задач кодирования
  • qwen3-coder-480b: модель генерации кода с 450 миллиардами параметров и поддержкой нескольких языков
  • kimi-k2-instruct-0905: триллионная MoE-модель для генерации кода и творческого письма

Сервис предоставляет метрики, включая средний TTFT <500 мс, и цены, начинающиеся от ¥7 за миллион токенов. Платформа обслуживает более 60 000 разработчиков, а ежемесячное потребление токенов превышает 90 миллиардов.

Мониторинг работоспособности

99%Доступность за последнее время
История (72 точек)
ПрошлоеСейчас

Бенчмарки API и цены

Сравните 44 строк моделей по свежести аудита, последним speedtest, скорости, задержке и цене за токен.

Модель
qwen3-next-80b-a3b-instruct
bge-m3
bge-reranker-v2-m3
deepseek-ocr
deepseek-r1-0528
deepseek-v3-0324
deepseek-v3.2
deepseek-v4-flash
deepseek-v4-flash-finance
deepseek-v4-pro
doubao-tts
glm-4.6
glm-4.7
glm-5.1-vip
glm-5.2
glm-5.2-vip
glm-5.2-vip1
kimi-k2-instruct
kimi-k2-thinking
kimi-k2.5
kimi-k2.6
kimi-k2.7-code
kimi-k3
kimi-k3-vip
minimax-m2.1

Показано 25 из 44 строк моделей

Последние записи тестов

ВремяМодельСкоростьЗадержка
Nov 14, 10:21 AM
deepseek-v3.2-exp
39.89 tok/s
0.58s
Nov 3, 12:17 PM
hunyuan-a13b-instruct
143.03 tok/s
3.85s
Sep 23, 04:24 AM
kimi-k2-instruct-0905
13.20 tok/s
1.09s
Sep 23, 03:44 AM
qwen3-8b
150.65 tok/s
5.56s
Aug 12, 12:34 PM
qwen3-8b
80.04 tok/s
9.19s
Jun 11, 02:54 AM
qwen3-8b
80.91 tok/s
8.15s

Похожие альтернативные API-провайдеры для сравнения

Сравните альтернативы TokenPony среди 6 близких API-провайдеров по 209 сигналам LMSpeed: общим моделям, ценам, скорости бенчмарков, доступности и бесплатным моделям.

ПровайдерПочему сравниватьМоделиБесплатноСредняя ценаСкоростьДоступность 30д
TokenPony

api-tokenpony-cn

An AI model aggregation platform providing unified API access to multiple large language models with cost optimization features.

Текущий провайдер как база450N/A85 tok/s9940%
紫脑喵

newapi-aisonnet-org

Provides API access to AI models including Claude, GPT, and Gemini, with support for chat, image generation, and coding tools.

  • Выше измеренная скорость
  • Выше доступность за 30 дней
  • Шире покрытие моделей
2680$0.225/M131 tok/s9980%
SkyAI

api-071572-xyz

SkyAI provides an OpenAI-compatible API relay with access to multiple AI models and stable performance.

  • Выше измеренная скорость
  • Больше бесплатных моделей
  • Шире покрытие моделей
6414N/A98 tok/s0%
6i2

www-6i2-com

6i2 API aggregates major AI models like GPT-4, Claude, Gemini, and others into a unified OpenAI-compatible interface.

  • Выше измеренная скорость
  • Больше бесплатных моделей
  • Шире покрытие моделей
4913N/A110 tok/s7720%
云AI

new-yunai-link

云AI is a unified LLM API gateway offering access to multiple AI models with enterprise-grade security, low latency, and cost-effective pricing for developers.

  • Выше доступность за 30 дней
  • Шире покрытие моделей
1630$0.0005/MN/A9980%
Catiecli

skyag-xiamu-asia

A multi-user proxy service for the Gemini API, focused on providing access for non-commercial and public welfare site operators.

  • Выше измеренная скорость
  • Шире покрытие моделей
590N/A117 tok/s5660%
FreeModel

freemodel

FreeModel is an OpenAI-compatible API gateway that provides access to frontier AI models through a unified endpoint, with free usage options for developers.

  • Выше измеренная скорость
  • Выше доступность за 30 дней
170N/A253 tok/s9960%

Примечания

  • Проверки работоспособности: Область: график за 72 часа и недавняя доступность измеряют только подключение к API. Каждый столбец суммирует проверки за один час. Цели: LMSpeed сначала проверяет настроенный URL проверки и URL статуса провайдера, затем API-адреса, полученные из известных API-хостов и недавних базовых URL speed-test. Сайт используется только тогда, когда его адрес похож на API endpoint. Этапы: для каждого адреса выполняются DNS-разрешение, TCP-соединение, TLS-рукопожатие для HTTPS и HTTP HEAD с переходом по редиректам. После первого доступного адреса проверка прекращается. Критерий доступности: все обязательные сетевые этапы должны завершиться успешно. HTTP-ответ ниже 500, включая 401 от API с аутентификацией, считается доступным, кроме статусов, классифицированных как блокировка. Блокировки: HTTP 403, 429, 521, 525 и 530, а также обнаруженные проверки WAF или Cloudflare, помечаются как заблокированные и не учитываются при расчёте доступности, поскольку LMSpeed не может определить, отключён ли сам API. Доступность моделей: если настроен отдельный тестовый ключ, LMSpeed отправляет аутентифицированный GET-запрос к вычисленному endpoint /models и сравнивает полученные ID с моделями провайдера. Результаты по моделям показываются в разделе «Модели и цены» и не включаются в процент доступности API. Таймауты: TCP-соединение, TLS-рукопожатие, HTTP-проверка и запрос моделей используют отдельный 20-секундный таймаут. Полный запуск может занять больше времени при проверке нескольких адресов. Периодичность: фоновый worker по умолчанию проверяет всех провайдеров каждые 5 минут. На 72-часовом графике эти выборки объединяются в почасовые столбцы; оператор также может изменить расписание. Ограничение: автоматические выборочные проверки не являются SLA и не гарантируют квоту аккаунта, доступность каждой модели и региона или успешное выполнение запросов генерации. Перед операционными решениями проверьте официальную страницу статуса провайдера.
  • Данные Domain Rating поступают от Ahrefs. Это оценка силы домена от 0 до 100 на основе обратных ссылок; она не измеряет скорость или надежность API.
  • Объявления и FAQ берутся из снимка статуса NewAPI этого провайдера, если он доступен. LMSpeed сохраняет исходный контент и необязательные английские переводы из источника статуса провайдера, затем показывает на странице локализованные поля.