Qwen
·Released on 25 февр. 2026 г.

Qwen3.5-Flash API Benchmarks, Pricing & Provider Data

Compare Qwen3.5-Flash with another model

Choose a model to open its comparison page.

Share on X
LLM

The Qwen3.5 native vision-language Flash models are built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference effic...

Specifications

Input and output token limits for this model, plus how it ranks on long-context understanding.

INPUT
1Mtokens
1.2K pages of text
OUTPUT
65.5Ktokens
8K128K1M4M
1M

Возможности

Technical Details

Вход
Выход
Выпущена
Feb 2026
Документация
Токенизатор
Qwen3
Архитектура
text+image+video->text
Модерация
Нет
Поддерживаемые параметры
frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

Эндпоинты OpenRouter

1 эндпоинтов

Сторонние данные эндпоинтов OpenRouter показаны отдельно от измерений LMSpeed. Некоторые 30-минутные live-метрики появляются только после синхронизации с OpenRouter API key.

Provider endpointВходВыводДоступность 1 деньЗадержка 30мПропускная способность 30мКонтекст / вывод
Alibaba
alibaba
$0.065/M$0.260/M100.0%undefined токенов / undefined токенов

Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.Стандартные бенчмарки могут включать BenchLM и другие открытые источники.

Работайте с данными LMSpeed

Бесплатно

Бесплатный публичный API для цен LLM, бенчмарков и данных провайдеров

  • Актуальные цены и доступность
  • Бенчмарки скорости и задержки
  • 300+ моделей, 600+ провайдеров
  • 1 000 запросов в день
Документация API