llama.cpp — движок инференса с открытым исходным кодом на C++, разработанный для эффективного локального запуска больших языковых моделей (LLM). Предоставляет лёгкое высокопроизводительное решение для работы с моделями, такими как Qwen3.5 35B-A3B, на потребительском железе с поддержкой CPU и GPU. Ключевые возможности: загрузка моделей, генерация текста и управление диалогами через веб-интерфейс. Движок оптимизирован для низкой задержки и экономии ресурсов, что делает его подходящим для разработчиков и исследователей, которым нужен офлайн или приватный инференс AI. Типичные сценарии: локальные чат-боты, прототипирование исследований и приложения с требованиями к конфиденциальности данных без облачных зависимостей.
429496 AI
ai.429496.xyz
Самостоятельно размещенная конечная точка AI API на базе llama.cpp, предоставляющая доступ к LLM с открытым исходным кодом.
- Модели
- 1 моделей
- От
- --
- Скорость
- 45 tok/s
- Обновлено
- 6/8/2026
- Задержка
- 0.00 s
- Дата создания
- 3/15/2026
Конечные точки API
- Конечная точка 1
ai.429496.xyz
Подтвердите право собственности, чтобы получить доступ к управлению провайдером:
- Редактировать название, контент и ссылки провайдера
- Получить продвижение с приоритетным трафиком и повышенной видимостью
- Отображать значок верификации для повышения доверия пользователей
Рейтинг лидеров
Рейтинги основаны на тестах, предоставленных сообществом, и периодических зондах работоспособности. Носит рекомендательный характер, не является официальными данными.
О 429496 AI
Мониторинг работоспособности
Бенчмарки API и цены
Сравните 1 строк моделей по свежести аудита, последним speedtest, скорости, задержке и цене за токен.
Qwen3.5-35B-A3B-Q4_K_M.gguf | 44.6 t/s | 0.87 s |
Показано 1 из 1 строк моделей
Последние записи тестов
| Время | Модель | Скорость | Задержка |
|---|---|---|---|
| Mar 15, 01:02 PM | Qwen3.5-35B-A3B-Q4_K_M.gguf | 44.59 tok/s | 0.87s |
Похожие альтернативные API-провайдеры для сравнения
Сравните альтернативы 429496 AI среди 6 близких API-провайдеров по 58 сигналам LMSpeed: общим моделям, ценам, скорости бенчмарков, доступности и бесплатным моделям.
| Провайдер | Почему сравнивать | Модели | Бесплатно | Средняя цена | Скорость | Доступность 30д |
|---|---|---|---|---|---|---|
| 429496 AI 429496-ai A self-hosted AI API endpoint powered by llama.cpp, providing access to open-source LLMs. | Текущий провайдер как база | 1 | 0 | N/A | 45 tok/s | 0% |
| 6i2 www-6i2-com 6i2 API aggregates major AI models like GPT-4, Claude, Gemini, and others into a unified OpenAI-compatible interface. |
| 49 | 13 | N/A | 110 tok/s | 7700% |
| 紫脑喵 newapi-aisonnet-org Provides API access to AI models including Claude, GPT, and Gemini, with support for chat, image generation, and coding tools. |
| 268 | 0 | $0.225/M | 131 tok/s | 9980% |
| SkyAI api-071572-xyz SkyAI provides an OpenAI-compatible API relay with access to multiple AI models and stable performance. |
| 64 | 14 | N/A | 98 tok/s | 0% |
| Catiecli skyag-xiamu-asia A multi-user proxy service for the Gemini API, focused on providing access for non-commercial and public welfare site operators. |
| 59 | 0 | N/A | 117 tok/s | 5630% |
| FreeModel freemodel FreeModel is an OpenAI-compatible API gateway that provides access to frontier AI models through a unified endpoint, with free usage options for developers. |
| 17 | 0 | N/A | 253 tok/s | 9960% |
| 晴辰云 gpt-qt-cool A unified AI access and governance platform compatible with OpenAI API specifications, offering quota management, auditing, and real-time monitoring. |
| 14 | 0 | N/A | 94 tok/s | 9950% |
Примечания
- Проверки работоспособности: Область: график за 72 часа и недавняя доступность измеряют только подключение к API. Каждый столбец суммирует проверки за один час. Цели: LMSpeed сначала проверяет настроенный URL проверки и URL статуса провайдера, затем API-адреса, полученные из известных API-хостов и недавних базовых URL speed-test. Сайт используется только тогда, когда его адрес похож на API endpoint. Этапы: для каждого адреса выполняются DNS-разрешение, TCP-соединение, TLS-рукопожатие для HTTPS и HTTP HEAD с переходом по редиректам. После первого доступного адреса проверка прекращается. Критерий доступности: все обязательные сетевые этапы должны завершиться успешно. HTTP-ответ ниже 500, включая 401 от API с аутентификацией, считается доступным, кроме статусов, классифицированных как блокировка. Блокировки: HTTP 403, 429, 521, 525 и 530, а также обнаруженные проверки WAF или Cloudflare, помечаются как заблокированные и не учитываются при расчёте доступности, поскольку LMSpeed не может определить, отключён ли сам API. Доступность моделей: если настроен отдельный тестовый ключ, LMSpeed отправляет аутентифицированный GET-запрос к вычисленному endpoint /models и сравнивает полученные ID с моделями провайдера. Результаты по моделям показываются в разделе «Модели и цены» и не включаются в процент доступности API. Таймауты: TCP-соединение, TLS-рукопожатие, HTTP-проверка и запрос моделей используют отдельный 20-секундный таймаут. Полный запуск может занять больше времени при проверке нескольких адресов. Периодичность: фоновый worker по умолчанию проверяет всех провайдеров каждые 5 минут. На 72-часовом графике эти выборки объединяются в почасовые столбцы; оператор также может изменить расписание. Ограничение: автоматические выборочные проверки не являются SLA и не гарантируют квоту аккаунта, доступность каждой модели и региона или успешное выполнение запросов генерации. Перед операционными решениями проверьте официальную страницу статуса провайдера.
- Данные Domain Rating поступают от Ahrefs. Это оценка силы домена от 0 до 100 на основе обратных ссылок; она не измеряет скорость или надежность API.
- Объявления и FAQ берутся из снимка статуса NewAPI этого провайдера, если он доступен. LMSpeed сохраняет исходный контент и необязательные английские переводы из источника статуса провайдера, затем показывает на странице локализованные поля.
