NeuralDeep запустил три модели Qwen и Nemotron на русском железе
Платформа NeuralDeep добавила в API три новые модели: Qwen3-Embedding-8B для векторизации текстов на 100+ языках, Qwen3-Reranker-8B для переранжирования результатов RAG и Nemotron-3-Diarization от NVIDIA для определения спикеров в аудио. Модели работают на серверах в России через партнёрство с Битрикс24 и доступны по схеме PAYG (оплата по кошельку).
Qwen3-Embedding поддерживает сжатие размерности через MRL и работает в формате FP8, реранкер обрабатывает контекст до 8k токенов, диаризация определяет до 8 спикеров в любом аудиоформате. Доступ к моделям ограничен временем: с 18:00 по 07:00 MSK в будни и круглосуточно в выходные.
Источник: Валера Ковальский
Что мы знаем о компании
NVIDIA
- инженер
- Даниэль Хан
- NVIDIA выпустила Kumo Tabular — модели для анализа таблиц без обучения 2026-10-01
- NVIDIA и Hugging Face научили NeMo Automodel работать с диффузионными моделями 2026-09-30
- Трамп встретился с главами Meta, OpenAI, Google и Nvidia по регулированию ИИ 2026-09-29
- OpenAI тайно сотрудничает с Nvidia по безопасности ИИ 2026-09-29
Новости этого рынка выходят у нас в телеграме первыми — @wikipulse.
Комментарии из открытых обсуждений в телеграме, приведены дословно. Мнение авторов не редакция.