MTPLX быстрее oMLX в 2,8–6,4 раза на одной модели
Разработчик VladimirVP сравнил два MLX-сервера на MacBook Pro с M4 Max и обнаружил, что MTPLX с многотокенным предсказанием завершает задачи в 2,8–6,4 раза быстрее, чем oMLX, хотя ChatGPT рекомендовал второй вариант. Тест проводился на модели Qwen3.8-27B в разных режимах размышлений.
По скрытым тестам оба сервера показали сравнимые результаты, но MTPLX выигрывает в скорости явных прогонов. Автор отмечает, что сборки моделей различались, и каждый режим на oMLX запускался однократно.
Источник: Хабр — всё
- Amazon обновила Kindle с плоским экраном и ценой от $150 2026-10-03
- Broadcom и Blackstone собрали $60 млрд на ИИ-чипы для Anthropic 2026-10-03
- Чат-бот мэрии Нью-Йорка советовал предпринимателям нарушать трудовое право 2026-10-03
- CLI-Anything генерирует интерфейсы для ИИ-агентов к любому софту 2026-10-03
Новости этого рынка выходят у нас в телеграме первыми — @wikipulse.