Dev48
ЯЗЫК
  • О нас
  • Услуги
  • Индустрии
  • Технологии
  • Статьи
  • Контакты
Забронировать звонок
    Главная/Статьи/Splash engine samyy bystryy lokalnyy qwen38 na apple silicon 2
Dev48

© 2026 · All rights reserved.

Splash Engine - самый быстрый локальный Qwen3.8 на Apple Silicon

Источник: LM Studio Blog

Splash Engine - самый быстрый локальный Qwen3.8 на Apple Silicon

Источник: LM Studio Blog

Как использовать Splash от Inco AI в LM Studio Bionic

29 сентября 2026 г.•Обновлено: 29 сентября 2026 г.

Что такое Splash Engine?

Splash — это открытый инференсный движок от Inco AI, предназначенный для локального запуска языковых моделей на Apple Silicon. Он оптимизирован специально для моделей Qwen3.6-35B-A3B и Qwen3.8-27B. Движок предоставляет графические ядра GPU и план памяти, адаптированный к каждой поддерживаемой модели. Каждая модель поставляется с отдельной черновой моделью DFlash 2 для спекулятивного декодирования, что повышает скорость генерации.

В тестах Inco на 48 ГБ M5 Pro Splash показал примерно в два раза более высокую скорость декодирования по сравнению с самым быстрым из протестированных ими движков на Qwen3.8-27B: 74 токена в секунду на коротких запросах и 54 токена при 32K контексте. При четырех одновременных запросах на коротких запросах его общая пропускная способность достигла 170 токенов в секунду — в 3,9 раза больше, чем у самого быстрого движка в их сравнении. Подробнее о Splash читайте в блоге Inco по ссылке blog post.

Используйте его в LM Studio Bionic

Скачайте и установите LM Studio Bionic версии 1.1.5 или выше, затем откройте приложение. Splash требует Mac M3 или новее с macOS 26.4 или выше и не менее 36 ГБ объединенной памяти; Inco рекомендует 48 ГБ или больше.

Перейдите в Настройки > Среда выполнения. В разделе «Экспериментальные бэкенды» нажмите «Скачать» рядом с Splash (Metal), чтобы установить движок.

Скачайте движок Splash в разделе Настройки > Среда выполнения.

Затем перейдите в Настройки > Обзор, вставьте одну из следующих ссылок Hugging Face в строку поиска, выберите модель и нажмите «Скачать».

После завершения загрузки начните новую сессию и выберите модель из локального списка моделей.

← Все статьи

Ещё в разделе «Разработка ПО»

Все →
Финансовый директор Aurora считает, что 30 000 беспилотных грузовиков к 2030 году — это не так уж и неправдоподобно, как кажетсяПресса
Aurora

Финансовый директор Aurora считает, что 30 000 беспилотных грузовиков к 2030 году — это не так уж и неправдоподобно, как кажется

Сертификация Boeing 737 Max 10 отложена из-за проблемы с программным обеспечением, заявляет FAAПресса
Boeing

Сертификация Boeing 737 Max 10 отложена из-за проблемы с программным обеспечением, заявляет FAA

Shopify открывает чек-вывод для браузерных ИИ-агентов
Пресса
Shopify

Shopify открывает чек-вывод для браузерных ИИ-агентов

Air Teams: внедрите лучшие агентные рабочие процессы во всей команде и автоматизируйте повторяющиеся задачи
JetBrains

Air Teams: внедрите лучшие агентные рабочие процессы во всей команде и автоматизируйте повторяющиеся задачи

Выпущен Rider 2026.2.3!
JetBrains

Выпущен Rider 2026.2.3!

Более надежная схема компиляции для модулей Kotlin Multiplatform
JetBrains

Более надежная схема компиляции для модулей Kotlin Multiplatform

Ещё от LM Studio

Запустите Muse Glimmer локально
LM Studio

Запустите Muse Glimmer локально

Bionic теперь поддерживает навыки
LM Studio

Bionic теперь поддерживает навыки

Как работает Auto Review в Bionic
LM Studio

Как работает Auto Review в Bionic

Ссылки на сессии и интроспекция
LM Studio

Ссылки на сессии и интроспекция