• Виктор
  • Блог
  • 2 мин. чтения

Perplexity открыла исходный код Lily — движка для локальной работы ИИ на Mac


Perplexity открыла исходный код Lily — лёгкого движка инференса для локальной работы с моделями в Perplexity Computer. Он рассчитан на компьютеры Mac с Apple Silicon и специально оптимизирован для модели Qwen3.6-35B-A3B.

Lily написан на Rust и использует собственные Metal-ядра. В опубликованном описании Perplexity связывает движок с гибридным режимом работы: часть задач выполняется локально на Mac, а облачные модели используются для исследований и сложных рассуждений.

Что известно о Lily

Perplexity оптимизировала Lily для Qwen3.6-35B-A3B — разреженной модели с 35 млрд параметров, которая активирует около 3 млрд параметров на токен. Движок рассчитан именно на этот чекпойнт в формате MLX affine 4-bit и не является универсальным сервером для других моделей Qwen. Lily также предоставляет совместимый с OpenAI API интерфейс.

Lily не превращает Perplexity Computer в полностью офлайн-сервис. По данным компании, гибридный режим распределяет работу между локальной моделью и облачными моделями: облако используется для исследований и рассуждений, а локальная модель может работать с приватными файлами и приложениями на Mac.

Как пользоваться

Опубликованный Lily можно собрать и запустить отдельно от Perplexity Computer. Для него требуется Mac с Apple GPU Family 10 или новее — это соответствует Apple Silicon поколения M5 и новее — и macOS 26 или новее. В репозитории есть инструкции по загрузке чекпойнта, сборке через Rust и запуску сервера.

Проект распространяется по лицензии Apache-2.0.

Почему это важно? Код Lily можно изучать и дорабатывать отдельно от Perplexity Computer. При этом движок остаётся специализированным решением для Qwen3.6-35B-A3B, а обычный пользовательский режим Perplexity Computer по-прежнему сочетает локальную обработку с облачными возможностями сервиса.

Ранее Perplexity Computer получила гибридные вычисления на Mac — сервис распределяет задачу между облачными ИИ-моделями и локальной моделью на компьютере пользователя.

Итог. Lily даёт Perplexity собственный открытый движок для локального запуска Qwen3.6-35B-A3B на Mac с Apple Silicon. Компания оптимизировала его непосредственно под архитектуру модели и добилась более высокой производительности по сравнению с MLX-LM в собственных тестах.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Anthropic объединила чат с Cowork и встроила редакторы документов и слайдов прямо в Claude

Anthropic объединила стандартный диалоговый чат и рабочий режим Cowork в единый интерфейс Claude. Модель теперь сама определяет характер...

Google показала проекты на Gemini 3.8 Flash

Google показала четыре проекта, собранных разработчиками на Gemini 3.8 Flash. Модель вышла в начале сентября и, по заявлению...

Google запускает Nano Banana – новая эра редактирования изображений

Google представила модель искусственного интеллекта Nano Banana - предварительную версию Gemini 2.5 Flash Image, которая уже доступна пользователям...

ElevenLabs запустила Flows Agent в ElevenCreative — агент строит workflow по текстовому запросу

ElevenLabs представила Flows Agent в ElevenCreative. Пользователь описывает, что хочет создать, а ИИ-агент подбирает модели, добавляет узлы на...

MiniMax выпустила видеомодель H3 – ролики в 2K со звуком

MiniMax 31 июля представила H3 - мультимодальную видеомодель, которая принимает текст, изображения, видео и звук и выдаёт ролики...

Runway представила Multi-Shot App: от одного промпта к полноценной многосценной истории с диалогами, звуком и монтажом

Runway представила новый инструмент, который заметно упрощает создание видеоконтента с помощью нейросетей. Multi-Shot App превращает один текстовый запрос...

YouTube запустил генерацию видео с помощью Veo 2 для Shorts

YouTube представил новую функцию для генерации коротких роликов в Shorts, интегрировав ИИ-модель Veo 2 от Google в инструмент...

NotebookLM научился делать минутные вертикальные видео из документов

Google добавила в NotebookLM новый формат - Short Video Overviews. Сервис автоматически собирает из загруженных документов короткое вертикальное...

Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики

Alibaba официально запустила Wan3.0 - видеомодель, которая делает ролик длиной до 30 секунд из текста, картинок, аудио и...

Килиан Мбаппе ушёл от Nike и стал амбассадором бренда On

Швейцарский производитель спортивной одежды и обуви On заключил контракт с нападающим «Реала» и сборной Франции Килианом Мбаппе. Футболист...

Pika Labs запустила Pika Agents

Pika Labs вывела Pika Agents в открытый доступ и предложила другой способ работы с генеративным ИИ. Вместо привычного...

Нейросеть Кандинский 3.0: как пользоваться, как обрабатывать фото и создавать картинки

Кандинский – это бесплатная нейросеть от Сбера, способная генерировать картинки по текстовому описанию. Работает по сходному с Midjourney...

Portable Computer от Perplexity доехал до AMD

Perplexity открыла Portable Computer на Windows-компьютерах с процессорами AMD Ryzen AI Max. Подписчики сервиса запускают локальные ИИ-задачи и...

OpenAI выпустила приложение Sora на Android — пока только в 7 странах

OpenAI представила Android-версию приложения Sora — инструмента для генерации коротких видео с помощью искусственного интеллекта. Скачать ИИ-генератор видео...

Anthropic выпустила Claude Opus 5.5 – уровень Fable за меньшие деньги

Anthropic выпустила Claude Opus 5.5, первую модель нового поколения Claude 5.5. По заявлению компании, на большинстве задач она...

Как пользоваться Nano Banana 2 Lite бесплатно — гайд

Недавно Google выпустил нейросеть Nano Banana 2 Lite — облегчённую версию генератора изображений на базе Gemini. ИИ-модель быстро...

Как пользоваться QwenWork: регистрация, возможности, бесплатные кредиты и тарифы

QwenWork — это новый ИИ-агент от Alibaba, который доступен на сайте и через отдельное приложение. По принципу работы...

ByteDance открыла публичный API Seedance 2.5

7 августа Volcano Engine открыла публичный API Seedance 2.5 - видеомодели ByteDance, которая одним проходом собирает 30-секундный ролик...

ImagineArt показала модель 2.0

ImagineArt представила модель ImagineArt 2.0 и делает ставку на то, что в генерации изображений пользователям важен уже не...

Kling представил VIDEO 2.6 — ИИ-модель, которая генерирует видео и звук за один прогон

Kling запустил модель VIDEO 2.6 — свой первый генератор, который создаёт картинку и звук одновременно. Один запрос превращается...