Ollama 0.19 получила аппаратное ускорение на процессорах Apple M5

Приложение Ollama, предназначенное для локального запуска моделей искусственного интеллекта на устройствах с Windows, macOS и Linux, получило важное обновление — теперь оно поддерживает аппаратное ускорение на системах с процессорами Apple M5.

В отличие от облачных сервисов, таких как ChatGPT, которые требуют постоянного подключения к интернету и не позволяют запускать модели локально, Ollama дает возможность загружать и использовать ИИ-модели прямо на домашних компьютерах. Многие из этих моделей доступны в открытом доступе на платформах сообщества или предоставляются разработчиками без ограничений для загрузки.

Однако запуск таких моделей на локальных машинах часто сталкивается с проблемами, связанными с высоким потреблением оперативной и видеопамяти. Чтобы решить эту задачу, в версии 0.19 Ollama интегрировали поддержку фреймворка машинного обучения MLX от Apple и унифицированной архитектуры памяти. Это позволило значительно повысить производительность на устройствах с чипами Apple M5, M5 Pro и M5 Max.

Теперь приложение использует нейроускорители Apple, что сокращает время ожидания первого сгенерированного токена и ускоряет процесс генерации текста в целом. Благодаря этому выросла скорость работы как универсальных ИИ-агентов, таких как OpenClaw, так и специализированных моделей — OpenCode, Anthropic Claude Code и OpenAI Codex.

Важно отметить, что для эффективной работы обновлённой версии Ollama требуется наличие не менее 32 Гбайт унифицированной памяти на компьютере. Такой объем памяти обеспечивает стабильность и высокую производительность при работе с ресурсоёмкими моделями.

Таким образом, обновление Ollama 0.19 открывает новые возможности для пользователей Mac с процессорами Apple M5, позволяя запускать мощные ИИ-модели локально и с высокой скоростью, не завися от облачных сервисов и интернет-соединения.

Понравилась статья? Поделиться с друзьями:
Сайт для студентов