Хабр Курсы для всех
РЕКЛАМА
Большая витрина: от крупнейших школ до частных авторов. Сравнивайте по цене, длительности, формату и выбирайте самый подходящий курс!

Качество еще не тестировал, но скорость действительно увеличилась ~30 -> 50 t/s при маленьком контексте на M1 Max (32С/64GB) при использовании incoai/Qwen3.8-27B-Splash. При увеличении контекста замедляется, но все равно быстрее. И да, в оригинале поддерживает начиная с M3, но есть форк с поддержкой М1/М2: https://github.com/paperniuk/splash
И на реддите в /localLLM обсуждение интересное.
Как Splash ускоряет локальные LLM на Mac