Apple — framework de ML otimizado pra unified memory do Apple Silicon, performance impressionante em M-series.
Performance em Apple Silicon supera frameworks generalistas. Unified memory simplifica modelos grandes em laptops. Trade-off: ecossistema só Apple (zero portabilidade), modelos precisam de conversão. Vale pra workloads onde a equipe está toda em Mac Studio/M-series e quer rodar modelos grandes localmente. Outros casos: llama.cpp ainda mais maduro.