- Главная
- Mac
- MacBook Pro
- MacBook Pro 14" (2023) M3
- Ноутбук Apple MacBook Pro 14″ M3 Max Silver Z1AX002A4 (2023)
Это максимальная конфигурация памяти в линейке M3 Max — для тех, кому действительно нужен весь объём: локальные LLM уровня 70B с длинным контекстным окном, параллельная работа сразу с несколькими крупными моделями или датасетами, профессиональная ML-разработка без постоянного вылета в подкачку. Для чистого видеомонтажа или 3D 128GB избыточны — там узким местом остаётся не память, а количество GPU-ядер, которое здесь такое же, как и в версиях с 48GB и 64GB.
На 70B-моделях в квантизации Q4_K_M 128GB дают около 14 токенов в секунду — сопоставимо или чуть быстрее версии с 96GB (14CPU/30GPU), но с заметно большим запасом под длинный контекст: у 96GB-версии модель и контекст занимают почти всю доступную память, а здесь остаётся ощутимый запас для истории диалога и параллельных процессов. Структурное преимущество перед видеокартами NVIDIA — единый пул памяти, доступный и CPU, и GPU без выгрузки слоёв и штрафа на передачу данных по шине.
Для моделей крупнее 70B (например 405B) 128GB уже недостаточно — такие модели требуют чипа M3 Ultra, который в M3 Max физически недоступен. Практическое правило — держать модель и её контекстное окно в пределах примерно 80% от объёма памяти, оставляя запас для macOS и фоновых процессов. Память здесь также впаяна и не расширяется после покупки, а доплата за переход с 48/64GB на 128GB при этом же чипе существенная.
Для каких задач чаще всего берут
ML / Data Science
Локальные AI-модели
AI-ассистент / Чат-боты
Разработка
DevOps / Серверы
Видеомонтаж
Хвалят
Максимальный объём памяти в линейке M3 Max (128GB) — самый большой контекстный запас для локальных LLM 70B в этой линейке продукта
На 70B-моделях в Q4_K_M около 14 токенов/сек — сопоставимо или чуть быстрее версии с 96GB, но с заметно большим запасом под длинный контекст
Единый пул памяти доступен и CPU, и GPU без выгрузки слоёв — структурное преимущество перед видеокартами с раздельной VRAM при работе с крупными моделями
GPU-ядер (40) и пропускная способность (400GB/s) такие же, как у версий с 48GB и 64GB того же чипа — для видеомонтажа и рендеринга прирост от памяти не создаёт узкого места
Хватает памяти для параллельной работы с несколькими крупными моделями или датасетами одновременно
Экран Liquid Retina XDR и автономность до 18 часов — как и у остальных M3 Max версий
Жалуются
Для моделей крупнее 70B (например 405B) памяти уже недостаточно — такие модели требуют чипа M3 Ultra, недоступного в этом чипе
Практическое правило — держать модель и контекст в пределах ~80% памяти, иначе не остаётся запаса для macOS и фоновых процессов
Существенная доплата за переход с 48GB/64GB на 128GB при том же чипе и тех же GPU-ядрах
Для чистого видеомонтажа и 3D 128GB избыточны — узким местом там остаётся количество GPU-ядер, а не память
Память впаяна и не расширяется после покупки
При долгой инференс-нагрузке на больших моделях корпус ощутимо нагревается, вентилятор становится слышен


