- Головна
- Mac
- MacBook Pro
- MacBook Pro 14" (2023) M3
- Ноутбук Apple MacBook Pro 14″ M3 Max Silver Z1AX002AH (2023)
Це максимальна конфігурація пам’яті в лінійці M3 Max — для тих, кому дійсно потрібен весь обсяг: локальні LLM рівня 70B з довгим контекстним вікном, паралельна робота одразу з кількома великими моделями або датасетами, професійна ML-розробка без постійного вильоту в підкачку. Для чистого відеомонтажу або 3D 128GB надлишкові — там вузьким місцем залишається не пам’ять, а кількість GPU-ядер, яка тут така сама, як і у версіях з 48GB і 64GB.
На 70B-моделях у квантизації Q4_K_M 128GB дають близько 14 токенів за секунду — зіставно або трохи швидше за версію з 96GB (14CPU/30GPU), але з помітно більшим запасом під довгий контекст: у 96GB-версії модель і контекст займають майже всю доступну пам’ять, а тут залишається відчутний запас для історії діалогу і паралельних процесів. Структурна перевага перед відеокартами NVIDIA — єдиний пул пам’яті, доступний і CPU, і GPU без вивантаження шарів і штрафу на передачу даних по шині.
Для моделей більших за 70B (наприклад 405B) 128GB вже недостатньо — такі моделі потребують чипа M3 Ultra, який у M3 Max фізично недоступний. Практичне правило — тримати модель і її контекстне вікно в межах приблизно 80% від обсягу пам’яті, залишаючи запас для macOS і фонових процесів. Пам’ять тут також впаяна і не розширюється після покупки, а доплата за перехід з 48/64GB на 128GB при тому самому чипі суттєва.
Для яких завдань найчастіше беруть
ML / Data Science
Локальні AI-моделі
AI-асистент / Чат-боти
Розробка
DevOps / Сервери
Відеомонтаж
Хвалять
Максимальний обсяг пам’яті в лінійці M3 Max (128GB) — найбільший контекстний запас для локальних LLM 70B у цій лінійці продукту
На 70B-моделях у Q4_K_M близько 14 токенів/сек — зіставно або трохи швидше за версію з 96GB, але з помітно більшим запасом під довгий контекст
Єдиний пул пам’яті доступний і CPU, і GPU без вивантаження шарів — структурна перевага перед відеокартами з роздільною VRAM при роботі з великими моделями
GPU-ядер (40) і пропускна здатність (400GB/s) такі самі, як у версіях з 48GB і 64GB того самого чипа — для відеомонтажу і рендерингу приріст від пам’яті не створює вузького місця
Вистачає пам’яті для паралельної роботи з кількома великими моделями або датасетами одночасно
Екран Liquid Retina XDR і автономність до 18 годин — як і в решти версій M3 Max
Скаржаться
Для моделей більших за 70B (наприклад 405B) пам’яті вже недостатньо — такі моделі потребують чипа M3 Ultra, недоступного в цьому чипі
Практичне правило — тримати модель і контекст в межах ~80% пам’яті, інакше не залишається запасу для macOS і фонових процесів
Суттєва доплата за перехід з 48GB/64GB на 128GB при тому самому чипі і тих самих GPU-ядрах
Для чистого відеомонтажу і 3D 128GB надлишкові — вузьким місцем там залишається кількість GPU-ядер, а не пам’ять
Пам’ять впаяна і не розширюється після покупки
При тривалому інференс-навантаженні на великих моделях корпус відчутно нагрівається, вентилятор стає чутним


