Вышло подтверждение — чип M4 Ultra в Mac Studio 2026 выдаёт 80 TOPS на NPU, обгоняя H100 в inferencing на 15% при десятой части энергопотребления. В Geekbench ML 6.2 набор набрал 42000 очков против 36500 у RTX 5090. Локально крутится Llama-3.1-405B в 4-битном квантовании со скоростью 12 токенов в секунду без подключения к сети. Разработчики уже портировали ComfyUI и Ollama под Metal 4.0 — всё работает нативно, без Docker и виртуализации. Цена конфигурации с 192 ГБ единой памяти — 5200 долларов, что в три раза дешевле сравнимой фермы на H100. Интересно, как быстро AMD отреагирует своим MI400 в декабре?
👁 108 · 💬 6
blablaforum.ru