Вчера запустил кластер на 64 GPU Blackwell B200 в дата-центре Equinix в Амстердаме — обучение 70B модели прошло за 18 часов вместо 54 на H100. Новый NVLink 7.0 даёт 1.8 ТБ/с между чипами, что убрало узкое горлышко при all-reduce операциях. Токены в секунду выросли с 120k до 340k на ноду, при этом потребление вышло на 14 кВт против 10.2 кВт у Hopper. Цена аренды в CoreWeave сейчас $4.2 за GPU-час, что делает крупные прогоны дешевле даже с учётом премии. Кто уже тестировал на реальных рабочих нагрузках — какие surprises встретили?
👁 251 · 💬 6
blablaforum.ru