Основные выводы
Цены на NVIDIA B300 в 2026 году составляют от $7,10 до $17,80 за один GPU-час по требованию и от $300 000 до $350 000 за систему DGX B300 с 8 GPU, при этом для большинства рабочих нагрузок инференса самым дешевым вариантом является оплата за токен, а не аренда карты как таковая.
- B300 представляет собой чип B200 с увеличенным объемом памяти: 288 ГБ HBM3E против 180 ГБ при той же пропускной способности 8 ТБ/с. Переплата окупается только тогда, когда ваша модель или ее KV-кеш перестают помещаться в стандартный объем.
- Выбор провайдера сильнее влияет на ваш счет, чем выбор самого чипа. Чип B200 на AWS за $14,24 в час обойдется примерно в два раза дороже, чем B300 на Modal за $7,10.
- Для GPU, которые уже принадлежат платформе, тарификация моделей с открытыми весами происходит за токен без платы за аренду GPU, надбавок за вычисления или минимальных платежей, поэтому часы простоя больше не появляются в вашем счете.
Как выглядят цены на NVIDIA B300 в 2026 году
Цены на NVIDIA B300 в 2026 году представлены в трех единицах измерения, и вам, скорее всего, придется столкнуться со всеми тремя при оценке затрат на GPU для рабочей нагрузки. По состоянию на октябрь 2026 года:
- По требованию (On-demand): от $7,10 до $17,80 за GPU-час по прайс-листам публичных облаков, от Modal на нижней границе до AWS на верхней.
- Одна карта: от $50 000 до $60 000 в предложениях реселлеров за штуку. NVIDIA не публикует розничную цену, а карта поставляется только в составе систем HGX и DGX.
- Система на 8 GPU: от $300 000 до $350 000 за DGX B300 по предложениям реселлеров, причем некоторые просят от $400 000 до $500 000.
Каждая цифра стоимости выше является ценовым предложением, поэтому воспринимайте ее как отправную точку для переговоров. Почасовая ставка — это единственная цена, которую можно проверить на публичной странице.
За что вы платите: 288 ГБ на том же кристалле Blackwell
B300, представитель линейки NVIDIA Blackwell Ultra, меняет одну важную для вашего счета вещь — память. Вот как он сопоставляется с B200 по пяти ключевым характеристикам, определяющим цену:
- Память: 288 ГБ HBM3E против 180 ГБ, то есть в 1,6 раза больше.
- Пропускная способность: 8 ТБ/с у обоих чипов.
- Плотный формат NVFP4: около 15 петафлопс против 10, прирост в 1,5 раза.
- FP8: практически без изменений.
- Энергопотребление: до 1400 Вт на GPU против 1000 Вт, требуется система прямого жидкостного охлаждения.
Рассчитывайте на чуть меньший объем памяти, чем указано в заголовке. AWS указывает 2144 ГБ памяти GPU на восемь графических процессоров в своем инстансе p6-b300.48xlarge, что составляет около 268 ГБ на карту, а NVIDIA указывает 2,1 ТБ для полной системы DGX B300. Рассчитывайте модели примерно на 270 ГБ полезной памяти на карту.
Если ваш стек обслуживания работает в формате FP8 без поддержки пути NVFP4, дополнительные деньги идут исключительно за память и ни за что больше. Подробнее о том, как ускорители распределяют память, производительность и гибкость, читайте в нашем сравнении TPU и GPU.
Почему B300 стоит столько, сколько он стоит
Цена отражает дефицит и требования к инфраструктуре, а не саму кремниевую основу.
Почему B300 стоит именно так: предложение по требованию ограничено, поскольку большая часть мощностей зарезервирована крупными корпорациями по долгосрочным контрактам. Карта, потребляющая до 1400 Вт и требующая жидкостного охлаждения, также помещается лишь в немногие дата-центры, что ограничивает круг провайдеров, способных ее предложить.
Попробуйте Telnyx Inference для запуска моделей с открытыми весами с оплатой за токен, без платы за аренду GPU, надбавок за вычисления или минимальных платежей.
Облачные цены NVIDIA B300 за GPU-час в 2026 году
Облачные цены на NVIDIA B300 по требованию за GPU-час в 2026 году варьируются от $7,10 на Modal до $17,80 на AWS, что означает разницу в 2,5 раза за одну и ту же карту с 288 ГБ памяти.
Цена B300 по требованию в зависимости от провайдера
Колонка с 10 часами показывает стоимость короткого тестового запуска у каждого провайдера.
Цена B300 по требованию за GPU-час, октябрь 2026 года
Это цены по требованию для чипа 288 GB SXM6 B300 из публичных прайс-листов в регионах США в долларах США, актуальные на октябрь 2026 года. AWS продает B300 только в виде конфигурации из 8 GPU p6-b300.48xlarge по цене $142,42 в час, здесь указана стоимость в пересчете на один GPU.
В двух строках указаны диапазоны, поскольку цены менялись. Собственная страница ценообразования Runpod указывает $6,94 в Community Cloud и $7,39 в Secure Cloud, в то время как октябрьские обзоры цен называли цифру $7,89. Nebius указывал $7,85 в августе и $9,50 к октябрю. Всегда указывайте дату рядом с любой ценой, которую вы берете для финансовых расчетов.
Запустите одну карту в режиме 24/7, и разница составит около $5 180 в месяц при тарифе $7,10 против примерно $12 990 при тарифе $17,80. У одного и того же провайдера B300 стоит на $0,70–$3,56 в час дороже, чем B200. Сравнивая разных провайдеров, можно заметить, что B200 на AWS за $14,24 стоит в два раза дороже, чем B300 на Modal, поэтому выбор провайдера важнее выбора конкретной карты.
Telnyx не сдает B300 в аренду по часам, поэтому ее нет в этой таблице. Инференс компании выполняется на принадлежащих ей GPU, включая региональные мощности в Сиднее и Дубае, и тарифицируется за токен, как описано в разделе ниже.
Зарезервированные, спотовые и управляемые тарифные планы
Тариф по требованию находится в середине общей тарифной сетки:
- Зарезервированные (Reserved): от $3,13 за GPU-час при заключении контракта на 48 месяцев. Годовые и трехлетние контракты публикуются редко, поэтому запрашивайте их в письменном виде.
- По требованию (On demand): от $7,10 до $17,80 за GPU-час.
- Управляемые кластеры DGX B300 (Managed DGX B300): от $12,00 до $18,00 за GPU-час.
- Спотовые и промо-тарифы (Spot and promo): в начале 2026 года появлялись минимальные значения от $2,45, но на публичных ресурсах их больше нет.
48-месячный контракт о резервировании окупается только в том случае, если вы можете загрузить карту работой на протяжении четырех лет. Рассчитывайте его под постоянную нагрузку, а пиковые значения перенаправляйте в другое место.
Скрытые расходы почасовой тарификации
Если вы уже платите за арендованные машины, собственные серверы и API инференса для пиковых нагрузок, эти статьи расходов накапливаются в счетах.
Что не входит в почасовую ставку: AWS взимает плату за исходящий трафик после первых бесплатных 100 ГБ. Гиперскейлеры продают B300 узлами по 8 GPU, поэтому вы платите $142,42 в час на AWS, даже если вам нужна всего одна карта. Сетевые хранилища Runpod добавляют от $0,07 до $0,14 за ГБ в месяц. Часы простоя оплачиваются везде, кроме посекундных и бессерверных (serverless) тарифов.
Рассчитайте стоимость аналогичной работы за токен с помощью Telnyx Inference, без почасовой тарификации, пока карта ожидает трафик.
Цены на NVIDIA DGX B300: стоимость системы с 8 GPU
Система NVIDIA DGX B300 стоит от $300 000 до $350 000 за восемь GPU по ценам реселлеров 2026 года, или около $37 500 – $43 750 за один GPU. Некоторые реселлеры запрашивают от $400 000 до $500 000. На странице NVIDIA DGX B300 указано, что система уже поставляется, ее энергопотребление составляет около 14 кВт, при этом цена не публикуется. Поставки начались в январе 2026 года, согласно отчетам реселлеров.
Что входит в цену DGX B300
Стоимость готового комплекта включает восемь GPU, процессоры, коммутаторы NVLink, корпус и локальное хранилище NVMe. Она не включает электропитание, модернизацию под систему жидкостного охлаждения, размещение в дата-центре (колокацию), сетевую фабрику для объединения систем между собой или персонал для их обслуживания. Сравнение вариантов приобретения в пересчете на один GPU:
- Один B300: около $53 000 по предложению реселлера за июль 2026 года.
- DGX B300, 8 GPU: от $300 000 до $350 000, или от $37 500 до $43 750 за GPU.
- Сборка партнера HGX B300, 8 GPU: от $550 000 до $650 000, или от $68 750 до $81 250 за GPU, из которых от $120 000 до $180 000 приходится на CPU, сетевое оборудование, корпус и интеграцию.
- GB300 NVL72, 72 GPU: от $3 млн до $4 млн по рыночным оценкам, или около $41 700 – $55 600 за GPU.
Ценовые диапазоны HGX и DGX не совпадают, поэтому рассматривайте их как два независимых рынка реселлеров и избегайте их усреднения. Предложения на DGX B200 варьируются от $280 000 до $500 000, из-за чего премию за уровень системы B300 трудно точно определить.
Аренда или покупка: срок окупаемости в месяцах
Покупка выгодна только в том случае, если вы поддерживаете непрерывную загрузку системы круглосуточно на протяжении большей части года. По сравнению с арендой по требованию при круглосуточном использовании (24/7), система DGX B300 окупается примерно за:
- от 7.3 до 8.6 месяцев из расчета $7.10 в час.
- от 6.6 до 7.7 месяцев из расчета $7.85 в час.
- от 5.7 до 6.6 месяцев из расчета $9.16 в час.
- от 2.9 до 3.4 месяцев по сравнению с управляемым потолком в $18.00.
- Не включено: электропитание, модернизация системы охлаждения, пространство, сети и персонал.
Именно на последней строке математика обычно и не сходится. При энергопотреблении около 14 кВт на систему до начала охлаждения, затраты на электроэнергию и инфраструктуру — это то, что большинство команд недооценивают, поэтому перед подписанием документов запросите реальную смету у вашего дата-центра. Наше руководство по сравнению выделенных серверов (bare metal) и облака охватывает более широкий круг вопросов, связанных с совокупной стоимостью владения.
"Мы владеем всем стеком, включая графические процессоры. Это означает, что мы полностью контролируем задержки (латентность), можем интегрировать инференс напрямую с телефонией и речевыми сервисами в рамках одной сети, и мы не подвержены рискам сбоев сторонних провайдеров или изменения цен выше по цепочке. Когда провайдер арендует облачные GPU, любая нестабильность в этом облаке становится проблемой его клиентов. У нас такой зависимости нет". Режис Давид Соуза (Regis David Souza), ведущий инженер-программист в Telnyx
Стоит ли платить за цены NVIDIA B300, или лучше платить за токен?
За цену NVIDIA B300 стоит платить, когда вашим главным ограничением является объем памяти. Для инференса на готовых моделях плата за токен на собственных GPU обычно выгоднее аренды любой видеокарты. Обе карты работают на скорости 8 ТБ/с, поэтому дополнительная память — это единственное, за вы переплачиваете.
Что делать с B300: арендовать, покупать или платить за токен?
- Пиковый трафик, стандартная открытая модель: обращайтесь в Telnyx Inference и платите за токен. В часы простоя вы ничего не платите, в то время как аренда B300 обходится в сумму от $7.10 до $17.80 каждый час.
- Модель помещается в 180 ГБ, стек для инференса использует FP8: лучше арендуйте B200. Обе карты работают на скорости 8 ТБ/с, а формат FP8 задействует их минимально, поэтому переплата за B300 принесет вам лишь память, которую вы не будете использовать.
- Модель или кэш KV превышают 180 ГБ: арендуйте B300 на Modal или Runpod примерно за $7 в час. Вы получаете около 270 ГБ полезного объема на карту менее чем за половину стоимости в AWS.
- Устойчивая нагрузка 24/7, готовы стойки с жидкостным охлаждением: запросите котировки у реселлеров DGX B300 и ориентируйтесь на сумму около $300 000. Некоторые предложения достигают $500 000, при этом каждая видеокарта потребляет до 1400 Вт.
Когда 288 ГБ окупают себя
Начните с весов вашей модели, добавьте 20–30% на кэш KV и накладные расходы среды выполнения, а затем сравните полученную сумму с примерно 180 ГБ на B200 и примерно 270 ГБ полезной памяти на B300. Три примера:
- Llama 3 70B в формате FP16: около 140 ГБ весов или от 168 до 182 ГБ с учетом накладных расходов. Это впритык для B200 и комфортно для B300.
- Та же модель в формате FP8: около 70 ГБ весов или от 84 до 91 ГБ с учетом накладных расходов. Она помещается в 141 ГБ H200.
- Плотная модель класса 130B в формате FP16: около 260 ГБ весов или от 312 до 338 ГБ с учетом накладных расходов. Это превышает возможности одной B300, поэтому вам придется применить квантование или разделить модель между двумя картами.
Модели типа «мощная смесь экспертов» (Mixture-of-Experts) должны удерживать в памяти каждого эксперта, поэтому учитывайте общее количество параметров, а не активных. B300 оправдывает свою премиальную цену, когда ваша модель вместе с кэшем занимает от 180 до примерно 270 ГБ, когда задачи с длинным контекстом или рассуждениями полностью загружают карту, когда ваш стек работает с NVFP4, или когда одна B300 заменяет две B200 и избавляет от необходимости тензорного параллельного разделения (tensor-parallel split).
Когда выгоднее купить B200, H200 или платить за токен
Карта меньшего размера или оплата за токен выигрывают в четырех случаях:
- Ваша модель помещается в 180 ГБ: B200 стоит примерно на $1 в час дешевле у провайдеров, предлагающих обе модели.
- Ваша модель помещается в 141 ГБ без использования FP4: H200 можно арендовать за $3.59–$10.85 в час, и собственные серверы с H200 уже покрывают этот сегмент.
- Вы ограничены пропускной способностью или используете только FP8: B300 не дает ничего из того, чем вы будете пользоваться.
- Вы запускаете инференс для стандартной модели из каталога: платите за токены, а не за часы.
Почасовая ставка оценивает время, а ваша рабочая нагрузка потребляет токены. NVIDIA заявляет о стоимости $0.24 за миллион токенов для Blackwell Ultra на DeepSeek-R1 на основе бенчмарков SemiAnalysis для настроенного и полностью загруженного развертывания. Арендованная карта редко работает таким образом. Каждый час ожидания трафика все равно стоит $7.10 или более, поэтому карта, которая простаивает наполовину, удваивает ваши фактические затраты на токен.
Сервис Telnyx Inference оценивает саму работу. Модель MiniMax-M3 стоит $0.27 за миллион входных токенов и $1.10 за миллион выходных токенов в рамках стандартного тарифа по состоянию на октябрь 2026 года (согласно ценам Telnyx на инференс), без платы за аренду GPU, надбавок за вычисления или минимальных платежей при оплате по факту использования. Модели работают в собственной сети GPU для инференса от Telnyx, поэтому между вами и видеокартой нет никаких облачных провайдеров.
"Мы владеем графическими процессорами и сетью, поэтому в каждом токене нет наценки облачного провайдера, платы за аренду GPU, надбавок за вычисления или минимальных платежей. Цена подчиняется законам физики". Режис Давид Соуза (Regis David Souza), ведущий инженер-программист в Telnyx
Оплата за токен распространяется на модели, которые платформа уже обслуживает. Если ваша рабочая нагрузка зависит от ваших собственных дообученных (fine-tuned) весов, по-прежнему актуально сравнение по часам, приведенное выше.
Часто задаваемые вопросы (FAQ)
Могу ли я запустить приватную модель на собственных GPU провайдера вместо аренды B300?
Это зависит от провайдера. Некоторые платформы обслуживают только собственный каталог моделей на принадлежащих им GPU, в то время как другие позволяют загружать свои веса. Прежде чем предполагать, что вы можете использовать свои веса, проверьте, есть ли ваша конкретная модель в каталоге. Если она там есть, оплата за токен обычно выгоднее аренды карты для инференса.
Стоит ли мне заменять собственные машины с H200 на арендованные мощности B300?
Обычно нет. H200 справляется с любой моделью, которая помещается в 141 ГБ вместе с кэшем KV. Переходите на B300 только тогда, когда модель или кэш превышают 180 ГБ памяти B200, или когда ваш стек работает с NVFP4. В противном случае вы будете платить $7.10 или более в час за память, которую не используете.
Сколько стоит графический процессор NVIDIA B300?
В октябре 2026 года аренда B300 по запросу стоит от $7.10 до $17.80 за час работы GPU. Покупка одной карты обойдется примерно в $53 000 по ценам реселлеров, а сервер DGX B300 с 8 GPU стоит от $300 000 до $350 000. NVIDIA не публикует розничных цен, поэтому все цифры по покупке основаны на индивидуальных коммерческих предложениях.
В чем разница между B300 и B200?
B300 оснащена 288 ГБ памяти HBM3E по сравнению со 180 ГБ у B200 при той же пропускной способности в 8 ТБ/с. Производительность плотных вычислений NVFP4 возрастает примерно с 10 до 15 петафлопс, FP8 остается примерно на том же уровне, а энергопотребление увеличивается с 1000 Вт до 1400 Вт. У того же провайдера она стоит примерно на $1 в час дороже.
Можно ли купить одну NVIDIA B300?
У NVIDIA — нет. B300 поставляется исключительно в составе систем HGX и DGX, реализуемых через партнеров. Стоимость одиночных устройств по предложениям реселлеров составляет от $50 000 до $60 000, и в эту цену не входят серверное шасси, сетевое оборудование и жидкостное охлаждение, необходимые для работы даже одной карты.
Оценивайте работу, а не карту
Теперь вы знаете, во сколько обходится B300 в пересчете на часы и на целые системы. Для инференса на моделях с открытыми весами Telnyx выставляет счета за токен на принадлежащих ей GPU без платы за аренду, надбавок за вычисления и минимальных платежей.
Ознакомьтесь с сервисом Telnyx Inference








