NVIDIA раздает мощный ИИ бесплатно — и зарабатывает на этом больше конкурентов
<p><strong>Компания NVIDIA недавно выпустила Nemotron 3 Ultra — крупнейшую открытую ИИ-модель в линейке Nemotron 3. Релиз состоялся 4 июня 2026 года: в открытый доступ под свободной лицензией выложили веса модели, обучающие данные, и сами методики обучения. Модель создана для долго работающих автономных агентов и сложных рассуждений.</strong></p>
<p>В отличие от закрытых флагманов вроде ChatGPT или Claude, Nemotron 3 Ultra можно скачать, дообучить на собственных данных и запустить на своей инфраструктуре. Ставка здесь не на максимальный интеллект, а на открытость, эффективность и контроль над моделью.</p>
<section class="c-bic-highlighted-text mb-8 md:mb-12 " id="block_6a33bf0c9c13e">
<div class="flex items-center gap-5 px-5 py-4 rounded-xl bg-grey-50 text-dark-grey-700">
<svg class="min-w-5 h-5 text-blue-600" fill="none" height="28" viewBox="0 0 28 28" width="28" xmlns="http://www.w3.org/2000/svg"><path d="m11.195 26.6 1.4-9.8h-4.9c-.812 0-.798-.448-.532-.924.266-.476.07-.112.098-.168L16.795 1.4l-1.4 9.8h4.9c.686 0 .784.462.658.714l-.098.21-9.66 14.476Z" fill="currentColor"></path></svg>
<div class="bic-block-highlighted-paragraph-content p3 p3--ns [&_p:last-child]:!mb-0 [&_p]:!leading-6 [&_p]:!font-body [&_p]:!text-4 [&_a]:!text-blue-600">
<p><strong><em>Хотите еще эксклюзивных новостей и аналитики? Подписывайтесь на наш</em></strong><a href="https://t.me/beincrypto_trading"><strong><em> телеграм-канал</em></strong></a><strong><em>, обсуждайте новости и делитесь мнениями о последних событиях рынка в чате!</em></strong></p>
</div>
</div>
</section>
<h2 class="bic-gutenberg-heading wp-heading wp-block-heading" id="h-чем-особенна-архитектура-модели">Чем особенна архитектура модели</h2>
<p>Nemotron 3 Ultra — это не просто «увеличенный трансформер». <a href="https://hackernoon.com/nvidia-nemotron-3-ultra-the-shovel-seller-starts-mining-for-gold-itself" rel="noreferrer noopener nofollow" target="_blank">В ее основе лежит гибридная архитектура, состоящая из трех разных подходов</a>: слои Mamba-2, слои внимания (Attention) и латентная смесь экспертов (Latent MoE) — механизм, который направляет каждый запрос только к нужным «специалистам» внутри модели.</p>
<p>Слои Mamba-2 обрабатывают длинные тексты быстро и экономно: затраты у них растут линейно с длиной, а не лавинообразно, как у обычного механизма внимания. Слои внимания, в свою очередь, точно удерживают в памяти большие объемы текста. А Latent MoE сжимает данные перед тем, как передать их экспертам, благодаря чему каждый из них работает узко и точно, не требуя дополнительных вычислений.</p>
<p>Всего у модели около 550 млрд параметров, но на обработку каждого токена задействуется лишь примерно 55 млрд. За счет этого она мыслит как огромная система, а по затратам ведет себя как куда более компактная. Вместе с окном контекста в 1 млн токенов и скоростью свыше 300 токенов в секунду это дает в пять-шесть раз большую пропускную способность и примерно на 30% более низкую стоимость задач.</p>
<h2 class="bic-gutenberg-heading wp-heading wp-block-heading" id="h-стратегия-nvidia-и-ставка-на-экосистему">Стратегия NVIDIA и ставка на экосистему</h2>
<p>Главная ценность релиза, по оценке отраслевых аналитиков, не в самой модели, а в экосистеме, которую NVIDIA выстраивает вокруг своего оборудования. Логика проста: тот, кто запускает Nemotron, почти наверняка делает это на видеокартах NVIDIA, дообучает с помощью ее программных инструментов и разворачивает на ее же софте. Открытость здесь не благотворительность, а способ привести разработчиков обратно к покупке оборудования компании.</p>
<p>Устроить такое NVIDIA может потому, что ее финансовые возможности несопоставимы с затратами на саму модель. При капитализации свыше $5 трлн обучение Nemotron 3 Ultra, которое обошлось, вероятно, в сотни миллионов долларов, для компании почти незаметная статья расходов. Продажи видеокарт с лихвой покрывают исследования, поэтому NVIDIA способна раздавать модель бесплатно и все равно зарабатывать больше, чем закрытые конкуренты берут за платный доступ.</p>
<p>Дополнительный вес релизу придает политический контекст. Открытую американскую модель можно проверить, изменить и запустить на собственных серверах — это сделало ее привлекательной для стран, которые строят независимый национальный ИИ, от Европы до Юго-Восточной Азии. Такую модель никто не отключит удаленно, и это особенно ценно на фоне недавних ограничений вокруг закрытых моделей.</p>
<h2 class="bic-gutenberg-heading wp-heading wp-block-heading" id="h-в-чем-модель-уступает-и-что-будет-дальше">В чем модель уступает и что будет дальше</h2>
<p>При всех достоинствах Nemotron 3 Ultra не самая умная модель на рынке. В независимом рейтинге Artificial Analysis Intelligence Index она набрала 48 баллов — это лучший результат среди открытых моделей США, но в мире она уступает лидерам, таким как Kimi K2.6 (54 балла) и DeepSeek. Открытые модели, по оценкам аналитиков, отстают от закрытых на три–семь месяцев.</p>
<p>Но это отставание, по мнению автора разбора, значит все меньше, если открытой модели попросту хватает для реальных задач. Банку, который ставит Nemotron 3 Ultra для обработки кредитов на своих серверах, не нужен интеллект флагманского уровня — нужна модель, которую можно дообучить на закрытых данных, держать внутри своего защищенного контура и не отдавать конфиденциальные сведения посторонним.</p>
<p>Ставка NVIDIA на эффективность, а не на рекорды в тестах, может оказаться дальновиднее. При массовом внедрении ИИ на первый план выходит стоимость работы модели, и та, что почти не уступает в уме, но в пять раз дешевле, побеждает в реальной эксплуатации. Аналитики ждут, что открытая экосистема будет только крепнуть: у NVIDIA есть и ресурсы, и мотивация, и каналы распространения, чтобы выпускать все более сильные открытые модели быстрее любой другой компании.</p>
<p><strong><em>