{"id":2681,"date":"2026-07-21T15:00:00","date_gmt":"2026-07-21T15:00:00","guid":{"rendered":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/"},"modified":"2026-07-22T05:59:08","modified_gmt":"2026-07-22T05:59:08","slug":"setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72","status":"publish","type":"post","link":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/","title":{"rendered":"Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72"},"content":{"rendered":"<p><br \/>\n<\/p>\n<div>\n<p class=\"wp-block-paragraph\">Frontier mannequin pre-training has converged on combination of consultants (MoE), which is basically altering what limits large-scale AI coaching. As compute per token falls, communication more and more determines how effectively fashions scale throughout 1000&#8217;s of GPUs. NVIDIA GB300 NVL72 set a world document for pre-training DeepSeek-V3 671B at 1,648 TFLOPs per GPU, displaying how advances throughout your entire AI platform\u2014from silicon to networking to software program\u2014proceed to push coaching efficiency ahead. Each achieve in pre-training effectivity means researchers can prepare bigger fashions, run extra experiments, and attain frontier functionality sooner on the identical NVIDIA infrastructure.\u00a0\u00a0<\/p>\n<p class=\"wp-block-paragraph\">The speedy trade shift towards these MoE architectures is pushed by their large computational effectivity. Not like dense fashions, the place each token prompts each parameter and compute per token rises with the whole parameter rely, MoE fashions activate a subset of parameters for every token. For instance, DeepSeek-V3 holds 671B parameters however prompts solely ~37B parameters per token, reaching frontier scale on the per-token value of a much smaller mannequin.<\/p>\n<p class=\"wp-block-paragraph\">The tradeoff is communication. These consultants dwell on different GPUs, so each MoE layer should dispatch every token to its consultants and collect the outcomes by way of an all-to-all communication sample in each the ahead and backward passes. This collective sits within the vital path, making throughput as depending on communication as on compute. As a result of it happens at each layer in each coaching step, small delays compound till the all-to-all can not be hidden behind compute, and including GPUs not will increase throughput.<\/p>\n<div class=\"wp-block-image\">\n<figure data-wp-context=\"{&quot;imageId&quot;:&quot;6a605c2af08f7&quot;}\" data-wp-interactive=\"core\/image\" data-wp-key=\"6a605c2af08f7\" class=\"aligncenter size-full is-resized wp-lightbox-container\"><img decoding=\"async\" width=\"1127\" height=\"492\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59.webp\" alt=\"MoE training step showing forward pass, backward pass, gradient sync, and optimizer step. Within each layer, attention connects to experts through tensor-parallel all-reduce and all-to-all communication. Per-layer communication is on the critical path; gradient sync occurs once per step and can overlap with compute.\" class=\"wp-image-120246\" style=\"aspect-ratio:2.2907789330151695;width:740px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59.webp 1127w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-179x78.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-300x131.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-768x335.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-625x273.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-645x282.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-500x218.png 500w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-160x70.png 160w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-362x158.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-252x110.png 252w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-1024x447.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-960x419.png 960w\" sizes=\"(max-width: 1127px) 100vw, 1127px\"\/><img loading=\"lazy\" decoding=\"async\" width=\"1127\" height=\"492\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59.webp\" alt=\"MoE training step showing forward pass, backward pass, gradient sync, and optimizer step. Within each layer, attention connects to experts through tensor-parallel all-reduce and all-to-all communication. Per-layer communication is on the critical path; gradient sync occurs once per step and can overlap with compute.\" class=\"lazyload wp-image-120246\" style=\"aspect-ratio:2.2907789330151695;width:740px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59.webp 1127w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-179x78.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-300x131.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-768x335.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-625x273.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-645x282.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-500x218.png 500w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-160x70.png 160w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-362x158.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-252x110.png 252w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-1024x447.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-59-960x419.png 960w\" data-sizes=\"(max-width: 1127px) 100vw, 1127px\"\/><figcaption class=\"wp-element-caption\">Determine 1. Anatomy of an MoE coaching step, displaying the place communication occurs and the way it impacts efficiency<\/figcaption><\/figure>\n<\/div>\n<p class=\"wp-block-paragraph\">Because of this pre-training wants a tightly coupled scale-up area, the place each GPU can talk with each different GPU over a non-blocking cloth that gives excessive, uniform bandwidth, low latency, and full bisection bandwidth because the area grows. Coaching a mannequin of this measurement requires extra GPUs than a single area can maintain, and plenty of domains should be linked collectively. This scale-out site visitors is lighter and fewer frequent, but it surely should nonetheless full throughout the compute window and stay predictable, so no single gradual hyperlink governs the step. The problem is two-tiered, and success is measured in delivered FLOPs, not peak FLOPs.<\/p>\n<h3 id=\"nvidia_gb300_nvl72_built_for_tightly_coupled_ai_pre-training\" class=\"wp-block-heading\">NVIDIA GB300 NVL72: Constructed for tightly coupled AI pre-training<\/h3>\n<p class=\"wp-block-paragraph\">A two-tiered communication problem requires a system designed round it, not only a sooner chip. Compute, scale-up interconnect, scale-out networking, infrastructure processing, and software program every carry a part of the load. A shortfall in anyone caps the entire.\u00a0 GB300 NVL72 addresses these challenges collectively, a rack-scale system constructed by way of excessive co-design, the place silicon, interconnect, networking, and software program are engineered as one platform relatively than assembled from components.\u00a0<\/p>\n<p class=\"wp-block-paragraph\">At its core is NVIDIA NVLink, the scale-up cloth that makes 72 NVIDIA Blackwell Extremely GPUs work as one. Fifth-generation NVLink offers every GPU 1.8 TB\/s of bandwidth and 130 TB\/s of non-blocking, all-to-all bandwidth throughout the rack, so each GPU reaches each different in a single hop.\u00a0<\/p>\n<p class=\"wp-block-paragraph\">The width is simply half of it; the trail is the remaining. NVLink is memory-semantic: a GPU reads and writes a peer\u2019s HBM straight, as native load and retailer operations, over a lossless, flow-controlled cloth. The switch is a {hardware} reminiscence operation relatively than a software program ship, so nothing within the knowledge path provides latency, and reductions can run contained in the swap as the information flows by way of.\u00a0<\/p>\n<p class=\"wp-block-paragraph\">That is what the per-layer site visitors calls for: the tensor-parallel all-reduce and the MoE all-to-all keep contained in the rack, at full bandwidth and low latency. Past the rack, the platform scales out over NVIDIA ConnectX-8 SuperNICs at 800 Gbps per GPU, with NVIDIA Quantum-X800 InfiniBand or NVIDIA Spectrum-X Ethernet, to maintain the gradient site visitors hidden behind the compute.\u00a0<\/p>\n<div class=\"wp-block-image\">\n<figure data-wp-context=\"{&quot;imageId&quot;:&quot;6a605c2af1ae3&quot;}\" data-wp-interactive=\"core\/image\" data-wp-key=\"6a605c2af1ae3\" class=\"aligncenter size-full is-resized wp-lightbox-container\"><img decoding=\"async\" width=\"1212\" height=\"657\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55.webp\" alt=\"Comparison of GPU-to-GPU memory access paths. NVLink scale-up connects a GPU to peer HBM through an NVLink Switch in two low-latency hops. Traditional scale-up routes through PCIe, NICs, and a packet-fabric switch across six stages, adding higher latency.\" class=\"wp-image-120234\" style=\"aspect-ratio:1.8448234446312755;width:744px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55.webp 1212w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-179x97.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-300x163.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-768x416.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-625x339.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-645x350.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-500x271.png 500w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-160x87.png 160w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-362x196.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-203x110.png 203w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-1024x555.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-960x520.png 960w\" sizes=\"(max-width: 1212px) 100vw, 1212px\"\/><img loading=\"lazy\" decoding=\"async\" width=\"1212\" height=\"657\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55.webp\" alt=\"Comparison of GPU-to-GPU memory access paths. NVLink scale-up connects a GPU to peer HBM through an NVLink Switch in two low-latency hops. Traditional scale-up routes through PCIe, NICs, and a packet-fabric switch across six stages, adding higher latency.\" class=\"lazyload wp-image-120234\" style=\"aspect-ratio:1.8448234446312755;width:744px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55.webp 1212w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-179x97.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-300x163.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-768x416.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-625x339.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-645x350.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-500x271.png 500w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-160x87.png 160w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-362x196.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-203x110.png 203w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-1024x555.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-55-960x520.png 960w\" data-sizes=\"(max-width: 1212px) 100vw, 1212px\"\/><figcaption class=\"wp-element-caption\">Determine 2. NVLink cloth in comparison with a standard cloth<\/figcaption><\/figure>\n<\/div>\n<p class=\"wp-block-paragraph\">Co-design extends past the coaching cloth into infrastructure providers and software program. In manufacturing AI factories, NVIDIA BlueField knowledge processing models (DPUs) present an remoted infrastructure-processing area for digital networking, storage entry, safety, telemetry, and lifecycle administration, lowering host CPU overhead for large-scale coaching jobs.<\/p>\n<p class=\"wp-block-paragraph\">Coaching software program covers each side of the ecosystem. NVIDIA Megatron Core is constructed and tuned for these GPUs. NVIDIA has additionally actively contributed to open supply frameworks to make sure TorchTitan and JAX run at full velocity on GB300 NVL72 methods.<\/p>\n<h2 id=\"exceptional_pre-training_performance_with_megatron_core\u00a0\u00a0\" class=\"wp-block-heading\">Distinctive pre-training efficiency with Megatron Core\u00a0\u00a0<\/h2>\n<p class=\"wp-block-paragraph\">On the DeepSeek-V3 671B mannequin, utilizing 256 GPUs, Megatron Core reaches 1,648 TFLOPs per GPU on GB300 NVL72, in comparison with 606 TFLOPs per GPU on earlier GB200 NVL72 outcomes, ~3x larger delivered throughput per GPU in a single technology.\u00a0<\/p>\n<div class=\"wp-block-image\">\n<figure data-wp-context=\"{&quot;imageId&quot;:&quot;6a605c2af2b01&quot;}\" data-wp-interactive=\"core\/image\" data-wp-key=\"6a605c2af2b01\" class=\"aligncenter size-full is-resized wp-lightbox-container\"><img decoding=\"async\" width=\"2048\" height=\"1250\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61.webp\" alt=\"Bar chart comparing delivered training performance in TFLOPs per GPU on DeepSeek-V3 671B at 256 GPUs. GB200 NVL72 reaches 606 TFLOPs\/GPU and GB300 NVL72 achieves 1,648 TFLOPS\/GPU  3x higher performance for the same GPU count.\" class=\"wp-image-120249\" style=\"aspect-ratio:1.6384249664756796;width:780px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61.webp 2048w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-179x109.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-300x183.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-768x469.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-625x381.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-1536x938.png 1536w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-645x394.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-492x300.png 492w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-147x90.png 147w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-362x221.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-180x110.png 180w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-1024x625.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-885x540.png 885w\" sizes=\"(max-width: 2048px) 100vw, 2048px\"\/><img loading=\"lazy\" decoding=\"async\" width=\"2048\" height=\"1250\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61.webp\" alt=\"Bar chart comparing delivered training performance in TFLOPs per GPU on DeepSeek-V3 671B at 256 GPUs. GB200 NVL72 reaches 606 TFLOPs\/GPU and GB300 NVL72 achieves 1,648 TFLOPS\/GPU  3x higher performance for the same GPU count.\" class=\"lazyload wp-image-120249\" style=\"aspect-ratio:1.6384249664756796;width:780px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61.webp 2048w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-179x109.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-300x183.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-768x469.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-625x381.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-1536x938.png 1536w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-645x394.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-492x300.png 492w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-147x90.png 147w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-362x221.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-180x110.png 180w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-1024x625.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-61-885x540.png 885w\" data-sizes=\"(max-width: 2048px) 100vw, 2048px\"\/><figcaption class=\"wp-element-caption\">Determine 3. 3x larger delivered efficiency GB200 NVL72 (early software program model) vs GB300 NVL72 (newest software program model)<\/figcaption><\/figure>\n<\/div>\n<p class=\"wp-block-paragraph\">NVIDIA continues to optimize its software program for higher efficiency from the general platform. On a pre-training workload the dimensions of DeepSeek-v3 671B, these beneficial properties compound. On the identical GB300 NVL72 rack-scale system, efficiency elevated 1.5x in six months, pushed by software program enhancements. This exhibits that uncooked efficiency and coaching throughput proceed to enhance nicely after the silicon ships.\u00a0<\/p>\n<div class=\"wp-block-image\">\n<figure data-wp-context=\"{&quot;imageId&quot;:&quot;6a605c2af3a20&quot;}\" data-wp-interactive=\"core\/image\" data-wp-key=\"6a605c2af3a20\" class=\"aligncenter size-full is-resized wp-lightbox-container\"><img decoding=\"async\" width=\"2048\" height=\"1328\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53.webp\" alt=\"Bar chart showing delivered training performance in TFLOPs per GPU on DeepSeek-V3 671B at 256 GPUs, measured on unchanged GB300 NVL72 hardware. The performance rose from 1,088 6 months ago to 1,648 today, about 1.5 times higher, driven entirely by software optimization.\" class=\"wp-image-120231\" style=\"width:748px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53.webp 2048w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-177x115.png 177w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-300x195.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-768x498.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-625x405.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-1536x996.png 1536w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-645x418.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-463x300.png 463w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-179x115.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-139x90.png 139w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-362x235.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-170x110.png 170w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-1024x664.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-833x540.png 833w\" sizes=\"(max-width: 2048px) 100vw, 2048px\"\/><img loading=\"lazy\" decoding=\"async\" width=\"2048\" height=\"1328\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53.webp\" alt=\"Bar chart showing delivered training performance in TFLOPs per GPU on DeepSeek-V3 671B at 256 GPUs, measured on unchanged GB300 NVL72 hardware. The performance rose from 1,088 6 months ago to 1,648 today, about 1.5 times higher, driven entirely by software optimization.\" class=\"lazyload wp-image-120231\" style=\"width:748px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53.webp 2048w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-177x115.png 177w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-300x195.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-768x498.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-625x405.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-1536x996.png 1536w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-645x418.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-463x300.png 463w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-179x115.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-139x90.png 139w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-362x235.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-170x110.png 170w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-1024x664.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-53-833x540.png 833w\" data-sizes=\"(max-width: 2048px) 100vw, 2048px\"\/><figcaption class=\"wp-element-caption\">Determine 4. 1.5x larger efficiency in six months from software program alone on GB300 NVL72<\/figcaption><\/figure>\n<\/div>\n<h2 id=\"leading_pre-training_frameworks_accelerated_by_nvidia\u00a0\u00a0\" class=\"wp-block-heading\">Main pre-training frameworks accelerated by NVIDIA\u00a0\u00a0<\/h2>\n<p class=\"wp-block-paragraph\">NVIDIA engineers contribute on to the open frameworks the AI neighborhood depends on, including optimizations that make them sooner on NVIDIA GPUs. Developed collaboratively with the PyTorch and JAX communities, these contributions land constantly and enhance efficiency over time.<\/p>\n<p class=\"wp-block-paragraph\">TorchTitan is PyTorch\u2019s native coaching stack, and NVIDIA contributions constantly enhance its efficiency on GB300 NVL72. On DeepSeek-V3 671B, these optimizations compound to ship roughly 6x larger delivered efficiency on the identical infrastructure.<\/p>\n<div class=\"wp-block-image\">\n<figure data-wp-context=\"{&quot;imageId&quot;:&quot;6a605c2b005f8&quot;}\" data-wp-interactive=\"core\/image\" data-wp-key=\"6a605c2b005f8\" class=\"aligncenter size-full is-resized wp-lightbox-container\"><img decoding=\"async\" width=\"2048\" height=\"1136\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63.webp\" alt=\"Bar chart of TorchTitan delivered performance evolution in TFLOPs per GPU on DeepSeek-V3 671B on GB300 NVL72. Across successive optimization stages, performance rises by about 6x overall, driven by NVIDIA software contributions to TorchTitan framework.\" class=\"wp-image-120252\" style=\"aspect-ratio:1.8028465804066542;width:744px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63.webp 2048w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-179x99.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-300x166.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-768x426.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-625x347.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-1536x852.png 1536w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-645x358.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-500x277.png 500w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-160x90.png 160w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-362x201.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-198x110.png 198w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-1024x568.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-960x533.png 960w\" sizes=\"(max-width: 2048px) 100vw, 2048px\"\/><img loading=\"lazy\" decoding=\"async\" width=\"2048\" height=\"1136\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63.webp\" alt=\"Bar chart of TorchTitan delivered performance evolution in TFLOPs per GPU on DeepSeek-V3 671B on GB300 NVL72. Across successive optimization stages, performance rises by about 6x overall, driven by NVIDIA software contributions to TorchTitan framework.\" class=\"lazyload wp-image-120252\" style=\"aspect-ratio:1.8028465804066542;width:744px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63.webp 2048w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-179x99.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-300x166.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-768x426.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-625x347.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-1536x852.png 1536w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-645x358.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-500x277.png 500w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-160x90.png 160w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-362x201.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-198x110.png 198w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-1024x568.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-63-960x533.png 960w\" data-sizes=\"(max-width: 2048px) 100vw, 2048px\"\/><figcaption class=\"wp-element-caption\">Determine 5. GB300 NVL72 efficiency evolution with TorchTitan optimizations\u00a0<\/figcaption><\/figure>\n<\/div>\n<p class=\"wp-block-paragraph\">JAX follows the identical arc. Over six months, NVIDIA JAX optimizations have lifted efficiency enhancements by almost 10x on DeepSeek-V3 671B at 256 GPU scale\u2014all from software program optimizations. The most recent software program model reaches an distinctive efficiency throughput of 1,025 TFLOPS\/GPU, and software program optimizations proceed to evolve from there.\u00a0\u00a0<\/p>\n<div class=\"wp-block-image\">\n<figure data-wp-context=\"{&quot;imageId&quot;:&quot;6a605c2b0131f&quot;}\" data-wp-interactive=\"core\/image\" data-wp-key=\"6a605c2b0131f\" class=\"aligncenter size-full wp-lightbox-container\"><img decoding=\"async\" width=\"2048\" height=\"1238\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73.webp\" alt=\"Bar chart of JAX delivered performance evolution  in TFLOPs per GPU on DeepSeek-V3 671B at 256 GPUs on GB300 NVL72, from January 2026 to today. Performance rises by nearly 10x over six months, driven by NVIDIA software optimization.\" class=\"wp-image-120303\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73.webp 2048w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-179x108.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-300x181.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-768x464.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-625x378.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-1536x929.png 1536w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-645x390.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-496x300.png 496w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-149x90.png 149w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-362x219.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-182x110.png 182w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-1024x619.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-893x540.png 893w\" sizes=\"(max-width: 2048px) 100vw, 2048px\"\/><img loading=\"lazy\" decoding=\"async\" width=\"2048\" height=\"1238\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73.webp\" alt=\"Bar chart of JAX delivered performance evolution  in TFLOPs per GPU on DeepSeek-V3 671B at 256 GPUs on GB300 NVL72, from January 2026 to today. Performance rises by nearly 10x over six months, driven by NVIDIA software optimization.\" class=\"lazyload wp-image-120303\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73.webp 2048w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-179x108.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-300x181.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-768x464.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-625x378.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-1536x929.png 1536w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-645x390.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-496x300.png 496w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-149x90.png 149w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-362x219.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-182x110.png 182w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-1024x619.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-73-893x540.png 893w\" data-sizes=\"(max-width: 2048px) 100vw, 2048px\"\/><figcaption class=\"wp-element-caption\">Determine 6. GB300 NVL72 efficiency evolution with JAX optimizations<\/figcaption><\/figure>\n<\/div>\n<p class=\"wp-block-paragraph\">Scaling DeepSeek-V3 671B pre-training from 256 to 1,024 GPUs, Megatron Core holds 98.5% of its per-GPU efficiency whereas TorchTitan and JAX every maintain 97%, so almost all of the added infrastructure turns into added system-level tokens per second throughput. That effectivity is the scale-out cloth doing its job effectively as racks are scaled out with 800 Gb\/s per-GPU networking; gradient site visitors stays hidden behind compute, guaranteeing that including extra GPUs strictly will increase whole system throughput as a substitute of bogging the community down with communication overhead.\u00a0<\/p>\n<div class=\"wp-block-image\">\n<figure data-wp-context=\"{&quot;imageId&quot;:&quot;6a605c2b02189&quot;}\" data-wp-interactive=\"core\/image\" data-wp-key=\"6a605c2b02189\" class=\"aligncenter size-full is-resized wp-lightbox-container\"><img decoding=\"async\" width=\"1186\" height=\"750\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57.webp\" alt=\"Chart of Megatron Core, TorchTitan, and JAX scaling efficiency for pre-training DeepSeek-V3 671B on GB300 NVL72. All three start at 100% at 256 GPUs and stay high as the count grows to 512 and 1,024, where Megatron Core holds 98.5% and TorchTitan and JAX each hold about 97%.\" class=\"wp-image-120239\" style=\"aspect-ratio:1.5814090307398148;width:802px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57.webp 1186w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-179x113.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-300x190.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-768x486.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-625x395.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-645x408.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-474x300.png 474w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-142x90.png 142w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-362x229.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-174x110.png 174w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-1024x648.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-854x540.png 854w\" sizes=\"(max-width: 1186px) 100vw, 1186px\"\/><img loading=\"lazy\" decoding=\"async\" width=\"1186\" height=\"750\" data-wp-class--hide=\"state.isContentHidden\" data-wp-class--show=\"state.isContentVisible\" data-wp-init=\"callbacks.setButtonStyles\" data-wp-on--click=\"actions.showLightbox\" data-wp-on--load=\"callbacks.setButtonStyles\" data-wp-on--pointerdown=\"actions.preloadImage\" data-wp-on--pointerenter=\"actions.preloadImageWithDelay\" data-wp-on--pointerleave=\"actions.cancelPreload\" data-wp-on-window--resize=\"callbacks.setButtonStyles\" src=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57.webp\" alt=\"Chart of Megatron Core, TorchTitan, and JAX scaling efficiency for pre-training DeepSeek-V3 671B on GB300 NVL72. All three start at 100% at 256 GPUs and stay high as the count grows to 512 and 1,024, where Megatron Core holds 98.5% and TorchTitan and JAX each hold about 97%.\" class=\"lazyload wp-image-120239\" style=\"aspect-ratio:1.5814090307398148;width:802px;height:auto\" srcset=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57.webp 1186w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-179x113.png 179w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-300x190.png 300w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-768x486.png 768w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-625x395.png 625w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-645x408.png 645w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-474x300.png 474w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-142x90.png 142w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-362x229.png 362w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-174x110.png 174w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-1024x648.png 1024w, https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/image-57-854x540.png 854w\" data-sizes=\"(max-width: 1186px) 100vw, 1186px\"\/><figcaption class=\"wp-element-caption\">Determine 7. Scaling DeepSeek-V3 671B pre-training on GB300 NVL72. Megatron Core, TorchTitan, and JAX all maintain per-GPU throughput, whereas scaling from 256 to 1,024 GPUs<\/figcaption><\/figure>\n<\/div>\n<h2 id=\"setting_a_world_record\" class=\"wp-block-heading\">Setting a world document<\/h2>\n<p class=\"wp-block-paragraph\">Pre-training DeepSeek-v3 671B with 256 GPUs achieves a world document 1,648 TFLOPs per GPU with GB300 NVL72, enabling the identical coaching job to succeed in the identical efficiency with a fraction of the {hardware} in comparison with the earlier technology.\u00a0<\/p>\n<p class=\"wp-block-paragraph\">The open frameworks inform the identical story. Efficiency continues to enhance on the identical platform because the software program evolves. These outcomes will not be the ceiling\u2014they arrive from a platform whose {hardware}, interconnect, and software program are designed collectively and constantly optimized. The record-setting efficiency of immediately is simply the inspiration for even larger efficiency tomorrow.\u00a0<\/p>\n<h2 id=\"get_started_training_frontier_models_on_nvidia_ai_infrastructure\" class=\"wp-block-heading\">Get began coaching frontier fashions on NVIDIA AI infrastructure<\/h2>\n<p class=\"wp-block-paragraph\">Acknowledgements<\/p>\n<p class=\"wp-block-paragraph\">Setting a world document on the NVIDIA GB300 NVL72 platform by pre-training the DeepSeek-V3 mannequin displays the work of many distinctive engineers throughout the corporate. We wish to acknowledge the contributions of the next people (sorted by final identify):<\/p>\n<p class=\"wp-block-paragraph\">Aidyn Aitzhan, Michael Andersch, Jan Bernloehr, Santosh Bhavani, Ben Cashman, Carlo del Mundo, Ashraf Eassa, Fabio Paes Leme Ferriani, Matt Frank, Abhinav Goel, Vivek Goel, Elfie Guo, Eric Harper, Munira Hussain, Tomasz Jakubek, Masaki Kozuki, George Kurian, Himangshu Lahkar, Guihong Li, Kibibi Moseley, Nitin Nitin, Devin O\u2019Kelly, Christian M. Sarofeen, Priya Sethuraman, Tejash Shah, Franciszek Szarwacki, John Tran, Qiyu Wan, and Cliff Woolley.<\/p>\n<\/div>\n<p><br \/>\n<br \/><a href=\"https:\/\/developer.nvidia.com\/blog\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/\">Source link <\/a><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Frontier mannequin pre-training has converged on combination of consultants (MoE), which is basically altering what limits large-scale AI coaching. As compute per token falls, communication more and more determines how effectively fashions scale throughout 1000&#8217;s of GPUs. NVIDIA GB300 NVL72 set a world document for pre-training DeepSeek-V3 671B at 1,648 TFLOPs per GPU, displaying how [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":2683,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"fifu_image_url":"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/World-Record.webp","fifu_image_alt":"","jnews-multi-image_gallery":[],"jnews_single_post":[],"jnews_primary_category":[],"jnews_override_bookmark_settings":[],"jnews_social_meta":[],"jnews_override_counter":[],"footnotes":""},"categories":[3],"tags":[3162,3161,81,2596,3114,2356,1547,135],"class_list":["post-2681","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-ai-platforms-apps","tag-gb300","tag-moe","tag-nvidia","tag-nvl72","tag-pretraining","tag-record","tag-setting","tag-world"],"yoast_head":"<!-- This site is optimized with the Yoast SEO plugin v27.7 - https:\/\/yoast.com\/product\/yoast-seo-wordpress\/ -->\n<title>Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72 - Future News 24<\/title>\n<meta name=\"description\" content=\"Frontier model pre&#x2d;training has converged on mixture of experts (MoE), which is fundamentally changing what limits large&#x2d;scale AI training. As compute per token&#8230;\" \/>\n<meta name=\"robots\" content=\"index, follow, max-snippet:-1, max-image-preview:large, max-video-preview:-1\" \/>\n<link rel=\"canonical\" href=\"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/\" \/>\n<meta property=\"og:locale\" content=\"en_US\" \/>\n<meta property=\"og:type\" content=\"article\" \/>\n<meta property=\"og:title\" content=\"Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72 - Future News 24\" \/>\n<meta property=\"og:description\" content=\"Frontier model pre&#x2d;training has converged on mixture of experts (MoE), which is fundamentally changing what limits large&#x2d;scale AI training. As compute per token&#8230;\" \/>\n<meta property=\"og:url\" content=\"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/\" \/>\n<meta property=\"og:site_name\" content=\"Future News 24\" \/>\n<meta property=\"article:published_time\" content=\"2026-07-21T15:00:00+00:00\" \/>\n<meta property=\"article:modified_time\" content=\"2026-07-22T05:59:08+00:00\" \/>\n<meta property=\"og:image\" content=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/World-Record.webp\" \/>\n<meta name=\"author\" content=\"Future News 24\" \/>\n<meta name=\"twitter:card\" content=\"summary_large_image\" \/>\n<meta name=\"twitter:image\" content=\"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/World-Record.webp\" \/>\n<meta name=\"twitter:label1\" content=\"Written by\" \/>\n\t<meta name=\"twitter:data1\" content=\"Future News 24\" \/>\n\t<meta name=\"twitter:label2\" content=\"Est. reading time\" \/>\n\t<meta name=\"twitter:data2\" content=\"7 minutes\" \/>\n<script type=\"application\/ld+json\" class=\"yoast-schema-graph\">{\"@context\":\"https:\\\/\\\/schema.org\",\"@graph\":[{\"@type\":\"Article\",\"@id\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/#article\",\"isPartOf\":{\"@id\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/\"},\"author\":{\"name\":\"Future News 24\",\"@id\":\"https:\\\/\\\/futurenews24.com\\\/#\\\/schema\\\/person\\\/cecad1bde21cfc357cf70128144d6c83\"},\"headline\":\"Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72\",\"datePublished\":\"2026-07-21T15:00:00+00:00\",\"dateModified\":\"2026-07-22T05:59:08+00:00\",\"mainEntityOfPage\":{\"@id\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/\"},\"wordCount\":1352,\"commentCount\":0,\"publisher\":{\"@id\":\"https:\\\/\\\/futurenews24.com\\\/#organization\"},\"image\":{\"@id\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/#primaryimage\"},\"thumbnailUrl\":\"https:\\\/\\\/developer-blogs.nvidia.com\\\/wp-content\\\/uploads\\\/2026\\\/07\\\/World-Record.webp\",\"keywords\":[\"GB300\",\"MoE\",\"NVIDIA\",\"NVL72\",\"Pretraining\",\"record\",\"setting\",\"World\"],\"articleSection\":[\"AI Platforms &amp; Apps\"],\"inLanguage\":\"en-US\",\"potentialAction\":[{\"@type\":\"CommentAction\",\"name\":\"Comment\",\"target\":[\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/#respond\"]}]},{\"@type\":\"WebPage\",\"@id\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/\",\"url\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/\",\"name\":\"Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72 - Future News 24\",\"isPartOf\":{\"@id\":\"https:\\\/\\\/futurenews24.com\\\/#website\"},\"primaryImageOfPage\":{\"@id\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/#primaryimage\"},\"image\":{\"@id\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/#primaryimage\"},\"thumbnailUrl\":\"https:\\\/\\\/developer-blogs.nvidia.com\\\/wp-content\\\/uploads\\\/2026\\\/07\\\/World-Record.webp\",\"datePublished\":\"2026-07-21T15:00:00+00:00\",\"dateModified\":\"2026-07-22T05:59:08+00:00\",\"description\":\"Frontier model pre&#x2d;training has converged on mixture of experts (MoE), which is fundamentally changing what limits large&#x2d;scale AI training. As compute per token&#8230;\",\"breadcrumb\":{\"@id\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/#breadcrumb\"},\"inLanguage\":\"en-US\",\"potentialAction\":[{\"@type\":\"ReadAction\",\"target\":[\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/\"]}]},{\"@type\":\"ImageObject\",\"inLanguage\":\"en-US\",\"@id\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/#primaryimage\",\"url\":\"https:\\\/\\\/developer-blogs.nvidia.com\\\/wp-content\\\/uploads\\\/2026\\\/07\\\/World-Record.webp\",\"contentUrl\":\"https:\\\/\\\/developer-blogs.nvidia.com\\\/wp-content\\\/uploads\\\/2026\\\/07\\\/World-Record.webp\"},{\"@type\":\"BreadcrumbList\",\"@id\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/2026\\\/07\\\/21\\\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\\\/#breadcrumb\",\"itemListElement\":[{\"@type\":\"ListItem\",\"position\":1,\"name\":\"Home\",\"item\":\"https:\\\/\\\/futurenews24.com\\\/\"},{\"@type\":\"ListItem\",\"position\":2,\"name\":\"Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72\"}]},{\"@type\":\"WebSite\",\"@id\":\"https:\\\/\\\/futurenews24.com\\\/#website\",\"url\":\"https:\\\/\\\/futurenews24.com\\\/\",\"name\":\"Future News 24\",\"description\":\"The Smart Hub for AI and Next-Gen Innovation\",\"publisher\":{\"@id\":\"https:\\\/\\\/futurenews24.com\\\/#organization\"},\"potentialAction\":[{\"@type\":\"SearchAction\",\"target\":{\"@type\":\"EntryPoint\",\"urlTemplate\":\"https:\\\/\\\/futurenews24.com\\\/?s={search_term_string}\"},\"query-input\":{\"@type\":\"PropertyValueSpecification\",\"valueRequired\":true,\"valueName\":\"search_term_string\"}}],\"inLanguage\":\"en-US\"},{\"@type\":\"Organization\",\"@id\":\"https:\\\/\\\/futurenews24.com\\\/#organization\",\"name\":\"Future News 24\",\"url\":\"https:\\\/\\\/futurenews24.com\\\/\",\"logo\":{\"@type\":\"ImageObject\",\"inLanguage\":\"en-US\",\"@id\":\"https:\\\/\\\/futurenews24.com\\\/#\\\/schema\\\/logo\\\/image\\\/\",\"url\":\"https:\\\/\\\/futurenews24.com\\\/wp-content\\\/uploads\\\/2026\\\/06\\\/fn24-favicon.png\",\"contentUrl\":\"https:\\\/\\\/futurenews24.com\\\/wp-content\\\/uploads\\\/2026\\\/06\\\/fn24-favicon.png\",\"width\":250,\"height\":250,\"caption\":\"Future News 24\"},\"image\":{\"@id\":\"https:\\\/\\\/futurenews24.com\\\/#\\\/schema\\\/logo\\\/image\\\/\"}},{\"@type\":\"Person\",\"@id\":\"https:\\\/\\\/futurenews24.com\\\/#\\\/schema\\\/person\\\/cecad1bde21cfc357cf70128144d6c83\",\"name\":\"Future News 24\",\"image\":{\"@type\":\"ImageObject\",\"inLanguage\":\"en-US\",\"@id\":\"https:\\\/\\\/secure.gravatar.com\\\/avatar\\\/d57f07142d73cb5503ab2446ea7bc9ef3d0a5ba378d64a6157692311e42bf097?s=96&d=mm&r=g\",\"url\":\"https:\\\/\\\/secure.gravatar.com\\\/avatar\\\/d57f07142d73cb5503ab2446ea7bc9ef3d0a5ba378d64a6157692311e42bf097?s=96&d=mm&r=g\",\"contentUrl\":\"https:\\\/\\\/secure.gravatar.com\\\/avatar\\\/d57f07142d73cb5503ab2446ea7bc9ef3d0a5ba378d64a6157692311e42bf097?s=96&d=mm&r=g\",\"caption\":\"Future News 24\"},\"sameAs\":[\"https:\\\/\\\/futurenews24.com\"],\"url\":\"https:\\\/\\\/futurenews24.com\\\/index.php\\\/author\\\/mridulpahuja20\\\/\"}]}<\/script>\n<!-- \/ Yoast SEO plugin. -->","yoast_head_json":{"title":"Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72 - Future News 24","description":"Frontier model pre&#x2d;training has converged on mixture of experts (MoE), which is fundamentally changing what limits large&#x2d;scale AI training. As compute per token&#8230;","robots":{"index":"index","follow":"follow","max-snippet":"max-snippet:-1","max-image-preview":"max-image-preview:large","max-video-preview":"max-video-preview:-1"},"canonical":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/","og_locale":"en_US","og_type":"article","og_title":"Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72 - Future News 24","og_description":"Frontier model pre&#x2d;training has converged on mixture of experts (MoE), which is fundamentally changing what limits large&#x2d;scale AI training. As compute per token&#8230;","og_url":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/","og_site_name":"Future News 24","article_published_time":"2026-07-21T15:00:00+00:00","article_modified_time":"2026-07-22T05:59:08+00:00","og_image":[{"url":"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/World-Record.webp","type":"","width":"","height":""}],"author":"Future News 24","twitter_card":"summary_large_image","twitter_image":"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/World-Record.webp","twitter_misc":{"Written by":"Future News 24","Est. reading time":"7 minutes"},"schema":{"@context":"https:\/\/schema.org","@graph":[{"@type":"Article","@id":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/#article","isPartOf":{"@id":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/"},"author":{"name":"Future News 24","@id":"https:\/\/futurenews24.com\/#\/schema\/person\/cecad1bde21cfc357cf70128144d6c83"},"headline":"Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72","datePublished":"2026-07-21T15:00:00+00:00","dateModified":"2026-07-22T05:59:08+00:00","mainEntityOfPage":{"@id":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/"},"wordCount":1352,"commentCount":0,"publisher":{"@id":"https:\/\/futurenews24.com\/#organization"},"image":{"@id":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/#primaryimage"},"thumbnailUrl":"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/World-Record.webp","keywords":["GB300","MoE","NVIDIA","NVL72","Pretraining","record","setting","World"],"articleSection":["AI Platforms &amp; Apps"],"inLanguage":"en-US","potentialAction":[{"@type":"CommentAction","name":"Comment","target":["https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/#respond"]}]},{"@type":"WebPage","@id":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/","url":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/","name":"Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72 - Future News 24","isPartOf":{"@id":"https:\/\/futurenews24.com\/#website"},"primaryImageOfPage":{"@id":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/#primaryimage"},"image":{"@id":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/#primaryimage"},"thumbnailUrl":"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/World-Record.webp","datePublished":"2026-07-21T15:00:00+00:00","dateModified":"2026-07-22T05:59:08+00:00","description":"Frontier model pre&#x2d;training has converged on mixture of experts (MoE), which is fundamentally changing what limits large&#x2d;scale AI training. As compute per token&#8230;","breadcrumb":{"@id":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/#breadcrumb"},"inLanguage":"en-US","potentialAction":[{"@type":"ReadAction","target":["https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/"]}]},{"@type":"ImageObject","inLanguage":"en-US","@id":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/#primaryimage","url":"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/World-Record.webp","contentUrl":"https:\/\/developer-blogs.nvidia.com\/wp-content\/uploads\/2026\/07\/World-Record.webp"},{"@type":"BreadcrumbList","@id":"https:\/\/futurenews24.com\/index.php\/2026\/07\/21\/setting-a-world-record-for-moe-pre-training-on-nvidia-gb300-nvl72\/#breadcrumb","itemListElement":[{"@type":"ListItem","position":1,"name":"Home","item":"https:\/\/futurenews24.com\/"},{"@type":"ListItem","position":2,"name":"Setting a World Document for MoE Pre-Coaching on NVIDIA GB300 NVL72"}]},{"@type":"WebSite","@id":"https:\/\/futurenews24.com\/#website","url":"https:\/\/futurenews24.com\/","name":"Future News 24","description":"The Smart Hub for AI and Next-Gen Innovation","publisher":{"@id":"https:\/\/futurenews24.com\/#organization"},"potentialAction":[{"@type":"SearchAction","target":{"@type":"EntryPoint","urlTemplate":"https:\/\/futurenews24.com\/?s={search_term_string}"},"query-input":{"@type":"PropertyValueSpecification","valueRequired":true,"valueName":"search_term_string"}}],"inLanguage":"en-US"},{"@type":"Organization","@id":"https:\/\/futurenews24.com\/#organization","name":"Future News 24","url":"https:\/\/futurenews24.com\/","logo":{"@type":"ImageObject","inLanguage":"en-US","@id":"https:\/\/futurenews24.com\/#\/schema\/logo\/image\/","url":"https:\/\/futurenews24.com\/wp-content\/uploads\/2026\/06\/fn24-favicon.png","contentUrl":"https:\/\/futurenews24.com\/wp-content\/uploads\/2026\/06\/fn24-favicon.png","width":250,"height":250,"caption":"Future News 24"},"image":{"@id":"https:\/\/futurenews24.com\/#\/schema\/logo\/image\/"}},{"@type":"Person","@id":"https:\/\/futurenews24.com\/#\/schema\/person\/cecad1bde21cfc357cf70128144d6c83","name":"Future News 24","image":{"@type":"ImageObject","inLanguage":"en-US","@id":"https:\/\/secure.gravatar.com\/avatar\/d57f07142d73cb5503ab2446ea7bc9ef3d0a5ba378d64a6157692311e42bf097?s=96&d=mm&r=g","url":"https:\/\/secure.gravatar.com\/avatar\/d57f07142d73cb5503ab2446ea7bc9ef3d0a5ba378d64a6157692311e42bf097?s=96&d=mm&r=g","contentUrl":"https:\/\/secure.gravatar.com\/avatar\/d57f07142d73cb5503ab2446ea7bc9ef3d0a5ba378d64a6157692311e42bf097?s=96&d=mm&r=g","caption":"Future News 24"},"sameAs":["https:\/\/futurenews24.com"],"url":"https:\/\/futurenews24.com\/index.php\/author\/mridulpahuja20\/"}]}},"_links":{"self":[{"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/posts\/2681","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/comments?post=2681"}],"version-history":[{"count":1,"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/posts\/2681\/revisions"}],"predecessor-version":[{"id":2682,"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/posts\/2681\/revisions\/2682"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/media\/2683"}],"wp:attachment":[{"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/media?parent=2681"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/categories?post=2681"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/futurenews24.com\/index.php\/wp-json\/wp\/v2\/tags?post=2681"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}