
Nemo Mbridge Perf Parallelism Strategies
nvidia/skills/skills/nemo-mbridge-perf-parallelism-strategiesby nvidiacf5224d14250Apache-2.03.5K starsListed Oct 8, 2026Updated Oct 8, 2026Repository updated today
Operational guide for choosing and combining parallelism strategies in Megatron Bridge, including sizing rules, hardware topology mapping, and combined parallelism configuration.
- cf5224d14250Currentcommit cf5224dPublished Oct 8, 2026
Source and attribution
Source:nvidia/skillsinskills/nemo-mbridge-perf-parallelism-strategiesat commitcf5224d
License: Apache-2.0
Content belongs to its original authors. SourceWeft indexes it from a public repository.
More from nvidia/skills

Tilegym Cutile Python
nvidia
Guides writing, debugging and optimizing cuTile Python GPU kernels, with examples, validation loops and optional multi-agent orchestration.

Tilegym Monkey Patch Kernels To Transformers
nvidia
Integrates TileGym cuTile kernels into Hugging Face transformers models via non-intrusive monkey-patching and auto-generates new kernels.

Tilegym Converting Cutile To Julia
nvidia
Converts cuTile Python GPU kernels to cuTile.jl Julia equivalents, with rules, examples and a static validator.

Tilegym Adding Cutile Kernel
nvidia
Guides adding a new cuTile GPU kernel operator to TileGym, from dispatch registration through tests and benchmarks.

Physicsnemo Discover
nvidia
Guides discovery of PhysicsNeMo model families, datapipes and examples for a SciML task, citing live repo paths.

Nemoclaw User Guide
nvidia
Routes an AI agent to NemoClaw's canonical Markdown docs and docs MCP server to answer setup and operations questions.