bitcurrent
Pinned Loading
Repositories
Showing 9 of 9 repositories
- lightning-Hivemind Public Forked from Vectorrent/lightning-Hivemind
Lightning Training strategy for HiveMind
- gpt-test-submission Public
- dtune Public
Distributed DoRA Training through periodic weight averaging for finetuning/continual pretraining
- DistributedTraining Public
- NewArchScrapBook Public
- flask_DHT_bootstrap Public
- swarm Public Forked from yandex-research/swarm
Official code for "SWARM Parallelism: Training Large Models Can Be Surprisingly Communication-Efficient"
People
This organization has no public members. You must be a member to see who’s a part of this organization.
Top languages
Loading…
Most used topics
Loading…