Running 3.96k The Ultra-Scale Playbook π 3.96k The ultimate guide to training LLM on large GPU Clusters
berkeley-nest/Starling-LM-7B-alpha Text Generation β’ 7B β’ Updated Mar 20, 2024 β’ 2.24k β’ β’ 560