← Search

Stanko Sergey

1 accepted papers

2026

Sign-SGD via Parameter-Free Optimization

ICLR 2026poster

Large language models have achieved major advances across domains, yet training them remains extremely resource-intensive. We revisit Sign-SGD, which serves both as a memory-efficient optimizer for single-node training and as a gradient compression mechanism for distributed learning. This paper addr…

Cited by 0SourceScholar