Artykuły w kategorii
Badania Naukowe
2 artykuły
To Grok Grokking: Dlaczego sieci neuronowe czasem rozumieją z opóźnieniem
Grokking pojawia się już w regresji grzbietowej: dowód trzech faz treningu pokazuje, że opóźnienie generalizacji skaluje się jak 1/λ i steruje nim weight decay.
Uczenie MaszynoweGeneralizacjaGrokking
LLM-kaskady z ograniczeniami kosztów — poznaj C3PO
C3PO buduje kaskady LLM z probabilistycznym ograniczeniem kosztu zamiast sztywnego budżetu, osiągając jakość najcięższego modelu przy dużo niższym rachunku.
AILLMMachine Learning