Artykuły z tagiem
Rozumowanie
3 artykuły
Demystifying Video Reasoning: Modele nie myślą klatkami - myślą krokami odszumiania
Chain-of-Steps: modele dyfuzyjne wideo rozumują wzdłuż kroków odszumiania, nie klatek. Ensemble różnych seedów poprawia wyniki bez żadnego dotrenowania.
AIComputer VisionGenerowanie Wideo
SAGE: Twój Model Wie, Kiedy Przestać Myśleć — Tylko Mu Nie Pozwalasz
SAGE zamienia prawdopodobieństwo następnego tokenu na skumulowane, dzięki czemu model sam kończy myślenie: 40-50% mniej tokenów bez straty dokładności.
AILLMRozumowanie
Attention as a Compass – jak uczyć modele rozumowania mądrzej?
AttnRL wykorzystuje macierze uwagi jako kompas wskazujący punkty rozgałęzienia w process-supervised RL: +1,8 pp nad GRPO i TreeRL przy 8% krótszym treningu.
AIuczenie ze wzmocnieniemLLM