Artykuły z tagiem
Uczenie ze Wzmocnieniem
4 artykuły
SAGE: Twój Model Wie, Kiedy Przestać Myśleć — Tylko Mu Nie Pozwalasz
SAGE zamienia prawdopodobieństwo następnego tokenu na skumulowane, dzięki czemu model sam kończy myślenie: 40-50% mniej tokenów bez straty dokładności.
AILLMRozumowanie
Green-VLA: Jeden Mózg AI dla Wszystkich Robotów
Green-VLA trenuje jedną politykę w pięciu etapach na 3000 godzinach demonstracji z humanoidów, manipulatorów mobilnych i ramion; wyniki SOTA na CALVIN ABC-D.
AIRobotykaVLA
Attention as a Compass – jak uczyć modele rozumowania mądrzej?
AttnRL wykorzystuje macierze uwagi jako kompas wskazujący punkty rozgałęzienia w process-supervised RL: +1,8 pp nad GRPO i TreeRL przy 8% krótszym treningu.
AIuczenie ze wzmocnieniemLLM
Rola AI w zarządzaniu konstelacjami satelitarnymi
ConstellAI, projekt ESA, uczy agentów RL trasowania i przydziału pasma w mega-konstelacjach; w symulatorze bije Dijkstrę niższymi opóźnieniami.
ConstellAIUczenie ze WzmocnieniemSatelity