📡 RL 지금 흐름
강화학습 분야는 분산 컴퓨팅 환경을 활용하여 복잡한 워크로드를 가속하는 방향으로 발전하고 있으며, 특히 에이전트 훈련 및 관리를 위한 전용 프레임워크와 도구들이 주목받고 있다. 또한, 금융 트레이딩이나 대규모 언어 모델(LLM)과 같은 특정 응용 분야에 머신러닝을 직접 적용하려는 시도가 두드러지게 나타나고 있다.
reinforcement-learningrldeep-reinforcement-learninggymnasiumlarge-language-modelscomputer-vision
ray-project/ray
98
분산 런타임과 AI 라이브러리를 제공하여 머신러닝 워크로드를 가속하는 컴퓨팅 엔진이다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 43680
★ 43,6802026-09-01이슈 3,550
AI4Finance-Foundation/FinGPT
97
오픈소스 금융 대규모 언어 모델입니다.
RLJupyter NotebookMIT
최근 30일 내 활발 · 라이선스 MIT · stars 21199
★ 21,1992026-08-02이슈 86
stefan-jansen/machine-learning-for-trading
97
데이터 수집부터 실시간 거래까지 머신러닝을 활용한 트레이딩 코드를 제공한다.
RLJupyter NotebookMIT
최근 30일 내 활발 · 라이선스 MIT · stars 20749
★ 20,7492026-09-01이슈 3
microsoft/agent-lightning
96
AI 에이전트를 훈련시키는 데 사용되는 도구 모음입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 17943
★ 17,9432026-08-28이슈 159
owainlewis/awesome-artificial-intelligence
96
인공지능 관련 강의, 서적, 논문 등을 모아 놓은 목록입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 16291
★ 16,2912026-08-15이슈 73
Farama-Foundation/Gymnasium
95
단일 에이전트 강화 학습 환경을 위한 표준 API를 제공합니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 12448
★ 12,4482026-08-29이슈 78
wandb/wandb
95
AI 개발 플랫폼으로 모델 학습 및 관리를 지원하는 도구입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 11248
★ 11,2482026-09-01이슈 950
OpenRLHF/OpenRLHF
95
레이를 기반으로 하는 사용하기 쉽고 확장성 높은 에이전트 RL 프레임워크입니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 9968
★ 9,9682026-08-13이슈 364
NVlabs/Sana
95
선형 확산 트랜스포머를 이용한 효율적인 고해상도 이미지 합성 기술을 제공한다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 8917
★ 8,9172026-08-27이슈 137
georgezouq/awesome-ai-in-finance
94
🔬 A curated list of awesome LLMs & deep learning strategies & tools in financial market.
RLCC0-1.0
최근 30일 내 활발 · 라이선스 CC0-1.0 · stars 6467
★ 6,4672026-08-04이슈 45
kvcache-ai/Mooncake
94
Mooncake는 Moonshot AI의 주요 LLM 서비스인 Kimi를 위한 서빙 플랫폼입니다.
RLC++Apache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 6459
★ 6,4592026-09-01이슈 544
PufferAI/PufferLib
94
강화 학습을 위한 팽창(puffing) 기법을 구현한 라이브러리입니다.
RLCMIT
최근 30일 내 활발 · 라이선스 MIT · stars 6318
★ 6,3182026-08-31이슈 193
google-deepmind/open_spiel
94
게임 연구를 위한 환경과 알고리즘을 모아 놓은 라이브러리입니다.
RLC++Apache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 5450
★ 5,4502026-08-31이슈 49
hiyouga/EasyR1
94
효율적이고 확장 가능한 다중 모드 강화 학습 훈련 프레임워크를 제공한다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 5139
★ 5,1392026-08-31이슈 56
google-deepmind/dm_control
93
물리 기반 시뮬레이션과 강화 학습 환경을 위한 소프트웨어 스택이다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 4681
★ 4,6812026-08-29이슈 128
open-spaced-repetition/fsrs4anki
93
A modern Anki custom scheduling based on Free Spaced Repetition Scheduler algorithm
RLJupyter NotebookMIT
최근 30일 내 활발 · 라이선스 MIT · stars 4052
★ 4,0522026-08-14이슈 8
Farama-Foundation/PettingZoo
93
다중 에이전트 강화 학습 환경을 위한 표준 API를 제공합니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 3503
★ 3,5032026-08-13이슈 47
awesome-mlss/awesome-mlss
92
머신러닝 여름 학교 관련 자료들을 모아놓은 가이드입니다.
RLHTMLMIT
최근 30일 내 활발 · 라이선스 MIT · stars 3031
★ 3,0312026-08-18이슈 8
mujocolab/mjlab
92
MuJoCo 기반의 Isaac Lab API를 제공하여 강화학습 및 로봇 연구에 활용합니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 2941
★ 2,9412026-09-01이슈 33
MaximeVandegar/Papers-in-100-Lines-of-Code
92
Implementation of papers in 100 lines of code.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 2869
★ 2,8692026-08-30이슈 0
mll-lab-nu/RAGEN
92
Agent RL framework for LLM agents: multi-turn reinforcement learning with StarPO and reasoning-collapse diagnostics
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 2784
★ 2,7842026-08-23이슈 29
google-deepmind/mctx
92
JAX 환경에서 몬테카를로 트리 탐색을 구현한 라이브러리입니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 2657
★ 2,6572026-08-06이슈 7
NVlabs/ProtoMotions
92
물리 시뮬레이션을 통해 디지털 휴먼과 인간형 로봇을 훈련하는 프레임워크입니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 2359
★ 2,3592026-08-20이슈 15
BindsNET/bindsnet
91
PyTorch를 이용해 스파이킹 신경망을 시뮬레이션하는 라이브러리입니다.
RLPythonAGPL-3.0
최근 30일 내 활발 · 라이선스 AGPL-3.0 · stars 1695
★ 1,6952026-09-01이슈 11
opendilab/LightZero
91
다양한 순차적 의사결정 시나리오를 위한 통합 벤치마크를 제공한다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 1641
★ 1,6412026-08-28이슈 53
Denys88/rl_games
91
강화 학습을 위한 다양한 구현체들을 제공하는 저장소입니다.
RLJupyter NotebookMIT
최근 30일 내 활발 · 라이선스 MIT · stars 1384
★ 1,3842026-09-01이슈 64
kengz/SLM-Lab
91
Modular Deep Reinforcement Learning framework in PyTorch. Companion library of the book "Foundations of Deep Reinforcement Learning".
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 1362
★ 1,3622026-08-20이슈 5
google-deepmind/android_env
90
안드로이드 기기에서 강화 학습 연구를 수행하는 환경입니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 1240
★ 1,2402026-08-25이슈 12
nnaisense/evotorch
90
Advanced evolutionary computation library built directly on top of PyTorch, created at NNAISENSE.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 1145
★ 1,1452026-08-31이슈 19
agi-brain/xuance
90
다양한 심층 강화 학습 알고리즘을 통합한 라이브러리입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 1082
★ 1,0822026-09-01이슈 31
AspirinCode/papers-for-molecular-design-using-DL
90
생성형 AI와 딥러닝을 활용한 분자 및 물질 설계 관련 논문 목록입니다.
RLGPL-3.0
최근 30일 내 활발 · 라이선스 GPL-3.0 · stars 951
★ 9512026-08-30이슈 0
MushroomRL/mushroom-rl
90
강화 학습을 위한 파이썬 라이브러리를 제공합니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 944
★ 9442026-08-28이슈 4
instadeepai/Mava
90
🦁 A research-friendly codebase for fast experimentation of multi-agent reinforcement learning in JAX
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 933
★ 9332026-08-26이슈 30
unilabsim/UniLab
90
다양한 환경에서 로봇 강화학습을 위한 이기종 아키텍처를 제공한다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 905
★ 9052026-09-01이슈 30
instadeepai/jumanji
90
🕹️ A diverse suite of scalable reinforcement learning environments in JAX
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 860
★ 8602026-09-01이슈 28
MolecularAI/REINVENT4
90
AI molecular design tool for de novo design, scaffold hopping, R-group replacement, linker design and molecule optimization.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 852
★ 8522026-08-09이슈 10
bold-lab-ai/JaxMARL
90
Multi-Agent Reinforcement Learning with JAX
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 847
★ 8472026-08-20이슈 13
Farama-Foundation/MO-Gymnasium
89
강화 학습을 위한 다중 목표 환경을 제공하는 라이브러리입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 760
★ 7602026-08-19이슈 10
FilippoAiraldi/mpc-reinforcement-learning
89
모델 예측 제어를 이용한 강화 학습을 구현하는 저장소입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 709
★ 7092026-08-31이슈 1
X-GenGroup/Flow-Factory
89
흐름 매칭 모델에 대한 강화 학습을 위한 통합 프레임워크를 제공한다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 687
★ 6872026-09-01이슈 42
utilForever/RosettaStone
89
C++와 강화 학습을 이용한 하스스톤 시뮬레이터입니다.
RLC++AGPL-3.0
최근 30일 내 활발 · 라이선스 AGPL-3.0 · stars 680
★ 6802026-08-19이슈 215
Farama-Foundation/Stable-Retro
89
추가 게임과 에뮬레이터로 확장된 레트로 비디오게임 환경을 제공합니다.
RLC++MIT
최근 30일 내 활발 · 라이선스 MIT · stars 678
★ 6782026-09-01이슈 14
hsahovic/poke-env
89
포켓몬 배틀 환경을 파이썬으로 제어하는 도구입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 505
★ 5052026-08-31이슈 34
uoftcprg/pokerkit
88
An open-source Python library for poker game simulations, hand evaluations, and statistical analysis
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 490
★ 4902026-08-22이슈 0
dynamicslab/hydrogym
88
An RL-Gym for Challenge Problems in Data-Driven Modeling and Control of Fluid Dynamics.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 461
★ 4612026-08-26이슈 24
SynaLinks/synalinks
88
아이디어를 실제 구현까지 연결하는 그래프 기반의 신경-기호 언어 모델 프레임워크입니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 455
★ 4552026-08-31이슈 2
Eclectic-Sheep/sheeprl
88
Distributed Reinforcement Learning accelerated by Lightning Fabric
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 438
★ 4382026-08-31이슈 26
Ronchy2000/Multi-agent-RL
88
Projects from basic algorithms to MARL. Implements MADDPG,MATD3,MA/HAPPO in Predator-Prey pursuit games with PettingZoo MPE environments.
RLJupyter NotebookMIT
최근 30일 내 활발 · 라이선스 MIT · stars 438
★ 4382026-08-10이슈 0
rishal-hurbans/Grokking-Artificial-Intelligence-Algorithms
88
The official code repository supporting the book, Grokking Artificial Intelligence Algorithms
RLPythonAGPL-3.0
최근 30일 내 활발 · 라이선스 AGPL-3.0 · stars 427
★ 4272026-08-06이슈 7
Nicolepcx/transformers-the-definitive-guide
88
This is the official repository for the book Transformers - The Definitive Guide
RLJupyter NotebookApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 420
★ 4202026-08-05이슈 1
TorchTrade/torchtrade
88
알고리즘 트레이딩을 위한 모듈식 강화 학습 프레임워크입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 417
★ 4172026-09-01이슈 4
yihaosun1124/OfflineRL-Kit
88
An elegant PyTorch offline reinforcement learning library for researchers.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 393
★ 3932026-08-09이슈 2
allenai/ScienceWorld
88
ScienceWorld is a text-based virtual environment centered around accomplishing tasks from the standardized elementary science curriculum.
RLScalaApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 385
★ 3852026-08-20이슈 14
lupinjia/LeggedGym-Ex
88
legged robot environments for reinforcement learning in multiple simulators (IsaacGym, Genesis, IsaacSim)
RLPythonBSD-3-Clause
최근 30일 내 활발 · 라이선스 BSD-3-Clause · stars 363
★ 3632026-08-24이슈 1
microsoft/jericho
88
A learning environment for man-made Interactive Fiction games.
RLCGPL-2.0
최근 30일 내 활발 · 라이선스 GPL-2.0 · stars 335
★ 3352026-08-14이슈 7
javifalces/HFTFramework
87
강화 학습을 이용해 시장 조성 알고리즘 성능을 개선하는 프레임워크입니다.
RLJupyter NotebookApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 306
★ 3062026-09-01이슈 0
Cognitive-AI-Systems/pogema
87
[ICLR-2025] POGEMA stands for Partially-Observable Grid Environment for Multiple Agents. This is a grid-based environment that was specifically designed to be flexible, tunable and scalable. It can be tailored to a variety of PO-MAPF / MAPF settings.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 300
★ 3002026-08-13이슈 0
ruslanmv/BOT-MMORPG-AI
87
BOT-MMORPG-AI is your personal gaming assistant that uses artificial intelligence to play your favorite MMORPG and RPG games automatically. It watches how YOU play, learns from your gameplay, and then takes over the boring, repetitive tasks while you relax, work, or sleep.
RLJupyter NotebookApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 281
★ 2812026-09-01이슈 31
Future-House/aviary
87
과학적 과제를 수행하는 언어 에이전트 훈련 환경을 제공합니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 279
★ 2792026-08-28이슈 14
MichalBortkiewicz/JaxGCRL
87
Online Goal-Conditioned Reinforcement Learning in JAX. ICLR 2025 Spotlight.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 277
★ 2772026-08-07이슈 5
CCS-Lab/hBayesDM
87
질의응답에 초점을 맞춘 신경망 모델을 탐구하는 코드 저장소입니다.
RLTeXGPL-3.0
최근 30일 내 활발 · 라이선스 GPL-3.0 · stars 264
★ 2642026-09-01이슈 31
🆕worldbench/DiffusionOPSD
87
🔥 On-Policy Self-Distillation in Diffusion Models
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 256
★ 2562026-08-27이슈 2
ugr-sail/sinergym
87
강화 학습을 이용한 건물 시뮬레이션 및 제어 환경을 제공합니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 235
★ 2352026-09-01이슈 5
YuvrajSingh-mist/NeatRL
87
Repository of implementations of classic and sota rl algorithms from scratch in PyTorch
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 227
★ 2272026-08-03이슈 0
libo-huang/Awesome-Causal-Reinforcement-Learning
87
[TNNLS-2025, arXiv-2023.2.10] Official repository of "A Survey on Causal Reinforcement Learning"
RLMIT
최근 30일 내 활발 · 라이선스 MIT · stars 226
★ 2262026-08-19이슈 2
Farama-Foundation/Shimmy
87
다양한 강화 학습 환경에 대한 펫팅즈우 및 지마나지움 바인딩을 제공합니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 222
★ 2222026-08-27이슈 2
airbus/scikit-decide
87
AI framework for Reinforcement Learning, Automated Planning and Scheduling
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 201
★ 2012026-08-28이슈 17
fw-ai/cookbook
87
Fireworks를 이용해 생성형 AI를 구축하고 배포하는 레시피와 자료 모음입니다.
RLJupyter NotebookApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 200
★ 2002026-09-01이슈 80
ivanbelenky/RL
86
강화학습 방법론과 기술을 다루는 저장소입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 197
★ 1972026-09-01이슈 0
utilForever/baba-is-auto
86
C++와 강화학습을 이용한 바바 이즈 유 시뮬레이터입니다.
RLC++MIT
최근 30일 내 활발 · 라이선스 MIT · stars 191
★ 1912026-08-31이슈 111
epignatelli/navix
86
Accelerated minigrid environments with JAX
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 179
★ 1792026-09-01이슈 21
xxzcc/Awesome-Credit-Assignment-in-LLM-RL
86
질의응답에 초점을 맞춘 신경망 모델을 탐구하는 코드 저장소입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 174
★ 1742026-08-03이슈 0
gopala-kr/summary
86
읽은 논문들의 내용을 주제별로 요약한 자료 모음입니다.
RLMIT
최근 30일 내 활발 · 라이선스 MIT · stars 174
★ 1742026-08-31이슈 2
🆕Calix-L/DanKS
86
RL‑Empowered Small‑Scale Competitive Guandan Agent
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 172
★ 1722026-09-01이슈 0
🆕NiluK/worldmodels101
86
Free interactive course on world models in AI. Nine visual chapters on prediction, latent dynamics, planning, JEPA, video models, and failure modes.
RLTypeScriptCC-BY-SA-4.0
최근 30일 내 활발 · 라이선스 CC-BY-SA-4.0 · stars 166
★ 1662026-08-24이슈 0
halfrost/threes-ai
86
카드 게임을 위한 기대값 최대화와 알파제로 기반의 인공지능 구현체입니다.
RLPythonGPL-3.0
최근 30일 내 활발 · 라이선스 GPL-3.0 · stars 164
★ 1642026-08-24이슈 1
flo7up/relataly-public-python-tutorials
86
머신러닝, 딥러닝 등 다양한 분야의 파이썬 실습 노트북 모음입니다.
RLJupyter NotebookCC-BY-SA-4.0
최근 30일 내 활발 · 라이선스 CC-BY-SA-4.0 · stars 161
★ 1612026-08-24이슈 2
ComputationalPsychiatry/pyhgf
86
예측 코딩을 위한 신경망 라이브러리를 제공하는 계산 정신의학 도구입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 157
★ 1572026-09-01이슈 19
stefanbschneider/mobile-env
86
An open, minimalist Gymnasium environment for autonomous coordination in wireless mobile networks.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 155
★ 1552026-08-15이슈 0
bayesianbandits/bayesianbandits
86
다양한 팔의 밴딧 문제를 위한 파이썬 기반 마이크로 프레임워크입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 147
★ 1472026-08-31이슈 4
rlglab/minizero
86
알파제로와 뮤제로 학습을 위한 딥 강화학습 프레임워크를 제공한다.
RLC++Apache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 142
★ 1422026-08-18이슈 1
shasankp000/AI-Player
86
A minecraft mod which aims to add a "second player" into the game which will actually be intelligent.
RLJavaGPL-2.0
최근 30일 내 활발 · 라이선스 GPL-2.0 · stars 141
★ 1412026-08-29이슈 6
Future-House/ldp
86
언어 에이전트, 환경, 최적화기 모듈 교환을 지원하는 프레임워크입니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 137
★ 1372026-08-31이슈 20
google-deepmind/envlogger
86
강화 학습의 궤적을 기록하는 도구입니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 135
★ 1352026-08-25이슈 2
iit-DLSLab/basic-locomotion-isaaclab
85
다양한 사족 보행 로봇의 기본 이동 작업을 위한 시뮬레이션 환경을 제공한다.
RLPythonBSD-3-Clause
최근 30일 내 활발 · 라이선스 BSD-3-Clause · stars 120
★ 1202026-09-01이슈 5
AVSLab/bsk_rl
85
우주선 자율 연구를 위한 강화학습 환경 및 도구를 제공합니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 119
★ 1192026-09-01이슈 27
jcbmrshll/turbozero
85
fast + parallel AlphaZero in JAX
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 112
★ 1122026-08-09이슈 2
🆕zhouzypaul/qgf
85
JAX Implementation for Q-Guided Flow and Common RL Baselines
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 112
★ 1122026-08-27이슈 1
🆕THU-BPM/RLCSD
85
Source code of paper "RLCSD: Reinforcement Learning with Contrastive On-Policy Self-Distillation"
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 98
★ 982026-08-29이슈 1
The-Martyr/Awesome-Multimodal-Reasoning
85
멀티모달 대규모 언어 모델의 추론 및 생성 최신 연구 동향을 모았다.
RLMIT
최근 30일 내 활발 · 라이선스 MIT · stars 94
★ 942026-08-22이슈 0
🆕BytedTsinghua-SIA/Direct-OPD
85
Weak-to-Strong Generalization via Direct On-Policy Distillation
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 88
★ 882026-08-18이슈 2
munich-quantum-toolkit/predictor
85
양자 컴퓨팅을 위한 장치별 회로 컴파일 및 자동 장치 선택 도구입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 87
★ 872026-08-31이슈 28
lucidrains/hl-gauss-pytorch
85
The Gaussian Histogram Loss (HL-Gauss) proposed by Imani et al. with a few convenient wrappers for regression, in Pytorch
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 81
★ 812026-08-31이슈 1
purdue-tracelab/PACE-ICRA2026
85
[ICRA2026] "PACE: Physics Augmentation for Coordinated End-to-end Reinforcement Learning toward Versatile Humanoid Table Tennis"
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 80
★ 802026-08-31이슈 2
🆕kwai/MobileForge
85
주석 없이 모바일 GUI 에이전트를 위한 적응 코드를 제공합니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 80
★ 802026-08-29이슈 2
smly/RiichiEnv
84
High-Performance Research Environment for Riichi Mahjong
RLRustApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 78
★ 782026-08-14이슈 22
Shengxiang-Lin/PGPO
84
Official Repository for "PGPO: Prototype-Guided Progressive Obfuscation for Privacy-Preserving LLM-Enhanced Recommendation" (EMNLP 2026 MainConference)
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 78
★ 782026-08-27이슈 0
AmineAndam04/cleanmarl
84
Single file implementations of Deep Multi-agent Reinforcement Learning
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 75
★ 752026-09-01이슈 0
microsoft/Mu-Protein
84
Official implementation of μProtein -- Accelerating protein engineering with fitness landscape modeling and reinforcement learning
RLJupyter NotebookMIT
최근 30일 내 활발 · 라이선스 MIT · stars 74
★ 742026-08-25이슈 12
flatland-association/flatland-rl
84
불확실성 하의 복원력 있는 자원 할당 문제를 다루는 다목적 환경입니다.
RLJupyter NotebookMIT
최근 30일 내 활발 · 라이선스 MIT · stars 71
★ 712026-09-01이슈 63
NoteDance/Note
84
머신러닝 라이브러리로 분산 훈련 및 심층 학습을 지원합니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 69
★ 692026-08-22이슈 0
desy-ml/cheetah
84
강화 학습 및 최적화를 위한 빠르고 미분 가능한 입자 가속기 광학 시뮬레이션입니다.
RLPythonGPL-3.0
최근 30일 내 활발 · 라이선스 GPL-3.0 · stars 69
★ 692026-08-26이슈 125
yhs0602/CraftGround
84
질의응답에 초점을 맞춘 신경망 모델을 탐구하는 코드 저장소입니다.
RLKotlinGPL-3.0
최근 30일 내 활발 · 라이선스 GPL-3.0 · stars 67
★ 672026-08-27이슈 20
m-wojnar/reinforced-lib
84
Reinforcement learning library
RLPythonCC-BY-4.0
최근 30일 내 활발 · 라이선스 CC-BY-4.0 · stars 66
★ 662026-08-31이슈 0
JdeRobot/BehaviorMetrics
84
자율주행 신경망 비교를 위한 도구입니다.
RLPythonGPL-3.0
최근 30일 내 활발 · 라이선스 GPL-3.0 · stars 64
★ 642026-08-04이슈 61
eserie/wax-ml
84
A Python library for machine-learning and feedback loops on streaming data
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 64
★ 642026-08-15이슈 0
jekyllstein/Reinforcement-Learning-Sutton-Barto-Exercise-Solutions
84
Chapter notes and exercise solutions for Reinforcement Learning: An Introduction by Sutton and Barto
RLJuliaUnlicense
최근 30일 내 활발 · 라이선스 Unlicense · stars 62
★ 622026-08-26이슈 0
nissymori/mahjax
84
질의응답에 초점을 맞춘 신경망 모델을 탐구하는 코드 저장소입니다.
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 61
★ 612026-08-19이슈 3
AlicanKaya192/Data-Science-RoadMap
84
Python temellerinden Reinforcement Learning'e kadar uzanan, 22 modüllük uçtan uca Veri Bilimi & Makine Öğrenmesi yol haritası. Her konuda çalıştırılmış notebook'lar ve PDF tekrar soruları.
RLJupyter NotebookMIT
최근 30일 내 활발 · 라이선스 MIT · stars 56
★ 562026-08-22이슈 0
DTUWindEnergy/WindGym
84
풍력 발전소 제어를 위한 강화 학습 환경을 제공합니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 56
★ 562026-08-25이슈 2
piesauce/awesome-dLLM-resources
84
질의응답에 초점을 맞춘 신경망 모델을 탐구하는 코드 저장소입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 55
★ 552026-09-01이슈 0
gugugu12138/AdaptoFlux
84
질의응답에 초점을 맞춘 신경망 모델을 탐구하는 코드 저장소입니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 54
★ 542026-08-28이슈 0
iit-DLSLab/sim2real-robot-identification
84
A joints calibration routine for quadrupeds and manipulators to facilitate sim-to-real transfer from isaaclab and mujoco to real robots
RLPythonBSD-3-Clause
최근 30일 내 활발 · 라이선스 BSD-3-Clause · stars 52
★ 522026-08-06이슈 1
tinker495/JAxtar
84
JAX 기반의 병렬화 가능한 A\* 및 Q\* 솔버를 구현하여 신경 휴리스틱 검색 연구에 활용합니다.
RLPythonMIT
최근 30일 내 활발 · 라이선스 MIT · stars 51
★ 512026-08-27이슈 0
google/sbsim
77
RLPythonApache-2.0
최근 30일 내 활발 · 라이선스 Apache-2.0 · stars 122
★ 1222026-08-25이슈 60
Unity-Technologies/ml-agents
76
게임과 시뮬레이션을 이용해 지능형 에이전트를 훈련하는 도구 모음입니다.
RLC#NOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 19653
★ 19,6532026-08-25이슈 21
MathFoundationRL/Book-Mathematical-Foundation-of-Reinforcement-Learning
76
질의응답에 초점을 맞춘 신경망 모델을 탐구하는 코드 저장소입니다.
RLMATLAB
최근 30일 내 활발 · 라이선스 불명확 · stars 17654
★ 17,6542026-08-10이슈 0
kmario23/deep-learning-drizzle
76
Drench yourself in Deep Learning, Reinforcement Learning, Machine Learning, Computer Vision, and NLP by learning from these exciting lectures!!
RLHTML
최근 30일 내 활발 · 라이선스 불명확 · stars 12938
★ 12,9382026-08-22이슈 5
evilsocket/pwnagotchi
75
(⌐■_■) - Deep Reinforcement Learning instrumenting bettercap for WiFi pwning.
RLPythonNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 9194
★ 9,1942026-08-19이슈 294
VowpalWabbit/vowpal_wabbit
75
Vowpal Wabbit is a machine learning system which pushes the frontier of machine learning with techniques such as online, hashing, allreduce, reductions, learning2search, active, and interactive learning.
RLC++NOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 8707
★ 8,7072026-08-26이슈 2
guyulongcs/Awesome-Deep-Learning-Papers-for-Search-Recommendation-Advertising
72
Awesome Deep Learning papers for industrial Search, Recommendation and Advertisement. They focus on Embedding, Matching, Pre-Ranking, Ranking, Post Ranking, Relevance, LLM and RL. Please cite our paper "Deep Learning to Rank in Industrial Search Engines, Recommender Systems, and Online Advertising - An Overview and New Perspectives" (TOIS 2026).
RLPython
최근 30일 내 활발 · 라이선스 불명확 · stars 2589
★ 2,5892026-08-29이슈 0
Farama-Foundation/ViZDoom
72
둠 게임을 기반으로 한 강화 학습 환경을 제공합니다.
RLC++
최근 30일 내 활발 · 라이선스 불명확 · stars 2065
★ 2,0652026-08-30이슈 39
meta-pytorch/tnt
71
PyTorch 훈련 도구와 유틸리티를 위한 가벼운 라이브러리입니다.
RLPythonNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 1722
★ 1,7222026-08-28이슈 95
microsoft/TextWorld
71
TextWorld is a sandbox learning environment for the training and evaluation of reinforcement learning (RL) agents on text-based games.
RLJupyter NotebookNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 1441
★ 1,4412026-09-01이슈 21
Farama-Foundation/Minari
71
오프라인 강화 학습 데이터셋의 표준 형식과 관련 유틸리티를 제공합니다.
RLPythonNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 1292
★ 1,2922026-08-04이슈 23
RUC-NLPIR/ARPO
70
[ICLR 2026] Agentic Reinforced Policy Optimization (ARPO)
RLPython
최근 30일 내 활발 · 라이선스 불명확 · stars 1113
★ 1,1132026-08-20이슈 1
🆕Tencent-Hunyuan/UniRL
70
다양한 모달리티를 통합하는 모델 강화 학습 프레임워크입니다.
RLPythonNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 923
★ 9232026-08-31이슈 74
JuliaPOMDP/POMDPs.jl
69
주어진 환경에서 완전 및 부분 관측 마르코프 결정 과정을 정의하고 해결하는 인터페이스입니다.
RLJuliaNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 765
★ 7652026-08-30이슈 25
zli12321/Vision-Language-Models-Overview
69
비전-언어 모델 논문 및 모델을 모아 소개하는 자료 저장소입니다.
RLHTML
최근 30일 내 활발 · 라이선스 불명확 · stars 704
★ 7042026-08-22이슈 0
chsiang426/ML-2021-notes
69
臺灣大學 (NTU) 李宏毅教授「機器學習 (Machine Learning) 2021 Spring 」課程筆記
RL
최근 30일 내 활발 · 라이선스 불명확 · stars 601
★ 6012026-08-16이슈 0
🆕jhljx/RecSys-Industrial-Book
68
추천 시스템의 산업적 아키텍처와 핵심 알고리즘을 다룬 오픈 소스 책이다.
RLNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 377
★ 3772026-08-16이슈 0
🆕XiaoRed5/Agentic-RL-Most-Detailed-Intro
68
에이전트 기반 강화 학습의 상세한 입문 자료를 제공합니다.
RLHTML
최근 30일 내 활발 · 라이선스 불명확 · stars 325
★ 3252026-08-06이슈 0
harveybc/gym-fx
67
외환 거래 시뮬레이션 환경으로 주문 상태와 지표를 관찰한다.
RLPython
최근 30일 내 활발 · 라이선스 불명확 · stars 209
★ 2092026-09-01이슈 2
jgvictores/awesome-deep-reinforcement-learning
67
Curated list for Deep Reinforcement Learning (DRL): software frameworks, models, datasets, gyms, baselines...
RL
최근 30일 내 활발 · 라이선스 불명확 · stars 206
★ 2062026-08-25이슈 2
xlang-ai/CUA-Gym
66
Scalable pipeline for synthesizing verifiable RLVR training data for computer-use agents
RLPythonNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 194
★ 1942026-08-13이슈 7
Draichi/T-1000
66
질의응답에 초점을 맞춘 신경망 모델을 탐구하는 코드 저장소입니다.
RLPython
최근 30일 내 활발 · 라이선스 불명확 · stars 176
★ 1762026-08-19이슈 4
Kim-Hammar/csle
66
A research platform to develop automated security policies using quantitative methods, e.g., optimal control, computational game theory, reinforcement learning, optimization, evolutionary methods, and causal inference.
RLPythonNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 151
★ 1512026-08-21이슈 10
zjunlp/DataMind
66
LLM 기반의 데이터 분석 에이전트를 연구하고 구현한 오픈소스 저장소이다.
RLPython
최근 30일 내 활발 · 라이선스 불명확 · stars 135
★ 1352026-08-30이슈 0
ThyrixYang/awesome-artificial-intelligence-research
66
다양한 인공지능 연구 분야의 최신 트렌드를 모아놓은 목록입니다.
RL
최근 30일 내 활발 · 라이선스 불명확 · stars 132
★ 1322026-08-31이슈 1
🆕aminekago-web/Paradigm-Survival-Arena
65
다양한 인공지능 패러다임들이 생존을 위해 경쟁하는 시뮬레이션 게임입니다.
RLHTML
최근 30일 내 활발 · 라이선스 불명확 · stars 118
★ 1182026-09-01이슈 0
druce/rl
65
Deep Reinforcement Learning For Trading
RLJupyter Notebook
최근 30일 내 활발 · 라이선스 불명확 · stars 109
★ 1092026-08-19이슈 5
callmespring/RL-short-course
65
질의응답에 초점을 맞춘 신경망 모델을 탐구하는 코드 저장소입니다.
RLJupyter NotebookNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 102
★ 1022026-08-26이슈 0
ADGEfficiency/rl-resources
65
A curated collection of reinforcement learning resources
RL
최근 30일 내 활발 · 라이선스 불명확 · stars 100
★ 1002026-08-07이슈 1
jolibrain/wheatley
65
Next-generation scheduling problem solver based on GNNs and Reinforcement Learning
RLPythonNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 84
★ 842026-08-14이슈 5
Bellman281/Stat4ML
65
Statistics and Mathematics for Machine Learning, Deep Learning , Deep NLP
RLPythonNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 81
★ 812026-08-03이슈 0
Xuan-1998/LPSim
64
GPU-accelerated, multi-GPU simulator for large-scale network flow and agent-based optimization: powers ICML 2026 deep-RL dispatch, MoE routing policies, and closed-loop LLM-driven fleet optimization over networks with hundreds of thousands of nodes and millions of agents.
RLC++NOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 75
★ 752026-08-17이슈 8
caiyuanhao1998/Open-PhyGDPO
64
PhyGDPO: Physics-Aware Groupwise Direct Preference Optimization for Physically Consistent Text-to-Video Generation (ECCV 2026)
RLPython
최근 30일 내 활발 · 라이선스 불명확 · stars 70
★ 702026-08-31이슈 3
purdue-tracelab/Humanoid-Locomotion-Survey
64
Companion repository for "Evolution of Humanoid Locomotion Control" in Science Robotics (2026)
RL
최근 30일 내 활발 · 라이선스 불명확 · stars 67
★ 672026-08-20이슈 0
gigatskhondia/gigala
64
Gigala - Open source framework for 2D/3D intelligent topology optimization by reinforcement learning and genetic algorithms.
RLJupyter NotebookNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 61
★ 612026-08-29이슈 3
Mungeryang/CS336-From-Scratch-Spring2026
64
The NoteBook and Assignments implemention via Learning CS336 Spring 2026😛
RLJupyter Notebook
최근 30일 내 활발 · 라이선스 불명확 · stars 60
★ 602026-08-19이슈 0
🆕THUDM/SCALE-CUA
64
Open-source framework for computer use agents: VeriGen verifiable task synthesis, online RL training (AgentRL), and OSWorld/ScienceBoard evaluation.
RLPython
최근 30일 내 활발 · 라이선스 불명확 · stars 55
★ 552026-08-03이슈 4
PlaytikaOSS/pybandits
64
다양한 상황에 맞는 다중 팔 밴딧 알고리즘을 구현하는 파이썬 라이브러리입니다.
RLPythonNOASSERTION
최근 30일 내 활발 · 라이선스 불명확 · stars 53
★ 532026-09-01이슈 6