Downloads · 30 days
18
23% of all-time downloads
prostochel097/alphapilot-v1
alphapilot-v1 is a reinforcement learning model from prostochel097. Use it for the reinforcement learning task on the model card, and read the license before you ship it in a product. It is set up for transformers. The card lists the license as apache-2.0.
Alpha-Pilot-V1 — это полностью автономная интеллектуальная система управления космическим модулем, обученная с нуля методом глубокого обучения с подкреплением (Deep Q-Learning).
Downloads · 30 days
18
23% of all-time downloads
All-time downloads
79
Public
Parameters
35.7K
287 KB on disk
Likes
0
Public
Click a slice to open those files.
.safetensors143 KB · 96%
From the Hugging Face model README
Alpha-Pilot-V1 — это полностью автономная интеллектуальная система управления космическим модулем, обученная с нуля методом глубокого обучения с подкреплением (Deep Q-Learning).
Модель прошла путь цифровой эволюции от хаотичных падений до ювелирной посадки на поверхность Луны всего за 357 тренировочных эпизодов.
На видео продемонстрирован финальный этап обучения: агент идеально стабилизирует модуль и совершает мягкую посадку в заданном квадрате.
Модели потребовалось менее 400 попыток, чтобы полностью освоить физику среды:
Модель поддерживает автоматическую загрузку через библиотеку transformers.
import torch
from transformers import AutoModel
# Загрузка модели
# Обязательно используйте trust_remote_code=True для активации кастомной архитектуры
model = AutoModel.from_pretrained("prostochel097/alphapilot-v1", trust_remote_code=True)
model.eval()
# Симуляция входных данных с датчиков (8 чисел)
dummy_observation = torch.randn(1, 8)
# Принятие решения
with torch.no_grad():
logits = model(dummy_observation)
action = torch.argmax(logits).item()
actions = ["Ничего не делать", "Левый движок", "Главный движок", "Правый движок"]
print(f"🤖 Решение пилота: {actions[action]}")