Преимущества 3D-обучения с подкреплением
В отличие от абстрактных 2D/2.5D симуляций, полигон на Unreal Engine 5.7
предоставляет фотореалистичную среду с физически корректным освещением, тенями, отражениями и атмосферой.
Агент обучается на реальном видеопотоке с камеры, используя
свёрточную нейросеть для детекции и классификации объектов
(здания, транспорт, БПЛА, препятствия) с выдачей их 3D-координат в пространстве полигона.
Такой подход устраняет разрыв между симуляцией и реальностью (sim-to-real gap):
политика, обученная на визуальном входе UE5.7, напрямую переносится на бортовой компьютер дрона
без дообучения. Градиенты ландшафта, отражения от стёкол и динамические тени становятся
частью наблюдения агента, формируя устойчивую политику, работающую
в реальных городских условиях.
NN YOLOv8 / DINOv2
3D координаты объектов
UE5.7 Lumen + Nanite
RL PPO / SAC / DreamerV3