НОВОСТЬ · RESEARCH · #144
Планирование или обучение: надёжность и стоимость при обслуживании нескольких активов
В препринте на arXiv проведено эмпирическое сравнение методов планирования и обучения с подкреплением (RL) для обслуживания нескольких подшипников на основе данных до отказа. Исследование показывает, что планирование задаёт надёжность как жёсткое ограничение и даёт политики без отказов с затратами, слабо зависящими от штрафа за отказ, тогда как RL минимизирует ожидаемые затраты и часто жертвует профилактикой ради редких отказов (давая меньшие затраты при низких штрафах, но сохраняющиеся отказы даже при высоких штрафах); также рассмотрены приёмки для ограничения поведения (награждение, маскирование действий) и представлен единый протокол бенчмарка.
КЛЮЧЕВЫЕ ТЕЗИСЫ
- В препринте на arXiv проведено эмпирическое сравнение методов планирования и обучения с подкреплением (RL) для обслуживания нескольких подшипников на основе данных до отказа.
- Исследование показывает, что планирование задаёт надёжность как жёсткое ограничение и даёт политики без отказов с затратами, слабо зависящими от штрафа за отказ, тогда как RL минимизирует ожидаемые затраты и часто жертвует профилактикой ради редких отказов (давая меньшие затраты при низких штрафах, но сохраняющиеся отказы даже при высоких штрафах); также рассмотрены приёмки для ограничения поведения (награждение, маскирование действий) и представлен единый протокол бенчмарка.
- Проясняет практические компромиссы между планированием и RL в промышленном обслуживании и предоставляет переносимый бенчмарк для сравнения методов принятия решений, помогая выбрать между планированием для надёжности и RL для экономичности.
ПОЧЕМУ ЭТО ВАЖНО
Проясняет практические компромиссы между планированием и RL в промышленном обслуживании и предоставляет переносимый бенчмарк для сравнения методов принятия решений, помогая выбрать между планированием для надёжности и RL для экономичности.