Key points are not available for this paper at this time.
치킨과 같은 혼합 동기 조정 문제에서 에이전트는 파레토 효율적인 결과를 조정하는 데 실패할 수 있습니다. 안전한 파레토 개선(SPIs)은 본래 플레이어가 자신의 대리인이 게임을 어떻게 진행할지에 대한 확률적 믿음이 없을 때 조정 실패를 완화하기 위해 제안되었습니다; 대리인은 본래의 플레이 방식에서 파레토 개선을 보장하도록 행동하라는 지시를 받습니다. 보다 일반적으로, SPIs는 모든 플레이어가 변형된 프로필 아래에서 반드시 더 나은 상태가 되도록 하는 전략 프로필의 변환으로 정의될 수 있습니다. 본 연구에서는 SPIs가 기대 효용 극대화 에이전트 간의 조정 실패의 단점을 얼마나 줄일 수 있는지를 조사합니다. 우리는 플레이어가 서로의 코드에 기반하여 결정을 조건화할 수 있는 컴퓨터 프로그램을 제출하는 게임을 고려하며, 이 속성을 사용하여 재협상이 가능한 프로그램을 사용하여 SPIs를 구성합니다. 우리는 먼저 플레이어의 믿음에 대한 온건한 조건 하에서 각 플레이어가 항상 재협상을 선호한다는 것을 보여줍니다. 다음으로, 유사한 가정 하에서 각 플레이어가 효율적인 결과에서 얻을 수 있는 최저 보상을 받을 때까지는 재협상할 의향이 항상 있도록 선호한다는 것을 보여줍니다. 따라서 주관적으로 최적의 플레이는 플레이어에게 특정 파레토 개선에 대한 조정 없이도 최소한 이러한 보상을 보장합니다. 마지막으로, 재협상이 이 경계에서 플레이어에게 어떤 개선도 보장하지 않음을 증명합니다.
DiGiovanni et al. (Fri,)는 이 질문을 연구했습니다.