nVidia Visual Profiler 4.1로 돌린 결과
이놈의 충돌처리가 단순 연산만으로 작동하는게 아니고 케이스 바이 케이스로 처리할게 많아서 분기가 많다. 그러다보니 병렬화가 어렵다. 나름 죽도록 병렬화 했다고 생각하는데 실제 코드의 50%정도밖에 병렬화가 안되는것 같다. 코드 최적화는 할만큼 한거 같고 나머지는 GPU스펙에 달린듯. 이하는 NV Visual Profiler로 돌린 화면. 컴퓨팅 활용도 72.4%면 할만큼 했다고 생각한다. 매트릭스 연산이나 영상처리가 아닌지라 더 이상은 무리.

댓글을 달려면 로그인해야 합니다.