하고 싶은 게 데이터프레임 처리인데
time stamp / sensor(번호) / data
68540.1111 / sensor6 / 0
68540.1112 / sensor47 / 1
68540.3121 / sensor62 / 1
68540.4321 / sensor8 / 0
68541.3322 / sensor6 / 3
(중략)
(time stamp는 일정 간격으로 들어오는 게 아니라 랜덤이라 각각 다름)
로 구성되어 있는 데이터프레임이야
여기서 time stamp를 5초 구간으로 묶은 뒤 (12335.0 <= x < 12340.0 이렇게)
그 구간에 있는 모든 데이터 중에서, sensor 가 겹치면(겹치는 경우가 굉장히 많음) 그 여러개 센서 중에서 time stamp의 값이 가장 큰 것의 행 만을 추출하고 싶음.
위에 예로 든 데이터프레임으로 보자면
sensor6이 2개인데 나중의 sensor6만 가져오고 싶어.
어떤 식으로 짜야할까?
5초 구간으로 묶는 건, for, range로 짜고 pd cut 기능 쓰면 될 것 같긴 한데......
sensor 겹치면 가장 큰 값 추출하는 걸 어떻게 해야 할지 모르겠다.
duplicated를 쓰면 boolean 형태로만 나오는 걸로 아는데... 어렵네ㅜㅜ
어차피 배열이 타임스탬프값 순으로 반복된다면, 타입스탬프를 5초기준으로 잘라서 딕셔너리 타입 만들어서 해당 센서 이름을 Key로, 그 센서의 타임스탬프를 value로 잡으면 타임스탬프가 마지막이 덮어씌어져서 의도한대로 쓸수 있을듯
x = {sensor6 : 68540.1111} x.update(sensor6=68541.3322) 뭐 요렇게?
센싱 데이터 입력된 거 가져오는 거라 타임스탬프 들어오는 게 일정치가 않아ㅜㅜ 딕셔너리 타입도 한 번 고민해볼게 고마워!
해당 댓글은 삭제되었습니다.
와 땡큐땽큐 고마워요. ㅠㅠ
해당 댓글은 삭제되었습니다.
헉 감사합니다