기본 콘텐츠로 건너뛰기

개발 공부 - [해슁] hashing - 1

 Hashing


Hash Table

- 해쉬 테이블은 dynamic set을 구현하는 효과적인 방법의 하나

: 적절한 가정하에서 평균 탐색, 삽입, 삭제시간 O(1)

: 보통 최악의 경우 O(n)


-> Red-Black 에서는 O(logN) 이었었음...


- Hash 함수 h를 사용하여 키 k 를 T[h(k)] 에 저장

h : U -> {0,1...m-1},

여기서 m은 테이블의 크기, U는 모든 가능한 키(양의 정수)들의 집합

- 키 k가 h(k)로 해슁되었다고 말함.


해쉬테이블은 일반적으로 하나의 배열

index = h(k)

k는 그냥 하나의 키

: 각 키에 대한 해쉬함수값을 그 키를 저장할 배열 인덱스로 사용한다.


해쉬 함수의 예

- 모든 키들을 자연수라고 가정. (어떤 데이터든지 자연수로 해석하는 것이 가능)

- 예 : 문자열

ASCII 코드 : C=67, L=76, R=82, S=83

문자열 CLRS는 (67 * 128^3) + (76+128^2) + (82*128^1) + (83*128^0) = 141764947


해쉬 함수의 간단한 예 :

: h(k) = k%m 

- 즉 key를 하나의 자연수로 해석한 후 테이블의 크기 m 으로 나눈 나머지

- 항상 0~m-1 사이의 정수가 됨



충돌 (collision)

- 두 개 이상의 키가 동일한 위치로 해싱되는 경우

- 즉, 서로 다른 두 키 k1과 k2에 대해서 h(k1) = h(k2) 인 상황

- 일반적으로 |U| >> m 이므로 항상 발생 가능 (즉 단사함수가 아님)

ㄴ 단사함수는 매칭 되는게 일대일인 함수를 뜻함. 

정의역의 서로 다른 원소를 공역의 서로 다른 원소로 대응시키는 함수다.

-만약 |k|>m이라면 당연히 발생, 여기서 k는 실제로 저장된 키들의 집합

- 충돌이 발생할 경우 대처 방법이 필요

- 대표적인 두 가지 충돌 해결 방법 : chaining 과 open addressing


chaining에 의한 충돌 해결 방법

: 동일한 장소로 해슁된 모든 키들을 하나의 연결리스트로 저장

- 이것은 링크드 리스트로 그냥 chain 처럼 만들어 주는 방식임


키의 삽입

    - 키 k를 리스트 T[h(k)]의 맨 앞에 삽입 : 시간 복잡도 O(1)

    - 중복된 키가 들어올 수 있고, 중복 저장이 허용되지 않는다면 삽입시 리스트를 검색해야 함. 따라서 시간복잡도는 리스트의 길이에 비례

키의 검색

    - 리스트 T[h(k)]에서 순차검색

    - 시간복잡도는 키가 저장된 리스트의 길이에 비례

키의 삭제

    - 리스트 T[h(k)]로부터 키를 검색 후 삭제

    - 일단 키를 검색해서 찾은 후에는 O(1) 시간에 삭제 가능



최악의 경우 모든 키가 하나의 슬롯으로 해슁되는 경우 (무리!)

    - 길이가 n인 하나의 연결리스트가 만들어짐

    - 따라서 최악의 경우 탐색시간은 O(n) + 해쉬함수 계산시간


평균시간복잡도는 키들이 여러 슬롯에 얼마나 잘 분배되느냐에 의해서 결정


-------------------------------------------------------------

SUHA(simple uniform hashing assumption)

: 각각의 키가 모든 슬롯들에 균등한 확률로 

독립적으로 해슁된다는 가정

    - 성능분석을 위한 가정

    - hash 함수는 deterministic 하므로 현실에서는 사실 불가능

: load factor a(알파) = n/m:

    n : 테이블에 저장될 키의 개수

    m : 해쉬테이블의 크기 = 연결리스트의 개수

    각 슬롯에 저장된 키의 평균 개수

연결리스트 T[j]의 길이를 nj라고 하면 E[nj]  = a(알파)

만약 n=O(m) 이면 평균검색시간은 O(1)

이것은 이론적으로 살짝 읽어보면

https://en.wikipedia.org/wiki/SUHA_(computer_science)

이론적으로 확률이 같은 환경을 가정(가설) 해 놓고 하는 얘기라는 소리 인 듯 하다.

댓글

이 블로그의 인기 게시물

Ebook - 전자책 drm 상관 없이 pdf로 만들기

yes24와 교보문고에서 ebook을 구매 해야 했는데 너무 불편하고, 필기가 매우 화날 정도로 안 좋아서 원시적으로 사용하기로 했다. 1. 목적 : ebook에서 필기 및 사용이 불편하여 pdf로 변환  2. 용도 : 개인 사용 목적이며 화질이 다소 저하되어도 필기만 용이하면 상관 없음 3. 방법 1) 휴대폰 및 카메라로 동영상을 촬영했다. DRM 때문에 프로그램으로는 촬영이 안 되는 것을 확인했다. (사실 개인 사용 목적이면 기본 화면 캡쳐를 사용해도 된다...) 2) 마우스 클릭 해주는 매크로를 사용했다. (1) key_macro.exe > https://blog.daum.net/pg365/250 듀얼 모니터에서 위치 이탈 현상이 있긴 해도 괜찮았다. (2) AutoClick.exe > http://bestsoftwarecenter.blogspot.com/2011/02/autoclick-22.html 이 걸로 잘 사용했다. 3초마다 한 번 클릭하도록 사용했다. 3) 동영상을 이미지로 변경해주는 프로그램을 사용했다. Free Video to JPG Converter > https://www.dvdvideosoft.com/products/dvd/Free-Video-to-JPG-Converter.htm (240826: 다운로드 시 정상적으로 되지 않아서 URL 수정) 일 하면서 듀얼 모니터에 켜 놨는데 속도가 괜찮았다. * Every frame 으로 사용해야 한다. 4) 중복 사진 제거해주는 프로그램을 사용했다. VlsiPics  > http://www.visipics.info/index.php?title=Main_Page 생각보다 느리니 퇴근시에 걸어놓고 가면 된다. 한번 play가 끝나면 Auto-select 하고 Delete 하면 된다. 5) 이미지를 일괄 Crop 작업 해주는 프로그램을 사용했다. JPEGCrops > https://jpegcrops.softonic.kr/ *...

개발 공부 - json JSONObject 사용 시 백슬래시(\), 원화 표시(\) 제거 및 치환

import org.json.simple.JSONObject; String dataString = new String(authData.toJSONString()); dataString = dataString.replaceAll("\\\\", ""); String 으로 안 바뀌는 가 싶어서 String 으로 변환 해 주고 작업 하였다. 사실 toJSONString 해도 정상 동작 해야 하는데 이유를 잘 모르겠음. 그리고 나서 다시 이클립스 구동 하니 toString 도 먹은 걸로 봐서 이상하다고 생각! String dataString = authData.toString(); dataString = dataString.replaceAll("\\\\", ""); 어쨌든 백 슬래시 제거를 해줘야 하는데 \\ 도 아니고 \\\\를 해야 변환이 가능했다는 결말이었습니다. 참고 : https://stackoverflow.com/questions/15450519/why-does-string-replace-not-work/15450539 test =test.replace("KP", "");  replace 후에 담아 주지 않으면 적용이 안 됩니다!

개발 공부 - OracleXETNSListener 서비스가 로컬 컴퓨터에서 시작했다가 중지되었습니다.

여러 가지 요인이 있지만 PC 이름 변경시 OracleXETNSListener 서비스 시작이 불가능합니다. 고치는 법은 C:\oraclexe\app\oracle\product\11.2.0\server\network\ADMIN 와 같은 설치 경로에서 listener.ora와 tnsnames.ora 의 pc명을 바꾼 PC명으로 바꿔주면 됩니다. 그래도 안 된다면 cmd 창에서 services.msc 를 입력 후 OracleXETNSListener 서비스를 시작 시키면 됩니다. 오류명: OracleXETNSListener 서비스가 로컬 컴퓨터에서 시작했다가 중지되었습니다. 일부 서비스는 다른 서비스 또는 프로그램에서 사용되지 않으면 자동으로 중지됩니다. 참고한 사이트들 1. http://blog.naver.com/visioner7/120165951652 2. http://database.sarang.net/?inc=read&aid=6819&criteria=oracle&subcrit=&id=&limit=20&keyword=ora-12560&page=5 이런 걸 보면 오라클은 앙칼진 시골 아가씨야