기본 콘텐츠로 건너뛰기

개발 공부 - [Huffman Coding] 압축 (Compression) - 3

제 2단계
Huffman Tree

Huffman coding 알고리즘은 [트리들의 집합]을 유지하면서
매 단계에서 가장 프리퀀시가 작은 두 트리를 찾아서
두 트리를 하나로 합친다.

이런 연산에 가장 적합한 자료구조는 최소 힙이다. (우선순위큐!)
즉 힙에 저장된 각각의 원소들은 하나의 트리이다. (노드가 아니라)
ㄴ 런 객체들이 모여서 만들어지는 트리이다.

ㄴ extractMin (힙 안의 최소값을 꺼내 주는 것) 
ㄴ insert (넣기)
이 기능을 지원하도록 만들 것


최소 힙
- 크기가 5인 힙
- 5개의 트리가 저장되어 있다
- 각 트리는 오직 하나의 노드로 구성되어 있다.

 heap
0 : A3 1(프리퀀시 값)
1 : C2 1
2 : A1 1
3 : B1 2
4 : A2 2

이렇게 각각의 런을 싱글 노드 트리라고 보면 되고,
각 트리가 노드 하나짜리 트리이다.

min heap은 컴플릿 바이너리 트리 + 힙 프로퍼티를 만족해야 함
부모는 자식보다 작거나 같다 - frequency 값으로 보는 것
A3 1 - C2 1 / A1 1
C2 1 - B1 2 / A2 2 
트리 모양은 이런 구조로 되어 있음
힙을 이진 트리 모양으로 만들기는 하는데, 프로그램 상에서는 그냥 1차원 배열 힙으로 만들면 되는 거라서 

 heap
0 : A3 1(프리퀀시 값)
1 : C2 1
2 : A1 1
3 : B1 2
4 : A2 2

이런 식으로 삽입 하면 된다.

일단 최소 힙 만들기 위해 힙을 만들어서 extreactMin을 두번 반복하고 insert를 하면 

공백 7 (루트 - the Root 라고 부름)
공백 4  - 차일드 2 
    A2 2
    B1 2
공백 3  - 차일드 2 
    C2 1
    공백 2 - 차일드 2
        A3 1
        A1 1

이런 허프만 트리를 조성할 수 있다.



class Run implements Comparable<Run>{
    public byte symbol;
    public int runLen;
    public int freq;

    //트리의 노드로 사용하기 위해서 왼쪽 자식과 오른쪽 자식 노드 필드를 추가한다.
    //두 run의 크기관계를 비교하는 compareTo 메소드를 오버라이딩 하라
    // 비교의 기준은 freq이다.
}


힙은 3장에서 작성한 Heap 클래스를 가져와서 사용하고,
Generics로 수정하고, heapify, insert, extractMin 등의 함수를 min heap에 맞게 수정한다.


public class HuffmanCoding{
    private ArrayList<Run> runs = new ArrayList<Run>();
    private Heap <Run> heap; //min heap 이다.
    private Run theRoot = null; //허프만트리 루트이다.
    
    private void createHuffmanTree(){
        heap = new Heap<Run>();
        //일단 힙을 하나 생성하고
        // 모든 런들을 힙에다가 집어넣고 (insert)
        // 힙 사이즈가 1이 될 때까지 
        // 힙에서 extractMin을 2번 해서 2번 min 값을 꺼내고
        // 두개의 트리를 합쳐서 하나의 트리로 만들고
        // 도로 트리를 힙에다가 넣어주면
        // 마지막에 남아있는 애를 theRoot로 root로 지정해 주면 끝

        
    }
    
    private void collectRuns(RandomAccessFile fin) throws IOExcetpion{
        ...
    }

}

코드는 그냥 출력용으로만 하나의 트리 보여주기 용으로 맨들어 줬는데
소스 짜 봐야 할 듯.




댓글

이 블로그의 인기 게시물

Ebook - 전자책 drm 상관 없이 pdf로 만들기

yes24와 교보문고에서 ebook을 구매 해야 했는데 너무 불편하고, 필기가 매우 화날 정도로 안 좋아서 원시적으로 사용하기로 했다. 1. 목적 : ebook에서 필기 및 사용이 불편하여 pdf로 변환  2. 용도 : 개인 사용 목적이며 화질이 다소 저하되어도 필기만 용이하면 상관 없음 3. 방법 1) 휴대폰 및 카메라로 동영상을 촬영했다. DRM 때문에 프로그램으로는 촬영이 안 되는 것을 확인했다. (사실 개인 사용 목적이면 기본 화면 캡쳐를 사용해도 된다...) 2) 마우스 클릭 해주는 매크로를 사용했다. (1) key_macro.exe > https://blog.daum.net/pg365/250 듀얼 모니터에서 위치 이탈 현상이 있긴 해도 괜찮았다. (2) AutoClick.exe > http://bestsoftwarecenter.blogspot.com/2011/02/autoclick-22.html 이 걸로 잘 사용했다. 3초마다 한 번 클릭하도록 사용했다. 3) 동영상을 이미지로 변경해주는 프로그램을 사용했다. Free Video to JPG Converter > https://www.dvdvideosoft.com/products/dvd/Free-Video-to-JPG-Converter.htm (240826: 다운로드 시 정상적으로 되지 않아서 URL 수정) 일 하면서 듀얼 모니터에 켜 놨는데 속도가 괜찮았다. * Every frame 으로 사용해야 한다. 4) 중복 사진 제거해주는 프로그램을 사용했다. VlsiPics  > http://www.visipics.info/index.php?title=Main_Page 생각보다 느리니 퇴근시에 걸어놓고 가면 된다. 한번 play가 끝나면 Auto-select 하고 Delete 하면 된다. 5) 이미지를 일괄 Crop 작업 해주는 프로그램을 사용했다. JPEGCrops > https://jpegcrops.softonic.kr/ * https://joker1209.tistory.co

개발 공부 - json JSONObject 사용 시 백슬래시(\), 원화 표시(\) 제거 및 치환

import org.json.simple.JSONObject; String dataString = new String(authData.toJSONString()); dataString = dataString.replaceAll("\\\\", ""); String 으로 안 바뀌는 가 싶어서 String 으로 변환 해 주고 작업 하였다. 사실 toJSONString 해도 정상 동작 해야 하는데 이유를 잘 모르겠음. 그리고 나서 다시 이클립스 구동 하니 toString 도 먹은 걸로 봐서 이상하다고 생각! String dataString = authData.toString(); dataString = dataString.replaceAll("\\\\", ""); 어쨌든 백 슬래시 제거를 해줘야 하는데 \\ 도 아니고 \\\\를 해야 변환이 가능했다는 결말이었습니다. 참고 : https://stackoverflow.com/questions/15450519/why-does-string-replace-not-work/15450539 test =test.replace("KP", "");  replace 후에 담아 주지 않으면 적용이 안 됩니다!

개발 공부 - OracleXETNSListener 서비스가 로컬 컴퓨터에서 시작했다가 중지되었습니다.

여러 가지 요인이 있지만 PC 이름 변경시 OracleXETNSListener 서비스 시작이 불가능합니다. 고치는 법은 C:\oraclexe\app\oracle\product\11.2.0\server\network\ADMIN 와 같은 설치 경로에서 listener.ora와 tnsnames.ora 의 pc명을 바꾼 PC명으로 바꿔주면 됩니다. 그래도 안 된다면 cmd 창에서 services.msc 를 입력 후 OracleXETNSListener 서비스를 시작 시키면 됩니다. 오류명: OracleXETNSListener 서비스가 로컬 컴퓨터에서 시작했다가 중지되었습니다. 일부 서비스는 다른 서비스 또는 프로그램에서 사용되지 않으면 자동으로 중지됩니다. 참고한 사이트들 1. http://blog.naver.com/visioner7/120165951652 2. http://database.sarang.net/?inc=read&aid=6819&criteria=oracle&subcrit=&id=&limit=20&keyword=ora-12560&page=5 이런 걸 보면 오라클은 앙칼진 시골 아가씨야