기본 콘텐츠로 건너뛰기

개발 공부 - [Huffman Coding] 압축 (Compression) - 4

제 3단계
Codeword 부여하기

각각의 런들에게 실제로 코드워드 부여하는 법
: Huffman 트리의 리프 노드에 위치한 run 들에게 이진 codeword 를 부여할 차례이다.

-리마인드-
Prefix Code
: 어떤 codeword(101, 010 같은 것) 도 다른 codeword의 prefix(접두사)가 되지 않는 코드
(codeword란 하나의 문자에 부여된 이진코드를 말함)
-리마인드 끝-

assignCodeword(prefix, node)
만약에 node가 leaf 이면
    prefix 를 node 에 할당한다. (부여한다)

아니면
    assignCodeword(prefix + '0' , node.left);
    assignCodeword(prefix + '1', node.right);


루트 
루트 자식 왼쪽 - 0 | 루트 자식 오른쪽 - 1
루트 자식 왼쪽의 왼쪽 - 00 | 루트 자식 왼쪽의 오른쪽 - 01 
ㄴ 이런 식으로 자식 위치에 따라서 나의 codeword 에 0  이나 1을 추가한다.
루트 자식 오른쪽의 왼쪽 - 10 | 루트 자식 오른쪽의 오른쪽 - 11 
루트 자식 오른쪽의 오른쪽의 왼쪽 - 110 | 루트 자식 오른쪽의 오른쪽 - 111
ㄴ 이런 식으로 추가하라는 수도 코드임

여기서 prefix를 하나의 32비트 정수로 표현한다 (8비트)
하지만 32비트 중에서 하위 몇 비트만이 실제 부여된 codeword이다.
따라서 codeword의 길이를 따로 유지해야 한다.




class Run implements Comparable<Run>{
    public byte symbol;
    public int runLen;
    public int freq;

    //트리의 노드로 사용하기 위해서 왼쪽 자식과 오른쪽 자식 노드 필드를 추가한다.
    //노드에 부여된 코드워드를 저장하기 위한 필드를 아래와 같이 추가한다.

    public int codeword; //부여된 코드워드를 32비트 정수로 저장.
    public int codewordLen; //부여된 코드워드의 길이 - 즉 코드워드의 
                            //하위 코드워드 렝스 비트가 실제 코드워드이다.


}


루트는 코드워드 길이가 nothing 인 거고

루트 - nothting ( = "")
루트 자식 왼쪽 - 0(0000..... 0) | 루트 자식 오른쪽 - 1 (0000......0001) 

이런 식으로 실제 32비트 정수로 저장될 것이다.

요고는 비트 연산으로 코딩해야 할 것인데, 
codeword 구현 할때는 left shift 연산 사용해서 << ← 사용한 뒤에,
0이나 1을 뒤에 붙여주는 식으로 구현해야 함.

0011 1100 을 << 1 하면 0111 1000 으로 한 칸 shift 해서 2배 증가 함
60 -> 120

그래서 0011 1100 을 << 1 + 1 해서 0111 1001 해서 2배 증가 + 1추가 함
↑ 이게 구현하려는 것임 (0 추가 or 1 추가 해서 자식 애들 분기 할 수 있도록 함)




private void assignCodewords (Run p, int codeword, int length){
//assignCodewords(theRoot, 0,0)으로 처음 호출한다.
//codeword는 노드 p에 부여된 codeword
//length는 노드 p에 부여된 codeword의 길이
    
    if(p.left == null && p.right == null){
        p.codeword = codeword;
        p.codewordLen = length;
    }
    else{
        assignCodeword(prefix + '0' , node.left); //이런 식으로 구현 하지는 않음
        assignCodeword(prefix + '1', node.right); //이런 식으로 구현 하지는 않음

        //왼쪽 자식노드에게는 codeword의 뒤에 0을 추가
        //오른쪽 자식노드에게는 1을 추가
    }


}

-------------------------------------------------------------------

public class HuffmanCoding {
    
    //이렇게 함수로 빼서 사용

     public void compressFile(RandomAccessFile fIn) {
         collectRuns(fIn);
         createHuffmanTree();
         assignCodewords(theRoot, 0, 0);
     }

    static public void main (String args[]) {
        HuffmanCoding app = new HuffmanCoding();
        RandomAccessFile fIn;
        
        try {
            fIn = new RandomAccessFile(“sample.txt”,”r");
             app.compressFile(fIn);
            fIn.close();
        } catch (IOException io) {
            System.err.println("Cannot open " + fileName);
        }
    }
}













댓글

이 블로그의 인기 게시물

Ebook - 전자책 drm 상관 없이 pdf로 만들기

yes24와 교보문고에서 ebook을 구매 해야 했는데 너무 불편하고, 필기가 매우 화날 정도로 안 좋아서 원시적으로 사용하기로 했다. 1. 목적 : ebook에서 필기 및 사용이 불편하여 pdf로 변환  2. 용도 : 개인 사용 목적이며 화질이 다소 저하되어도 필기만 용이하면 상관 없음 3. 방법 1) 휴대폰 및 카메라로 동영상을 촬영했다. DRM 때문에 프로그램으로는 촬영이 안 되는 것을 확인했다. (사실 개인 사용 목적이면 기본 화면 캡쳐를 사용해도 된다...) 2) 마우스 클릭 해주는 매크로를 사용했다. (1) key_macro.exe > https://blog.daum.net/pg365/250 듀얼 모니터에서 위치 이탈 현상이 있긴 해도 괜찮았다. (2) AutoClick.exe > http://bestsoftwarecenter.blogspot.com/2011/02/autoclick-22.html 이 걸로 잘 사용했다. 3초마다 한 번 클릭하도록 사용했다. 3) 동영상을 이미지로 변경해주는 프로그램을 사용했다. Free Video to JPG Converter > https://www.dvdvideosoft.com/products/dvd/Free-Video-to-JPG-Converter.htm (240826: 다운로드 시 정상적으로 되지 않아서 URL 수정) 일 하면서 듀얼 모니터에 켜 놨는데 속도가 괜찮았다. * Every frame 으로 사용해야 한다. 4) 중복 사진 제거해주는 프로그램을 사용했다. VlsiPics  > http://www.visipics.info/index.php?title=Main_Page 생각보다 느리니 퇴근시에 걸어놓고 가면 된다. 한번 play가 끝나면 Auto-select 하고 Delete 하면 된다. 5) 이미지를 일괄 Crop 작업 해주는 프로그램을 사용했다. JPEGCrops > https://jpegcrops.softonic.kr/ *...

개발 공부 - json JSONObject 사용 시 백슬래시(\), 원화 표시(\) 제거 및 치환

import org.json.simple.JSONObject; String dataString = new String(authData.toJSONString()); dataString = dataString.replaceAll("\\\\", ""); String 으로 안 바뀌는 가 싶어서 String 으로 변환 해 주고 작업 하였다. 사실 toJSONString 해도 정상 동작 해야 하는데 이유를 잘 모르겠음. 그리고 나서 다시 이클립스 구동 하니 toString 도 먹은 걸로 봐서 이상하다고 생각! String dataString = authData.toString(); dataString = dataString.replaceAll("\\\\", ""); 어쨌든 백 슬래시 제거를 해줘야 하는데 \\ 도 아니고 \\\\를 해야 변환이 가능했다는 결말이었습니다. 참고 : https://stackoverflow.com/questions/15450519/why-does-string-replace-not-work/15450539 test =test.replace("KP", "");  replace 후에 담아 주지 않으면 적용이 안 됩니다!

개발 공부 - OracleXETNSListener 서비스가 로컬 컴퓨터에서 시작했다가 중지되었습니다.

여러 가지 요인이 있지만 PC 이름 변경시 OracleXETNSListener 서비스 시작이 불가능합니다. 고치는 법은 C:\oraclexe\app\oracle\product\11.2.0\server\network\ADMIN 와 같은 설치 경로에서 listener.ora와 tnsnames.ora 의 pc명을 바꾼 PC명으로 바꿔주면 됩니다. 그래도 안 된다면 cmd 창에서 services.msc 를 입력 후 OracleXETNSListener 서비스를 시작 시키면 됩니다. 오류명: OracleXETNSListener 서비스가 로컬 컴퓨터에서 시작했다가 중지되었습니다. 일부 서비스는 다른 서비스 또는 프로그램에서 사용되지 않으면 자동으로 중지됩니다. 참고한 사이트들 1. http://blog.naver.com/visioner7/120165951652 2. http://database.sarang.net/?inc=read&aid=6819&criteria=oracle&subcrit=&id=&limit=20&keyword=ora-12560&page=5 이런 걸 보면 오라클은 앙칼진 시골 아가씨야