본문 바로가기 메뉴 바로가기

CodeAngie

프로필사진
  • 글쓰기
  • 관리
  • 태그
  • 방명록
  • RSS

CodeAngie

검색하기 폼
  • 전체보기 (166) N
    • Study (5) N
      • Algorithm (8)
      • Coding Test (50)
      • Java (5)
      • FastAPI (2)
      • Docker (8)
      • FastCampus (42)
      • Codetree (9)
      • Ect (23)
    • ML (9)
      • Transformer (5)
      • RecSys (0)
      • Ect (4)

olefile (1)
[Python] Colab에서 아래한글(hwp) 문서 읽기

Colab을 사용해 아래한글 문서를 받아 엑셀로 정리하는 작업을 하려고 한다. 윈도우에서 한글 문서를 다루는 패키지로 pyhwp가 있지만, Colab에서는 리눅스 OS를 사용하기 때문에 pyhwp로 아래한글 문서를 읽기가 쉽지 않았다. (exe 파일을 사용해서 그렇다고 본 것 같다.) 다행히 olefile 패키지를 사용하여 아래한글 문서를 바로 txt 문서로 변환하여 읽어 올 수 있는 방법을 찾았다. 1. olefile 패키지 설치 pip install olefile 2. 아래한글 문서 열기 import olefile path = "/content/file_name.hwp" f = olefile.OleFileIO(path) 3. 아래한글 문서 디코딩하기 기본적인 틀은 openstream 함수로 문서의 내..

Study/Ect 2023. 5. 2.
이전 1 다음
이전 다음
«   2026/01   »
일 월 화 수 목 금 토
1 2 3
4 5 6 7 8 9 10
11 12 13 14 15 16 17
18 19 20 21 22 23 24
25 26 27 28 29 30 31
TAG
  • 최소신장트리
  • pytorch
  • 코드트리
  • 트랜스포머
  • docker
  • 누적합
  • DP
  • greedy
  • 프로그래머스
  • 파이썬
  • java
  • dfs
  • COLAB
  • 티스토리챌린지
  • python
  • Django
  • Transformer
  • 백준
  • 그리디
  • disjoint set
  • MySQL
  • 구현
  • 오블완
  • 코딩테스트
  • 알고리즘
  • lis
  • 분리집합
  • BFS
  • kruskal
  • boj
more
링크

Blog is powered by Tistory / Designed by Tistory

티스토리툴바