키워드 필터링
키워드를 분리해내며 검사해내는 과정 입니다. ㅎㅎㅎㅎㅎㅎㅎ
왼쪽은 분리해내는 과정.
가운데의 A는 분리한 키워드, B는 필터된 키워드
오른쪽은 가운데와 마찬가지로 다른 키워드로 검사한 것

왼쪽은 분리해내는 과정.
가운데의 A는 분리한 키워드, B는 필터된 키워드
오른쪽은 가운데와 마찬가지로 다른 키워드로 검사한 것

댓글 4개
15년 전
저만 어렵나요? 짱돌 굴려봐도 모르겠습니다!
15년 전
키워드를 분리해내는 쪽을 잘 모르겠어요. 전 그냥 DAUM API 사용하는 것으로 ㅎㅎ;
15년 전
앞에서부터 분리하고, 뒤에서부터 분리하고
두글짜부터 분리하고, 세글짜부터 분리하고, 네글짜부터 분리하고
두글자씩 첫번째부터 분리하고, 두글자씩 두번째부터 분리하고, 두글자씩 세번째부터 분리하고
세글자씩 첫번째부터 분리하고, 세글자씩 두번째부터 분리하고...
총 바이트를 구해서 계속 분리하면서 필터에 있는 단어와 검사를 하는거죠!
두글짜부터 분리하고, 세글짜부터 분리하고, 네글짜부터 분리하고
두글자씩 첫번째부터 분리하고, 두글자씩 두번째부터 분리하고, 두글자씩 세번째부터 분리하고
세글자씩 첫번째부터 분리하고, 세글자씩 두번째부터 분리하고...
총 바이트를 구해서 계속 분리하면서 필터에 있는 단어와 검사를 하는거죠!
15년 전
이런건 형태소 분석기로 하는게 정신건강에 좋습니다.
"대학생선교회"
잘못 추출하면, 대학 + 생선 + 교회 가 나옵니다.
http://nlp.kookmin.ac.kr/HAM/kor/ham-intr.html 전 주로 이분껄 사용합니다만, 상업용으로 공개하신게 아니라서..
http://cs.sungshin.ac.kr/~shim/demo/mach.html 이건 공개용 버전인듯
"대학생선교회"
잘못 추출하면, 대학 + 생선 + 교회 가 나옵니다.
http://nlp.kookmin.ac.kr/HAM/kor/ham-intr.html 전 주로 이분껄 사용합니다만, 상업용으로 공개하신게 아니라서..
http://cs.sungshin.ac.kr/~shim/demo/mach.html 이건 공개용 버전인듯
게시판 목록
토크
개발과 관련된 어떤 얘기도 괜찮습니다.
| 번호 | 제목 | 글쓴이 | 날짜 | 조회 |
|---|---|---|---|---|
| 60 |
choijinhee
|
17년 전 | 1867 | |
| 59 | 17년 전 | 2086 | ||
| 58 | 17년 전 | 2301 | ||
| 57 |
지엔소프트
|
17년 전 | 1435 | |
| 56 |
보드타는찌니
|
17년 전 | 1584 | |
| 55 |
choijinhee
|
17년 전 | 1519 | |
| 54 |
끝없는도전
|
17년 전 | 1744 | |
| 53 | 17년 전 | 2337 | ||
| 52 | 17년 전 | 2201 | ||
| 51 | 17년 전 | 1860 | ||
| 50 | 17년 전 | 1462 | ||
| 49 | 17년 전 | 1725 | ||
| 48 |
stuartkim
|
17년 전 | 1527 | |
| 47 | 17년 전 | 1693 | ||
| 46 | 17년 전 | 1850 | ||
| 45 | 17년 전 | 1819 | ||
| 44 | 17년 전 | 1809 | ||
| 43 | 17년 전 | 1842 | ||
| 42 |
|
17년 전 | 1864 | |
| 41 | 17년 전 | 1815 | ||
| 40 |
보드타는찌니
|
17년 전 | 1698 | |
| 39 | 17년 전 | 2206 | ||
| 38 |
|
17년 전 | 1691 | |
| 37 | 17년 전 | 2204 | ||
| 36 |
|
17년 전 | 1598 | |
| 35 |
은사시나무
|
17년 전 | 1578 | |
| 34 | 17년 전 | 2103 | ||
| 33 | 17년 전 | 1832 | ||
| 32 | 17년 전 | 1630 | ||
| 31 | 17년 전 | 2787 |
댓글 작성
댓글을 작성하시려면 로그인이 필요합니다.
로그인하기