키워드 필터링
키워드를 분리해내며 검사해내는 과정 입니다. ㅎㅎㅎㅎㅎㅎㅎ
왼쪽은 분리해내는 과정.
가운데의 A는 분리한 키워드, B는 필터된 키워드
오른쪽은 가운데와 마찬가지로 다른 키워드로 검사한 것

왼쪽은 분리해내는 과정.
가운데의 A는 분리한 키워드, B는 필터된 키워드
오른쪽은 가운데와 마찬가지로 다른 키워드로 검사한 것

댓글 4개
15년 전
저만 어렵나요? 짱돌 굴려봐도 모르겠습니다!
15년 전
키워드를 분리해내는 쪽을 잘 모르겠어요. 전 그냥 DAUM API 사용하는 것으로 ㅎㅎ;
15년 전
앞에서부터 분리하고, 뒤에서부터 분리하고
두글짜부터 분리하고, 세글짜부터 분리하고, 네글짜부터 분리하고
두글자씩 첫번째부터 분리하고, 두글자씩 두번째부터 분리하고, 두글자씩 세번째부터 분리하고
세글자씩 첫번째부터 분리하고, 세글자씩 두번째부터 분리하고...
총 바이트를 구해서 계속 분리하면서 필터에 있는 단어와 검사를 하는거죠!
두글짜부터 분리하고, 세글짜부터 분리하고, 네글짜부터 분리하고
두글자씩 첫번째부터 분리하고, 두글자씩 두번째부터 분리하고, 두글자씩 세번째부터 분리하고
세글자씩 첫번째부터 분리하고, 세글자씩 두번째부터 분리하고...
총 바이트를 구해서 계속 분리하면서 필터에 있는 단어와 검사를 하는거죠!
15년 전
이런건 형태소 분석기로 하는게 정신건강에 좋습니다.
"대학생선교회"
잘못 추출하면, 대학 + 생선 + 교회 가 나옵니다.
http://nlp.kookmin.ac.kr/HAM/kor/ham-intr.html 전 주로 이분껄 사용합니다만, 상업용으로 공개하신게 아니라서..
http://cs.sungshin.ac.kr/~shim/demo/mach.html 이건 공개용 버전인듯
"대학생선교회"
잘못 추출하면, 대학 + 생선 + 교회 가 나옵니다.
http://nlp.kookmin.ac.kr/HAM/kor/ham-intr.html 전 주로 이분껄 사용합니다만, 상업용으로 공개하신게 아니라서..
http://cs.sungshin.ac.kr/~shim/demo/mach.html 이건 공개용 버전인듯
게시판 목록
토크
개발과 관련된 어떤 얘기도 괜찮습니다.
| 번호 | 제목 | 글쓴이 | 날짜 | 조회 |
|---|---|---|---|---|
| 331 |
|
15년 전 | 1084 | |
| 330 | 15년 전 | 1547 | ||
| 329 | 15년 전 | 1132 | ||
| 328 | 15년 전 | 1231 | ||
| 327 | 15년 전 | 1757 | ||
| 326 | 15년 전 | 2316 | ||
| 325 |
|
15년 전 | 1397 | |
| 324 | 15년 전 | 1181 | ||
| 323 | 15년 전 | 1102 | ||
| 322 | 15년 전 | 1271 | ||
| 321 | 15년 전 | 1383 | ||
| 320 | 15년 전 | 1089 | ||
| 319 | 15년 전 | 1620 | ||
| 318 |
terrorboys
|
15년 전 | 1341 | |
| 317 | 15년 전 | 1674 | ||
| 316 | 15년 전 | 1172 | ||
| 315 | 15년 전 | 1949 | ||
| 314 | 15년 전 | 1518 | ||
| 313 | 15년 전 | 1173 | ||
| 312 | 15년 전 | 1174 | ||
| 311 | 15년 전 | 1288 | ||
| 310 | 15년 전 | 1550 | ||
| 309 | 15년 전 | 1116 | ||
| 308 | 15년 전 | 1116 | ||
| 307 | 15년 전 | 1035 | ||
| 306 | 15년 전 | 1747 | ||
| 305 | 15년 전 | 2364 | ||
| 304 | 15년 전 | 1319 | ||
| 303 | 15년 전 | 1872 | ||
| 302 | 15년 전 | 1650 |
댓글 작성
댓글을 작성하시려면 로그인이 필요합니다.
로그인하기