지금 머신러닝 공부를 하는데 결과가 이상하게 나와서 한번만 봐주실 수 있을까요??ㅠㅠ
나이브 베이즈 분류기로 댓글의 긍정 부정을 판별하려는데 클래스 불균형이 심각하면 그게 결과에 많이 영향을 미치나요?
만일 긍정과 부정이 9:1인 train데이터를 가지고 모델을 만들고 test데이터에 대해 prediction하는 경우에 컴퓨터는 무조건 긍정으로 판별하여
그 결과의 정확도가 test데이터의 부정label 갯수만큼 떨어지는것인지 궁금합니다.
제가 만든 데이터셋과 R script파일을 첨부합니다.. 제발 한번만 봐주세요ㅠㅠ
Comment 1
-
cardiomoon
2018.06.05 08:57
No. | Subject | Author | Date |
---|---|---|---|
1233 | 영수증 메일로 받을수 있을까요? [1] | 딸기공주 | 2023.09.13 |
1232 | 그래프 관련 문의드립니다. | nanak | 2023.09.14 |
1231 | 선형회귀분석 시 보정변수 사용 관련 질문드립니다. [2] | 전한울 | 2023.09.18 |
1230 | 안녕하세요 에러 관련 문의드립니다 [1] | 화이팅 | 2023.09.19 |
1229 | 정회원 확인 [2] | lionking | 2023.09.24 |
1228 | 영수증 발급을 부탁드립니다. [1] | 규빈어멈 | 2023.09.26 |
1227 | 정회원 가입 확인 요청드립니다. [1] | osman | 2023.10.03 |
1226 | PSM caliper default 값 관련 문의드립니다. [1] | Ooppps | 2023.10.05 |
1225 | forest plot 그림이 전체가 다 나오지 않습니다. [1] | joyguni | 2023.10.08 |
1224 | ggplot [1] | 통계린 | 2023.10.30 |
1223 | PSM 관련 질문드립니다. | dr. | 2023.11.05 |
1222 | semMediation 설치 재문의드립니다 [3] | 마술샘 | 2023.11.11 |
1221 | 4군의 psm 에 대해 문의드립니다 교수님. [2] | Alicehwang | 2024.01.04 |
1220 | autoReg를 이용한 logistic에러 [1] | pkjsdf123 | 2024.01.08 |
1219 | Disconnected from the server 문의 드립니다. [3] | Dr.Yu | 2024.01.19 |
1218 | PSM시 연속형변수로 변경 [1] | osman | 2024.01.24 |
1217 | 관찰 기간의 차이에 따른 생존분석 결과 해석 질문드립니다. | Tjan | 2024.02.13 |
1216 | Elastic net 여쭤봅니다. | 느릿거북 | 2024.02.15 |
1215 | 긴급하게 문의드립니다. | starwars | 2024.02.27 |
1214 | PSM 분석에서 Disconnected from server 발 | dsman | 2024.03.03 |
코드를 살펴보았는데 별 문제 없어보입니다.
그런데 질문을 이해 못하겠는데요. 전체 데이터의 긍정과 부정이 약 9:1인 데이터를 가지고 7:3으로 training set와 test set로 나누어 모델을 만들고 test데이터에 대해 prediction하는 경우에 약 9:1로 나올 것으로 예상됩니다. 코드의 결과도 약 9:1로 나오는데요?