전체 글 (510) 썸네일형 리스트형 Raschka Ch 1. Giving Computers the Ability to Learn from Data Python Machine Learning (2019, 3rd ed., Sebastian Raschka, Vahid Mirjalili) Chapter 1 Giving Computers the Ability to Learn from Data Overview 1.1 Building intelligent machines to transform data into knowledge 1.2 The three different types of machine learning 1.2.1 Making predictions about the future with supervised learning Classification for predicting class labels Regression for predicting co.. 영문 데이터에 대한 텍스트 마이닝 - 2 with 캐글 영화 리뷰 데이터 Movie Review And Rating https://www.kaggle.com/newra008/movie-review-and-rating Movie Review And Rating Movies review from year 2016-2022 www.kaggle.com 전 포스팅에서 빈도분석, 비교분석을 통해 데이터의 특징을 파악하는 기초분석을 실시하였다. https://normalpdf.tistory.com/16 영문 데이터에 대한 텍스트 마이닝 - 1 with 캐글 영화 리뷰 데이터 이번 포스팅에서는 빈도 / 비교 분석에 대하여 다룰 예정입니다. 이후 포스팅에서 감정분석도 진행하니 참고해주세요. 빈도분석 , 비교분석 Spider , Matrix , Snowden 범주 별 최다 빈도 수 단어 분석 .. 영문 데이터에 대한 텍스트 마이닝 - 1 with 캐글 영화 리뷰 데이터 이번 포스팅에서는 빈도 / 비교 분석에 대하여 다룰 예정입니다. 이후 포스팅에서 감정분석도 진행하니 참고해주세요. 빈도분석 , 비교분석 Spider , Matrix , Snowden 범주 별 최다 빈도 수 단어 분석 로그 오즈비로 Spider , Matrix 두 집단 비교 tf-idf로 세 집단 비교 Movie Review And Rating https://www.kaggle.com/newra008/movie-review-and-rating Movie Review And Rating Movies review from year 2016-2022 www.kaggle.com ID : Id provided for each movie review Movie : Name of the movie Year : The .. Tackling Toxic Using Keras 데이터 Identify and classify toxic online comments Introduction: 인터넷을 통해 익명의 사람들은 때때로 사람들이 보통 실제 삶에서는 없을 끔찍한 것을 말하게 한다. 이번에 우리의 플랫폼의 한 댓글에서 증오를 없애보자. → 악성 댓글에 대하여 분류하는 문제 같음 This notebook attempts to tackle this classification problem by using Keras LSTM. While there are many notebook out there that are already tackling using this approach, I feel that there isn't enough explanation to what is going on.. KoNLP 패키지 설치 문제 해결 https://normalpdf.tistory.com/4 위 글에 있는 KoNLP 패키지 설치 코드로 작성했는데도 오류가 난다면 참고하세요. > remotes::install_github("haven-jeon/KoNLP", + upgrade = "never", + INSTALL_opts = c("--no-multiarch")) 저같은 경우는 R library 가 여러 개여서 해당코드 실행시 계속 오류가 발생했습니다. C:/program files/ R / R-4.1.2 / library 폴더에 packages 가 다운로드되고 있어야 하는데 라이브러리가 program files 말고도 documents / R / library가 하나 더 존재했고 여기안에서도 패키지가 다운로드 되고있어 오류가 난 것 같습니.. 04. 감정분석 - 실습 "news_comment_BTS_csv" 2020년 9월 21일 방탄소년단이 '빌보드 핫 100 차트' 1위에 오른 소식을 다룬 기사에 달린 댓글 Q1. "news_comment_BTS_csv" 를 불러온 다음 행 번호를 나타낸 변수를 추가하고 분석에 적합하게 전처리 하기 Q2. 댓글을 띄어쓰기 기준으로 토큰화하고 감정 사전을 이용해 댓글의 감정 점수 구하기 Q3. 감정 범주별 빈도를 나타낸 막대그래프 만들기 Q4. 댓글을 띄어쓰기 기준으로 토큰화한 다음 감정 범주별 단어 빈도 구하기 Q5. 로그 오즈비를 이용해 긍정 댓글과 부정 댓글에 상대적으로 자주 사용된 단어 10개씩 추출하기 Q6. 긍정 댓글과 부정 댓글에 상대적으로 자주 사용된 단어를 나타낸 막대그래프 만들기 Q7. 'Q3' 에서 만든 데이터를.. 04. 감정분석 04-1. 감정 사전 활용하기 04-2. 댓글 감정 분석하기 04-3. 감정 범주별 주요 단어 살펴보기 04-4. 감정 사전 수정하기 04-1. 감정 사전 활용하기 감정 분석을 할 때는 '감정 사전'을 활용한다. 감정 사전은 감정을 나타낸 단어와 감정의 단어를 표현한 숫자로 구성된다. 감정 사전을 이용해서 문장의 단어에 감정 점수를 부여한 다음 합산하면 문장이 어떤 감정을 표현하는지 파악할 수 있다. 감정 사전 살펴보기 군산대학교 소프트웨어융합공학과에서 만든 'KNU 한국어 감성사전' 을 이용해 감정분석을 하는 방법을 알아보겠다. 우선, 감정 사전을 불러와 구조를 살펴보겠다. → 감정 사전은 'knu_sentiment_lexicon.csv' csv 파일을 이용하여 불러온다. 감정 사전은 다음과 같은 wo.. New York City Taxi Trip Duration 데이터 뉴욕시의 총 택시 운행 기간 예측 In this competition, Kaggle is challenging you to build a model that predicts the total ride duration of taxi trips in New York City. Your primary dataset is one released by the NYC Taxi and Limousine Commission, which includes pickup time, geo-coordinates, number of passengers, and several other variables. id - a unique identifier for each trip vendor_id - a code indicating t.. 이전 1 ··· 60 61 62 63 64 다음