KT 에이블스쿨 : 딥러닝 심화 4일차 - PandasAI, ChatGPT 파인튜닝, 언어모델링(NLP), 허깅페이스
딥러닝 심화 24.04.19 (금) 어느새 딥러닝 마지막날 ,, ㅠ ChatGPT - PandasAI를 실습할 유통 판매데이터 거의 모든 비즈니스는 아래의 3가지 데이터셋으로 이뤄짐 제화 : 회사가 제공하는 기업 데이터 (상품 마스터데이터 ) 고객 : 고객에 의해 생기는 고객 데이터 (고객 마스터데이터 ) 트랜젝션 데이터 (transaction) : 고객과 회사의 상호작용으로 인해 생긴 데이터 ex) 제화 = 금융상품 / 요금제+스마트폰 고객 = 가입, 구매 트랜젝션 = 구매이력 ChatGPT - 파인튜닝 ChatGPT를 파인튜닝해서 서비스로 만든 것이 많음 = OpenAI의 마켓플레이스 그중 데이터분석에 특화된 서비스가 Data Analytics 임 Data Analytics 데이터셋 엑셀파일을 올리면서, 질문하면 그래프 시각화, 상관관계 분석을 해줌 게다가 비즈니스 관점에서 해석해서 알려줌 질문이 구체적일수록 상세하게 답변해줌 = 데이터분석 상세 방법을 알아야함 자연어처리 NLP 자연어처리할때 !! 맥락 !!을 이해 하는게 중요함 context ~~~!!! 단순 text가 아니라, context가 중요 기존의 NLP 는 RNN 기반 오랫동안 언어모델을 위한 주요한 접근 방식 단점 : 병렬처리 어려움, 장기 의존성 문제, 확장성 제한 언어모델이 전체적인 맥락을 파악하는게 어려웠음 Transformer : 자연어처리는 이게 최고 (현재) 구글이 2017년에 만듬 (오픈AI가 2018년부터 시작) ...