한국어 욕설 데이터
조준희님이 수집하여 라벨링한 한국어 욕설 데이터 세트를 공유합니다. 여러 커뮤니티에서 수집된 것으로서, 실세계 데이터에 대한 평가용으로 적합한 것 같습니다. 아래는 데이터 세트에 대한 설명입니다: Data Description 문장의 욕설 여부를 분류한…
조준희님이 수집하여 라벨링한 한국어 욕설 데이터 세트를 공유합니다. 여러 커뮤니티에서 수집된 것으로서, 실세계 데이터에 대한 평가용으로 적합한 것 같습니다. 아래는 데이터 세트에 대한 설명입니다: Data Description 문장의 욕설 여부를 분류한…
BERT로 대표되는 딥러닝 기반의 대규모 언어 모델은 Q&A, 문서 요약, 문서 생성, 대화 등 자연어 관련한 다양한 task에서 뛰어난 성능을 보이고 있으며 특히 최근 등장한 GPT-3의 경우 인공 일반 지능(AGI)에…
Gather Town은 Zoom이나 Teams와 같은 화상미팅 솔루션의 일종이지만, 가상 공간과 아바타를 적극적으로 도입한 것이 특징입니다. 예를 들어 “Office”라는 가상 공간을 만들고, 각 참여자들은 고유한 아바타와 가상 공간 내 “자리”를 부여받습니다.…
주어진 질문에 대해 적합한 답변을 생성하는 QA Task는 최근 딥러닝 기술로 인해 많은 성능 향상이 이루어져 왔습니다. 잘 알려진 SQuAD도 이런 Task 중 하나입니다. 그런데, 각 Task 별로 모델이 학습되다보니…
흔히 Q&A task라고 부르는 문제는 질문과 대답을 pair로 기록한 데이터 세트로부터 학습하여 질문을 던졌을 때 적절한 대답이 나오도록 하는 것을 목표로 합니다. 챗봇을 생각하면 되는데, question generation은 이와는 달리 문단을…
포커는 반이 심리전이라고 해도 과언이 아닐 만큼 바둑이나 체스와는 또 다른 게임입니다. 이번에 페이스북이 공개한 ReBeL은 이런 점에서 주목할 만하다고 생각합니다. 특히, 강화학습과 검색을 함께 사용한 것이 특징인데, RAG와 같이…
MindMeld는 서비스 가능한 수준의 품질 확보를 목적으로 만들어진 오픈소스 대화형 AI 플랫폼입니다. Python으로 작성되어 있으며 최신 NLP 기술 및 지식 기반 Q&A 엔진을 포함하고 있습니다. 다음은 MindMeld 플랫폼의 대략적 아키텍처입니다:…
디비전2는 매시브 엔터테인먼트가 개발하고 유비소프트가 퍼블리싱한 온라인 액션 RPG로서 천연두가 유행하는 워싱턴 DC를 배경으로 하고 있습니다. 게이머는 정부 요원과 함께 도시를 새로 세우는 역할을 맡아 수행하게 됩니다. 매시브 엔터테인먼트의 수석…
아바타는 AI 기술이 등장하기 오래 전 부터 SNS, 고객 응대, 게임 내 캐릭터 표현 등 여러 가지 형태로 활용되어 왔습니다. 관련한 그래픽 기술의 발전에 힘 입어, 다양한 시도들이 이루어져 왔는데,…