BigQuery를 이용한 데이터 처리 프로세스 – ETL
ETL은 데이터를 추출(E), 변환(T), 적재(L) 순으로 데이터를 처리하는 프로세스입니다. ELT는 데이터를 추출(E), 로드(L) 및 변환(T)을 하는 프로세스를 의미하며, 위에 언급한 ETL의 T와 L의 위치가 바뀐 개념으로 생각하시면 됩니다.
ETL은 데이터를 추출(E), 변환(T), 적재(L) 순으로 데이터를 처리하는 프로세스입니다. ELT는 데이터를 추출(E), 로드(L) 및 변환(T)을 하는 프로세스를 의미하며, 위에 언급한 ETL의 T와 L의 위치가 바뀐 개념으로 생각하시면 됩니다.
세그먼트 설정을 완료하면 타깃 오디언스(Target Audience)를 생성하게 됩니다. 오디언스(Audience) 란? 온라인 마케팅에서는 고객 및 잠재적 고객으로서 마케팅 메시지를 듣게 될 특정 대상들을 뜻합니다. 마케팅 실행의 대상이고 템플릿에 의한 결과물로 볼 수 있습니다.
빅쿼리에서 정제 테이블을 생성하는데 정제 테이블에서 바로 조회하지 않고 엘라스틱서치 서버에 데이터를 옮겨서 사용하는 이유에 대해서 질문을 가지실 수 있습니다. 엘라스틱서치에 데이터를 저장하는 가장 큰 이유는 “비용”과 “검색 속도”가 있습니다.
사용자가 사용할만한 세그먼트를 미리 정의하여 ‘트레이트’ 라는 이름으로 분류하고 생성해야, 이후 세그먼트 생성 시 간편하게 사용할 수 있습니다. user, land(페이지 이동간 정보), event(특정 전환) 와 같은 원천 데이터에서 트레이트를 가공 및 생성하여 사용합니다.
데이터들은 원천 데이터의 생산 주체가 누구인가에 따라 자사/1사(1st party) 데이터와 3사(3rd party) 데이터로 나눕니다. 3사 데이터를 획득하는 방법 중 하나인 크롤링에 대해 알아보고, 자동화 툴 인 selenium을 이용한 크롤러를 만드는 예제를 알려드리겠습니다.
UTM으로 유입된 딥링크(Deep Link) 성과 분석에 대해 공유하고자 합니다. 딥링크는 특정 주소 혹은 값을 입력하면 앱이 실행되거나 특정 화면으로 이동시키는 기능을 수행합니다. 즉, 딥링크가 사용되면 광고에 반응한 이용자는 앱이 바로 실행되어 특정 화면으로 바로 이동하게 됩니다.
AIR에서 제공하는 수많은 리포트들은 어떤 과정으로 화면에 그려지고 있는지 궁금하지 않으신가요? AIR의 신속한 리포팅이 가능한 이유는 바로 Elasticsearch로 데이터를 빠르게 검색 및 집계하기 때문입니다. Elasticsearch를 사용하여 진행하는 과정에 대해 알아봅시다.
세그먼틀릿 입력 값은 크게 2가지 종류로 분류하고 있습니다. 숫자형 데이터는 숫자형 데이터를 입력 받아 조건에 사용합니다. 또한, 연산자, 범위식 사용이 가능합니다. 문자형 데이터는 문자형 데이터를 입력 혹은 선택하여 조건에 사용하고, 연산자 사용이 가능합니다.
실시간으로 수집된 데이터를 확인할 수 있게 해주는 파이프 라인 도구 “Logstash”에 대해 알아보겠습니다. 그 전에 먼저 ELK에 대해 정리하겠습니다. ELK는 Elasticsearch, Logstash 및 Kibana 의 오픈 소스 프로젝트의 앞 글자를 가져와 만든 단어입니다.
비즈스프링에서 보유하고 있는 AI 기술을 요약 콘텐츠입니다. 비즈스프링은 산학협력을 통한 AI기술 개발 및 상용화를 위해, 한양대학교 및 고려대학교의 산학협력 가족기업으로 참여하여, AI 전문 분야에 대한 원천기술을 확보하려 노력하고 있습니다.