Notice
Recent Posts
Recent Comments
Link
일 | 월 | 화 | 수 | 목 | 금 | 토 |
---|---|---|---|---|---|---|
1 | 2 | 3 | 4 | |||
5 | 6 | 7 | 8 | 9 | 10 | 11 |
12 | 13 | 14 | 15 | 16 | 17 | 18 |
19 | 20 | 21 | 22 | 23 | 24 | 25 |
26 | 27 | 28 | 29 | 30 | 31 |
Tags
- 데이터엔지니어링
- spark
- 개발자혜성
- 빅데이터
- Python
- eks
- apache spark
- 개발자
- kubernetes
- kafka
- AWS SageMaker
- 추천시스템
- DataEngineering
- 데이터엔지니어
- BigData
- 클라우데라
- dataengineer
- 하둡
- mlops
- 블로그
- Data engineering
- redis bloom filter
- 빅데이터플랫폼
- hadoop
- 하둡에코시스템
- recommendation system
- Spark structured streaming
- Terraform
- cloudera
- pyspark
Archives
- Today
- Total
목록Data Pipeline (1)
Hyesung Oh
Bloom Filter 를 사용해봅시다 [2] Redis Bloom Filter feat. 추천시스템
TL;DR지난 포스팅에서는 Bloom Filter 소개와 Pyspark Integration에 대해서 소개했습니다.https://surgach.tistory.com/140 Bloom Filter 를 사용해봅시다 [1] python, pyspark bloom filter 구현TL;DR개발자가 작성하는 많은 비즈니스로직에는 특정 조건, 집단에 해당하는 item, user만 포함 or 제외하는 형태가 많은 부분을 차지합니다. 특히 데이터 엔지니어의 경우 통계 마트 테이블을 만들surgach.tistory.comBloom Filter는 다양한 활용처가 있겠지만, 그중에서도 추천 시스템에 활용할 수 있습니다. Redis-stack에서는 Bloom Filter를 제공하는데요, 추천 결과를 유저에게 제공할 때, 유저..
Data Engineering/MLOps
2024. 6. 17. 21:09