프로젝트 배경
1) 예상 리스크 및 대응 계획 - 크롤링 대상 페이지 구조 변경 시 파서가 깨지는 리스크가 있으며, 선택자(selector) 추상화 계층으로 대응할 계획입니다 - 대량 크롤링 시 대상 서버에 부하를 주지 않도록 요청 간 딜레이와 동시성 제한을 설계할 필요가 있습니다 - 수집 콘텐츠의 저작권·법적 이슈를 고려해 원문 링크아웃 및 요약 노출 정책을 적용할 계획입니다 - 커뮤니티 활성화 초기 콜드스타트 문
프로젝트 성과
크롤링 중복 방지 파이프라인 설계
URL 해시 기반 중복 판별 로직과 PostgreSQL 유니크 제약을 결합해 동일 게시글 재수집을 차단하는 구조를 설계합니다
커뮤니티 피드 무한 스크롤 구조 구현
Intersection Observer 기반 무한 스크롤과 커서 페이지네이션을 적용해 대량 게시글을 효율적으로 노출하는 구조를 구현합니다
좋아요·댓글 실시간 반영 구조 설계
낙관적 UI 업데이트와 서버 검증을 결합해 좋아요·댓글 수치를 즉시 반영하는 상호작용 구조를 설계합니다
JWT 기반 인증 흐름 구축
Access/Refresh 토큰 이원화 및 재발급 미들웨어를 적용해 안전한 세션 유지 구조를 구축합니다
핵심 기능
진행 단계
크롤링 대상 분석 및 DB 스키마 설계
2026.07
수집 대상 페이지 구조 분석, PostgreSQL 게시글/회원/좋아요/댓글 테이블 12개 설계
프로젝트 상세
1) 포트폴리오 소개 외부 플랫폼에서 자동 수집한 콘텐츠와 회원이 직접 작성하는 게시글을 하나의 피드에 통합 노출하는 커뮤니티 서비스를 구현합니다. Python 기반 크롤링 엔진으로 초기 콘텐츠 볼륨을 확보하고, 20~30대 여성 이용자를 주 타깃으로 하는 라이프스타일 커뮤니티 경험을 React 기반 반응형 UI로 설계합니다. 2) 작업 범위 - 홈 피드: 회원이 접속하면 크롤링으로 수집된 외부 콘텐







