DREAMLABS INFORMATION POST

[시즌 3] 온갖 크롤링 코드 안녕~ 공개된 페이지를 모두 긁어버리는 Insane-search(thanks to 지피타쿠)

Insane-search는 한국 개발자가 만든 Claude Code용 웹 데이터 접근 플러그인입니다. (메타데이터 기반 추론)

AI 엔지니어링 AI 제품/도구 크리에이티브/콘텐츠
기존 게시물의 제목, 요약, 본문 키워드 기반 재분류
[시즌 3] 온갖 크롤링 코드 안녕~ 공개된 페이지를 모두 긁어버리는 Insane-search(thanks to 지피타쿠) thumbnail
SOURCE VIDEO

[시즌 3] 온갖 크롤링 코드 안녕~ 공개된 페이지를 모두 긁어버리는 Insane-search(thanks to 지피타쿠)

편집자P

video_id: vjSZIyYd0NI published: 2026-06-24T15:23:07Z playlist: PLHwM6idVO2zyqi2IZeDAiP5QBqRXd2Zyh
YouTube 원본 보기

DreamLabs 기술 브리핑: Insane-search - AI 에이전트의 웹 데이터 접근성 혁신

핵심 요약

Insane-search는 한국 개발자가 Claude Code용으로 개발한 플러그인으로, AI 에이전트가 쿠팡, 네이버, 유튜브 등 일반적인 웹 크롤링을 차단하는 사이트의 공개 데이터를 합법적으로 수집할 수 있도록 돕습니다. 이 도구는 “브라우저로 볼 수 있는 공개 페이지라면 에이전트도 볼 수 있어야 한다”는 철학을 기반으로 하며, 로그인이나 유료 콘텐츠 우회 없이 합법적인 방법을 단계적으로 시도하여 데이터를 가져옵니다. 영상에서는 Insane-search의 설치부터 유튜브 자막, 네이버 쇼핑 상품 데이터, 알리익스프레스 상품 정보 추출 실습까지 다루며, 봇 탐지를 우회하여 사이트 내부 API 호출을 통해 데이터를 수집하는 고급 기능도 시연합니다. 이는 마케터의 가격 비교나 업무 자동화 등 다양한 분야에서 활용될 수 있는 잠재력을 보여줍니다. (모든 내용은 YouTube 영상 메타데이터 기반으로 추론되었습니다.)

주요 내용

  • AI 에이전트의 웹 데이터 접근성 문제 해결: 주요 웹사이트의 에이전트 차단 문제를 극복하는 솔루션입니다.
  • “공개 페이지 접근” 철학: 브라우저로 접근 가능한 모든 공개 정보는 에이전트도 접근할 수 있어야 한다는 원칙을 따릅니다.
  • 합법적이고 윤리적인 데이터 수집: 로그인, 유료 콘텐츠 우회 없이 공개된 정보만을 대상으로 합니다.
  • 봇 탐지 우회 기술: 단순 크롤링이 막힐 경우, 사이트의 내부 API 호출을 찾아 공식적인 데이터 경로를 통해 수집합니다.
  • 다양한 실용적 활용 사례: 유튜브 자막 추출, 네이버 쇼핑 상품 데이터 수집 등 마케팅 및 리서치에 유용한 기능을 제공합니다.
  • Claude Code 플러그인 생태계 확장: AI 코딩 환경 내에서 웹 데이터 수집 기능을 강화합니다.
  • 한국 개발자의 오픈소스 기여: 국내 개발자가 주도한 프로젝트로, AI 도구 생태계에 기여합니다. (메타데이터 기반 추론)

DreamLabs 적용 가능성

  • 시장 및 경쟁사 분석 자동화: 네이버 쇼핑, 알리익스프레스 등 이커머스 플랫폼에서 특정 상품의 가격, 리뷰, 트렌드 데이터를 자동으로 수집하여 시장 분석 및 경쟁사 모니터링에 활용할 수 있습니다.
  • 콘텐츠 리서치 및 분석 강화: 유튜브 영상의 자막 및 메타데이터를 대량으로 추출하여 특정 주제의 트렌드 분석, 키워드 연구, 또는 내부 콘텐츠 제작을 위한 자료 수집에 활용할 수 있습니다.
  • AI 에이전트의 정보 수집 능력 확장: DreamLabs 내부에서 개발 중인 AI 에이전트나 챗봇이 웹상의 최신 공개 정보를 더 폭넓게 탐색하고 요약하는 기능을 구현하는 데 기여할 수 있습니다.
  • 데이터 기반 의사결정 지원: 다양한 웹 소스에서 수집된 정형/비정형 데이터를 통합하여 DreamLabs의 비즈니스 및 기술 전략 수립에 필요한 인사이트를 도출하는 데 활용할 수 있습니다.
  • 내부 자동화 도구 개발: 반복적인 웹 기반 데이터 수집 작업을 자동화하여 연구원 및 개발자의 수동 작업을 줄이고 핵심 업무에 집중할 수 있도록 지원합니다.

확인 필요 사항

  • 실제 데이터 수집 성공률 및 안정성: 영상에서 시연된 유튜브, 네이버 쇼핑, 알리익스프레스 외 다른 사이트에서의 실제 데이터 수집 성공률과 장기적인 안정성을 검증해야 합니다.
  • 서비스 약관 준수 여부: Insane-search가 “합법적”이라고 주장하지만, 특정 웹사이트의 서비스 약관(ToS)에 따라 데이터 수집이 허용되는지 개별적으로 확인하고 법적 리스크를 평가해야 합니다.
  • 성능 및 확장성 테스트: 대량의 데이터를 수집하거나 빈번하게 업데이트되는 정보를 모니터링할 때의 성능 저하 여부 및 확장성을 테스트해야 합니다.
  • 봇 탐지 우회 방식의 지속 가능성: 내부 API 호출을 통한 우회 방식이 웹사이트 업데이트에 얼마나 강건하며, 지속적으로 유지 보수될 수 있는지 확인이 필요합니다.
  • Claude Code 환경 외 호환성: DreamLabs의 주력 AI 개발 환경이 Claude Code가 아닐 경우, 다른 환경에서의 통합 가능성 및 추가 개발 필요성을 검토해야 합니다.
  • 오픈소스 프로젝트의 활성화 및 지원: 해당 프로젝트의 커뮤니티 활성화 정도, 버그 수정 및 기능 업데이트 주기 등 지속적인 지원 여부를 파악해야 합니다.

원본 링크

핵심 포인트

  • Insane-search는 한국 개발자가 만든 Claude Code용 웹 데이터 접근 플러그인입니다. (메타데이터 기반 추론)
  • “브라우저로 볼 수 있는 공개 페이지는 에이전트도 볼 수 있어야 한다”는 철학을 가집니다.
  • 로그인, 유료 콘텐츠 우회 없이 합법적인 방법으로 공개 데이터만 수집합니다.
  • 유튜브, 네이버, 쿠팡, Reddit, 알리익스프레스 등 다양한 웹사이트를 지원합니다.
  • 유튜브 자막/메타데이터 추출, 네이버 쇼핑 상품 데이터 수집, 알리익스프레스 상품 정보 수집 실습을 시연합니다.
  • 봇 탐지를 우회하기 위해 사이트 내부 API 호출을 찾아 데이터를 가져오는 방식을 사용합니다.
  • 마케팅, 가격 비교, 업무 자동화 등 다양한 분야에서 데이터 수집을 자동화할 수 있습니다.

영상 구조

  • Insane Search 소개 및 핵심 철학 (0:00 - 1:10)
  • Claude Code 플러그인 설치 과정 (3:39 - 6:25)
  • 유튜브 자막 및 네이버 쇼핑 데이터 추출 실습 (6:58 - 8:15)
  • 알리익스프레스 데이터 수집 시도 및 봇 탐지 우회 원리 (12:08 - 13:33)
  • 실습 결과 확인 및 Insane Search의 활용 방안 (15:46 - 17:18)

DreamLabs 적용

  • 시장 및 경쟁사 분석 자동화: 네이버 쇼핑, 알리익스프레스 등 이커머스 플랫폼에서 특정 상품의 가격, 리뷰, 트렌드 데이터를 자동으로 수집하여 시장 분석 및 경쟁사 모니터링에 활용할 수 있습니다.
  • 콘텐츠 리서치 및 분석 강화: 유튜브 영상의 자막 및 메타데이터를 대량으로 추출하여 특정 주제의 트렌드 분석, 키워드 연구, 또는 내부 콘텐츠 제작을 위한 자료 수집에 활용할 수 있습니다.
  • AI 에이전트의 정보 수집 능력 확장: DreamLabs 내부에서 개발 중인 AI 에이전트나 챗봇이 웹상의 최신 공개 정보를 더 폭넓게 탐색하고 요약하는 기능을 구현하는 데 기여할 수 있습니다.
  • 데이터 기반 의사결정 지원: 다양한 웹 소스에서 수집된 정형/비정형 데이터를 통합하여 DreamLabs의 비즈니스 및 기술 전략 수립에 필요한 인사이트를 도출하는 데 활용할 수 있습니다.
  • 내부 자동화 도구 개발: 반복적인 웹 기반 데이터 수집 작업을 자동화하여 연구원 및 개발자의 수동 작업을 줄이고 핵심 업무에 집중할 수 있도록 지원합니다.

확인 필요

  • 실제 데이터 수집 성공률 및 안정성: 영상에서 시연된 유튜브, 네이버 쇼핑, 알리익스프레스 외 다른 사이트에서의 실제 데이터 수집 성공률과 장기적인 안정성을 검증해야 합니다.
  • 서비스 약관 준수 여부: Insane-search가 “합법적”이라고 주장하지만, 특정 웹사이트의 서비스 약관(ToS)에 따라 데이터 수집이 허용되는지 개별적으로 확인하고 법적 리스크를 평가해야 합니다.
  • 성능 및 확장성 테스트: 대량의 데이터를 수집하거나 빈번하게 업데이트되는 정보를 모니터링할 때의 성능 저하 여부 및 확장성을 테스트해야 합니다.
  • 봇 탐지 우회 방식의 지속 가능성: 내부 API 호출을 통한 우회 방식이 웹사이트 업데이트에 얼마나 강건하며, 지속적으로 유지 보수될 수 있는지 확인이 필요합니다.
  • Claude Code 환경 외 호환성: DreamLabs의 주력 AI 개발 환경이 Claude Code가 아닐 경우, 다른 환경에서의 통합 가능성 및 추가 개발 필요성을 검토해야 합니다.
  • 오픈소스 프로젝트의 활성화 및 지원: 해당 프로젝트의 커뮤니티 활성화 정도, 버그 수정 및 기능 업데이트 주기 등 지속적인 지원 여부를 파악해야 합니다.

원본