콘텐츠 추출
어떤 URL에서든 콘텐츠를 추출하고 파싱합니다 — 기사, 영상, 트윗, PDF 등. 요약과 길이 제한은 선택 사항입니다.
어떤 URL에서든 구조화된 콘텐츠를 추출합니다. 기사, YouTube 영상, 트윗, 위챗 공식 계정 글, PDF 등을 지원합니다. 단독으로 써도 되고, 다른 skill의 전처리 단계로 써도 됩니다.
트리거
/content-parser로 이 skill을 호출하거나, 다음 문구 중 아무거나 사용하세요:
| 문구 | 언어 |
|---|---|
parse this URL / parse this | 영어 |
extract content / extract from | 영어 |
解析链接 | 중국어 |
提取内容 | 중국어 |
ListenHub Skills가 설치되어 있어야 합니다 — 시작하기를 참고하세요.
빠른 예시
Parse this article: https://en.wikipedia.org/wiki/TopologyAI가 콘텐츠를 추출하고 미리보기를 반환한 뒤, 저장하거나 다른 skill에서 사용할지 물어봅니다.
지원하는 소스
| 플랫폼 | URL 패턴 | 콘텐츠 유형 |
|---|---|---|
| YouTube | youtube.com/watch?v=, youtu.be/ | 영상 자막 |
| Bilibili | bilibili.com/video/ | 영상 자막 |
| Twitter/X | twitter.com/, x.com/ | 트윗(프로필 또는 단일 트윗) |
mp.weixin.qq.com/s/ | 공식 계정 글 | |
.pdf 직접 URL | 문서 텍스트 | |
| DOCX | .docx 직접 URL | 문서 텍스트 |
| 이미지 | 이미지 직접 URL | OCR / 설명 |
| 모든 웹페이지 | 모든 HTTP(S) URL | 기사 본문 |
추출 옵션
모든 옵션은 선택 사항입니다. 지정하지 않으면 Content Parser가 기본 제한값으로 기사 전문을 추출합니다. AI가 추출 전에 옵션을 설정할지 물어보며, 요청에 직접 적어도 됩니다("요약해 줘", "최신 트윗 50개 가져와").
| 파라미터 | 설명 | 기본값 |
|---|---|---|
summarize | 전문 대신 생성된 요약을 반환 | false |
maxLength | 최대 콘텐츠 길이(문자 수) | 100,000(최대 500,000) |
twitter.count | 가져올 트윗 수 — Twitter/X 프로필 전용 | 20(최대 100) |
Summarize — 문서 전체가 아니라 요지만 필요할 때 켜세요. 긴 기사나 영상을 다른 skill에 넘길 때 유용합니다. 켜면 응답이 전체 content 대신 요약을 담아 옵니다.
Max length — 반환하고 과금하는 텍스트 양의 상한입니다. 아주 긴 페이지를 잘라내려면 낮추세요. 기본값 100,000자면 대부분의 기사를 담을 수 있고, 최대 500,000까지 올릴 수 있습니다.
플랫폼별 처리 — 추출 방식은 소스에 맞춰 자동으로 달라집니다:
- YouTube / Bilibili — 페이지 껍데기가 아니라 영상 자막을 가져옵니다.
- Twitter/X — 단일 트윗 URL은 그 트윗을, 프로필 URL은 최신 트윗들을 반환하며
twitter.count로 개수를 조절합니다(기본 20, 최대 100). - PDF / DOCX — 파일 직접 URL에서 문서 텍스트를 추출합니다.
- 이미지 — 이미지 직접 URL에 대해 OCR 텍스트나 설명을 반환합니다.
자주 쓰는 사용 사례
단독 추출
Extract the content from this YouTube video: https://youtube.com/watch?v=...긴 기사 요약하기
Parse this report and just give me a summary: https://example.com/2026-outlook프로필에서 트윗 가져오기
Extract the latest 50 tweets from https://x.com/elonmusk추출 + 생성
같은 대화 안에서 다른 skill과 조합하세요:
Parse this article and turn it into a podcast: https://example.com/articleExtract this YouTube video and make an explainer video from it더 많은 워크플로 예시는 Skill 조합하기 가이드를 참고하세요.
출력
추출이 끝나면 AI는 다음과 같은 구조화된 데이터를 받습니다:
- content — 추출된 전체 텍스트,
maxLength까지(기본 100,000자) - metadata — 제목, 저자, 게시일 등 페이지 메타데이터
- references — 콘텐츠에서 참조된 URL
- summary —
summarize를 켰을 때content대신 반환됨
기본적으로 AI는 추출된 제목을 따서 현재 작업 디렉터리에 파일 두 개를 저장합니다:
{slug}.md— 추출된 콘텐츠를 Markdown으로 담은 파일, 바로 읽거나 편집 가능{slug}.json— 메타데이터, 참조, 크레딧을 포함한 원본 API 응답 전체
그런 다음 콘텐츠 앞부분 미리보기를 보여 주고, /podcast이나 /tts 같은 다른 skill로 넘길지 물어봅니다.
제약
- 유료 결제가 걸린 콘텐츠는 접근하지 못할 수 있습니다
- JavaScript로 렌더링되는 콘텐츠는 일부만 추출될 수 있습니다
- 아주 긴 콘텐츠는
maxLength에서 잘릴 수 있습니다 - 일부 플랫폼은 자동화된 접근을 차단할 수 있습니다
크레딧
콘텐츠 추출은 추출된 콘텐츠 길이를 기준으로 과금됩니다:
| 규칙 | 상세 |
|---|---|
| 선차감 | 추출이 시작될 때 5 크레딧 예약 |
| 요율 | 100,000자당 100 크레딧, 실제 사용량이 5 미만이면 실제 사용량만 청구 |
| 기본 상한 | 100,000자(100 크레딧) |
| 최대 상한 | 500,000자(500 크레딧) |
| 실패 시 환불 | 실패하면 선차감된 크레딧 전액 환불 |
API 레퍼런스
기술적인 세부 사항은 콘텐츠 추출 API 레퍼런스를 참고하세요.