찾다
웹 프론트엔드JS 튜토리얼NodeJS의 URL 차단 모듈 사용 예 url-extract_기본 지식

지난번에 NodeJS PhantomJS를 사용하여 스크린샷을 찍는 방법을 소개했지만 각 스크린샷 작업마다 PhantomJS 프로세스가 활성화되어 있기 때문에 동시성이 높아지면 효율성이 걱정되므로 모든 코드를 다시 작성하여 독립적으로 만들었습니다. 쉽게 통화할 수 있습니다.
어떻게 개선할 수 있나요? 스레드 수와 단일 스레드에서 처리되는 URL 수를 제어합니다. 통신에는 표준 출력 및 WebSocket을 사용하십시오. 현재 Javascript 객체를 사용하는 캐싱 메커니즘을 추가합니다. 외부 세계에 대한 간단한 인터페이스를 제공합니다.

디자인

종속성 및 설치

PhantomJS 1.9.0부터 Websocket만 지원하기 시작했으므로 먼저 PATH의 PhantomJS 버전이 1.9.0 이상인지 확인해야 합니다. 명령줄에 다음을 입력하세요.

$ phantomjs -v

버전 번호 1.9.x가 반환될 수 있으면 작업을 계속할 수 있습니다. 버전이 너무 낮거나 오류가 발생하는 경우 PhantomJS 공식 홈페이지에 접속하여 최신 버전을 다운로드 받으세요.

Git이 설치되어 있거나 Git Shell이 ​​있는 경우 명령줄에 다음을 입력하세요.
$ npm install url-extract

설치를 진행하세요.

간단한 예

예를 들어 Baidu 홈페이지를 차단하려면 다음과 같이 할 수 있습니다.

코드 복사 코드는 다음과 같습니다.
module.exports = (function () { "use strict" var urlExtract = require('url-extract' ); urlExtract.snapshot('http: //www.baidu.com', function (job) { console.log('스냅샷 예시입니다.'); console.log(job); process.exit(); }); })();
다음은 인쇄 내용입니다.

그 중 이미지 속성은 작업 경로를 기준으로 한 스크린샷의 주소입니다. Job의 getData 인터페이스를 사용하여 더 명확한 데이터를 얻을 수 있습니다. 예를 들어:

코드 복사 코드는 다음과 같습니다.
module.exports = (function () { "엄격한 사용" var urlExtract = require('url-extract'); urlExtract.snapshot('http://www.baidu.com', function (job) { console.log('스냅샷 예시입니다.'); console.log(job.getData()) })();
인쇄 내용은 다음과 같습니다.

image는 작업 경로를 기준으로 스크린샷의 주소를 나타내고, status는 상태가 정상인지 여부를 나타내며, true는 정상, false는 스크린샷 실패를 나타냅니다.

더 많은 예를 보려면

https://github.com/miniflycn/url-extract/tree/master/examples

를 참조하세요.

메인 API

.스냅샷

URL 스냅샷

.snapshot(url, [콜백]).snapshot(urls, [콜백]).snapshot(url, [옵션]).snapshot(urls, [옵션])

코드 복사 코드는 다음과 같습니다. url {String} 차단할 주소 url {Array } 차단할 주소 주소 배열 콜백 {Function} 콜백 함수 옵션 {Object} 선택적 매개변수 ┝ id {String} 첫 번째 매개변수가 urls인 경우 이 매개변수는 유효하지 않습니다. ┝ image {String} 저장 맞춤 스크린샷 주소, 첫 번째 매개변수가 URL인 경우 이 매개변수는 유효하지 않습니다.┝ groupId {String}은 URL 그룹의 groupId를 정의하며, 반환 시 어떤 URL 그룹인지 식별하는 데 사용됩니다. ┝ignoreCache {Boolean} 무시 여부 캐시┗ 콜백 {Function} 콜백 함수

.추출

URL 정보 수집 및 스냅샷 가져오기

.extract(url, [콜백]).extract(urls, [콜백]).extract(url, [옵션]).extract( urls, [옵션])

url {String} 차단할 주소

urls {Array} 차단할 주소 배열

콜백{Function} 콜백 함수

옵션{Object} 선택적 매개변수

┝ id {String} 첫 번째 매개변수가 urls인 경우 이 매개변수는 유효하지 않습니다.

┝ image {String} 스크린샷 저장 주소를 맞춤 설정합니다. 첫 번째 매개변수가 urls인 경우 이 매개변수는 유효하지 않습니다

┝ groupId {String}은 URL 그룹의 groupId를 정의하며,

을 반환할 때 어떤 URL 그룹인지 식별하는 데 사용됩니다.

┝ignoreCache {Boolean} 캐시 무시 여부

┗ 콜백 {Function} 콜백 함수

직업(수업)

각 URL은 작업 개체에 해당하며, URL 관련 정보는 작업 개체에 저장됩니다.

필드

url {String} 링크 주소 콘텐츠 {Boolean} 페이지 제목 및 설명 정보 크롤링 여부 id {String} 작업의 idgroupId {String} 여러 작업의 그룹 ID 캐시 {Boolean} 캐싱 콜백 활성화 여부 {Function} 콜백 함수 이미지 {String} 이미지 주소 상태 {Boolean} 현재 작업이 정상인지 여부

시제품

getData()는 직업 관련 데이터를 가져옵니다

글로벌 구성

url-extract 루트 디렉터리에 있는 구성 파일은 전역적으로 구성할 수 있습니다.

module.exports = { wsPort: 3001, maxJob: 100, maxQueueJob: 400, cache: 'object', maxCache: 10000, workerNum: 0};
wsPort {Number} websocket이 차지하는 포트 주소 maxJob {Number} 각 PhantomJS 스레드가 가질 수 있는 동시 작업자 수 maxQueueJob {Number} 대기 작업의 최대 수, 0은 이 수를 초과하는 모든 작업에 제한이 없음을 의미합니다. 즉시 실패로 돌아갑니다(즉, 상태 = false). 캐시 {String} 캐시 구현, 현재 객체만 maxCache {Number} 캐시 링크의 최대 수를 구현합니다. WorkerNum {Number} PhantomJS 스레드 번호, 0은 CPU 수와 동일함을 의미합니다.

간단한 서비스 예시

https://github.com/miniflycn/url-extract-server-example

connect 및 url-extract를 설치해야 합니다.

$ npm 설치

네트워크 디스크 파일을 다운로드하셨다면 connect를 설치해주세요:

$ npm 설치 연결

그런 다음 다음을 입력하세요.

$ 노드 저장소/서버

열기:

http://localhost:3000

효과를 확인해보세요.

;

성명
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.
JavaScript 엔진 이해 : 구현 세부 사항JavaScript 엔진 이해 : 구현 세부 사항Apr 17, 2025 am 12:05 AM

보다 효율적인 코드를 작성하고 성능 병목 현상 및 최적화 전략을 이해하는 데 도움이되기 때문에 JavaScript 엔진이 내부적으로 작동하는 방식을 이해하는 것은 개발자에게 중요합니다. 1) 엔진의 워크 플로에는 구문 분석, 컴파일 및 실행; 2) 실행 프로세스 중에 엔진은 인라인 캐시 및 숨겨진 클래스와 같은 동적 최적화를 수행합니다. 3) 모범 사례에는 글로벌 변수를 피하고 루프 최적화, Const 및 Lets 사용 및 과도한 폐쇄 사용을 피하는 것이 포함됩니다.

Python vs. JavaScript : 학습 곡선 및 사용 편의성Python vs. JavaScript : 학습 곡선 및 사용 편의성Apr 16, 2025 am 12:12 AM

Python은 부드러운 학습 곡선과 간결한 구문으로 초보자에게 더 적합합니다. JavaScript는 가파른 학습 곡선과 유연한 구문으로 프론트 엔드 개발에 적합합니다. 1. Python Syntax는 직관적이며 데이터 과학 및 백엔드 개발에 적합합니다. 2. JavaScript는 유연하며 프론트 엔드 및 서버 측 프로그래밍에서 널리 사용됩니다.

Python vs. JavaScript : 커뮤니티, 라이브러리 및 리소스Python vs. JavaScript : 커뮤니티, 라이브러리 및 리소스Apr 15, 2025 am 12:16 AM

Python과 JavaScript는 커뮤니티, 라이브러리 및 리소스 측면에서 고유 한 장점과 단점이 있습니다. 1) Python 커뮤니티는 친절하고 초보자에게 적합하지만 프론트 엔드 개발 리소스는 JavaScript만큼 풍부하지 않습니다. 2) Python은 데이터 과학 및 기계 학습 라이브러리에서 강력하며 JavaScript는 프론트 엔드 개발 라이브러리 및 프레임 워크에서 더 좋습니다. 3) 둘 다 풍부한 학습 리소스를 가지고 있지만 Python은 공식 문서로 시작하는 데 적합하지만 JavaScript는 MDNWebDocs에서 더 좋습니다. 선택은 프로젝트 요구와 개인적인 이익을 기반으로해야합니다.

C/C에서 JavaScript까지 : 모든 것이 어떻게 작동하는지C/C에서 JavaScript까지 : 모든 것이 어떻게 작동하는지Apr 14, 2025 am 12:05 AM

C/C에서 JavaScript로 전환하려면 동적 타이핑, 쓰레기 수집 및 비동기 프로그래밍으로 적응해야합니다. 1) C/C는 수동 메모리 관리가 필요한 정적으로 입력 한 언어이며 JavaScript는 동적으로 입력하고 쓰레기 수집이 자동으로 처리됩니다. 2) C/C를 기계 코드로 컴파일 해야하는 반면 JavaScript는 해석 된 언어입니다. 3) JavaScript는 폐쇄, 프로토 타입 체인 및 약속과 같은 개념을 소개하여 유연성과 비동기 프로그래밍 기능을 향상시킵니다.

JavaScript 엔진 : 구현 비교JavaScript 엔진 : 구현 비교Apr 13, 2025 am 12:05 AM

각각의 엔진의 구현 원리 및 최적화 전략이 다르기 때문에 JavaScript 엔진은 JavaScript 코드를 구문 분석하고 실행할 때 다른 영향을 미칩니다. 1. 어휘 분석 : 소스 코드를 어휘 단위로 변환합니다. 2. 문법 분석 : 추상 구문 트리를 생성합니다. 3. 최적화 및 컴파일 : JIT 컴파일러를 통해 기계 코드를 생성합니다. 4. 실행 : 기계 코드를 실행하십시오. V8 엔진은 즉각적인 컴파일 및 숨겨진 클래스를 통해 최적화하여 Spidermonkey는 유형 추론 시스템을 사용하여 동일한 코드에서 성능이 다른 성능을 제공합니다.

브라우저 너머 : 실제 세계의 JavaScript브라우저 너머 : 실제 세계의 JavaScriptApr 12, 2025 am 12:06 AM

실제 세계에서 JavaScript의 응용 프로그램에는 서버 측 프로그래밍, 모바일 애플리케이션 개발 및 사물 인터넷 제어가 포함됩니다. 1. 서버 측 프로그래밍은 Node.js를 통해 실현되며 동시 요청 처리에 적합합니다. 2. 모바일 애플리케이션 개발은 재교육을 통해 수행되며 크로스 플랫폼 배포를 지원합니다. 3. Johnny-Five 라이브러리를 통한 IoT 장치 제어에 사용되며 하드웨어 상호 작용에 적합합니다.

Next.js (백엔드 통합)로 멀티 테넌트 SAAS 애플리케이션 구축Next.js (백엔드 통합)로 멀티 테넌트 SAAS 애플리케이션 구축Apr 11, 2025 am 08:23 AM

일상적인 기술 도구를 사용하여 기능적 다중 테넌트 SaaS 응용 프로그램 (Edtech 앱)을 구축했으며 동일한 작업을 수행 할 수 있습니다. 먼저, 다중 테넌트 SaaS 응용 프로그램은 무엇입니까? 멀티 테넌트 SAAS 응용 프로그램은 노래에서 여러 고객에게 서비스를 제공 할 수 있습니다.

Next.js (Frontend Integration)를 사용하여 멀티 테넌트 SaaS 응용 프로그램을 구축하는 방법Next.js (Frontend Integration)를 사용하여 멀티 테넌트 SaaS 응용 프로그램을 구축하는 방법Apr 11, 2025 am 08:22 AM

이 기사에서는 Contrim에 의해 확보 된 백엔드와의 프론트 엔드 통합을 보여 주며 Next.js를 사용하여 기능적인 Edtech SaaS 응용 프로그램을 구축합니다. Frontend는 UI 가시성을 제어하기 위해 사용자 권한을 가져오고 API가 역할 기반을 준수하도록합니다.

See all articles

핫 AI 도구

Undresser.AI Undress

Undresser.AI Undress

사실적인 누드 사진을 만들기 위한 AI 기반 앱

AI Clothes Remover

AI Clothes Remover

사진에서 옷을 제거하는 온라인 AI 도구입니다.

Undress AI Tool

Undress AI Tool

무료로 이미지를 벗다

Clothoff.io

Clothoff.io

AI 옷 제거제

AI Hentai Generator

AI Hentai Generator

AI Hentai를 무료로 생성하십시오.

인기 기사

R.E.P.O. 에너지 결정과 그들이하는 일 (노란색 크리스탈)
1 몇 달 전By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 최고의 그래픽 설정
1 몇 달 전By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 아무도들을 수없는 경우 오디오를 수정하는 방법
1 몇 달 전By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 채팅 명령 및 사용 방법
1 몇 달 전By尊渡假赌尊渡假赌尊渡假赌

뜨거운 도구

SublimeText3 영어 버전

SublimeText3 영어 버전

권장 사항: Win 버전, 코드 프롬프트 지원!

mPDF

mPDF

mPDF는 UTF-8로 인코딩된 HTML에서 PDF 파일을 생성할 수 있는 PHP 라이브러리입니다. 원저자인 Ian Back은 자신의 웹 사이트에서 "즉시" PDF 파일을 출력하고 다양한 언어를 처리하기 위해 mPDF를 작성했습니다. HTML2FPDF와 같은 원본 스크립트보다 유니코드 글꼴을 사용할 때 속도가 느리고 더 큰 파일을 생성하지만 CSS 스타일 등을 지원하고 많은 개선 사항이 있습니다. RTL(아랍어, 히브리어), CJK(중국어, 일본어, 한국어)를 포함한 거의 모든 언어를 지원합니다. 중첩된 블록 수준 요소(예: P, DIV)를 지원합니다.

MinGW - Windows용 미니멀리스트 GNU

MinGW - Windows용 미니멀리스트 GNU

이 프로젝트는 osdn.net/projects/mingw로 마이그레이션되는 중입니다. 계속해서 그곳에서 우리를 팔로우할 수 있습니다. MinGW: GCC(GNU Compiler Collection)의 기본 Windows 포트로, 기본 Windows 애플리케이션을 구축하기 위한 무료 배포 가능 가져오기 라이브러리 및 헤더 파일로 C99 기능을 지원하는 MSVC 런타임에 대한 확장이 포함되어 있습니다. 모든 MinGW 소프트웨어는 64비트 Windows 플랫폼에서 실행될 수 있습니다.

SublimeText3 중국어 버전

SublimeText3 중국어 버전

중국어 버전, 사용하기 매우 쉽습니다.

SublimeText3 Mac 버전

SublimeText3 Mac 버전

신 수준의 코드 편집 소프트웨어(SublimeText3)