Nstdata Python SDK Quickstart: Cuộc Crawl Đầu Tiên Của Bạn Trong 5 Phút
TL;DR
Gói Python đã được xác minh cho Nstdata Crawl là nstdata-ai-crawl; cài đặt từ PyPI và nhập nstdata_ai_crawl.
Nhận mã thông báo từ bảng điều khiển Nstdata và lưu trữ nó trong NSTDATA_API_TOKEN, không bao giờ trong mã nguồn.
SDK bao gồm Crawl; Proxy và Proxy Manager là các sản phẩm riêng biệt được sử dụng thông qua URL proxy, HTTP clients hoặc các giao diện đã được tài liệu hóa của chúng.
Một yêu cầu Crawl trực tiếp cần có mã thông báo tài khoản, vì vậy ví dụ dưới đây đã được xác minh cú pháp nhưng không được trình bày như một cuộc gọi sản xuất đã thực hiện.
Cách nhanh chóng của Nstdata Python có một chi tiết quan trọng trong việc đặt tên: tên cài đặt sử dụng dấu gạch ngang, trong khi tên nhập sử dụng dấu gạch dưới.
Khối này phù hợp với bề mặt SDK đã cài đặt. Nó cần một mã thông báo thực và tiêu thụ tài nguyên dịch vụ trực tiếp, vì vậy chỉ chạy nó sau khi xem xét cài đặt tài khoản và thanh toán hiện tại.
import os
from nstdata_ai_crawl import NstDataClient, ScrapeRequestDto, Format
token = os.environ["NSTDATA_API_TOKEN"]with NstDataClient(token)as client: result = client.submit_scrape_task_sync( ScrapeRequestDto( url="https://example.com/", formats=[Format.MARKDOWN], onlyMainContent=True,))print(result)
Xác minh thành công ở cấp độ nội dung và các dấu hiệu trang mong đợi trước khi lưu đầu ra. Một phản hồi HTTP đơn thuần không chứng minh rằng nội dung được yêu cầu đã được truy xuất.
Ví dụ 2: Sử dụng một Nstdata Proxy trong Python
Nstdata Proxy không yêu cầu Crawl SDK. Sử dụng điểm cuối kênh được tạo với một khách hàng tiêu chuẩn:
ModuleNotFoundError: xác nhận môi trường ảo và tên nhập.
Thiếu token: xác minh NSTDATA_API_TOKEN trong quy trình hiện tại.
Nhiệm vụ được chấp nhận mà không có nội dung: kiểm tra trạng thái nhiệm vụ và lỗi ở cấp độ nội dung.
Lỗi xác thực proxy: tái tạo điểm cuối và mã hóa các thành phần thông tin xác thực.
Hết thời gian: sử dụng thử lại có ràng buộc với jitter và không thử lại các từ chối vĩnh viễn.
Kết luận
Sử dụng Crawl SDK cho các nhiệm vụ thu thập, một khách hàng HTTP tiêu chuẩn cho Proxy, và một URL Router cho Proxy Manager. Giữ những ranh giới đó rõ ràng làm cho việc tích hợp dễ dàng thử nghiệm và khắc phục sự cố hơn.
Trải nghiệm Nstdata — Bắt đầu dùng thử miễn phí của bạn hôm nay
Cài đặt nstdata-ai-crawl và nhập nstdata_ai_crawl.
Q: Một SDK Python có bao trùm tất cả ba sản phẩm Nstdata không?
Không có một SDK thống nhất nào được xác minh; gói chính thức bao gồm Crawl, trong khi Proxy và Proxy Manager sử dụng các giao diện kết nối đã được tài liệu.
Q: Tôi có thể chạy ví dụ mà không cần mã token API không?
Không. Một yêu cầu thu thập sống cần một mã token tài khoản.
Q: Token nên được lưu trữ ở đâu?
Sử dụng một biến môi trường hoặc một quản lý bí mật được phê duyệt, không bao giờ là tệp nguồn đã cam kết.
Lena Zhou
Sep. 18th 2026
110M+ IP that voi ti le truy cap thanh cong 99.9%
Phan hoi trung binh ~0.5s cho tac vu dong thoi cao
Chi tu $0.1/GB
Truy cap ngay cac pool proxy residential, datacenter, IPv6 va ISP cao cap.