[ search · extract ]● 2 cr/url · 30 req/min

Extraction de contenu depuis URL

Transmettez une ou plusieurs URLs et récupérez un contenu propre et lisible, navigation et publicités retirées. S'intègre directement aux pipelines RAG, aux workflows d'agents de scraping-et-résumé ou aux tâches de monitoring de contenu.

2 credits / URL30 req / minmax 25 URLs / callPOST /api/extract

Essayer Extract en direct

Une URL par ligne. Saisissez votre clé API et validez pour extraire le contenu.

auth · x-api-key

Pas encore de clé API ?

Connectez-vous à votre compte pour créer et gérer vos clés API.

2 URLs · 4 credits total

[ 02 · integrate ]

Guide d'intégration

Copiez un extrait, remplacez votre clé API, exécutez. Fonctionne avec n'importe quel client HTTP — exemples ci-dessous en cURL, JavaScript et Python.

spec
POST/api/extract
base
https://www.apipick.com

Extract clean readable content from one or more URLs. Removes navigation, ads, and boilerplate. Returns markdown-flavoured text ready for LLM ingestion.

paramètres
urlsarray<string>requis

1–25 http(s) URLs

extract_effortstringoptionnel

auto | low | high

response_lengthstringoptionnel

short | medium | long

curl -X POST "https://www.apipick.com/api/extract" \
  -H "Content-Type: application/json" \
  -H "x-api-key: YOUR_API_KEY" \
  -d '{
  "urls": [
    "https://en.wikipedia.org/wiki/Retrieval-augmented_generation",
    "https://docs.anthropic.com/claude/docs/intro-to-claude"
  ],
  "extract_effort": "auto"
}'
● 200 · réponse
{
  "results": [
    {
      "url": "https://en.wikipedia.org/wiki/Retrieval-augmented_generation",
      "title": "Retrieval-augmented generation - Wikipedia",
      "content": "Retrieval-augmented generation (RAG) is a technique…",
      "status": "ok"
    }
  ],
  "result_count": 1,
  "credits_used": 2,
  "remaining_credits": 98
}
[ 03 · limits ]

Limites de débit

La limitation est par clé API, fenêtre glissante de 60 secondes. En cas de dépassement, vous recevez un 429 propre avec un en-tête Retry-After.

débit de requêtes

30req/min

Par clé API, par endpoint. Fenêtre glissante de 60 secondes.

concurrence

3concurrent

Nombre maximal de requêtes simultanées en cours par clé API.

en-têtes de réponse
X-RateLimit-LimitNombre maximal de requêtes autorisées par minute
X-RateLimit-RemainingRequêtes restantes dans la fenêtre actuelle
X-RateLimit-ResetSecondes avant la réinitialisation de la fenêtre actuelle
Retry-AfterSecondes à attendre avant de réessayer (uniquement sur 429)
● 429 · trop de requêtes
HTTP/1.1 429 Too Many Requests
Retry-After: 12
X-RateLimit-Limit: 30
X-RateLimit-Remaining: 0
X-RateLimit-Reset: 12

{
  "error": "rate_limit_exceeded",
  "message": "Rate limit exceeded: 30 requests/minute per API key. Retry after 12s.",
  "retry_after": 12
}

Questions fréquentes

Comment les crédits sont-ils facturés ?

2 crédits par URL transmise. Un seul appel avec 5 URLs coûte 10 crédits. Maximum 25 URLs par appel.

À quoi ressemble la réponse ?

Un tableau d'objets { url, title, content, status }. content est un texte lisible nettoyé (façon markdown), débarrassé du boilerplate. Adapté à une consommation directe par les LLM.

Puis-je contrôler la profondeur d'extraction ?

Passez extract_effort (auto, low, high). 'auto' est la valeur par défaut et convient à la plupart des pages. 'high' est plus lent mais traite plus en profondeur les pages riches en JS ou de type paywall.

Que se passe-t-il si une URL échoue ?

Les URLs en échec renvoient un status défini sur un code d'erreur dans le tableau de résultats, mais l'appel dans son ensemble réussit. Les crédits sont facturés pour toutes les URLs transmises, quel que soit le résultat par URL.

Existe-t-il un schéma outil ?

GET /api/extract/tool-schema renvoie des définitions function calling OpenAI et tool use Claude.