Extraction de contenu depuis URL
Transmettez une ou plusieurs URLs et récupérez un contenu propre et lisible, navigation et publicités retirées. S'intègre directement aux pipelines RAG, aux workflows d'agents de scraping-et-résumé ou aux tâches de monitoring de contenu.
Essayer Extract en direct
Une URL par ligne. Saisissez votre clé API et validez pour extraire le contenu.
Pas encore de clé API ?
Connectez-vous à votre compte pour créer et gérer vos clés API.
Guide d'intégration
Copiez un extrait, remplacez votre clé API, exécutez. Fonctionne avec n'importe quel client HTTP — exemples ci-dessous en cURL, JavaScript et Python.
/api/extracthttps://www.apipick.comExtract clean readable content from one or more URLs. Removes navigation, ads, and boilerplate. Returns markdown-flavoured text ready for LLM ingestion.
urlsarray<string>requis1–25 http(s) URLs
extract_effortstringoptionnelauto | low | high
response_lengthstringoptionnelshort | medium | long
curl -X POST "https://www.apipick.com/api/extract" \
-H "Content-Type: application/json" \
-H "x-api-key: YOUR_API_KEY" \
-d '{
"urls": [
"https://en.wikipedia.org/wiki/Retrieval-augmented_generation",
"https://docs.anthropic.com/claude/docs/intro-to-claude"
],
"extract_effort": "auto"
}'{
"results": [
{
"url": "https://en.wikipedia.org/wiki/Retrieval-augmented_generation",
"title": "Retrieval-augmented generation - Wikipedia",
"content": "Retrieval-augmented generation (RAG) is a technique…",
"status": "ok"
}
],
"result_count": 1,
"credits_used": 2,
"remaining_credits": 98
}Limites de débit
La limitation est par clé API, fenêtre glissante de 60 secondes. En cas de dépassement, vous recevez un 429 propre avec un en-tête Retry-After.
30req/min
Par clé API, par endpoint. Fenêtre glissante de 60 secondes.
3concurrent
Nombre maximal de requêtes simultanées en cours par clé API.
X-RateLimit-LimitNombre maximal de requêtes autorisées par minuteX-RateLimit-RemainingRequêtes restantes dans la fenêtre actuelleX-RateLimit-ResetSecondes avant la réinitialisation de la fenêtre actuelleRetry-AfterSecondes à attendre avant de réessayer (uniquement sur 429)HTTP/1.1 429 Too Many Requests
Retry-After: 12
X-RateLimit-Limit: 30
X-RateLimit-Remaining: 0
X-RateLimit-Reset: 12
{
"error": "rate_limit_exceeded",
"message": "Rate limit exceeded: 30 requests/minute per API key. Retry after 12s.",
"retry_after": 12
}Questions fréquentes
Comment les crédits sont-ils facturés ?
2 crédits par URL transmise. Un seul appel avec 5 URLs coûte 10 crédits. Maximum 25 URLs par appel.
À quoi ressemble la réponse ?
Un tableau d'objets { url, title, content, status }. content est un texte lisible nettoyé (façon markdown), débarrassé du boilerplate. Adapté à une consommation directe par les LLM.
Puis-je contrôler la profondeur d'extraction ?
Passez extract_effort (auto, low, high). 'auto' est la valeur par défaut et convient à la plupart des pages. 'high' est plus lent mais traite plus en profondeur les pages riches en JS ou de type paywall.
Que se passe-t-il si une URL échoue ?
Les URLs en échec renvoient un status défini sur un code d'erreur dans le tableau de résultats, mais l'appel dans son ensemble réussit. Les crédits sont facturés pour toutes les URLs transmises, quel que soit le résultat par URL.
Existe-t-il un schéma outil ?
GET /api/extract/tool-schema renvoie des définitions function calling OpenAI et tool use Claude.