arXiv Papers Extractor avatar

arXiv Papers Extractor

Under maintenance

Pricing

from $0.25 / 1,000 results

Go to Apify Store
arXiv Papers Extractor

arXiv Papers Extractor

Under maintenance

Search arXiv and extract papers as clean typed records: title, abstract, authors, categories, DOI, and direct PDF links. No API key required.

Pricing

from $0.25 / 1,000 results

Rating

0.0

(0)

Developer

Cynix Dev

Cynix Dev

Maintained by Community

Actor stats

0

Bookmarked

2

Total users

1

Monthly active users

6 days ago

Last modified

Share

Search arXiv and get papers back as clean, typed dataset records — title, abstract, authors, categories, DOI, and direct PDF links. No API key required.

Built for research-monitoring pipelines, literature-review tooling, and AI agents that need fresh papers via MCP.

Example inputs

Latest ML papers on a topic:

{ "query": "state space models", "category": "cs.LG", "maxResults": 50 }

Fielded arXiv syntax (title + author):

{ "query": "ti:\"reinforcement learning\" AND au:silver", "sortBy": "relevance" }

Specific papers by ID:

{ "idList": ["1706.03762", "2005.14165"] }

Output record

FieldDescription
arxivId, versionPaper identifier
title, abstractFull text metadata
authorsAuthor list
primaryCategory, categoriesSubject classification
published, updatedTimestamps
doi, journalRef, commentPublication metadata when present
absUrl, pdfUrlDirect links

Use cases

  • Research monitoring — schedule daily runs on your topics; diff new IDs downstream.
  • RAG pipelines — chain with a content/PDF extractor to build literature knowledge bases.
  • Trend analysis — track publication volume per category over time.
  • AI agents — grounded "what's new in X" answers via MCP.

Fair access

Follows arXiv API guidelines: paged requests with 3-second delays. arXiv data is public scholarly metadata. Please respect arXiv's terms for bulk usage.