Hoe je elke pagina aan een neuraal netwerk kunt voeren zonder reclame en extra tokens
pullmd zet elke webpagina om naar schone Markdown voor LLM-agents, verwijdert reclame en navigatieclutter en bespaart tokens.
Taal
HomeTalen
Secties
pullmd zet elke webpagina om naar schone Markdown voor LLM-agents, verwijdert reclame en navigatieclutter en bespaart tokens.
Een blik op fast-plate-ocr, een lichtgewicht bibliotheek voor kentekenherkenning die tot 14.000 kentekens per seconde haalt met CCT-modellen en ONNX Runtime.
Een Node.js-bibliotheek die gestructureerde JSON uit rommelige PDF's en scans haalt met AI, voor cloud en lokale modellen.
Tesseract.js brengt OCR rechtstreeks naar de browser. Geen backend, geen cloudbetalingen — gewoon pure client-side tekstherkenning met WebAssembly.
Moest je ooit data uit een PDF of gescand document halen? Text-extract-api biedt een elegante oplossing met moderne OCR en taalmodellen.
Ontdek PDF Craft – een krachtig Python-hulpmiddel dat gescande PDF's omzet naar bewerkbare Markdown- en EPUB-formaten met slimme OCR.