Proving Lab

Keep the web page you will need later.

Save a whole page as one PDF that carries where it came from and when — and turn a list of links into a reference list. 19.3 % of sources in real bibliographies are already gone, and 8.7 % have no archived copy anywhere. Start here · for AI agents

Measurements, not opinions: everything here has a method, raw data and a control run. Where a number cannot be reproduced, it does not get written down. Where something went wrong, that is written down first.

The tool built here

Full Page PDF Snap

Save a whole webpage as one continuous PDF — the entire scrolling page on a single sheet. Nothing cropped at the edge, and no page break cutting through a table or a sentence. Everything happens in your browser: no upload, no account, no data collection. MIT licensed, free of charge, Firefox and Chrome.

One sheet, not 26 pages Works behind a login Stays on your device

Every claim here is measured and dated: one sheet against 26, 92.6 % of the text readable by OCR, zero network requests.

Download for Firefox

Version 2.33.4 — signed by Mozilla. Installs in one step, desktop and Android.

Without any store · Chrome and Edge · What it does

Notes

Build reports from real work — including the parts that went wrong.

15 August 2026

For researchers and students: the add-on in Firefox and Chrome

The practical companion to the students piece: every install route — Firefox on desktop and Android, the Chrome Web Store, and both store-free paths — then the capture–cite–archive workflow and the four settings that matter for papers. In nine languages.

2 browsers, 4 install routes 18 XMP fields in the PDF 2 ways the RIS record travels

10 August 2026

For students: a source that cites itself, survives, and can be read by a machine

Three things go wrong with a web source in a term paper: it disappears, its citation has to be typed by hand, and the file you kept is a picture no tool can search. What a capture does about each — including the six sources in twenty it hands straight back to you. In nine languages.

61 % coverage, same as Citoid 100 % accurate against its 79 % 6 of 20 handed back

3 August 2026

What an AI agent can and cannot do with a browser extension

Installing one into someone's browser is a user gesture by design — no store exposes an API for it. What an agent can do instead, the command-line flag that loads nothing and says nothing, and where the work divides between the two.

3 things an agent can do 1 flag that fails silently 0 ways to install for someone

3 August 2026

The sources a machine cannot cite for you — and how to cite them anyway

When a citation tool hands a source back, the cause is one of three: a bot defence, a refusal aimed at the network, or a page that declares nothing about itself. Each needs different work, and only one is solved by opening the page in a browser.

3 causes 1 solved by a browser 2 requests to tell them apart

2 August 2026

This site runs an MCP server. Measured: it is smaller than the file it competes with

An endpoint at /mcp hands the datasets, the methods and a citation reader to AI clients over JSON-RPC — no key, no account. What that is actually good for, and where a plain text file on the same domain already does the job.

4 tools 1,300 tokens total 1,988 in llms.txt

1 August 2026

Six things went wrong building software with an AI assistant in one day

A wrong assumption about browser engines, a false claim caught before publication, 22 local paths one commit from a public repository, and three more. Sorted by what actually caught them — two were caught by luck, one by nothing at all.

3 of 6 caught by checking an external source 1 still untested in production

Measurements

Each with the commands to repeat it and the raw data behind it.

3 August 2026

Installing a browser extension without a click, and removing it again

Four routes, both directions. One installs and uninstalls a signed store build in 4.1 seconds with no window and no admin rights — and the two commands themselves take 0.24 s, so the cost is starting the browser, not the work. The click route took 179 seconds, reported success at every step, and installed nothing: a click into empty space is a valid click. The fast route does not count in the store's user statistics, and that is the point rather than the flaw.

3 August 2026

Twenty links, ten citations: what a machine finishes and what it hands back

A reading list into a bibliography, end to end. The split does not run between paid and free — it runs between pages built to be cited and pages built to be read. Journal publishers yield records either way; statistics portals, chambers of commerce and newspapers yield none, and not because they defend themselves.

10/20 complete records 1 bot defence 5 pages with nothing to declare

3 August 2026

An agent can cite eight of twelve sources — the useful part is knowing which four it cannot

A mixed reading list through the citation endpoint: complete records with RIS for two thirds, and the rest named precisely enough to fetch by hand instead of invented.

8/12 done by the agent 1.09 s per source 4 named, not guessed

2 August 2026

Measured against Citoid on random samples: same coverage, nothing invented

The Wikimedia service built on the Zotero translators is the yardstick. Across 18 works drawn at random: equal coverage, and not one refusal reported as a success.

13/13 fields complete 0 false block reports 0.35 s median

1 August 2026

Print to PDF or capture the screen? The same page measured both ways

Firefox already saves pages as PDF for free. So when is a capture worth it? The same article through both routes — and the answer is narrower, and more useful, than either side usually admits.

1 : 26 pages 9 breaks cut a sentence capture leads on text: 91.5 %

1 August 2026

Webpage to PDF for OCR: how much text actually survives?

A full-page screenshot PDF run through Tesseract and compared against the source article. Includes the resolution threshold where recognition collapses.

92.6 % vocabulary recovered 8/8 critical values 72 dpi collapse point

1 August 2026

Does your PDF extension upload the page?

What current PDF extensions declare in their manifests, how to verify it in 30 seconds — and the consequence nobody mentions: server-side converters cannot reach pages behind a login.

8 extensions surveyed raw data published

1 August 2026

An extension is only as dangerous as its permissions allow

One year after Mozilla warned about phished developer accounts: why the useful question is not who you trust, but what a compromised extension could reach.

worst-case permission table assessment checklist

How things are measured here

A control run, always

Before any result counts, the method has to fail where it should. A comparison that does not distinguish the reference case measures nothing.

Raw data published

Numbers come with the file they were computed from, timestamped. That makes them checkable — and it means nobody has to take a claim on trust.

Losses named first

Where our own tool is worse — file size, processing time, missing features — it is stated before the advantages. A comparison that only flatters is worthless.

Dated, not timeless

Every figure carries the date it was retrieved. Software changes; a measurement without a date quietly turns into a false claim.

Tools

Software built here, documented like anything else on this site — including what it cannot do. It appears in some of the measurements above; that is disclosed on each of them.

Full Page PDF Snap

Firefox extension that saves a whole web page as one continuous PDF. Runs on the device, asks for activeTab rather than all-sites access, works on Firefox for Android. MIT licensed. Optionally writes the citation the page declares — authors, DOI, licence, time of retrieval — into the PDF, with an RIS record beside it.

Citation endpoint at /mcp

Hand it a URL, get back what that page says about itself as a structured record with RIS and BibTeX — or a named refusal where the page turns out to be a paywall, an error or a bot check rather than a work. No account and no key. Speaks MCP for AI clients and plain HTTP for everything else.

7 of 10 scholarly sources complete 0.45 s median 3 Aug 2026

Recipes: a reading list into a reference list

Complete, runnable instructions for putting the citation endpoint into the tools people actually work in: a shell loop that turns reading-list.txt into one importable .ris for Zotero or Citavi, one line to connect Claude Code, the remote-server entry for Claude Desktop and other MCP clients, and the Python minimum. Every one was run before it was written down.

Check any figure yourself

Everything here has a method, raw data and a control run — so it can be checked, not so it has to be believed.

The most useful contribution is a counter-measurement that comes out differently

Four places where the published figures are most likely to wobble are named explicitly — starting with the ten of twenty sources whose four refusals are blocks against a data-centre address. From a home network the rate should be higher, and that is unmeasured.

4 named weak spots 9 datasets, CC BY 4.0 open tasks on GitHub

For AI agents: rules, construction, limits

The project is set up so an agent can work on it without asking anyone first. Open tasks are served machine-readably by the open_work tool on /mcp — with labels, an excerpt, and the five rules that are different here from usual.

Disclosure

This site is run by the developer of Full Page PDF Snap, which appears in several of the measurements above. That is stated in each article where it is relevant, and the tool sits openly under /tools/ rather than hidden behind neutral framing.

Figures about other products come exclusively from publicly declared data — manifests and listing descriptions — with the retrieval date given. No product was decompiled, and no claim is made about any provider's intentions. Corrections are welcome via GitHub issues and get applied.

Proving Lab

Behalten Sie die Webseite, die Sie später brauchen.

Speichern Sie eine ganze Seite als ein PDF, das Herkunft und Abrufzeitpunkt trägt — und verwandeln Sie eine Linkliste in ein Literaturverzeichnis. 19,3 % der Quellen in echten Literaturverzeichnissen sind bereits verschwunden, und 8,7 % haben nirgends eine archivierte Kopie. Hier beginnen · für KI-Agenten

Messungen, keine Meinungen: Alles hier hat eine Methode, Rohdaten und einen Kontrolllauf. Was sich nicht nachrechnen lässt, wird nicht aufgeschrieben. Was schiefging, wird zuerst aufgeschrieben.

Das hier gebaute Werkzeug

Full Page PDF Snap

Speichert eine ganze Webseite als ein fortlaufendes PDF — die komplette scrollende Seite auf einem einzigen Blatt. Nichts am Rand abgeschnitten, kein Seitenumbruch mitten durch Tabelle oder Satz. Alles passiert in Ihrem Browser: kein Upload, kein Konto, keine Datenerhebung. MIT-lizenziert, kostenlos, Firefox und Chrome.

Ein Blatt, nicht 26 Seiten Funktioniert hinter einem Login Bleibt auf Ihrem Gerät

Jede Aussage hier ist gemessen und datiert: ein Blatt gegen 26, 92,6 % des Textes per OCR lesbar, null Netzwerkanfragen.

Für Firefox herunterladen

Version 2.33.4 — von Mozilla signiert. Installiert in einem Schritt, Desktop und Android.

Ganz ohne Store · Chrome und Edge · Was sie kann

Notizen

Bauberichte aus echter Arbeit — einschließlich der Teile, die schiefgingen.

15. August 2026

Für Wissenschaftler:innen und Studierende: die Erweiterung in Firefox und Chrome

Das praktische Gegenstück zum Studierenden-Beitrag: alle Installationswege — Firefox auf Desktop und Android, der Chrome Web Store und beide store-freien Pfade —, dann der Ablauf aufnehmen–zitieren–archivieren und die vier Einstellungen, die für Arbeiten zählen. In neun Sprachen.

2 Browser, 4 Installationswege 18 XMP-Felder im PDF 2 Wege für den RIS-Datensatz

10. August 2026

Für Studierende: eine Quelle, die sich selbst zitiert, überlebt und maschinenlesbar ist

Drei Dinge gehen mit einer Webquelle in einer Seminararbeit schief: Sie verschwindet, ihre Zitation muss von Hand abgetippt werden, und die aufgehobene Datei ist ein Bild, das kein Werkzeug durchsucht. Was eine Aufnahme gegen jedes der drei tut — einschließlich der sechs von zwanzig Quellen, die sie an Sie zurückgibt. In neun Sprachen.

61 % Abdeckung, gleichauf mit Citoid 100 % richtig gegenüber deren 79 % 6 von 20 zurückgegeben

3. August 2026

Was ein KI-Agent mit einer Browser-Erweiterung kann — und was nicht

Eine Installation in fremdem Browser ist bewusst eine Nutzer-Geste — kein Store bietet eine API dafür. Was ein Agent stattdessen kann, der Kommandozeilen-Schalter, der nichts lädt und nichts sagt, und wo die Arbeit zwischen beiden aufgeteilt ist.

3 Dinge, die ein Agent kann 1 Schalter, der still versagt 0 Wege, für jemanden zu installieren

3. August 2026

Die Quellen, die eine Maschine nicht für Sie zitieren kann — und wie man sie trotzdem zitiert

Wenn ein Zitationswerkzeug eine Quelle zurückgibt, ist die Ursache eine von dreien: eine Bot-Abwehr, eine Weigerung gegen das Netzwerk oder eine Seite, die nichts über sich erklärt. Jede braucht andere Arbeit, und nur eine löst das Öffnen im Browser.

3 Ursachen 1 durch einen Browser gelöst 2 Anfragen zur Unterscheidung

2. August 2026

Diese Seite betreibt einen MCP-Server. Gemessen: Er ist kleiner als die Datei, mit der er konkurriert

Ein Endpunkt unter /mcp reicht die Datensätze, die Methoden und einen Zitationsleser über JSON-RPC an KI-Clients — kein Schlüssel, kein Konto. Wozu das wirklich taugt, und wo eine schlichte Textdatei auf derselben Domain die Aufgabe schon erledigt.

4 Werkzeuge 1.300 Token insgesamt 1.988 in llms.txt

1. August 2026

Sechs Dinge, die beim Bauen von Software mit einem KI-Assistenten an einem Tag schiefgingen

Eine falsche Annahme über Browser-Engines, eine vor Veröffentlichung erwischte Falschbehauptung, 22 lokale Pfade einen Commit vor einem öffentlichen Repository — und drei weitere. Sortiert danach, was sie tatsächlich erwischt hat: zwei wurden durch Glück gefunden, eine durch gar nichts.

3 von 6 durch Prüfen einer externen Quelle erwischt 1 noch immer ungetestet im Produktivbetrieb

Messungen

Jede mit den Befehlen zu ihrer Wiederholung und den Rohdaten dahinter.

3. August 2026

Eine Browser-Erweiterung ohne Klick installieren — und wieder entfernen

Vier Wege, beide Richtungen. Einer installiert und deinstalliert eine signierte Store-Version in 4,1 Sekunden ohne Fenster und ohne Admin-Rechte — und die zwei Befehle selbst brauchen 0,24 s; die Kosten sind der Browser-Start, nicht die Arbeit. Der Klick-Weg brauchte 179 Sekunden, meldete bei jedem Schritt Erfolg und installierte nichts: Ein Klick ins Leere ist ein gültiger Klick. Der schnelle Weg zählt nicht in den Nutzerstatistiken des Stores — und das ist der Punkt, nicht der Fehler.

3. August 2026

Zwanzig Links, zehn Zitationen: was eine Maschine fertig macht und was sie zurückgibt

Eine Leseliste in ein Literaturverzeichnis, von Anfang bis Ende. Die Trennlinie läuft nicht zwischen kostenpflichtig und frei — sie läuft zwischen Seiten, die zum Zitieren gebaut sind, und Seiten, die zum Lesen gebaut sind. Fachverlage liefern Datensätze in beiden Fällen; Statistikportale, Kammern und Zeitungen liefern keine, und nicht, weil sie sich verteidigen.

10/20 vollständige Datensätze 1 Bot-Abwehr 5 Seiten ohne etwas zu erklären

3. August 2026

Ein Agent kann acht von zwölf Quellen zitieren — der nützliche Teil ist zu wissen, welche vier er nicht kann

Eine gemischte Leseliste durch den Zitations-Endpunkt: vollständige Datensätze mit RIS für zwei Drittel, und der Rest präzise genug benannt, um ihn von Hand zu holen statt zu erfinden.

8/12 vom Agenten erledigt 1,09 s pro Quelle 4 benannt, nicht geraten

2. August 2026

Gegen Citoid an Zufallsstichproben gemessen: gleiche Abdeckung, nichts erfunden

Der Wikimedia-Dienst auf Basis der Zotero-Translatoren ist der Maßstab. Über 18 zufällig gezogene Werke: gleiche Abdeckung, und keine einzige Weigerung als Erfolg gemeldet.

13/13 Felder vollständig 0 falsche Sperr-Meldungen 0,35 s Median

1. August 2026

Als PDF drucken oder den Bildschirm aufnehmen? Dieselbe Seite, beide Wege gemessen

Firefox speichert Seiten bereits kostenlos als PDF. Wann lohnt also eine Aufnahme? Derselbe Artikel durch beide Wege — und die Antwort ist enger und nützlicher, als beide Seiten üblicherweise zugeben.

1 : 26 Seiten 9 Umbrüche durchtrennen einen Satz Aufnahme führt beim Text: 91,5 %

1. August 2026

Webseite als PDF für OCR: Wie viel Text überlebt tatsächlich?

Ein Ganzseiten-Screenshot-PDF durch Tesseract, verglichen mit dem Ursprungsartikel. Einschließlich der Auflösungsschwelle, an der die Erkennung einbricht.

92,6 % Wortschatz zurückgewonnen 8/8 kritische Werte 72 dpi Einbruchstelle

1. August 2026

Lädt Ihre PDF-Erweiterung die Seite hoch?

Was aktuelle PDF-Erweiterungen in ihren Manifesten deklarieren, wie man es in 30 Sekunden überprüft — und die Folge, die niemand erwähnt: Server-seitige Konverter erreichen keine Seiten hinter einem Login.

8 Erweiterungen untersucht Rohdaten veröffentlicht

1. August 2026

Eine Erweiterung ist nur so gefährlich, wie ihre Berechtigungen es erlauben

Ein Jahr nach Mozillas Warnung vor erbeuteten Entwicklerkonten: Warum die nützliche Frage nicht ist, wem Sie vertrauen, sondern was eine kompromittierte Erweiterung erreichen könnte.

Worst-Case-Berechtigungstabelle Bewertungs-Checkliste

Wie hier gemessen wird

Ein Kontrolllauf, immer

Bevor ein Ergebnis zählt, muss die Methode dort scheitern, wo sie scheitern soll. Ein Vergleich, der den Referenzfall nicht unterscheidet, misst nichts.

Rohdaten veröffentlicht

Zahlen kommen mit der Datei, aus der sie berechnet wurden, mit Zeitstempel. Das macht sie prüfbar — und es heißt, niemand muss eine Behauptung auf Vertrauen hinnehmen.

Verluste zuerst genannt

Wo das eigene Werkzeug schlechter ist — Dateigröße, Laufzeit, fehlende Funktionen —, steht es vor den Vorteilen. Ein Vergleich, der nur schmeichelt, ist wertlos.

Datiert, nicht zeitlos

Jede Zahl trägt das Datum ihrer Erhebung. Software ändert sich; eine Messung ohne Datum wird still zur Falschbehauptung.

Werkzeuge

Hier gebaute Software, dokumentiert wie alles auf dieser Seite — einschließlich dessen, was sie nicht kann. Sie kommt in einigen der Messungen oben vor; das ist bei jeder offengelegt.

Full Page PDF Snap

Firefox-Erweiterung, die eine ganze Webseite als ein fortlaufendes PDF speichert. Läuft auf dem Gerät, fragt activeTab statt Zugriff auf alle Seiten an, funktioniert auf Firefox für Android. MIT-lizenziert. Schreibt optional die Zitation, die die Seite erklärt — Verfasser:innen, DOI, Lizenz, Abrufzeitpunkt — ins PDF, mit einem RIS-Datensatz daneben.

Zitations-Endpunkt unter /mcp

Geben Sie eine URL, bekommen Sie zurück, was diese Seite über sich selbst erklärt — als strukturierten Datensatz mit RIS und BibTeX, oder eine benannte Weigerung, wenn sich die Seite als Paywall, Fehler oder Bot-Prüfung entpuppt statt als Werk. Kein Konto und kein Schlüssel. Spricht MCP für KI-Clients und schlichtes HTTP für alles andere.

7 von 10 wissenschaftliche Quellen vollständig 0,45 s Median 3. Aug 2026

Rezepte: eine Leseliste in ein Literaturverzeichnis

Vollständige, lauffähige Anleitungen, um den Zitations-Endpunkt in die Werkzeuge zu bringen, in denen tatsächlich gearbeitet wird: eine Shell-Schleife, die reading-list.txt in eine importierbare .ris für Zotero oder Citavi verwandelt, eine Zeile für Claude Code, der Remote-Server-Eintrag für Claude Desktop und andere MCP-Clients und das Python-Minimum. Jedes wurde ausgeführt, bevor es aufgeschrieben wurde.

Rechnen Sie eine Zahl nach

Jede Angabe hier hat Methode, Rohdaten und einen Kontrolllauf — damit sie nachgerechnet werden kann, nicht damit sie geglaubt wird.

Der nützlichste Beitrag ist eine Gegenmessung, die etwas anderes ergibt

Vier Stellen, an denen die veröffentlichten Zahlen am wahrscheinlichsten wackeln, sind ausdrücklich benannt — angefangen bei den zehn von zwanzig Quellen, deren vier Ablehnungen Sperren gegen eine Rechenzentrums-Adresse sind. Aus einem Heimnetz müsste die Quote höher liegen, und gemessen ist das nicht.

4 benannte Schwachstellen 9 Datensätze, CC BY 4.0 offene Aufgaben auf GitHub

Für KI-Agenten: Regeln, Bauweise, Grenzen

Das Projekt ist so eingerichtet, dass ein Agent daran arbeiten kann, ohne vorher jemanden zu fragen. Offene Aufgaben liefert das Werkzeug open_work auf /mcp maschinenlesbar aus — mit Labels, Auszug und den fünf Regeln, die hier anders sind als üblich.

Offenlegung

Diese Seite wird vom Entwickler von Full Page PDF Snap betrieben, das in mehreren der Messungen oben vorkommt. Das steht in jedem Beitrag, in dem es relevant ist, und das Werkzeug steht offen unter /tools/, statt hinter neutraler Rahmung versteckt.

Zahlen über fremde Produkte stammen ausschließlich aus öffentlich deklarierten Daten — Manifesten und Store-Beschreibungen — mit angegebenem Abrufdatum. Kein Produkt wurde dekompiliert, und keine Aussage wird über die Absichten eines Anbieters gemacht. Korrekturen sind willkommen über GitHub Issues und werden übernommen.

Proving Lab

Guarda la página web que necesitarás más tarde.

Guarda una página entera como un solo PDF que lleva su origen y su fecha — y convierte una lista de enlaces en una bibliografía. El 19,3 % de las fuentes en bibliografías reales ya ha desaparecido, y el 8,7 % no tiene copia archivada en ningún sitio. Empieza aquí · para agentes de IA

Mediciones, no opiniones: todo aquí tiene método, datos brutos y una ejecución de control. Lo que no se puede recalcular no se escribe. Lo que salió mal se escribe primero.

La herramienta construida aquí

Full Page PDF Snap

Guarda una página web entera como un PDF continuo — toda la página desplazable en una sola hoja. Nada recortado en los bordes y ningún salto de página atravesando una tabla o una frase. Todo ocurre en tu navegador: sin subidas, sin cuenta, sin recolección de datos. Licencia MIT, gratuita, Firefox y Chrome.

Una hoja, no 26 páginas Funciona tras un inicio de sesión Se queda en tu dispositivo

Cada afirmación aquí está medida y fechada: una hoja contra 26, el 92,6 % del texto legible por OCR, cero peticiones de red.

Descargar para Firefox

Versión 2.33.4 — firmada por Mozilla. Se instala en un paso, escritorio y Android.

Sin ninguna tienda · Chrome y Edge · Qué hace

Notas

Crónicas de trabajo real — incluidas las partes que salieron mal.

15 de agosto de 2026

Para investigadores y estudiantes: la extensión en Firefox y Chrome

El complemento práctico del artículo para estudiantes: todas las vías de instalación — Firefox en escritorio y Android, la Chrome Web Store y ambos caminos sin tienda —, luego el flujo capturar–citar–archivar y los cuatro ajustes que importan para los trabajos. En nueve idiomas.

2 navegadores, 4 vías de instalación 18 campos XMP en el PDF 2 caminos para el registro RIS

10 de agosto de 2026

Para estudiantes: una fuente que se cita sola, sobrevive y es legible por máquina

Tres cosas fallan con una fuente web en un trabajo académico: desaparece, su cita hay que teclearla a mano, y el archivo guardado es una imagen que ninguna herramienta busca. Qué hace una captura contra cada una — incluidas las seis fuentes de veinte que te devuelve. En nueve idiomas.

61 % de cobertura, igual que Citoid 100 % correcto frente a su 79 % 6 de 20 devueltas

3 de agosto de 2026

Qué puede y qué no puede hacer un agente de IA con una extensión de navegador

Instalar una en el navegador de alguien es un gesto de usuario por diseño — ninguna tienda expone una API para ello. Qué puede hacer un agente en su lugar, el flag de línea de comandos que no carga nada y no dice nada, y dónde se divide el trabajo entre ambos.

3 cosas que un agente puede hacer 1 flag que falla en silencio 0 formas de instalar para otro

3 de agosto de 2026

Las fuentes que una máquina no puede citar por ti — y cómo citarlas igualmente

Cuando una herramienta de citación devuelve una fuente, la causa es una de tres: una defensa contra bots, una negativa dirigida a la red o una página que no declara nada de sí misma. Cada una necesita un trabajo distinto, y solo una se resuelve abriendo la página en un navegador.

3 causas 1 resuelta con un navegador 2 peticiones para distinguirlas

2 de agosto de 2026

Este sitio opera un servidor MCP. Medido: es más pequeño que el archivo con el que compite

Un endpoint en /mcp entrega los conjuntos de datos, los métodos y un lector de citas a clientes de IA por JSON-RPC — sin clave, sin cuenta. Para qué sirve realmente, y dónde un simple archivo de texto en el mismo dominio ya hace el trabajo.

4 herramientas 1.300 tokens en total 1.988 en llms.txt

1 de agosto de 2026

Seis cosas salieron mal construyendo software con un asistente de IA en un día

Una suposición errónea sobre motores de navegador, una afirmación falsa detectada antes de publicar, 22 rutas locales a un commit de un repositorio público — y tres más. Ordenadas por lo que realmente las detectó: dos se encontraron por suerte, una por nada en absoluto.

3 de 6 detectadas comprobando una fuente externa 1 aún sin probar en producción

Mediciones

Cada una con los comandos para repetirla y los datos brutos detrás.

3 de agosto de 2026

Instalar una extensión de navegador sin un clic, y quitarla de nuevo

Cuatro vías, en ambas direcciones. Una instala y desinstala una compilación firmada de la tienda en 4,1 segundos sin ventana y sin derechos de administrador — y los dos comandos en sí tardan 0,24 s; el coste es arrancar el navegador, no el trabajo. La vía del clic tardó 179 segundos, informó éxito en cada paso y no instaló nada: un clic en el vacío es un clic válido. La vía rápida no cuenta en las estadísticas de usuarios de la tienda — y ese es el punto, no el defecto.

3 de agosto de 2026

Veinte enlaces, diez citas: qué termina una máquina y qué devuelve

Una lista de lectura convertida en bibliografía, de principio a fin. La división no corre entre de pago y gratis — corre entre páginas construidas para ser citadas y páginas construidas para ser leídas. Las editoriales científicas dan registros en ambos casos; los portales de estadística, las cámaras de comercio y los periódicos no dan ninguno, y no porque se defiendan.

10/20 registros completos 1 defensa contra bots 5 páginas sin nada que declarar

3 de agosto de 2026

Un agente puede citar ocho de doce fuentes — lo útil es saber cuáles cuatro no puede

Una lista de lectura mixta por el endpoint de citación: registros completos con RIS para dos tercios, y el resto nombrado con la precisión suficiente para buscarlo a mano en lugar de inventarlo.

8/12 hechas por el agente 1,09 s por fuente 4 nombradas, no adivinadas

2 de agosto de 2026

Medido contra Citoid en muestras aleatorias: misma cobertura, nada inventado

El servicio de Wikimedia construido sobre los traductores de Zotero es el patrón. En 18 obras extraídas al azar: cobertura igual, y ni una negativa informada como éxito.

13/13 campos completos 0 informes de bloqueo falsos 0,35 s de mediana

1 de agosto de 2026

¿Imprimir a PDF o capturar la pantalla? La misma página medida de ambas formas

Firefox ya guarda páginas como PDF gratis. ¿Cuándo vale una captura? El mismo artículo por ambas vías — y la respuesta es más estrecha y más útil de lo que cualquiera de los dos lados suele admitir.

1 : 26 páginas 9 saltos cortan una frase la captura gana en texto: 91,5 %

1 de agosto de 2026

Página web a PDF para OCR: ¿cuánto texto sobrevive realmente?

Un PDF de captura de página completa pasado por Tesseract y comparado con el artículo fuente. Incluye el umbral de resolución donde el reconocimiento colapsa.

92,6 % del vocabulario recuperado 8/8 valores críticos 72 dpi punto de colapso

1 de agosto de 2026

¿Sube tu extensión de PDF la página?

Qué declaran las extensiones de PDF actuales en sus manifiestos, cómo verificarlo en 30 segundos — y la consecuencia que nadie menciona: los conversores del lado del servidor no alcanzan páginas tras un inicio de sesión.

8 extensiones examinadas datos brutos publicados

1 de agosto de 2026

Una extensión solo es tan peligrosa como sus permisos permiten

Un año después de la advertencia de Mozilla sobre cuentas de desarrollador robadas: por qué la pregunta útil no es en quién confías, sino qué podría alcanzar una extensión comprometida.

tabla de permisos en el peor caso lista de verificación de evaluación

Cómo se mide aquí

Una ejecución de control, siempre

Antes de que un resultado cuente, el método tiene que fallar donde debe. Una comparación que no distingue el caso de referencia no mide nada.

Datos brutos publicados

Las cifras vienen con el archivo del que se calcularon, con marca de tiempo. Eso las hace comprobables — y significa que nadie tiene que aceptar una afirmación por confianza.

Las pérdidas se nombran primero

Donde nuestra propia herramienta es peor — tamaño de archivo, tiempo de proceso, funciones ausentes —, se afirma antes que las ventajas. Una comparación que solo adula no vale nada.

Fechadas, no atemporales

Cada cifra lleva la fecha en que se tomó. El software cambia; una medición sin fecha se convierte en silencio en una afirmación falsa.

Herramientas

Software construido aquí, documentado como todo lo demás en este sitio — incluido lo que no puede hacer. Aparece en algunas de las mediciones de arriba; eso se declara en cada una.

Full Page PDF Snap

Extensión de Firefox que guarda una página web entera como un PDF continuo. Se ejecuta en el dispositivo, pide activeTab en lugar de acceso a todos los sitios, funciona en Firefox para Android. Licencia MIT. Opcionalmente escribe en el PDF la cita que la página declara — autores, DOI, licencia, momento de consulta —, con un registro RIS al lado.

Endpoint de citación en /mcp

Dale una URL y recibe lo que esa página dice de sí misma como registro estructurado con RIS y BibTeX — o una negativa nombrada cuando la página resulta ser un muro de pago, un error o una comprobación de bots en lugar de una obra. Sin cuenta y sin clave. Habla MCP para clientes de IA y HTTP simple para todo lo demás.

7 de 10 fuentes académicas completas 0,45 s de mediana 3 ago 2026

Recetas: una lista de lectura convertida en bibliografía

Instrucciones completas y ejecutables para meter el endpoint de citación en las herramientas en las que la gente trabaja de verdad: un bucle de shell que convierte reading-list.txt en un .ris importable para Zotero o Citavi, una línea para conectar Claude Code, la entrada de servidor remoto para Claude Desktop y otros clientes MCP, y el mínimo en Python. Cada una se ejecutó antes de escribirse.

Comprueba cualquier cifra

Todo aquí tiene método, datos brutos y una ejecución de control — para poder comprobarse, no para tener que creerse.

La contribución más útil es una contra-medición que dé un resultado distinto

Se nombran expresamente cuatro puntos donde las cifras publicadas tienen más probabilidades de tambalearse — empezando por las diez de veinte fuentes cuyas cuatro negativas son bloqueos contra una dirección de centro de datos. Desde una red doméstica la tasa debería ser mayor, y eso no está medido.

4 puntos débiles nombrados 9 conjuntos de datos, CC BY 4.0 tareas abiertas en GitHub

Para agentes de IA: reglas, construcción, límites

El proyecto está montado para que un agente pueda trabajar en él sin preguntar antes a nadie. Las tareas abiertas las sirve en formato legible por máquina la herramienta open_work en /mcp — con etiquetas, un extracto y las cinco reglas que aquí son distintas de lo habitual.

Divulgación

Este sitio lo opera el desarrollador de Full Page PDF Snap, que aparece en varias de las mediciones de arriba. Eso se indica en cada artículo donde es relevante, y la herramienta está abiertamente bajo /tools/ en lugar de escondida tras un encuadre neutral.

Las cifras sobre productos ajenos provienen exclusivamente de datos declarados públicamente — manifiestos y descripciones de tienda — con la fecha de consulta indicada. Ningún producto fue descompilado, y no se afirma nada sobre las intenciones de ningún proveedor. Las correcciones son bienvenidas vía issues de GitHub y se aplican.

Proving Lab

Gardez la page web dont vous aurez besoin plus tard.

Enregistrez une page entière en un seul PDF qui porte son origine et sa date — et transformez une liste de liens en bibliographie. 19,3 % des sources des bibliographies réelles ont déjà disparu, et 8,7 % n'ont aucune copie archivée nulle part. Commencer ici · pour les agents IA

Des mesures, pas des opinions : tout ici a une méthode, des données brutes et un essai de contrôle. Ce qui ne peut être recalculé n'est pas écrit. Ce qui a mal tourné est écrit d'abord.

L'outil construit ici

Full Page PDF Snap

Enregistre une page web entière en un PDF continu — toute la page défilante sur une seule feuille. Rien de rogné au bord, aucun saut de page traversant un tableau ou une phrase. Tout se passe dans votre navigateur : aucun téléversement, aucun compte, aucune collecte de données. Licence MIT, gratuit, Firefox et Chrome.

Une feuille, pas 26 pages Fonctionne derrière un identifiant Reste sur votre appareil

Chaque affirmation ici est mesurée et datée : une feuille contre 26, 92,6 % du texte lisible par OCR, zéro requête réseau.

Télécharger pour Firefox

Version 2.33.4 — signée par Mozilla. S'installe en une étape, bureau et Android.

Sans aucune boutique · Chrome et Edge · Ce qu'elle fait

Notes

Comptes rendus de travail réel — y compris les parties qui ont mal tourné.

15 août 2026

Pour les chercheuses, chercheurs et étudiant·e·s : l'extension dans Firefox et Chrome

Le pendant pratique de l'article pour étudiants : toutes les voies d'installation — Firefox sur bureau et Android, le Chrome Web Store et les deux chemins sans boutique —, puis le flux capturer–citer–archiver et les quatre réglages qui comptent pour les travaux. En neuf langues.

2 navigateurs, 4 voies d'installation 18 champs XMP dans le PDF 2 chemins pour l'enregistrement RIS

10 août 2026

Pour les étudiants : une source qui se cite elle-même, survit et est lisible par une machine

Trois choses tournent mal avec une source web dans un mémoire : elle disparaît, sa citation doit être retapée à la main, et le fichier conservé est une image qu'aucun outil ne fouille. Ce qu'une capture fait contre chacune — y compris les six sources sur vingt qu'elle vous rend. En neuf langues.

61 % de couverture, à égalité avec Citoid 100 % exact contre ses 79 % 6 sur 20 rendues

3 août 2026

Ce qu'un agent IA peut et ne peut pas faire avec une extension de navigateur

En installer une dans le navigateur de quelqu'un est un geste utilisateur par conception — aucune boutique n'expose d'API pour cela. Ce qu'un agent peut faire à la place, le drapeau de ligne de commande qui ne charge rien et ne dit rien, et où le travail se partage entre les deux.

3 choses qu'un agent peut faire 1 drapeau qui échoue en silence 0 façon d'installer pour autrui

3 août 2026

Les sources qu'une machine ne peut pas citer pour vous — et comment les citer quand même

Quand un outil de citation rend une source, la cause est l'une de trois : une défense anti-robots, un refus visant le réseau, ou une page qui ne déclare rien sur elle-même. Chacune demande un travail différent, et une seule se résout en ouvrant la page dans un navigateur.

3 causes 1 résolue par un navigateur 2 requêtes pour les distinguer

2 août 2026

Ce site fait tourner un serveur MCP. Mesuré : il est plus petit que le fichier auquel il se mesure

Un point d'accès sur /mcp remet les jeux de données, les méthodes et un lecteur de citations aux clients IA en JSON-RPC — sans clé, sans compte. À quoi cela sert vraiment, et où un simple fichier texte sur le même domaine fait déjà le travail.

4 outils 1 300 jetons au total 1 988 dans llms.txt

1 août 2026

Six choses ont mal tourné en construisant un logiciel avec un assistant IA en un jour

Une hypothèse fausse sur les moteurs de navigateur, une affirmation erronée repérée avant publication, 22 chemins locaux à un commit d'un dépôt public — et trois de plus. Triées selon ce qui les a réellement repérées : deux ont été trouvées par chance, une par rien du tout.

3 sur 6 repérées en vérifiant une source externe 1 encore non testée en production

Mesures

Chacune avec les commandes pour la refaire et les données brutes derrière.

3 août 2026

Installer une extension de navigateur sans un clic, et la retirer ensuite

Quatre voies, dans les deux sens. L'une installe et désinstalle une version signée de la boutique en 4,1 secondes sans fenêtre et sans droits d'administrateur — et les deux commandes elles-mêmes prennent 0,24 s ; le coût est le démarrage du navigateur, pas le travail. La voie du clic a pris 179 secondes, a annoncé un succès à chaque étape et n'a rien installé : un clic dans le vide est un clic valide. La voie rapide ne compte pas dans les statistiques d'utilisateurs de la boutique — et c'est le but, pas le défaut.

3 août 2026

Vingt liens, dix citations : ce qu'une machine termine et ce qu'elle rend

Une liste de lecture transformée en bibliographie, de bout en bout. La ligne de partage ne passe pas entre payant et gratuit — elle passe entre les pages construites pour être citées et les pages construites pour être lues. Les éditeurs scientifiques fournissent des notices dans les deux cas ; les portails de statistique, les chambres de commerce et les journaux n'en fournissent aucune, et ce n'est pas parce qu'ils se défendent.

10/20 notices complètes 1 défense anti-robots 5 pages sans rien à déclarer

3 août 2026

Un agent peut citer huit sources sur douze — l'utile est de savoir quelles quatre il ne peut pas

Une liste de lecture mixte par le point d'accès de citation : des notices complètes avec RIS pour les deux tiers, et le reste nommé assez précisément pour aller le chercher à la main au lieu de l'inventer.

8/12 faites par l'agent 1,09 s par source 4 nommées, pas devinées

2 août 2026

Mesuré contre Citoid sur échantillons aléatoires : même couverture, rien d'inventé

Le service Wikimedia bâti sur les traducteurs Zotero fait office d'étalon. Sur 18 œuvres tirées au hasard : couverture égale, et pas un refus rapporté comme un succès.

13/13 champs complets 0 faux rapport de blocage 0,35 s de médiane

1 août 2026

Imprimer en PDF ou capturer l'écran ? La même page mesurée des deux façons

Firefox enregistre déjà les pages en PDF gratuitement. Quand une capture vaut-elle donc le coup ? Le même article par les deux voies — et la réponse est plus étroite, et plus utile, qu'aucun des deux camps ne l'admet d'ordinaire.

1 : 26 pages 9 sauts coupent une phrase la capture mène sur le texte : 91,5 %

1 août 2026

Page web en PDF pour l'OCR : combien de texte survit vraiment ?

Un PDF de capture pleine page passé dans Tesseract et comparé à l'article source. Avec le seuil de résolution où la reconnaissance s'effondre.

92,6 % du vocabulaire récupéré 8/8 valeurs critiques 72 dpi point d'effondrement

1 août 2026

Votre extension PDF téléverse-t-elle la page ?

Ce que les extensions PDF actuelles déclarent dans leurs manifestes, comment le vérifier en 30 secondes — et la conséquence que personne ne mentionne : les convertisseurs côté serveur n'atteignent pas les pages derrière un identifiant.

8 extensions examinées données brutes publiées

1 août 2026

Une extension n'est dangereuse que dans la mesure de ses permissions

Un an après l'avertissement de Mozilla sur les comptes de développeur volés : pourquoi la question utile n'est pas qui vous croyez, mais ce qu'une extension compromise pourrait atteindre.

tableau des permissions au pire liste de contrôle d'évaluation

Comment on mesure ici

Un essai de contrôle, toujours

Avant qu'un résultat compte, la méthode doit échouer là où elle le doit. Une comparaison qui ne distingue pas le cas de référence ne mesure rien.

Données brutes publiées

Les chiffres viennent avec le fichier dont ils sont calculés, horodaté. Cela les rend vérifiables — et personne n'a à croire une affirmation sur parole.

Les pertes nommées d'abord

Là où notre propre outil est moins bon — taille de fichier, temps de traitement, fonctions manquantes —, c'est dit avant les avantages. Une comparaison qui ne fait que flatter ne vaut rien.

Datées, pas intemporelles

Chaque chiffre porte la date de son relevé. Les logiciels changent ; une mesure sans date devient silencieusement une affirmation fausse.

Outils

Des logiciels construits ici, documentés comme tout le reste de ce site — y compris ce qu'ils ne savent pas faire. Ils apparaissent dans certaines mesures ci-dessus ; c'est indiqué sur chacune.

Full Page PDF Snap

Extension Firefox qui enregistre une page web entière en un PDF continu. Tourne sur l'appareil, demande activeTab plutôt qu'un accès à tous les sites, fonctionne sur Firefox pour Android. Licence MIT. Écrit en option dans le PDF la citation que la page déclare — auteurs, DOI, licence, moment de consultation —, avec un enregistrement RIS à côté.

Point d'accès de citation sur /mcp

Donnez-lui une URL, recevez ce que cette page déclare d'elle-même sous forme de notice structurée avec RIS et BibTeX — ou un refus nommé lorsque la page s'avère être un mur payant, une erreur ou un contrôle anti-robots plutôt qu'une œuvre. Ni compte ni clé. Parle MCP pour les clients IA et HTTP simple pour tout le reste.

7 sur 10 sources savantes complètes 0,45 s de médiane 3 août 2026

Recettes : une liste de lecture transformée en bibliographie

Des instructions complètes et exécutables pour intégrer le point d'accès de citation dans les outils où l'on travaille vraiment : une boucle shell qui transforme reading-list.txt en un .ris importable pour Zotero ou Citavi, une ligne pour connecter Claude Code, l'entrée de serveur distant pour Claude Desktop et d'autres clients MCP, et le minimum en Python. Chacune a été exécutée avant d'être écrite.

Revérifiez n'importe quel chiffre

Tout ici a une méthode, des données brutes et un essai de contrôle — pour pouvoir être vérifié, pas pour devoir être cru.

La contribution la plus utile est une contre-mesure qui aboutit à autre chose

Quatre endroits où les chiffres publiés risquent le plus de vaciller sont nommés expressément — à commencer par les dix sources sur vingt dont les quatre refus sont des blocages contre une adresse de centre de données. Depuis un réseau domestique, le taux devrait être plus élevé, et cela n'est pas mesuré.

4 points faibles nommés 9 jeux de données, CC BY 4.0 tâches ouvertes sur GitHub

Pour les agents IA : règles, construction, limites

Le projet est monté pour qu'un agent puisse y travailler sans demander à personne au préalable. Les tâches ouvertes sont servies en lecture machine par l'outil open_work sur /mcp — avec étiquettes, extrait, et les cinq règles qui diffèrent ici de l'habitude.

Transparence

Ce site est tenu par le développeur de Full Page PDF Snap, qui apparaît dans plusieurs des mesures ci-dessus. C'est indiqué dans chaque article où c'est pertinent, et l'outil se trouve ouvertement sous /tools/ plutôt que caché derrière un cadrage neutre.

Les chiffres sur les produits tiers proviennent exclusivement de données publiquement déclarées — manifestes et descriptions de boutique — avec la date de consultation indiquée. Aucun produit n'a été décompilé, et rien n'est affirmé sur les intentions d'un fournisseur. Les corrections sont les bienvenues via les tickets GitHub et sont appliquées.

Proving Lab

Conserva la pagina web che ti servirà più avanti.

Salva una pagina intera come un unico PDF che porta con sé la sua origine e la sua data — e trasforma un elenco di link in una bibliografia. Il 19,3 % delle fonti nelle bibliografie reali è già sparito, e l'8,7 % non ha una copia archiviata da nessuna parte. Inizia qui · per agenti IA

Misurazioni, non opinioni: tutto qui ha un metodo, dati grezzi e una prova di controllo. Ciò che non si può ricalcolare non viene scritto. Ciò che è andato storto viene scritto per primo.

Lo strumento costruito qui

Full Page PDF Snap

Salva un'intera pagina web come un PDF continuo — tutta la pagina scorrevole su un unico foglio. Niente tagliato ai bordi e nessuna interruzione di pagina che attraversi una tabella o una frase. Tutto avviene nel tuo browser: nessun caricamento, nessun account, nessuna raccolta dati. Licenza MIT, gratuito, Firefox e Chrome.

Un foglio, non 26 pagine Funziona dietro un login Resta sul tuo dispositivo

Ogni affermazione qui è misurata e datata: un foglio contro 26, il 92,6 % del testo leggibile via OCR, zero richieste di rete.

Scarica per Firefox

Versione 2.33.4 — firmata da Mozilla. Si installa in un passaggio, desktop e Android.

Senza alcuno store · Chrome ed Edge · Cosa fa

Note

Resoconti di lavoro reale — comprese le parti andate storte.

15 agosto 2026

Per ricercatori, ricercatrici e studenti: l'estensione in Firefox e Chrome

Il compagno pratico dell'articolo per studenti: tutte le vie di installazione — Firefox su desktop e Android, il Chrome Web Store ed entrambi i percorsi senza store —, poi il flusso catturare–citare–archiviare e le quattro impostazioni che contano per gli elaborati. In nove lingue.

2 browser, 4 vie di installazione 18 campi XMP nel PDF 2 percorsi per il record RIS

10 agosto 2026

Per studenti: una fonte che si cita da sola, sopravvive ed è leggibile da una macchina

Tre cose vanno storte con una fonte web in un elaborato: sparisce, la sua citazione va riscritta a mano, e il file conservato è un'immagine che nessuno strumento cerca. Cosa fa una cattura contro ciascuna — comprese le sei fonti su venti che ti restituisce. In nove lingue.

61 % di copertura, alla pari con Citoid 100 % corretto contro il suo 79 % 6 su 20 restituite

3 agosto 2026

Cosa può e cosa non può fare un agente IA con un'estensione del browser

Installarne una nel browser di qualcuno è un gesto dell'utente per progettazione — nessuno store espone un'API per farlo. Cosa può fare invece un agente, il flag da riga di comando che non carica nulla e non dice nulla, e dove si divide il lavoro tra i due.

3 cose che un agente può fare 1 flag che fallisce in silenzio 0 modi di installare per altri

3 agosto 2026

Le fonti che una macchina non può citare per te — e come citarle comunque

Quando uno strumento di citazione restituisce una fonte, la causa è una di tre: una difesa anti-bot, un rifiuto rivolto alla rete o una pagina che non dichiara nulla di sé. Ognuna richiede un lavoro diverso, e solo una si risolve aprendo la pagina in un browser.

3 cause 1 risolta da un browser 2 richieste per distinguerle

2 agosto 2026

Questo sito gestisce un server MCP. Misurato: è più piccolo del file con cui compete

Un endpoint su /mcp consegna i set di dati, i metodi e un lettore di citazioni ai client IA via JSON-RPC — nessuna chiave, nessun account. A cosa serve davvero, e dove un semplice file di testo sullo stesso dominio fa già il lavoro.

4 strumenti 1.300 token in totale 1.988 in llms.txt

1 agosto 2026

Sei cose andate storte costruendo software con un assistente IA in un giorno

Un'ipotesi sbagliata sui motori di browser, un'affermazione falsa intercettata prima della pubblicazione, 22 percorsi locali a un commit da un repository pubblico — e altre tre. Ordinate per ciò che le ha davvero intercettate: due sono state trovate per fortuna, una da nulla.

3 su 6 intercettate controllando una fonte esterna 1 ancora non testata in produzione

Misurazioni

Ognuna con i comandi per ripeterla e i dati grezzi alle spalle.

3 agosto 2026

Installare un'estensione del browser senza un clic, e rimuoverla di nuovo

Quattro vie, in entrambe le direzioni. Una installa e disinstalla una build firmata dello store in 4,1 secondi senza finestra e senza diritti di amministratore — e i due comandi in sé richiedono 0,24 s; il costo è avviare il browser, non il lavoro. La via del clic ha richiesto 179 secondi, ha riportato successo a ogni passo e non ha installato nulla: un clic nel vuoto è un clic valido. La via veloce non conta nelle statistiche utenti dello store — e questo è il punto, non il difetto.

3 agosto 2026

Venti link, dieci citazioni: cosa completa una macchina e cosa restituisce

Una lista di lettura trasformata in bibliografia, dall'inizio alla fine. La linea di divisione non passa tra a pagamento e gratis — passa tra pagine costruite per essere citate e pagine costruite per essere lette. Gli editori scientifici danno record in entrambi i casi; i portali di statistica, le camere di commercio e i quotidiani non ne danno nessuno, e non perché si difendano.

10/20 record completi 1 difesa anti-bot 5 pagine senza nulla da dichiarare

3 agosto 2026

Un agente può citare otto fonti su dodici — la parte utile è sapere quali quattro non può

Una lista di lettura mista attraverso l'endpoint di citazione: record completi con RIS per due terzi, e il resto nominato con precisione sufficiente per recuperarlo a mano invece di inventarlo.

8/12 fatte dall'agente 1,09 s per fonte 4 nominate, non indovinate

2 agosto 2026

Misurato contro Citoid su campioni casuali: stessa copertura, nulla di inventato

Il servizio Wikimedia costruito sui traduttori di Zotero è il riferimento. Su 18 opere estratte a caso: copertura uguale, e nemmeno un rifiuto riportato come successo.

13/13 campi completi 0 falsi rapporti di blocco 0,35 s di mediana

1 agosto 2026

Stampare in PDF o catturare lo schermo? La stessa pagina misurata in entrambi i modi

Firefox salva già le pagine in PDF gratis. Quando vale quindi una cattura? Lo stesso articolo per entrambe le vie — e la risposta è più stretta, e più utile, di quanto entrambe le parti ammettano di solito.

1 : 26 pagine 9 interruzioni tagliano una frase la cattura è in testa sul testo: 91,5 %

1 agosto 2026

Pagina web in PDF per OCR: quanto testo sopravvive davvero?

Un PDF di cattura a pagina intera passato in Tesseract e confrontato con l'articolo sorgente. Include la soglia di risoluzione in cui il riconoscimento crolla.

92,6 % del vocabolario recuperato 8/8 valori critici 72 dpi punto di collasso

1 agosto 2026

La tua estensione PDF carica la pagina?

Cosa dichiarano le attuali estensioni PDF nei loro manifest, come verificarlo in 30 secondi — e la conseguenza che nessuno menziona: i convertitori lato server non raggiungono le pagine dietro un login.

8 estensioni esaminate dati grezzi pubblicati

1 agosto 2026

Un'estensione è pericolosa solo quanto i suoi permessi consentono

Un anno dopo l'avvertimento di Mozilla sugli account sviluppatore rubati: perché la domanda utile non è di chi ti fidi, ma cosa potrebbe raggiungere un'estensione compromessa.

tabella dei permessi nel caso peggiore checklist di valutazione

Come si misura qui

Una prova di controllo, sempre

Prima che un risultato conti, il metodo deve fallire dove deve. Un confronto che non distingue il caso di riferimento non misura nulla.

Dati grezzi pubblicati

Le cifre arrivano con il file da cui sono state calcolate, con data e ora. Questo le rende verificabili — e significa che nessuno deve accettare un'affermazione sulla fiducia.

Le perdite nominate per prime

Dove il nostro stesso strumento è peggiore — dimensione del file, tempo di elaborazione, funzioni mancanti —, è detto prima dei vantaggi. Un confronto che limita ad adulare non vale nulla.

Datate, non senza tempo

Ogni cifra porta la data in cui è stata rilevata. Il software cambia; una misurazione senza data diventa silenziosamente un'affermazione falsa.

Strumenti

Software costruito qui, documentato come tutto il resto del sito — compreso ciò che non sa fare. Compare in alcune delle misurazioni qui sopra; è dichiarato in ciascuna.

Full Page PDF Snap

Estensione di Firefox che salva un'intera pagina web come un PDF continuo. Gira sul dispositivo, chiede activeTab invece dell'accesso a tutti i siti, funziona su Firefox per Android. Licenza MIT. Opzionalmente scrive nel PDF la citazione che la pagina dichiara — autori, DOI, licenza, momento della consultazione —, con un record RIS accanto.

Endpoint di citazione su /mcp

Dagli un URL, ricevi ciò che quella pagina dichiara di sé come record strutturato con RIS e BibTeX — o un rifiuto nominato quando la pagina si rivela un paywall, un errore o un controllo anti-bot invece di un'opera. Nessun account e nessuna chiave. Parla MCP per i client IA e semplice HTTP per tutto il resto.

7 su 10 fonti accademiche complete 0,45 s di mediana 3 ago 2026

Ricette: una lista di lettura trasformata in bibliografia

Istruzioni complete ed eseguibili per portare l'endpoint di citazione negli strumenti in cui si lavora davvero: un ciclo di shell che trasforma reading-list.txt in un .ris importabile per Zotero o Citavi, una riga per connettere Claude Code, la voce di server remoto per Claude Desktop e altri client MCP, e il minimo in Python. Ognuna è stata eseguita prima di essere scritta.

Ricontrolla qualsiasi cifra

Tutto qui ha metodo, dati grezzi e una prova di controllo — per poter essere verificato, non per dover essere creduto.

Il contributo più utile è una contro-misurazione che dà un risultato diverso

Quattro punti in cui le cifre pubblicate hanno più probabilità di vacillare sono nominati esplicitamente — a cominciare dalle dieci fonti su venti i cui quattro rifiuti sono blocchi contro un indirizzo di data center. Da una rete domestica il tasso dovrebbe essere più alto, e questo non è misurato.

4 punti deboli nominati 9 set di dati, CC BY 4.0 compiti aperti su GitHub

Per agenti IA: regole, costruzione, limiti

Il progetto è impostato perché un agente possa lavorarci senza prima chiedere a nessuno. I compiti aperti sono serviti in formato leggibile dalle macchine dallo strumento open_work su /mcp — con etichette, un estratto e le cinque regole che qui sono diverse dal solito.

Trasparenza

Questo sito è gestito dallo sviluppatore di Full Page PDF Snap, che compare in diverse misurazioni qui sopra. Questo è indicato in ogni articolo in cui è rilevante, e lo strumento si trova apertamente sotto /tools/ invece che nascosto dietro una cornice neutra.

Le cifre su prodotti altrui provengono esclusivamente da dati pubblicamente dichiarati — manifest e descrizioni degli store — con la data di consultazione indicata. Nessun prodotto è stato decompilato, e nulla si afferma sulle intenzioni di alcun fornitore. Le correzioni sono benvenute tramite le issue su GitHub e vengono applicate.

Proving Lab

あとで必要になるウェブページを、残しておこう。

ページ全体を、出所と日付を記した1つの PDF として保存し、リンクのリストを参考文献 リストに変えます。実際の参考文献の19.3%の出典はすでに消えています。 さらに8.7%には、どこにもアーカイブされたコピーがありません。 ここから始める · AI エージェント向け

意見ではなく測定を: ここにあるすべてには方法、生データ、コントロールランが あります。再計算できない数字は書きません。うまくいかなかったことは、まず書きます。

ここで作ったツール

Full Page PDF Snap

ウェブページ全体を1つの連続した PDF として保存します — スクロールするページ全体を1枚のシートに。端で切れることも、表や文の途中で改ページされることもありません。すべてはブラウザの中で完結します: アップロードなし、アカウントなし、データ収集なし。MIT ライセンス、無料、Firefox と Chrome に対応。

1枚のシート、26ページではなく ログインの後ろでも動作 デバイスから出ない

ここにある主張はすべて測定され、日付が付いています: 1枚対26ページテキストの92.6 %をOCRで読取可能ネットワークリクエストゼロ

Firefox 版をダウンロード

バージョン 2.33.4 — Mozilla による署名済み。デスクトップでも Android でもワンステップでインストール。

ストアを使わない方法 · Chrome と Edge · 機能の詳細

ノート

実際の作業からのビルドレポート — うまくいかなかった部分も含めて。

2026年8月15日

研究者・学生の方へ: Firefox と Chrome での拡張機能

学生向け記事の実践編: すべてのインストール経路 — デスクトップと Android の Firefox、Chrome ウェブストア、そしてストアを使わない2つの経路 —、次に キャプチャ→引用→アーカイブのワークフローと、論文で重要な4つの設定。 9か国語で提供。

2 ブラウザ、4つのインストール経路 18 の XMP フィールドを PDF に RIS レコードの経路は 2

2026年8月10日

学生の方へ: 自分で出典を名乗り、生き残り、機械が読めるソース

レポートでウェブ資料がうまくいかないのは3つの点です: 消える、引用を手入力する 必要がある、保存したファイルが検索できない画像である。キャプチャがそれぞれに 何をするか — 20件中6件をあなたに返す部分も含めて。9か国語で提供。

カバレッジ 61%、Citoid と同等 正確性 100%、相手の79%に対して 20件中6件 は返却

2026年8月3日

AI エージェントがブラウザ拡張機能にできること、できないこと

他人のブラウザへのインストールは、設計上ユーザー操作です — どのストアもそのための API を公開していません。エージェントが代わりにできること、何も読み込まず何も 言わないコマンドラインフラグ、そして両者の仕事の分かれ目。

エージェントにできること 3 静かに失敗するフラグ 1 他人のためにインストールする方法は 0

2026年8月3日

機械があなたのために引用できないソース — それでも引用する方法

引用ツールがソースを返却するとき、原因は3つのうちの1つです: ボット防御、ネットワーク への拒否、あるいは自分について何も宣言しないページ。それぞれ必要な作業が異なり、 ブラウザでページを開くことで解決するのは1つだけです。

原因は 3 ブラウザで解決するのは 1 見分けるのに必要なリクエストは 2

2026年8月2日

このサイトは MCP サーバーを運営しています。測定結果: 競合するファイルより小さい

/mcp のエンドポイントが、データセット、メソッド、引用リーダーを JSON-RPC で AI クライアントに渡します — キーなし、アカウントなし。実際に何の 役に立つのか、そして同じドメインの素のテキストファイルですでに用が足りるのは どこか。

ツール 4 合計 1,300 トークン llms.txt では 1,988

2026年8月1日

AI アシスタントと1日でソフトウェアを作って、6つうまくいかなかったこと

ブラウザエンジンについての間違った思い込み、公開前に見つかった虚偽の主張、公開 リポジトリまであと1コミットだった22のローカルパス — あと3つ。実際に何が見つけたかで 並べています — 2つは幸運で、1つは何によっても見つかりませんでした。

6件中3件 は外部ソースの確認で発見 1 つは本番でいまだ未テスト

測定

それぞれに、再現するためのコマンドと、その背後にある生データがあります。

2026年8月3日

クリックなしでブラウザ拡張機能をインストールし、再び削除する

4つの経路、双方向。1つは署名済みストアビルドをウィンドウなし・管理者権限なしで 4.1秒でインストールとアンインストールを行い — 2つのコマンド自体は0.24秒です。 コストはブラウザの起動であって、作業ではありません。クリック経路は179秒かかり、 すべてのステップで成功と報告し、何もインストールしませんでした: 空所へのクリックも 有効なクリックなのです。速い経路はストアのユーザー統計にカウントされません — それは欠陥ではなく、要点です。

2026年8月3日

20のリンク、10の引用: 機械が終わらせるものと、返すもの

読書リストを参考文献に、最初から最後まで。分かれ目は有料か無料かではなく — 引用されるために作られたページと、読まれるために作られたページの間にあります。 学術出版社はどちらにしてもレコードを返します。統計ポータル、商工会議所、新聞は 返しません — 防御しているからではありません。

完全なレコード 10/20 ボット防御 1 宣言するものがないページ 5

2026年8月3日

エージェントは12件中8件を引用できる — 有用なのは、できない4件が分かること

混合の読書リストを引用エンドポイントに通しました: 3分の2は RIS 付きの完全な レコード、残りは手で取得できるだけ正確に — 捏造するのではなく — 名前を挙げて 返されます。

エージェントが処理 8/12 1ソースあたり 1.09秒 推測でなく指名 4

2026年8月2日

ランダムサンプルで Citoid と比較測定: 同じカバレッジ、捏造なし

Zotero トランスレーター上に構築された Wikimedia のサービスが物差しです。ランダムに 抽出した18の著作で: カバレッジは同等、拒否を成功と報告したことは一度もありません。

フィールド完全 13/13 誤ったブロック報告 0 中央値 0.35秒

2026年8月1日

PDF に印刷するか、画面をキャプチャするか? 同じページを両方の方法で測定

Firefox はすでに無料でページを PDF 保存できます。では、キャプチャが報われるのは どんなときか? 同じ記事を両方の経路で — 答えは、どちらの側も普段認めるより、 狭く、そして有用です。

ページ数 1 : 26 文を断ち切る改ページ 9 テキストではキャプチャが優位: 91.5%

2026年8月1日

OCR のためのウェブページ PDF 化: 実際にどれだけのテキストが残るか?

全ページスクリーンショット PDF を Tesseract にかけ、出典記事と比較しました。 認識が崩壊する解像度の閾値も含まれています。

語彙の 92.6% を回復 重要な値 8/8 崩壊点 72 dpi

2026年8月1日

あなたの PDF 拡張機能はページをアップロードしていますか?

現在の PDF 拡張機能がマニフェストで宣言していること、30秒で検証する方法 — そして 誰も言わない帰結: サーバーサイドのコンバーターはログインの後ろのページに届きません。

調査した拡張機能 8 生データ公開済み

2026年8月1日

拡張機能は、その権限が許す範囲でしか危険にならない

Mozilla が開発者アカウントのフィッシングを警告してから1年: 有用な問いは「誰を 信頼するか」ではなく、「侵害された拡張機能が何に届きうるか」です。

最悪ケースの権限表 評価チェックリスト

ここでの測定のしかた

コントロールランを、必ず

結果がカウントされる前に、方法は失敗すべきところで失敗しなければなりません。参照 ケースを区別できない比較は、何も測っていません。

生データを公開

数字は、計算元のファイルとタイムスタンプ付きで提供されます。それが検証可能性を 意味し — 誰も主張を信用で受け入れる必要がないことを意味します。

劣る点を先に挙げる

自分たちのツールが劣っているところ — ファイルサイズ、処理時間、欠けている機能 — は、 利点より先に述べます。お世辞だけの比較は無価値です。

時代を超えない、日付付きで

すべての数字は取得日を伴います。ソフトウェアは変わります。日付のない測定は、静かに 虚偽の主張へと変わります。

ツール

ここで作られたソフトウェア。このサイトの他のすべてと同じように — できないことも 含めて — 文書化しています。上の測定のいくつかに登場しますが、それは各測定で開示しています。

Full Page PDF Snap

ウェブページ全体を1つの連続した PDF として保存する Firefox 拡張機能。デバイス上で 動作し、全サイトへのアクセスではなく activeTab を要求し、Android 版 Firefox で動きます。MIT ライセンス。オプションで、ページが宣言する引用情報 — 著者、DOI、ライセンス、取得時刻 — を RIS レコードとともに PDF に書き込みます。

/mcp の引用エンドポイント

URL を渡すと、そのページが自分について宣言していることを RIS と BibTeX 付きの 構造化レコードとして返します — あるいは、ページが著作物ではなくペイウォール、 エラー、ボットチェックだった場合は、名前付きの拒否を返します。アカウントもキーも 不要。AI クライアントには MCP を、それ以外には素の HTTP を話します。

学術ソースの 10件中7件 が完全 中央値 0.45秒 2026年8月3日

レシピ: 読書リストを参考文献リストに

引用エンドポイントを、人々が実際に使っているツールに組み込むための、完全で実行 可能な手順: reading-list.txt を Zotero や Citavi にインポートできる 1つの .ris に変えるシェルループ、Claude Code をつなぐ1行、Claude Desktop や他の MCP クライアント向けのリモートサーバー設定、そして Python の 最小構成。すべて、書き留める前に実行済みです。

どの数字でも、自分で確かめてください

ここにあるすべてには方法、生データ、コントロールランがあります — 信じるためではなく、 確かめるためです。

いちばん有用な貢献は、違う結果の出る追測定です

公開されている数字がいちばん揺らぎそうな4か所を明示しています — まず、20件中 10件のソースで、4件の拒否がデータセンターのアドレスへのブロックだった点から。 家庭のネットワークからなら率はもっと高いはずで、それは未測定です。

挙げた弱点 4 か所 データセット 9 件、CC BY 4.0 未解決のタスクは GitHub

AI エージェントへ: ルール、作り、限界

このプロジェクトは、エージェントが誰かに尋ねることなく作業できるように構成されて います。未解決のタスクは open_work ツールが /mcp で機械可読に提供します — ラベル、抜粋、そしてここが 普通と違う5つのルールとともに。

開示

このサイトは Full Page PDF Snap の開発者が運営しており、このツールは上のいくつかの測定に登場します。 そのことは関連する各記事に記されており、ツールは中立的な体裁の後ろに隠すのではなく、 /tools/ の下に公開されています。

他社製品についての数字は、公開された宣言データ — マニフェストとストアの説明文 — のみに 由来し、取得日が記されています。どの製品も逆コンパイルしておらず、どの提供者の意図 についても主張していません。修正は GitHub issues で歓迎し、取り入れられます。

Proving Lab

Guarde a página da web de que você vai precisar depois.

Salve uma página inteira como um único PDF que carrega sua origem e sua data — e transforme uma lista de links numa bibliografia. 19,3 % das fontes em bibliografias reais já desapareceram, e 8,7 % não têm cópia arquivada em lugar nenhum. Comece aqui · para agentes de IA

Medições, não opiniões: tudo aqui tem método, dados brutos e uma execução de controle. O que não pode ser recalculado não é escrito. O que deu errado é escrito primeiro.

A ferramenta construída aqui

Full Page PDF Snap

Salva uma página da web inteira como um PDF contínuo — toda a página rolável numa única folha. Nada cortado nas bordas e nenhuma quebra de página atravessando uma tabela ou uma frase. Tudo acontece no seu navegador: sem upload, sem conta, sem coleta de dados. Licença MIT, gratuito, Firefox e Chrome.

Uma folha, não 26 páginas Funciona atrás de um login Fica no seu dispositivo

Cada afirmação aqui é medida e datada: uma folha contra 26, 92,6 % do texto legível por OCR, zero requisições de rede.

Baixar para Firefox

Versão 2.33.4 — assinada pela Mozilla. Instala em um passo, desktop e Android.

Sem nenhuma loja · Chrome e Edge · O que ela faz

Notas

Relatos de trabalho real — incluindo as partes que deram errado.

15 de agosto de 2026

Para pesquisadores e estudantes: a extensão no Firefox e no Chrome

O complemento prático do artigo para estudantes: todas as vias de instalação — Firefox no desktop e no Android, a Chrome Web Store e os dois caminhos sem loja —, depois o fluxo capturar–citar–arquivar e as quatro configurações que importam para os trabalhos. Em nove idiomas.

2 navegadores, 4 vias de instalação 18 campos XMP no PDF 2 caminhos para o registro RIS

10 de agosto de 2026

Para estudantes: uma fonte que se cita sozinha, sobrevive e pode ser lida por máquina

Três coisas dão errado com uma fonte da web num trabalho acadêmico: ela desaparece, sua citação precisa ser digitada à mão, e o arquivo guardado é uma imagem que nenhuma ferramenta pesquisa. O que uma captura faz contra cada uma — incluindo as seis fontes em vinte que ela devolve para você. Em nove idiomas.

61 % de cobertura, igual ao Citoid 100 % correto contra os 79 % dele 6 de 20 devolvidas

3 de agosto de 2026

O que um agente de IA pode e não pode fazer com uma extensão de navegador

Instalar uma no navegador de alguém é um gesto do usuário por projeto — nenhuma loja expõe uma API para isso. O que um agente pode fazer em vez disso, a flag de linha de comando que não carrega nada e não diz nada, e onde o trabalho se divide entre os dois.

3 coisas que um agente pode fazer 1 flag que falha em silêncio 0 formas de instalar para outra pessoa

3 de agosto de 2026

As fontes que uma máquina não pode citar por você — e como citá-las mesmo assim

Quando uma ferramenta de citação devolve uma fonte, a causa é uma de três: uma defesa contra bots, uma recusa dirigida à rede ou uma página que não declara nada sobre si. Cada uma exige um trabalho diferente, e só uma se resolve abrindo a página num navegador.

3 causas 1 resolvida por um navegador 2 requisições para distingui-las

2 de agosto de 2026

Este site roda um servidor MCP. Medido: é menor que o arquivo com que compete

Um endpoint em /mcp entrega os conjuntos de dados, os métodos e um leitor de citações a clientes de IA via JSON-RPC — sem chave, sem conta. Para que isso realmente serve, e onde um simples arquivo de texto no mesmo domínio já faz o trabalho.

4 ferramentas 1.300 tokens no total 1.988 no llms.txt

1 de agosto de 2026

Seis coisas deram errado construindo software com um assistente de IA em um dia

Uma suposição errada sobre motores de navegador, uma afirmação falsa detectada antes da publicação, 22 caminhos locais a um commit de um repositório público — e mais três. Ordenadas pelo que realmente as detectou: duas foram encontradas por sorte, uma por nada.

3 de 6 detectadas verificando uma fonte externa 1 ainda não testada em produção

Medições

Cada uma com os comandos para repeti-la e os dados brutos por trás.

3 de agosto de 2026

Instalar uma extensão de navegador sem um clique, e removê-la de novo

Quatro vias, nas duas direções. Uma instala e desinstala uma versão assinada da loja em 4,1 segundos sem janela e sem direitos de administrador — e os dois comandos em si levam 0,24 s; o custo é iniciar o navegador, não o trabalho. A via do clique levou 179 segundos, relatou sucesso em cada passo e não instalou nada: um clique no vazio é um clique válido. A via rápida não conta nas estatísticas de usuários da loja — e essa é a questão, não o defeito.

3 de agosto de 2026

Vinte links, dez citações: o que uma máquina termina e o que devolve

Uma lista de leitura transformada em bibliografia, de ponta a ponta. A divisão não passa entre pago e grátis — passa entre páginas feitas para serem citadas e páginas feitas para serem lidas. Editoras científicas entregam registros nos dois casos; portais de estatística, câmaras de comércio e jornais não entregam nenhum, e não porque se defendam.

10/20 registros completos 1 defesa contra bots 5 páginas sem nada a declarar

3 de agosto de 2026

Um agente consegue citar oito de doze fontes — a parte útil é saber quais quatro não consegue

Uma lista de leitura mista pelo endpoint de citação: registros completos com RIS para dois terços, e o resto nomeado com precisão suficiente para buscar à mão em vez de inventar.

8/12 feitas pelo agente 1,09 s por fonte 4 nomeadas, não adivinhadas

2 de agosto de 2026

Medido contra o Citoid em amostras aleatórias: mesma cobertura, nada inventado

O serviço da Wikimedia construído sobre os tradutores do Zotero é o parâmetro. Em 18 obras sorteadas ao acaso: cobertura igual, e nenhuma recusa relatada como sucesso.

13/13 campos completos 0 falsos relatórios de bloqueio 0,35 s de mediana

1 de agosto de 2026

Imprimir em PDF ou capturar a tela? A mesma página medida dos dois jeitos

O Firefox já salva páginas em PDF de graça. Quando vale uma captura? O mesmo artigo pelas duas vias — e a resposta é mais estreita, e mais útil, do que qualquer um dos lados costuma admitir.

1 : 26 páginas 9 quebras cortam uma frase captura vence no texto: 91,5 %

1 de agosto de 2026

Página da web em PDF para OCR: quanto texto realmente sobrevive?

Um PDF de captura de página inteira passado pelo Tesseract e comparado com o artigo de origem. Inclui o limiar de resolução em que o reconhecimento colapsa.

92,6 % do vocabulário recuperado 8/8 valores críticos 72 dpi ponto de colapso

1 de agosto de 2026

Sua extensão de PDF envia a página?

O que as extensões de PDF atuais declaram em seus manifestos, como verificar em 30 segundos — e a consequência que ninguém menciona: conversores no lado do servidor não alcançam páginas atrás de um login.

8 extensões examinadas dados brutos publicados

1 de agosto de 2026

Uma extensão só é tão perigosa quanto suas permissões permitem

Um ano depois do alerta da Mozilla sobre contas de desenvolvedor roubadas: por que a pergunta útil não é em quem você confia, mas o que uma extensão comprometida poderia alcançar.

tabela de permissões no pior caso checklist de avaliação

Como se mede aqui

Uma execução de controle, sempre

Antes que um resultado conte, o método tem de falhar onde deve. Uma comparação que não distingue o caso de referência não mede nada.

Dados brutos publicados

Os números vêm com o arquivo de onde foram calculados, com carimbo de data. Isso os torna verificáveis — e significa que ninguém precisa aceitar uma afirmação pela confiança.

As perdas nomeadas primeiro

Onde a nossa própria ferramenta é pior — tamanho de arquivo, tempo de processamento, funções ausentes —, isso é dito antes das vantagens. Uma comparação que só elogia não vale nada.

Datadas, não atemporais

Cada número carrega a data em que foi levantado. Software muda; uma medição sem data se torna em silêncio uma afirmação falsa.

Ferramentas

Software construído aqui, documentado como tudo o mais neste site — incluindo o que não consegue fazer. Aparece em algumas das medições acima; isso é declarado em cada uma.

Full Page PDF Snap

Extensão do Firefox que salva uma página da web inteira como um PDF contínuo. Roda no dispositivo, pede activeTab em vez de acesso a todos os sites, funciona no Firefox para Android. Licença MIT. Opcionalmente grava no PDF a citação que a página declara — autores, DOI, licença, momento da consulta —, com um registro RIS ao lado.

Endpoint de citação em /mcp

Dê uma URL, receba o que essa página declara sobre si como registro estruturado com RIS e BibTeX — ou uma recusa nomeada quando a página se revela um paywall, um erro ou uma verificação de bots em vez de uma obra. Sem conta e sem chave. Fala MCP para clientes de IA e HTTP simples para todo o resto.

7 de 10 fontes acadêmicas completas 0,45 s de mediana 3 ago 2026

Receitas: uma lista de leitura transformada em bibliografia

Instruções completas e executáveis para colocar o endpoint de citação nas ferramentas em que as pessoas realmente trabalham: um laço de shell que transforma reading-list.txt num .ris importável para Zotero ou Citavi, uma linha para conectar o Claude Code, a entrada de servidor remoto para o Claude Desktop e outros clientes MCP, e o mínimo em Python. Cada uma foi executada antes de ser escrita.

Confira qualquer número

Tudo aqui tem método, dados brutos e uma execução de controle — para poder ser conferido, não para precisar ser acreditado.

A contribuição mais útil é uma contramedição que dá um resultado diferente

Quatro pontos onde os números publicados têm mais chance de balançar são nomeados explicitamente — começando pelas dez de vinte fontes cujas quatro recusas são bloqueios contra um endereço de data center. De uma rede doméstica a taxa deveria ser maior, e isso não está medido.

4 pontos fracos nomeados 9 conjuntos de dados, CC BY 4.0 tarefas abertas no GitHub

Para agentes de IA: regras, construção, limites

O projeto é montado para que um agente possa trabalhar nele sem antes perguntar a ninguém. As tarefas abertas são servidas em formato legível por máquina pela ferramenta open_work em /mcp — com rótulos, um trecho e as cinco regras que aqui são diferentes do habitual.

Transparência

Este site é operado pelo desenvolvedor do Full Page PDF Snap, que aparece em várias das medições acima. Isso é indicado em cada artigo em que é relevante, e a ferramenta está abertamente em /tools/ em vez de escondida atrás de um enquadramento neutro.

Os números sobre produtos de terceiros vêm exclusivamente de dados publicamente declarados — manifestos e descrições de loja — com a data de consulta informada. Nenhum produto foi descompilado, e nada se afirma sobre as intenções de qualquer fornecedor. Correções são bem-vindas via issues no GitHub e são aplicadas.

Proving Lab

Сохраните веб-страницу, которая понадобится вам позже.

Сохраните страницу целиком одним PDF, который несёт её источник и дату — и превратите список ссылок в библиографию. 19,3 % источников в реальных библиографиях уже исчезли, а у 8,7 % нет ни одной архивной копии. Начните здесь · для ИИ-агентов

Измерения, а не мнения: у всего здесь есть метод, сырые данные и контрольный прогон. Что нельзя пересчитать, то не записывается. Что пошло не так, записывается первым.

Инструмент, построенный здесь

Full Page PDF Snap

Сохраняет веб-страницу целиком одним непрерывным PDF — вся прокручиваемая страница на одном листе. Ничего не обрезано по краям, и ни один разрыв страницы не проходит через таблицу или предложение. Всё происходит в вашем браузере: без выгрузки, без учётной записи, без сбора данных. Лицензия MIT, бесплатно, Firefox и Chrome.

Один лист, а не 26 страниц Работает за логином Остаётся на вашем устройстве

Каждое утверждение здесь измерено и датировано: один лист против 26, 92,6 % текста читается OCR, ноль сетевых запросов.

Скачать для Firefox

Версия 2.33.4 — подписана Mozilla. Устанавливается в один шаг, компьютер и Android.

Совсем без магазина · Chrome и Edge · Что она умеет

Заметки

Отчёты из реальной работы — включая части, которые пошли не так.

15 августа 2026 г.

Исследователям и студентам: расширение в Firefox и Chrome

Практическая пара к статье для студентов: все способы установки — Firefox на компьютере и Android, Chrome Web Store и оба пути без магазина —, затем цикл «захват–цитирование–архив» и четыре настройки, важные для научных работ. На девяти языках.

2 браузера, 4 способа установки 18 полей XMP в PDF 2 пути для RIS-записи

10 августа 2026 г.

Студентам: источник, который сам себя цитирует, выживает и читается машиной

Три вещи идут не так с веб-источником в курсовой: он исчезает, его цитату приходится перепечатывать вручную, а сохранённый файл — картинка, которую ни один инструмент не ищет. Что захват делает против каждой — включая шесть источников из двадцати, которые он возвращает вам. На девяти языках.

61 % покрытия, как у Citoid 100 % точности против его 79 % 6 из 20 возвращены

3 августа 2026 г.

Что ИИ-агент может и чего не может с расширением браузера

Установка в чужой браузер — это по замыслу жест пользователя: ни один магазин не предоставляет для этого API. Что агент может вместо этого, флаг командной строки, который ничего не загружает и ничего не говорит, и где между ними двоими делится работа.

3 вещи, которые агент может 1 флаг, который молча не срабатывает 0 способов установить за кого-то

3 августа 2026 г.

Источники, которые машина не может процитировать за вас — и как процитировать их всё же

Когда инструмент цитирования возвращает источник, причина — одна из трёх: защита от ботов, отказ, направленный на сеть, или страница, которая ничего о себе не заявляет. Каждая требует своей работы, и лишь одна решается открытием страницы в браузере.

3 причины 1 решается браузером 2 запроса, чтобы их различить

2 августа 2026 г.

Этот сайт держит MCP-сервер. Измерено: он меньше файла, с которым соревнуется

Конечная точка на /mcp передаёт наборы данных, методы и читалку цитат ИИ-клиентам по JSON-RPC — без ключа, без учётной записи. Для чего это на самом деле годится, и где обычный текстовый файл на том же домене уже справляется.

4 инструмента 1 300 токенов всего 1 988 в llms.txt

1 августа 2026 г.

Шесть вещей, пошедших не так при создании ПО с ИИ-ассистентом за один день

Неверное предположение о браузерных движках, ложное утверждение, пойманное до публикации, 22 локальных пути в одном коммите от публичного репозитория — и ещё три. Отсортированы по тому, что их реально поймало: два нашлись по везению, один — ничем.

3 из 6 пойманы проверкой внешнего источника 1 до сих пор не проверен в продакшене

Измерения

Каждое — с командами для его повторения и с сырыми данными за ним.

3 августа 2026 г.

Установка расширения браузера без единого щелчка — и удаление обратно

Четыре пути, в обе стороны. Один устанавливает и удаляет подписанную магазинную сборку за 4,1 секунды без окна и без прав администратора — а сами две команды занимают 0,24 с; цена — запуск браузера, а не работа. Путь со щелчком занял 179 секунд, сообщил об успехе на каждом шаге и не установил ничего: щелчок в пустоту — действительный щелчок. Быстрый путь не считается в статистике пользователей магазина — и это суть, а не недостаток.

3 августа 2026 г.

Двадцать ссылок, десять цитат: что машина доводит до конца, а что возвращает

Список чтения в библиографию, от начала до конца. Граница проходит не между платным и бесплатным — она проходит между страницами, построенными, чтобы их цитировали, и страницами, построенными, чтобы их читали. Научные издательства дают записи в обоих случаях; статистические порталы, торговые палаты и газеты не дают никаких — и не потому, что защищаются.

10/20 полных записей 1 защита от ботов 5 страниц без единого заявления

3 августа 2026 г.

Агент может процитировать восемь из двенадцати источников — полезно знать, какие четыре он не может

Смешанный список чтения через конечную точку цитирования: полные записи с RIS для двух третей, а остальные названы достаточно точно, чтобы забрать их вручную вместо выдумывания.

8/12 сделано агентом 1,09 с на источник 4 названы, а не угаданы

2 августа 2026 г.

Измерено против Citoid на случайных выборках: то же покрытие, ничего выдуманного

Эталон — сервис Wikimedia, построенный на трансляторах Zotero. На 18 случайно извлечённых произведениях: одинаковое покрытие, и ни одного отказа, доложенного как успех.

13/13 полей заполнены 0 ложных сообщений о блокировке 0,35 с медиана

1 августа 2026 г.

Печатать в PDF или захватывать экран? Одна и та же страница, измеренная двумя способами

Firefox уже сохраняет страницы в PDF бесплатно. Так когда окупается захват? Одна и та же статья обоими путями — и ответ уже и полезнее, чем обычно признаёт любая из сторон.

1 : 26 страниц 9 разрывов режут предложение захват ведёт по тексту: 91,5 %

1 августа 2026 г.

Веб-страница в PDF для OCR: сколько текста реально выживает?

PDF полностраничного скриншота прогнан через Tesseract и сравнён с исходной статьёй. Включая порог разрешения, на котором распознавание рушится.

92,6 % словаря восстановлено 8/8 критических значений 72 dpi точка обвала

1 августа 2026 г.

Выгружает ли ваше PDF-расширение страницу?

Что декларируют актуальные PDF-расширения в своих манифестах, как проверить это за 30 секунд — и следствие, о котором никто не говорит: серверные конвертеры не достают страницы за логином.

8 расширений исследовано сырые данные опубликованы

1 августа 2026 г.

Расширение опасно ровно настолько, насколько позволяют его разрешения

Год спустя после предупреждения Mozilla об украденных учётках разработчиков: почему полезный вопрос не «кому вы доверяете», а «до чего дотянется скомпрометированное расширение».

таблица разрешений наихудшего случая контрольный список оценки

Как здесь измеряют

Контрольный прогон — всегда

Прежде чем результат засчитывается, метод должен отказать там, где должен. Сравнение, не различающее эталонный случай, не измеряет ничего.

Сырые данные опубликованы

Цифры приходят с файлом, из которого они вычислены, и с меткой времени. Это делает их проверяемыми — и значит, никому не нужно принимать утверждение на веру.

Потери названы первыми

Где наш собственный инструмент хуже — размер файла, время обработки, недостающие функции —, сказано до преимуществ. Сравнение, которое только льстит, ничего не стоит.

Датировано, а не вне времени

Каждая цифра несёт дату своего снятия. Программы меняются; измерение без даты тихо превращается в ложное утверждение.

Инструменты

Программы, построенные здесь, задокументированы как всё на этом сайте — включая то, чего они не умеют. Они встречаются в некоторых измерениях выше; это раскрыто в каждом из них.

Full Page PDF Snap

Расширение Firefox, сохраняющее веб-страницу целиком одним непрерывным PDF. Работает на устройстве, запрашивает activeTab вместо доступа ко всем сайтам, работает на Firefox для Android. Лицензия MIT. Опционально записывает в PDF цитату, которую заявляет страница — авторы, DOI, лицензия, время обращения —, с RIS-записью рядом.

Конечная точка цитирования на /mcp

Дайте ей URL — получите то, что эта страница заявляет о себе, в виде структурированной записи с RIS и BibTeX, или именованный отказ, если страница оказывается пейволом, ошибкой или проверкой на бота, а не произведением. Ни учётной записи, ни ключа. Говорит на MCP для ИИ-клиентов и на простом HTTP для всего остального.

7 из 10 научных источников полные 0,45 с медиана 3 авг 2026

Рецепты: список чтения в библиографию

Полные, исполняемые инструкции, как встроить конечную точку цитирования в инструменты, в которых люди реально работают: цикл shell, превращающий reading-list.txt в импортируемый .ris для Zotero или Citavi, одна строка для подключения Claude Code, запись удалённого сервера для Claude Desktop и других MCP-клиентов и минимум на Python. Каждая была выполнена до того, как записана.

Перепроверьте любую цифру

У всего здесь есть метод, сырые данные и контрольный прогон — чтобы это можно было перепроверить, а не чтобы этому приходилось верить.

Самый полезный вклад — контр-измерение с другим результатом

Явно названы четыре места, где опубликованные цифры наиболее вероятно шатаются — начиная с десяти из двадцати источников, чьи четыре отказа были блокировками адреса дата-центра. Из домашней сети показатель должен быть выше, и это не измерено.

4 названных слабых места 9 наборов данных, CC BY 4.0 открытые задачи на GitHub

Для ИИ-агентов: правила, устройство, границы

Проект устроен так, что агент может работать над ним, ни у кого предварительно не спрашивая. Открытые задачи машиночитаемо выдаёт инструмент open_work на /mcp — с метками, выдержкой и пятью правилами, которые здесь отличаются от обычных.

Раскрытие

Этот сайт ведёт разработчик Full Page PDF Snap, который встречается в нескольких измерениях выше. Это указано в каждой статье, где это уместно, и инструмент открыто лежит под /tools/, а не спрятан за нейтральной рамкой.

Цифры о чужих продуктах происходят исключительно из публично заявленных данных — манифестов и описаний в магазинах — с указанной датой обращения. Ни один продукт не был декомпилирован, и ничего не утверждается о намерениях какого-либо поставщика. Исправления приветствуются через issues на GitHub и применяются.

Proving Lab

留住你以后会用到的网页。

把整个页面保存为一份带来源和日期的 PDF——并把一串链接变成参考文献列表。 真实参考文献中 19.3% 的来源已经消失,8.7% 的来源在任何地方都没有存档副本。 从这里开始 · 面向 AI 代理

要测量,不要观点:这里的一切都有方法、原始数据和对照运行。无法复算的数字 不写下来;出了差错的事情最先写下来。

这里打造的工具

Full Page PDF Snap

把整个网页保存为一份连续的 PDF——整个可滚动的页面在一张纸上。边缘无裁切,也没有穿过表格或句子的分页符。一切都在你的浏览器中发生:无上传、无账户、无数据收集。MIT 许可,免费,支持 Firefox 和 Chrome。

一张纸,而不是 26 页 在登录之后也能用 留在你的设备上

这里的每一项主张都经过测量并注明日期: 一张纸对 26 页92.6% 的文本可被 OCR 读取零网络请求

下载 Firefox 版

版本 2.33.4——由 Mozilla 签名。桌面端和 Android 均可一步安装。

完全不经过商店 · Chrome 和 Edge · 功能介绍

笔记

来自真实工作的构建记录——包括出错的部分。

2026年8月15日

致研究人员和学生:Firefox 与 Chrome 中的扩展

学生篇的实践姊妹篇:所有安装途径——桌面端与 Android 的 Firefox、Chrome 应用商店, 以及两条不经商店的路径——然后是“捕获—引用—归档”工作流,以及对论文至关重要 的四项设置。以九种语言提供。

2 款浏览器,4 条安装途径 PDF 中的 18 个 XMP 字段 RIS 记录的 2 条路径

2026年8月10日

致学生:一个能自引出处、能够存活、可被机器读取的来源

网络来源在课程论文中会出三种问题:它会消失;它的引用要手工录入;你保存的文件是 任何工具都无法搜索的图片。一次捕获对这三者各能做什么——包括 20 个来源中它 交还给你的 6 个。以九种语言提供。

覆盖率 61%,与 Citoid 持平 准确率 100%,对其 79% 20 个中 6 个被交还

2026年8月3日

AI 代理用浏览器扩展能做什么、不能做什么

向他人浏览器安装扩展,按设计是用户操作——没有任何商店为此提供 API。代理可以改做 什么、那个什么都不加载也什么都不说的命令行参数,以及两者之间的工作如何划分。

代理能做的 3 件事 1 个静默失败的参数 替他人安装的方式 0

2026年8月3日

机器无法替你引用的来源——以及如何照样引用它们

当引用工具把一个来源退回时,原因是三者之一:反机器人防御、针对网络的拒绝,或是 一个对自身毫无声明的页面。三者需要的处理各不相同,而其中只有一种靠用浏览器 打开页面解决。

原因 3 1 种靠浏览器解决 区分它们需要 2 次请求

2026年8月2日

本站运行一个 MCP 服务器。实测:它比与之竞争的文件还小

/mcp 端点通过 JSON-RPC 向 AI 客户端提供数据集、方法和引用读取器—— 无需密钥、无需账户。它究竟有什么用,以及在哪些地方同域名下的一个纯文本文件 就已经够用。

工具 4 合计 1,300 token llms.txt 中为 1,988

2026年8月1日

一天之内与 AI 助手开发软件出错的六件事

一个关于浏览器引擎的错误假设、一个在发布前被拦下的虚假陈述、距离公开仓库仅一次 提交的 22 个本地路径——还有三件。按究竟是什么抓住了它们来排序:两个靠运气被 发现,一个什么都没发现它。

6 件中 3 件靠核对来源被发现 1 个至今未在生产中验证

测量

每一项都附有复现它的命令和其背后的原始数据。

2026年8月3日

无需点击即可安装浏览器扩展,并将其移除

四条路径,双向。其中一条在 4.1 秒内安装并卸载了商店签名版本,无窗口、无管理员权限 ——而两条命令本身只需 0.24 秒,成本在启动浏览器,而非工作。点击路径用了 179 秒, 每一步都报告成功,却什么都没装上:点击空白处也是有效点击。快速路径不计入商店的 用户统计——这正是关键,而非缺陷。

2026年8月3日

二十个链接,十条引用:机器完成了什么,交还了什么

把一份阅读清单从头到尾变成参考文献。分界线不在付费与免费之间——而在为被引用而 建的页面和为被阅读而建的页面之间。学术出版社两种情况下都会给出记录;统计门户、 商会和报纸一条也不给,而且并不是因为它们在防御。

完整记录 10/20 反机器人防御 1 无任何可声明内容的页面 5

2026年8月3日

代理能引用 12 个来源中的 8 个——有用的部分是知道哪 4 个不行

把一份混合阅读清单送入引用端点:三分之二得到带 RIS 的完整记录,其余的被足够精确地 命名,可以手动获取,而不是靠编造。

代理完成 8/12 每个来源 1.09 秒 4 个被指名而非猜测

2026年8月2日

在随机样本上与 Citoid 对比测量:相同覆盖率,零编造

基于 Zotero 翻译器构建的维基媒体服务是标尺。随机抽取 18 部著作:覆盖率相同, 且没有一次拒答被报为成功。

字段完整 13/13 错误的拦截报告 0 中位数 0.35 秒

2026年8月1日

打印为 PDF 还是截屏?同一页面两种方式实测

Firefox 已经可以免费把页面存为 PDF。那么什么时候值得捕获?同一篇文章走两条路径 ——答案比任何一方通常承认的都更窄,也更有用。

页数 1 : 26 9 处分页截断句子 文本方面捕获领先:91.5%

2026年8月1日

网页转 PDF 用于 OCR:究竟有多少文本存活?

把整页截图 PDF 送入 Tesseract,与源文章对比。还包括识别崩溃的分辨率阈值。

词汇恢复 92.6% 关键值 8/8 崩溃点 72 dpi

2026年8月1日

你的 PDF 扩展会上传页面吗?

当前 PDF 扩展在清单中声明了什么、如何在 30 秒内验证——以及没人提及的后果: 服务器端转换器够不到登录之后的页面。

调查了 8 款扩展 原始数据已公开

2026年8月1日

扩展的危险程度只取决于其权限允许的范围

在 Mozilla 就开发者账户被钓鱼发出警告一年后:为什么有用的问题不是你信任谁, 而是被攻陷的扩展能够触及什么。

最坏情况权限表 评估清单

这里如何测量

对照运行,每次都有

在结果作数之前,方法必须在应当失败的地方失败。不能区分参照案例的比较,什么也测不到。

原始数据公开

数字都附带计算它们的文件和时间戳。这使它们可以被检验——也意味着没有人需要凭信任 接受一个说法。

先讲不足

我们自己的工具在哪些方面更差——文件大小、处理时间、缺失的功能——都先讲,再讲优点。 只会讨好的比较一文不值。

注明日期,而非脱离时间

每个数字都带有采集日期。软件在变;没有日期的测量会悄悄变成虚假陈述。

工具

这里构建的软件,与本站其他内容一样记录在案——包括它做不到的事。它出现在上面的一些 测量中;这一点在每一篇里都有披露。

Full Page PDF Snap

把整个网页保存为一份连续 PDF 的 Firefox 扩展。在设备上运行,只请求 activeTab 而非全站访问,支持 Android 版 Firefox。MIT 许可。 可选地把页面声明的引用信息——作者、DOI、许可、获取时间——连同一条 RIS 记录 写入 PDF。

/mcp 引用端点

给它一个 URL,得到该页面关于自身的结构化记录(含 RIS 和 BibTeX)——或者,当页面 其实是付费墙、错误或机器人检查而非一部著作时,得到一个具名的拒绝。无需账户, 无需密钥。对 AI 客户端说 MCP,对其他一切说普通 HTTP。

学术来源 10 个里 7 个完整 中位数 0.45 秒 2026年8月3日

食谱:把阅读清单变成参考文献

把引用端点接入人们实际使用的工具的完整可运行说明:一个把 reading-list.txt 变成可导入 Zotero 或 Citavi 的 .ris 的 shell 循环,连接 Claude Code 的一行命令,Claude Desktop 及其他 MCP 客户端的远程服务器配置,以及 Python 最小 示例。每一条都在写下之前实际运行过。

任何数字,都请自己验算

这里的一切都有方法、原始数据和对照运行——是为了可以被验算,而不是必须被相信。

最有用的贡献,是得出不同结果的复核测量

我们明确指出了公开数字最可能站不住脚的四个地方——首先是 20 个来源中的 10 个, 其 4 次拒绝是针对数据中心地址的封锁。从家庭网络测,比率应该更高,而这尚未测量。

指出的薄弱环节 4 数据集 9 个,CC BY 4.0 开放任务见 GitHub

面向 AI 代理:规则、构建方式、边界

这个项目被配置成代理无需先询问任何人即可上手工作。开放任务由 open_work 工具在 /mcp 上以机器可读方式提供——附标签、摘要,以及这里 与常规不同的五条规则。

披露

本站由 Full Page PDF Snap 的开发者运营,该工具出现在上面的多项测量中。这一点在每一篇相关文章里 都有说明,而且该工具公开放在 /tools/ 下,而不是藏在中立的表述背后。

关于其他产品的数字完全来自公开声明的数据——清单文件和商店描述——并注明获取日期。 没有反编译任何产品,也不对任何提供商的意图作任何主张。欢迎通过 GitHub issues 提出更正,并会被采纳。