The short answer: use a capture extension, not the print dialog. Print paginates — the same article came out as 26 pages with 9 breaks cutting through a sentence. A capture writes one continuous sheet and can stamp the page with where it came from and when.
Firefox, desktop and Android Chrome 116+, Edge, Brave, Vivaldi
Free, MIT licensed, runs on the device. Edge asks once to allow extensions from other stores; Opera needs its Install Chrome Extensions add-on first. Then: open the page, press Alt+Shift+Y or click the icon.
| Browser print | Full-page capture | |
|---|---|---|
| Same article comes out as | 26 pages | 1 sheet |
| Page breaks cutting a sentence | 9 | 0 |
| Text you can select and search | 87.6 % recall | 91.5 % recall |
| Costs anything | no, built in | no |
The capture leads on text since it carries a text layer — 91.5 % against 87.6 %, measured 5 August. If all you need is a readable, searchable copy and the pagination does not bother you, the function already in your browser is enough — and this page says so rather than pretending otherwise. A capture is worth it when the layout matters, when a break would fall through a table, or when the source details have to travel with the file. Method and raw data
A capture extension reads what your own session already shows. A licensed journal article, a course page, an order confirmation — saved as you see it. No server-side converter can do this, because it does not have your session: measured across 20 mixed sources, a server-side reader was refused by 5 of them outright. Capturing a page you may read is a copy for your own use; it is not a route to content you do not have access to.
Only Firefox. Chrome for Android installs no extensions at all, so the question only arises there. Of 248 page-saving extensions checked against the add-ons API, 60 declare Android support and none had been tested on a device before we did. The Android measurement
A URL in a bibliography is a promise about a page you do not control. Checked against 150 sources taken from real reference lists: 19.3 % were gone, 8.7 % had no archived copy anywhere, and where a snapshot existed it was a median of 603 days old. For a page that declares no publication date, the time of retrieval is the only date a reference can carry — and it exists only at the moment you look. What happens to a source after you cite it
A capture can write that in: authors, title, DOI, licence and the exact time, inside the PDF and in an RIS record beside it — a format that imports into Zotero, Citavi, EndNote or Mendeley.
For a bibliography rather than a single page, most of the work needs no browser. Of 20 mixed sources, 10 became complete records with RIS and BibTeX in 8.1 seconds over plain HTTP — no account, no key. The other ten are handed back with the reason, so you know which addresses need you. The recipes · the measurement
Die kurze Antwort: eine Aufnahme-Erweiterung, nicht der Druckdialog. Der Druck teilt in Seiten auf — derselbe Artikel kam als 26 Seiten heraus, mit 9 Umbrüchen mitten durch einen Satz. Eine Aufnahme schreibt ein durchgehendes Blatt und kann der Seite aufprägen, woher sie stammt und wann.
Firefox, Rechner und Android Chrome 116+, Edge, Brave, Vivaldi
Kostenlos, MIT-Lizenz, läuft auf dem Gerät. Edge fragt einmal, ob Erweiterungen aus anderen Stores zugelassen werden; Opera braucht zuerst seine Erweiterung Install Chrome Extensions. Dann: Seite öffnen, Alt+Shift+Y drücken oder auf das Symbol klicken.
| Druckexport des Browsers | Vollseiten-Aufnahme | |
|---|---|---|
| Derselbe Artikel ergibt | 26 Seiten | 1 Blatt |
| Umbrüche mitten im Satz | 9 | 0 |
| Markier- und durchsuchbarer Text | 87,6 % Trefferquote | 91,5 % Trefferquote |
| Kostet etwas | nein, eingebaut | nein |
Beim Text liegt die Aufnahme vorn, seit sie eine Textebene trägt — 91,5 % gegen 87,6 %, gemessen am 5. August. Wer nur eine lesbare, durchsuchbare Kopie braucht und sich an der Seitenaufteilung nicht stört, kommt mit der Funktion aus, die im Browser schon steckt — und diese Seite sagt das, statt etwas anderes vorzugeben. Eine Aufnahme lohnt sich, wenn das Layout zählt, wenn ein Umbruch durch eine Tabelle fiele, oder wenn die Quellenangaben mit der Datei mitreisen sollen. Methode und Rohdaten
Eine Aufnahme-Erweiterung liest, was Ihre eigene Sitzung ohnehin zeigt. Ein lizenzierter Zeitschriftenartikel, ein Kursraum, eine Bestellbestätigung — gesichert, wie Sie es sehen. Kein serverseitiger Umwandler kann das, weil er Ihre Sitzung nicht hat: gemessen an 20 gemischten Quellen wurde ein serverseitiger Leser von 5 davon rundweg abgewiesen. Eine Seite zu sichern, die Sie lesen dürfen, ist eine Kopie zum eigenen Gebrauch; es ist kein Weg zu Inhalten, zu denen Sie keinen Zugang haben.
Nur Firefox. Chrome für Android installiert überhaupt keine Erweiterungen, die Frage stellt sich also nur dort. Von 248 Seiten-Speicher-Erweiterungen, die gegen die Add-ons-API geprüft wurden, geben 60 Android-Unterstützung an, und keine davon war vor uns auf einem Gerät getestet worden. Die Android-Messung
Eine Adresse im Literaturverzeichnis ist ein Versprechen über eine Seite, die Sie nicht in der Hand haben. Geprüft an 150 Quellen aus echten Verzeichnissen: 19,3 % waren verschwunden, 8,7 % waren nirgends archiviert, und wo eine Sicherung bestand, war sie im Mittel 603 Tage alt. Bei einer Seite ohne Veröffentlichungsdatum ist der Zeitpunkt des Abrufs das einzige Datum, das eine Quellenangabe tragen kann — und es existiert nur in dem Moment, in dem Sie hinsehen. Was mit einer Quelle geschieht, nachdem man sie zitiert hat
Eine Aufnahme kann das hineinschreiben: Verfasser, Titel, DOI, Lizenz und die genaue Zeit, im PDF und in einem RIS-Satz daneben — ein Format, das sich in Zotero, Citavi, EndNote oder Mendeley einlesen lässt.
Für ein Literaturverzeichnis statt einer einzelnen Seite braucht der größere Teil der Arbeit gar keinen Browser. Von 20 gemischten Quellen wurden 10 in 8,1 Sekunden zu vollständigen Datensätzen mit RIS und BibTeX, über einfaches HTTP — ohne Konto, ohne Schlüssel. Die anderen zehn kommen mit Begründung zurück, damit Sie wissen, welche Adressen Sie selbst brauchen. Die Rezepte · die Messung
La respuesta corta: una extensión de captura, no el diálogo de impresión. La impresión pagina — el mismo artículo salió como 26 páginas con 9 saltos que cortaban una frase. Una captura escribe una hoja continua y puede estampar en la página de dónde vino y cuándo.
Firefox, escritorio y Android Chrome 116+, Edge, Brave, Vivaldi
Gratis, con licencia MIT, se ejecuta en el dispositivo. Edge pregunta una vez si permite extensiones de otras tiendas; Opera necesita antes su complemento Install Chrome Extensions. Después: abra la página, pulse Alt+Shift+Y o haga clic en el icono.
| Impresión del navegador | Captura de página completa | |
|---|---|---|
| El mismo artículo sale como | 26 páginas | 1 hoja |
| Saltos de página que cortan una frase | 9 | 0 |
| Texto que se puede seleccionar y buscar | 87,6 % de exhaustividad | 91,5 % de exhaustividad |
| Cuesta algo | no, va incluido | no |
En el texto va por delante la captura desde que lleva una capa de texto — 91,5 % frente a 87,6 %, medido el 5 de agosto. Si solo necesita una copia legible y con búsqueda y la paginación no le molesta, la función que ya trae su navegador basta — y esta página lo dice en lugar de fingir lo contrario. Una captura merece la pena cuando importa la maquetación, cuando un salto caería en medio de una tabla, o cuando los datos de la fuente tienen que viajar con el archivo. Método y datos brutos
Una extensión de captura lee lo que su propia sesión ya muestra. Un artículo de revista con licencia, una página de curso, una confirmación de pedido — guardados tal como usted los ve. Ningún convertidor del lado del servidor puede hacerlo, porque no tiene su sesión: medido en 20 fuentes mixtas, un lector del lado del servidor fue rechazado de plano por 5 de ellas. Capturar una página que usted puede leer es una copia para uso propio; no es una vía hacia contenidos a los que no tiene acceso.
Solo Firefox. Chrome para Android no instala ninguna extensión, así que la pregunta solo se plantea allí. De 248 extensiones para guardar páginas comprobadas contra la API de complementos, 60 declaran compatibilidad con Android y ninguna había sido probada en un dispositivo antes de que lo hiciéramos nosotros. La medición en Android
Una dirección en una bibliografía es una promesa sobre una página que usted no controla. Comprobado con 150 fuentes tomadas de listas de referencias reales: el 19,3 % había desaparecido, el 8,7 % no tenía copia archivada en ningún sitio, y donde existía una instantánea, tenía una mediana de 603 días. Para una página que no declara fecha de publicación, el momento de la consulta es la única fecha que puede llevar una referencia — y solo existe en el instante en que usted mira. Qué le pasa a una fuente después de citarla
Una captura puede escribirlo dentro: autores, título, DOI, licencia y la hora exacta, en el PDF y en un registro RIS al lado — un formato que se importa en Zotero, Citavi, EndNote o Mendeley.
Para una bibliografía en lugar de una sola página, la mayor parte del trabajo no necesita navegador. De 20 fuentes mixtas, 10 se convirtieron en registros completos con RIS y BibTeX en 8,1 segundos por HTTP simple — sin cuenta, sin clave. Las otras diez se devuelven con el motivo, para que sepa qué direcciones le necesitan a usted. Las recetas · la medición
La réponse courte : une extension de capture, pas la boîte de dialogue d’impression. L’impression pagine — le même article est sorti en 26 pages, avec 9 sauts coupant une phrase. Une capture écrit une feuille continue et peut inscrire sur la page d’où elle vient et quand.
Firefox, ordinateur et Android Chrome 116+, Edge, Brave, Vivaldi
Gratuit, sous licence MIT, s’exécute sur l’appareil. Edge demande une fois d’autoriser les extensions d’autres boutiques ; Opera a d’abord besoin de son module Install Chrome Extensions. Ensuite : ouvrez la page, appuyez sur Alt+Shift+Y ou cliquez sur l’icône.
| Impression du navigateur | Capture pleine page | |
|---|---|---|
| Le même article sort en | 26 pages | 1 feuille |
| Sauts de page coupant une phrase | 9 | 0 |
| Texte sélectionnable et cherchable | 87,6 % de rappel | 91,5 % de rappel |
| Coûte quelque chose | non, intégré | non |
Sur le texte, la capture mène depuis qu’elle porte une couche de texte — 91,5 % contre 87,6 %, mesuré le 5 août. S’il vous faut seulement une copie lisible et cherchable et que la pagination ne vous gêne pas, la fonction déjà présente dans votre navigateur suffit — et cette page le dit plutôt que de prétendre le contraire. Une capture vaut la peine quand la mise en page compte, quand un saut tomberait au milieu d’un tableau, ou quand les indications de source doivent voyager avec le fichier. Méthode et données brutes
Une extension de capture lit ce que votre propre session affiche déjà. Un article de revue sous licence, une page de cours, une confirmation de commande — enregistrés tels que vous les voyez. Aucun convertisseur côté serveur ne peut le faire, car il n’a pas votre session : mesuré sur 20 sources variées, un lecteur côté serveur a été refusé net par 5 d’entre elles. Capturer une page que vous avez le droit de lire est une copie pour votre usage ; ce n’est pas un chemin vers des contenus auxquels vous n’avez pas accès.
Seulement Firefox. Chrome pour Android n’installe aucune extension, la question ne se pose donc que là. Sur 248 extensions d’enregistrement de pages vérifiées auprès de l’API des modules, 60 déclarent la prise en charge d’Android et aucune n’avait été testée sur un appareil avant nous. La mesure Android
Une adresse dans une bibliographie est une promesse au sujet d’une page que vous ne maîtrisez pas. Vérifié sur 150 sources tirées de vraies listes de références : 19,3 % avaient disparu, 8,7 % n’avaient de copie archivée nulle part, et là où un instantané existait, il avait une médiane de 603 jours. Pour une page qui ne déclare aucune date de publication, le moment de la consultation est la seule date qu’une référence puisse porter — et il n’existe qu’à l’instant où vous regardez. Ce qu’il advient d’une source après qu’on l’a citée
Une capture peut l’inscrire : auteurs, titre, DOI, licence et l’heure exacte, dans le PDF et dans une notice RIS à côté — un format qui s’importe dans Zotero, Citavi, EndNote ou Mendeley.
Pour une bibliographie plutôt que pour une seule page, l’essentiel du travail n’a pas besoin de navigateur. Sur 20 sources variées, 10 sont devenues des notices complètes avec RIS et BibTeX en 8,1 secondes en HTTP simple — sans compte, sans clé. Les dix autres sont rendues avec le motif, pour que vous sachiez quelles adresses ont besoin de vous. Les recettes · la mesure
La risposta breve: un’estensione di cattura, non la finestra di stampa. La stampa impagina — lo stesso articolo è uscito come 26 pagine con 9 interruzioni che tagliavano una frase. Una cattura scrive un foglio continuo e può imprimere sulla pagina da dove viene e quando.
Firefox, computer e Android Chrome 116+, Edge, Brave, Vivaldi
Gratuito, licenza MIT, gira sul dispositivo. Edge chiede una volta se consentire estensioni da altri store; Opera ha prima bisogno del suo componente Install Chrome Extensions. Poi: apri la pagina, premi Alt+Shift+Y oppure fai clic sull’icona.
| Stampa del browser | Cattura a pagina intera | |
|---|---|---|
| Lo stesso articolo esce come | 26 pagine | 1 foglio |
| Interruzioni di pagina che tagliano una frase | 9 | 0 |
| Testo selezionabile e ricercabile | 87,6 % di richiamo | 91,5 % di richiamo |
| Costa qualcosa | no, è integrata | no |
Sul testo la cattura è in vantaggio da quando porta uno strato di testo — 91,5 % contro 87,6 %, misurato il 5 agosto. Se serve solo una copia leggibile e ricercabile e l’impaginazione non disturba, basta la funzione già presente nel browser — e questa pagina lo dice invece di far finta di niente. Una cattura conviene quando conta l’impaginazione, quando un’interruzione cadrebbe dentro una tabella, o quando i dati della fonte devono viaggiare con il file. Metodo e dati grezzi
Un’estensione di cattura legge ciò che la tua sessione già mostra. Un articolo di rivista in licenza, una pagina di corso, una conferma d’ordine — salvati come li vedi. Nessun convertitore lato server può farlo, perché non ha la tua sessione: misurato su 20 fonti miste, un lettore lato server è stato respinto in pieno da 5 di esse. Catturare una pagina che puoi leggere è una copia per uso personale; non è una via verso contenuti a cui non hai accesso.
Solo Firefox. Chrome per Android non installa alcuna estensione, quindi la domanda si pone soltanto lì. Di 248 estensioni per salvare pagine verificate tramite l’API dei componenti aggiuntivi, 60 dichiarano il supporto ad Android e nessuna era stata provata su un dispositivo prima di noi. La misurazione su Android
Un indirizzo in bibliografia è una promessa su una pagina che non controlli. Verificato su 150 fonti prese da bibliografie reali: il 19,3 % era sparito, l’8,7 % non aveva copia archiviata da nessuna parte, e dove esisteva un’istantanea era vecchia in mediana di 603 giorni. Per una pagina che non dichiara una data di pubblicazione, il momento della consultazione è l’unica data che un riferimento possa portare — ed esiste solo nell’istante in cui guardi. Che cosa succede a una fonte dopo che l’hai citata
Una cattura può scriverlo dentro: autori, titolo, DOI, licenza e l’ora esatta, nel PDF e in un record RIS accanto — un formato che si importa in Zotero, Citavi, EndNote o Mendeley.
Per una bibliografia invece che per una singola pagina, la maggior parte del lavoro non ha bisogno del browser. Di 20 fonti miste, 10 sono diventate record completi con RIS e BibTeX in 8,1 secondi via semplice HTTP — senza account, senza chiave. Le altre dieci tornano indietro con la motivazione, così sai quali indirizzi hanno bisogno di te. Le ricette · la misurazione
短い答え: 印刷ダイアログではなく、キャプチャ拡張機能を使う。印刷はページに分割する — 同じ記事が 26 ページになり、9 か所の改ページが文の途中を切った。キャプチャは 1 枚の連続した紙に書き出し、どこから取得したか、そしていつ取得したかをページに刻める。
Firefox(パソコンと Android) Chrome 116+, Edge, Brave, Vivaldi
無料、MIT ライセンス、処理は端末上で完結する。Edge は他のストアの拡張機能を許可するか一度だけ尋ねる。Opera は先に Install Chrome Extensions が必要になる。あとは、ページを開いて Alt+Shift+Y を押すか、アイコンをクリックするだけ。
| ブラウザーの印刷 | 全ページキャプチャ | |
|---|---|---|
| 同じ記事の出力 | 26 ページ | 1 枚 |
| 文を分断する改ページ | 9 | 0 |
| 選択・検索できる文字 | 再現率 87.6 % | 再現率 91.5 % |
| 費用 | なし(標準機能) | なし |
文字については、テキスト層を備えて以来キャプチャが上回っている — 91.5 % 対 87.6 %、8月5日の計測。読めて検索できる複製さえあればよく、ページ分割が気にならないなら、ブラウザーに最初から入っている機能で足りる — このページはそれを隠さずに書く。キャプチャが効くのは、レイアウトが意味を持つとき、改ページが表を割ってしまうとき、あるいは出典の情報をファイルと一緒に運びたいときだ。 方法と生データ
キャプチャ拡張機能は、自分のセッションがすでに表示しているものを読み取る。ライセンス契約のある学術論文、講義ページ、注文確認 — 見えているとおりに保存される。サーバー側の変換サービスにはできない。あなたのセッションを持っていないからだ。20 件の多様な出典で計測したところ、サーバー側のリーダーはそのうち 5 件から明確に拒否された。読む権利のあるページを保存するのは私的な複製であって、権利のない内容に手を伸ばす方法ではない。
Firefox だけである。Chrome for Android は拡張機能をいっさい入れられないので、この問いが立つのはそこだけだ。アドオン API に照らして調べた 248 件のページ保存拡張機能のうち、60 件が Android 対応を宣言しているが、私たちが試すまで、実機で確かめられたものは一つもなかった。 Android の計測
参考文献のアドレスは、自分の手の届かないページについての約束である。実際の参考文献表から取った 150 件の出典を調べたところ、19.3 % はすでに消えており、8.7 % はどこにも保存されていなかった。控えが存在した場合でも、その古さは中央値で 603 日だった。公開日を示さないページでは、取得した時点だけが参考文献に載せられる唯一の日付になる — そしてそれは、見たその瞬間にしか存在しない。 引用したあと、その出典に何が起きるか
キャプチャはそれを書き込める。著者、タイトル、DOI、ライセンス、正確な時刻を PDF の中に、そして隣に置く RIS レコードに — Zotero、Citavi、EndNote、Mendeley が読み込める形式で。
1 ページではなく参考文献表が相手なら、作業の大半にブラウザーは要らない。20 件の多様な出典のうち、10 件が 8.1 秒で RIS と BibTeX を備えた完全なレコードになった — 素の HTTP で、アカウントも鍵もなしに。残る 10 件は理由を添えて返るので、どのアドレスに人手が要るかが分かる。 レシピ · その計測
A resposta curta: uma extensão de captura, não a caixa de impressão. A impressão pagina — o mesmo artigo saiu como 26 páginas com 9 quebras cortando uma frase. Uma captura escreve uma folha contínua e pode carimbar na página de onde ela veio e quando.
Firefox, computador e Android Chrome 116+, Edge, Brave, Vivaldi
Gratuito, licença MIT, roda no aparelho. O Edge pergunta uma vez se permite extensões de outras lojas; o Opera precisa antes da extensão Install Chrome Extensions. Depois: abra a página, pressione Alt+Shift+Y ou clique no ícone.
| Impressão do navegador | Captura de página inteira | |
|---|---|---|
| O mesmo artigo sai como | 26 páginas | 1 folha |
| Quebras de página cortando uma frase | 9 | 0 |
| Texto que dá para selecionar e buscar | 87,6 % de revocação | 91,5 % de revocação |
| Custa algo | não, já vem embutido | não |
No texto, a captura está à frente desde que carrega uma camada de texto — 91,5 % contra 87,6 %, medido em 5 de agosto. Se você só precisa de uma cópia legível e pesquisável e a paginação não incomoda, a função que já existe no navegador basta — e esta página diz isso em vez de fingir o contrário. Uma captura compensa quando o layout importa, quando uma quebra cairia no meio de uma tabela, ou quando os dados da fonte precisam viajar junto com o arquivo. Método e dados brutos
Uma extensão de captura lê o que a sua própria sessão já mostra. Um artigo de periódico licenciado, uma página de curso, uma confirmação de pedido — salvos como você os vê. Nenhum conversor do lado do servidor consegue isso, porque não tem a sua sessão: medido em 20 fontes variadas, um leitor do lado do servidor foi recusado de saída por 5 delas. Capturar uma página que você pode ler é uma cópia para uso próprio; não é um caminho para conteúdos aos quais você não tem acesso.
Só o Firefox. O Chrome para Android não instala extensão nenhuma, então a pergunta só se coloca ali. De 248 extensões de salvar páginas verificadas contra a API de complementos, 60 declaram suporte a Android e nenhuma tinha sido testada num aparelho antes de nós. A medição no Android
Um endereço numa bibliografia é uma promessa sobre uma página que não é sua. Verificado em 150 fontes tiradas de listas de referências reais: 19,3 % tinham sumido, 8,7 % não tinham cópia arquivada em lugar nenhum, e onde havia um instantâneo ele tinha mediana de 603 dias. Para uma página que não declara data de publicação, o momento da consulta é a única data que uma referência pode carregar — e ela só existe no instante em que você olha. O que acontece com uma fonte depois de você citá-la
Uma captura pode escrever isso dentro: autores, título, DOI, licença e a hora exata, no PDF e num registro RIS ao lado — um formato que entra no Zotero, no Citavi, no EndNote ou no Mendeley.
Para uma bibliografia em vez de uma única página, a maior parte do trabalho não precisa de navegador. De 20 fontes variadas, 10 viraram registros completos com RIS e BibTeX em 8,1 segundos por HTTP simples — sem conta, sem chave. As outras dez voltam com o motivo, para você saber quais endereços precisam de você. As receitas · a medição
Короткий ответ: расширение для съёмки страницы, а не диалог печати. Печать разбивает на страницы — та же статья вышла как 26 страниц, и 9 разрывов прошли посреди предложения. Съёмка пишет один непрерывный лист и может проставить на странице, откуда она взята и когда.
Firefox, компьютер и Android Chrome 116+, Edge, Brave, Vivaldi
Бесплатно, лицензия MIT, работает на устройстве. Edge один раз спросит, разрешить ли расширения из других магазинов; Opera сначала требует своё дополнение Install Chrome Extensions. Дальше: откройте страницу и нажмите Alt+Shift+Y или щёлкните по значку.
| Печать браузера | Съёмка всей страницы | |
|---|---|---|
| Та же статья выходит как | 26 страниц | 1 лист |
| Разрывы страниц посреди предложения | 9 | 0 |
| Текст, который можно выделить и найти | полнота 87,6 % | полнота 91,5 % |
| Стоит ли денег | нет, встроено | нет |
По тексту съёмка впереди с тех пор, как она несёт текстовый слой — 91,5 % против 87,6 %, измерено 5 августа. Если нужна только читаемая и доступная поиску копия, а разбиение на страницы не мешает, хватит той функции, что уже есть в браузере, — и эта страница говорит об этом прямо, а не делает вид, будто иначе. Съёмка стоит того, когда важна вёрстка, когда разрыв пришёлся бы на таблицу или когда сведения об источнике должны путешествовать вместе с файлом. Метод и исходные данные
Расширение снимает то, что уже показывает ваша собственная сессия. Лицензированная журнальная статья, страница курса, подтверждение заказа — сохраняются такими, какими вы их видите. Серверная служба так не может, потому что у неё нет вашей сессии: на 20 разнородных источниках серверному читателю отказали 5 из них наотрез. Сохранить страницу, которую вам позволено читать, — это копия для личного пользования; это не путь к содержимому, к которому у вас нет доступа.
Только Firefox. Chrome для Android не устанавливает расширений вовсе, так что вопрос возникает лишь здесь. Из 248 расширений для сохранения страниц, проверенных через API дополнений, 60 заявляют поддержку Android, и ни одно из них не проверялось на устройстве до нас. Измерение на Android
Адрес в списке литературы — это обещание о странице, которая вам не подчиняется. Проверено на 150 источниках из реальных списков литературы: 19,3 % исчезли, у 8,7 % нигде не нашлось архивной копии, а там, где снимок был, его возраст составил в медиане 603 дня. Для страницы без даты публикации время обращения — единственная дата, которую может нести ссылка, и она существует только в тот момент, когда вы смотрите. Что происходит с источником после того, как вы его процитировали
Съёмка может записать это внутрь: авторов, заглавие, DOI, лицензию и точное время — в самом PDF и в записи RIS рядом, в формате, который читают Zotero, Citavi, EndNote и Mendeley.
Если речь о списке литературы, а не об одной странице, большая часть работы обходится без браузера. Из 20 разнородных источников 10 стали полными записями с RIS и BibTeX за 8,1 секунды по обычному HTTP — без учётной записи и без ключа. Остальные десять возвращаются с указанием причины, чтобы вы знали, какие адреса требуют вас. Рецепты · измерение
简短的答案:用抓取扩展,而不是打印对话框。打印会分页——同一篇文章印出来是 26 页,其中 9 处分页把句子拦腰截断。抓取写出的是一张连续的长纸,还能把来源和时间盖在页面上。
Firefox(桌面与 Android) Chrome 116+, Edge, Brave, Vivaldi
免费,MIT 许可,全部在本机运行。Edge 会问一次是否允许来自其他商店的扩展;Opera 需要先装上它的 Install Chrome Extensions。然后:打开网页,按 Alt+Shift+Y 或点击图标。
| 浏览器打印 | 整页抓取 | |
|---|---|---|
| 同一篇文章的结果 | 26 页 | 1 张 |
| 把句子截断的分页 | 9 | 0 |
| 可选中、可检索的文字 | 召回率 87.6 % | 召回率 91.5 % |
| 是否花钱 | 不花钱,系统自带 | 不花钱 |
论文字,自从抓取带上了文本层,它就领先了——91.5 % 对 87.6 %,测量于 8月5日。如果你只需要一份能读、能搜的副本,也不在意分页,浏览器里现成的功能就够了——本页把这一点说出来,而不是装作没有。值得抓取的情形是:版面本身要紧、某个分页会正好切在表格中间,或者出处信息必须跟着文件一起走。 方法与原始数据
抓取扩展读取的是你自己的会话已经显示出来的内容。有订阅的期刊论文、课程页面、订单确认——你看到什么样,就保存成什么样。服务器端的转换服务做不到这一点,因为它没有你的会话:在 20 个混合来源上测量,服务器端阅读器被其中 5 个直接拒绝。保存一个你有权阅读的页面,是供自己使用的复制件;它不是通往你无权访问内容的路径。
只有 Firefox。Chrome for Android 根本不安装任何扩展,所以这个问题只在那里出现。对照附加组件 API 核查了 248 个保存网页的扩展,其中 60 个声明支持 Android,而在我们之前,没有一个真正在设备上试过。 Android 测量
参考文献里的一个网址,是对一个你无法掌控的页面所作的承诺。以真实参考文献表中的 150 个来源核查:19.3 % 已经消失,8.7 % 在任何地方都没有存档副本;即便存在快照,其年龄中位数也有 603 天。对于不声明出版日期的页面来说,访问时间是参考文献唯一能承载的日期——而它只存在于你查看的那一刻。 一个来源在被引用之后会怎样
抓取可以把这些写进去:作者、标题、DOI、许可与准确时间,写在 PDF 内部,并在旁边附一份 RIS 记录——这种格式可以导入 Zotero、Citavi、EndNote 或 Mendeley。
如果面对的是一份参考文献表而不是单个页面,大部分工作根本不需要浏览器。20 个混合来源中,10 个在 8.1 秒内变成了带 RIS 与 BibTeX 的完整记录,走的是普通 HTTP——不要账号,不要密钥。另外十个会连同原因一起退回来,好让你知道哪些网址需要你亲自去处理。 配方 · 那次测量