Help:Extension:Wikisource/Wikimedia OCR
La funzione Wikimedia OCR dell'estensione Wikisource aggiunge una barra degli strumenti alla barra degli strumenti principale quando si entra in modifica nel namespace Pagina, per estrarre rapidamente il testo dall'immagine della pagina e aggiungerlo nella casella del corpo della pagina. OCR sta per Optical Character Recognition cioè Riconoscimento Ottico dei Caratteri, ed è il processo con cui il testo in un'immagine fotografica può essere convertito in un testo modificabile, e quindi inserito in un progetto wiki.

Per usare questa funzionalità, clicca il pulsante
sulla destra della barra di modifica principale.
Questo lancerà il processo OCR, e inserirà il testo risultante nel corpo della pagina nella casella di modifica (sostituendo qualunque testo che sia già presente).
Un bottone 'annulla' è mostrato in cima al corpo della pagina, e permette di ritornare allo stato precedente se lo si desidera.
Nella sua forma base, questa è tutta la funzionalità del Wikimedia OCR, ma ci sono alcune funzioni avanzate che possono essere utile in alcune circostanze, disponibili tramite il menù a discesa alla destra del bottone "Trascrivi il testo". Queste funzioni avanzate permettono di scegliere un motore di OCR differente; stabilire un elenco di lingue per aiutare il software a rilevare le parole; o selezionare un'area più piccola della pagina dalla quale estrarre il testo. Tutte queste funzionalità avanzate sono spiegate sotto, e, tranne la scelta del motore, sono tutte disponibili tramite la voce di menù "Opzioni avanzate", che apre una nuova scheda.

Motori OCR
Ci sono attualmente tre motori OCR disponibili: Tesseract, Google e Transkribus. Tesseract è uno strumento open source eseguito internamente, che supporta una vasta gamma di lingue e altre opzioni. Google OCR è uno strumento proprietario, che supporta molte lingue, ma offre meno opzioni. Transkribus è supportato dalla cooperativa europea READ-COOP e ha stretto accordi con la Fondazione Wikimedia per fornire un numero limitato di utilizzi gratuiti per supportare il progetto Wikisource Loves Manuscripts.
La scelta di quale utilizzare può dipendere a seconda della natura dell'immagine da processare.
Per cambiare motore, scegli il pulsante corrispondente dal menù a discesa. La tua scelta sarà ricordata per il dispositivo in uso, e può essere cambiata in ogni momento.
Lingue
Clicking the Opzioni avanzate menu item opens a new tab with a transcription form containing a field for selecting the language or languages that are used in the page of text being extracted.
Questo è utile perché i motori OCR possono essere molto più precisi quando sanno quali lingue aspettarsi.
Se la tua lingua non è nella lista, puoi lasciare il campo Lingue vuoto e il motore OCR tenterà di estrarre il testo come possibile. Questo può avere diversi risultati, e può essere il caso di provare.
Area di ritaglio

Per estrarre il testo da una parte soltanto dell'immagine (per esempio, una singola colonna di una pagina di un giornale), è possibile selezionare un'area di ritaglio.
Do this by first clicking the crop button (
, see screenshot at right), and then clicking and dragging over the page image to draw a rectangle.
L'immagine può essere ingrandita e allargata, e il rettangolo di ritaglio spostato e ridimensionato come necessario.
Ci sono dei bottoni sopra all'immagine che permettono di passare dal movimento al ritaglio e viceversa.
Quando hai selezionato l'area desiderata, premi "Estrai area" e il testo di quell'area soltanto verrà mostrato nella casella di testo sulla destra.
Tornare indietro dalle Opzioni avanzate
Dopo aver usato le opzioni avanzate per estrarre il testo, è necessario copiare e incollare il testo risultante nella casella del corpo della pagina.
To make this a bit quicker, a Copy to clipboard button is provided.
Primo utilizzo
The first time you open a page for editing, a pulsating blue dot is shown on the Extract text button.
Cliccando questo puntino o uno qualunque dei bottoni si aprirà una scheda che spiega che cos'è questa funzione.
Dopo che questa scheda viene chiusa, non sarà più mostrata (su quello stesso dispositivo).
Problematiche
If you encounter any issues with using Wikimedia OCR, please report them on Phabricator, under the Wikisource OCR tag.
| Nota: Quando modifichi questa pagina, acconsenti a pubblicare il tuo contributo con licenza CC0. Vedi pagine di aiuto di dominio pubblico per maggiori informazioni. |