[Risolto] T1, fontenc e codifica caratteri

  • Creatore
    Topic
  • #97960
    Up
    0
    Down
    ::


    Ciao a tutti,
    ho riscontrato un piccolo ma fastidioso problema nei documenti pdf che creo con Latex (uso Kile con Kate 3.7 su KDE 4.13.3 e per visualizzare i pdf uso okular 0.19.3).
    Succede che il concenuto del pdf è perfettamente leggibile, ma se provo a copiare una parte del contenuto testuale del pdf, mi copia dei caratteri strani.
    Per darvi un’idea, qui trovate uno screenshot:

    [attachment=1154]latex_simboli.png[/attachment]

    Il testo nel pdf è codificato in modo corretto (“corpo del testo”), mentre nel campo ricerca vedete che codifica il contenuto con dei simboli.
    Nel preambolo uso:
    `\documentclass[a4paper,12pt]{article}
    \usepackage[T1]{fontenc}
    \usepackage[italian]{babel}
    \usepackage[utf8]{inputenc}
    \usepackage{hyperref}
    \hypersetup{pdftitle={Titolo},
    pdfauthor={Mio nome},
    pdfnewwindow=true,
    bookmarks=true,
    colorlinks=true,
    linkcolor=blue,
    filecolor=blue,
    urlcolor=blue
    }
    \usepackage{graphicx}
    \usepackage{fancyhdr}`

    In modo particolare dovrebbe essere interessato il pacchetto fontenc con l’opzione T1.
    Non capisco però cosa c’è di sbagliato. Avete suggerimenti?

    Attachments:
    You must be logged in to view attached files.
Visualizzazione 1 filone di risposte
  • Autore
    Risposte
    • #97961
      OldClaudio
      Partecipante
        Up
        0
        Down
        ::


        Che programma usi per cercare e copiare il testo?

        La stringa Corpo del testo contiene solo caratteri ASCII, mentre gli altri segni sono rappresentati con due byte, tranne alcune lettere come la r di Corpo e st di testo.

        Sia la codifica utf8 (UTF-8 – Unicode Transfer Format eseguita con sequenze di byte di 8 bit), sia la codifica T1 contengono solo caratteri ASCII a 7 bit nei primi 128 caratteri della codifica (nella codifica T1, i caratteri con indirizzi da 0 a 31 e il carattere con indirizzo 127 sono carattri di servizio per TeX, ma non compiono mai nel file di uscita, tranne il “fine riga”).

        Quindi ho il sospetto che Kile e Okular non c’entrino per niente; posso sbagliarmi, ma sebbene io usi Okular abbastanza raramente, perché uso pochissimo Ubuntu, a me non è mai successa una cosa del genere.

        Fossi in te, io non userei i carattri CM con codifica T1 (si tratta dei CM-super), ma userei i Latin Modern. I CM-super sono font vettoriali che contengono anche il cirillico, ma non soddisfano la codifica UNICODE, e usano per lavora con TeX dei file virtuali particolari che indirizzano glifi che si trovano sparsi nella codifica dei CM-super. Può darsi che quello sia il motivo per il quale ti appaiono quei caratteri strani. Prova chiamando il pacchetto lmodern, invece di usare i CM-super di default.

      • #97962
        Up
        0
        Down
        ::


        Grazie mille OldClaudio!
        Effettivamente utilizzando Latin Modern il problema è risolto!
        Tra l’altro ho notato che con i caratteri CM avevo pure problemi nella visualizzazione delle informazioni del documento in Dolphin (file manager).

        Grazie mille per l’aiuto!
        Ciao ciao

    Visualizzazione 1 filone di risposte
    • Devi essere connesso per rispondere a questo topic.

    Go to top