<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Prestazioni |</title><link>https://clementgodbarge.com/it/tag/prestazioni/</link><atom:link href="https://clementgodbarge.com/it/tag/prestazioni/index.xml" rel="self" type="application/rss+xml"/><description>Prestazioni</description><generator>HugoBlox Kit (https://hugoblox.com)</generator><language>it-it</language><lastBuildDate>Fri, 28 Mar 2025 00:00:00 +0000</lastBuildDate><image><url>https://clementgodbarge.com/media/icon_hu_64a6c3bec25b3d7b.png</url><title>Prestazioni</title><link>https://clementgodbarge.com/it/tag/prestazioni/</link></image><item><title>Multi-Saxon</title><link>https://clementgodbarge.com/it/code/multi-saxon/</link><pubDate>Fri, 28 Mar 2025 00:00:00 +0000</pubDate><guid>https://clementgodbarge.com/it/code/multi-saxon/</guid><description>&lt;h2 id="multi-saxon-trasformazioni-xslt-in-parallelo-per-grandi-corpora-tei"&gt;Multi-Saxon: trasformazioni XSLT in parallelo per grandi corpora TEI&lt;/h2&gt;
&lt;p&gt;Multi-Saxon colma una lacuna seria fra gli strumenti di elaborazione XML: esegue in parallelo trasformazioni XSLT 2.0 e 3.0 che LXML, la diffusa libreria XML per Python, non sa gestire. Pensato per grandi collezioni di documenti XML TEI, abbatte i tempi di elaborazione grazie a un’esecuzione parallela efficiente.&lt;/p&gt;
&lt;h2 id="caratteristiche-principali"&gt;Caratteristiche principali&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;&lt;strong&gt;XSLT avanzato&lt;/strong&gt;: elabora trasformazioni XSLT 2.0 e 3.0, fuori dalla portata di LXML&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Elaborazione parallela&lt;/strong&gt;: la parallelizzazione riduce drasticamente i tempi di trasformazione delle grandi collezioni di documenti&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Su misura per la TEI&lt;/strong&gt;: progettato apposta per i documenti XML della Text Encoding Initiative (TEI)&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Prestazioni scalabili&lt;/strong&gt;: gestisce con efficienza corpora da centinaia a migliaia di documenti&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Multipiattaforma&lt;/strong&gt;: funziona su sistemi operativi e ambienti diversi&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="il-problema-che-multi-saxon-risolve"&gt;Il problema che Multi-Saxon risolve&lt;/h2&gt;
&lt;p&gt;Chi lavora con la TEI nell’umanistica digitale si scontra spesso con due ostacoli:&lt;/p&gt;
&lt;ol&gt;
&lt;li&gt;LXML (una comune libreria Python per l’elaborazione XML) sostiene soltanto XSLT 1.0, e preclude quindi le funzionalità più avanzate di XSLT 2.0/3.0&lt;/li&gt;
&lt;li&gt;Elaborare in sequenza grandi corpora di documenti TEI può richiedere tempi proibitivi&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;Multi-Saxon risponde a entrambi sfruttando le capacità XSLT avanzate di Saxon e distribuendo l’elaborazione su più core, con guadagni di prestazioni notevoli.&lt;/p&gt;
&lt;h2 id="realizzazione"&gt;Realizzazione&lt;/h2&gt;
&lt;p&gt;Multi-Saxon accoppia Python al processore Saxon per Java in una pipeline di trasformazione ad alte prestazioni:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;usa la libreria Saxon per Java per un’elaborazione XSLT 2.0/3.0 robusta&lt;/li&gt;
&lt;li&gt;ricorre al multiprocessing per distribuire le trasformazioni sui core disponibili&lt;/li&gt;
&lt;li&gt;gestisce con efficienza i pool di processi per massimizzare il throughput&lt;/li&gt;
&lt;li&gt;offre un’interfaccia semplice per l’elaborazione in batch dei documenti TEI&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="esempio-duso"&gt;Esempio d’uso&lt;/h2&gt;
&lt;div class="highlight"&gt;&lt;pre tabindex="0" class="chroma"&gt;&lt;code class="language-python" data-lang="python"&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="nn"&gt;multi_saxon&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;MultiSaxon&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="c1"&gt;# Initialize with your XSLT stylesheet&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="n"&gt;transformer&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;MultiSaxon&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="s2"&gt;&amp;#34;transform.xsl&amp;#34;&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="c1"&gt;# Transform a single document&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="n"&gt;transformer&lt;/span&gt;&lt;span class="o"&gt;.&lt;/span&gt;&lt;span class="n"&gt;transform&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="s2"&gt;&amp;#34;input.xml&amp;#34;&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="s2"&gt;&amp;#34;output.xml&amp;#34;&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="c1"&gt;# Transform an entire directory in parallel&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="n"&gt;transformer&lt;/span&gt;&lt;span class="o"&gt;.&lt;/span&gt;&lt;span class="n"&gt;transform_directory&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="s2"&gt;&amp;#34;input_dir&amp;#34;&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="s2"&gt;&amp;#34;output_dir&amp;#34;&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;h2 id="che-cosa-cambia-per-lumanistica-digitale"&gt;Che cosa cambia per l’umanistica digitale&lt;/h2&gt;
&lt;p&gt;Per i progetti di umanistica digitale alle prese con grandi collezioni di documenti TEI, Multi-Saxon rende possibili:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;trasformazioni complesse sull’intero corpus, impensabili con LXML&lt;/li&gt;
&lt;li&gt;tempi di elaborazione drasticamente ridotti (spesso di 5-10 volte sui sistemi multi-core)&lt;/li&gt;
&lt;li&gt;analisi più sofisticate grazie alle funzionalità avanzate di XSLT 2.0/3.0&lt;/li&gt;
&lt;li&gt;un flusso di lavoro più semplice per elaborare intere collezioni di documenti&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Il codice sorgente e la documentazione sono nel
.&lt;/p&gt;</description></item></channel></rss>