<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Java |</title><link>https://clementgodbarge.com/pl/tag/java/</link><atom:link href="https://clementgodbarge.com/pl/tag/java/index.xml" rel="self" type="application/rss+xml"/><description>Java</description><generator>HugoBlox Kit (https://hugoblox.com)</generator><language>pl-pl</language><lastBuildDate>Fri, 28 Mar 2025 00:00:00 +0000</lastBuildDate><image><url>https://clementgodbarge.com/media/icon_hu_64a6c3bec25b3d7b.png</url><title>Java</title><link>https://clementgodbarge.com/pl/tag/java/</link></image><item><title>Multi-Saxon</title><link>https://clementgodbarge.com/pl/code/multi-saxon/</link><pubDate>Fri, 28 Mar 2025 00:00:00 +0000</pubDate><guid>https://clementgodbarge.com/pl/code/multi-saxon/</guid><description>&lt;h2 id="multi-saxon-równoległe-przetwarzanie-xslt-dla-dużych-korpusów-tei"&gt;Multi-Saxon: równoległe przetwarzanie XSLT dla dużych korpusów TEI&lt;/h2&gt;
&lt;p&gt;Multi-Saxon wypełnia istotną lukę w narzędziach do przetwarzania XML: umożliwia równoległe wykonywanie transformacji XSLT 2.0 i 3.0, z którymi LXML (popularna pythonowa biblioteka XML) sobie nie radzi. Zaprojektowany z myślą o dużych kolekcjach dokumentów XML TEI, Multi-Saxon znacząco skraca czas przetwarzania dzięki sprawnemu wykonywaniu równoległemu.&lt;/p&gt;
&lt;h2 id="główne-funkcje"&gt;Główne funkcje&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;&lt;strong&gt;Zaawansowana obsługa XSLT&lt;/strong&gt;: przetwarza transformacje XSLT 2.0 i 3.0, wykraczające poza możliwości LXML&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Przetwarzanie równoległe&lt;/strong&gt;: radykalnie skraca czas transformacji dużych kolekcji dokumentów dzięki zrównolegleniu&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Zoptymalizowany pod TEI&lt;/strong&gt;: zaprojektowany specjalnie dla dokumentów XML Text Encoding Initiative (TEI)&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Skalowalna wydajność&lt;/strong&gt;: sprawnie obsługuje korpusy liczące od setek do tysięcy dokumentów&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;Wieloplatformowość&lt;/strong&gt;: działa w różnych systemach operacyjnych i środowiskach&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="problem-który-rozwiązuje-multi-saxon"&gt;Problem, który rozwiązuje Multi-Saxon&lt;/h2&gt;
&lt;p&gt;Badacze humanistyki cyfrowej pracujący z TEI często napotykają dwie poważne trudności:&lt;/p&gt;
&lt;ol&gt;
&lt;li&gt;LXML (powszechnie używana pythonowa biblioteka do przetwarzania XML) obsługuje tylko XSLT 1.0, co uniemożliwia korzystanie z bardziej zaawansowanych funkcji XSLT 2.0/3.0&lt;/li&gt;
&lt;li&gt;Sekwencyjne przetwarzanie dużych korpusów dokumentów TEI bywa zaporowo czasochłonne&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;Multi-Saxon rozwiązuje oba problemy: wykorzystuje zaawansowane możliwości XSLT procesora Saxon i rozdziela przetwarzanie między wiele rdzeni, co daje znaczny zysk wydajności.&lt;/p&gt;
&lt;h2 id="implementacja"&gt;Implementacja&lt;/h2&gt;
&lt;p&gt;Multi-Saxon łączy Pythona z javowym procesorem Saxon, tworząc wydajny potok transformacji:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;korzysta z javowej biblioteki Saxon do niezawodnego przetwarzania XSLT 2.0/3.0&lt;/li&gt;
&lt;li&gt;implementuje wieloprocesowość, by rozdzielić transformacje między dostępne rdzenie CPU&lt;/li&gt;
&lt;li&gt;sprawnie zarządza pulami procesów, by zmaksymalizować przepustowość&lt;/li&gt;
&lt;li&gt;oferuje prosty interfejs do wsadowego przetwarzania dokumentów TEI&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="przykład-użycia"&gt;Przykład użycia&lt;/h2&gt;
&lt;div class="highlight"&gt;&lt;pre tabindex="0" class="chroma"&gt;&lt;code class="language-python" data-lang="python"&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="kn"&gt;from&lt;/span&gt; &lt;span class="nn"&gt;multi_saxon&lt;/span&gt; &lt;span class="kn"&gt;import&lt;/span&gt; &lt;span class="n"&gt;MultiSaxon&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="c1"&gt;# Initialize with your XSLT stylesheet&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="n"&gt;transformer&lt;/span&gt; &lt;span class="o"&gt;=&lt;/span&gt; &lt;span class="n"&gt;MultiSaxon&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="s2"&gt;&amp;#34;transform.xsl&amp;#34;&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="c1"&gt;# Transform a single document&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="n"&gt;transformer&lt;/span&gt;&lt;span class="o"&gt;.&lt;/span&gt;&lt;span class="n"&gt;transform&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="s2"&gt;&amp;#34;input.xml&amp;#34;&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="s2"&gt;&amp;#34;output.xml&amp;#34;&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="c1"&gt;# Transform an entire directory in parallel&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span class="line"&gt;&lt;span class="cl"&gt;&lt;span class="n"&gt;transformer&lt;/span&gt;&lt;span class="o"&gt;.&lt;/span&gt;&lt;span class="n"&gt;transform_directory&lt;/span&gt;&lt;span class="p"&gt;(&lt;/span&gt;&lt;span class="s2"&gt;&amp;#34;input_dir&amp;#34;&lt;/span&gt;&lt;span class="p"&gt;,&lt;/span&gt; &lt;span class="s2"&gt;&amp;#34;output_dir&amp;#34;&lt;/span&gt;&lt;span class="p"&gt;)&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;h2 id="znaczenie-dla-humanistyki-cyfrowej"&gt;Znaczenie dla humanistyki cyfrowej&lt;/h2&gt;
&lt;p&gt;Projektom humanistyki cyfrowej pracującym z dużymi kolekcjami dokumentów TEI Multi-Saxon umożliwia:&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;złożone transformacje całych korpusów, niewykonalne w LXML&lt;/li&gt;
&lt;li&gt;radykalnie krótszy czas przetwarzania (często 5–10-krotnie na systemach wielordzeniowych)&lt;/li&gt;
&lt;li&gt;bardziej wyrafinowaną analizę dzięki zaawansowanym funkcjom XSLT 2.0/3.0&lt;/li&gt;
&lt;li&gt;prostszy przepływ pracy przy przetwarzaniu całych kolekcji dokumentów&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;Kod źródłowy i dokumentację znajdziesz w
.&lt;/p&gt;</description></item></channel></rss>