| Autor | Zpráva | ||
|---|---|---|---|
| peteo Profil |
#1 · Zasláno: 11. 10. 2006, 20:56:27
Do istej doby som pouľíval ako zdroj html kódu word (uloľi» ako html). Prestal som ho pouľíva» preto, lebo nebol schopný uklada» (konvertova») rozsiahlejąie súbory (viac ako 300.000 znakov).
Bol mi doporučený OpenOffice.org 1.1.0. Ten funguje, prevádza i vúčąie dokumenty z formátu doc do htm, hoci s príąerným kódom, ktorý musím pomocou programu replall zbavova» balastu. Ale to nie je problém, ten je inde: word mi kaľdý odstavec textu (.doc) previedol do html kódu ako 1 (jeden; dôleľité!) riadok html kódu, ale OpenOffice.org 1.1.0. ho prevádza mne nepochopiteµným spôsobom do x riadkov html kódu. Pre mňa je dôleľité, aby html kód odstavca bol práve v jednom riadku (vyuľité php skriptom pri vyhµadávaní na stránkach). Skúąal som upravi» formát či uľ textu v .doc (nezalamova») či priamo v html kóde (nezalamova»), ale aj tak si to OpenOffice.org 1.1.0. ukladá ako chce. Poraďte prosím, ako to urobi», aby OpenOffice.org 1.1.0. produkoval html kód odstavca v jednom riadku (bez zalomenia) alebo nejaký editor formátovaného textu (viacfarebný text + odkazy, záloľk, atd.), ktorý je schopný do html kódu uklada» i rozsiahle texty v .doc, prípadne .rtf. Ďakujem. |
||
| Joker Profil |
#2 · Zasláno: 12. 10. 2006, 11:44:55
peteo
S převodem na HTML v OpenOffice 1.1.0 nemám zkuąenosti, ale mám doma OpenOffice 2.0.x a tam mi vygenerovaný HTML kód přiąel docela dobrý, bez nějakého zbytečného balastu. Ale jestli ukládá odstavce do jednoho řádku, na to si nevzpomínám. Ohledně jiných editorů, tak PSPad umí importovat HTML z RTF souboru. |
||
| peteo Profil |
#3 · Zasláno: 12. 10. 2006, 15:33:10
Joker
OpenOffice 2.0.cz robí to isté ako OpenOffice 1.1.0. PSPad to s tak veµkými súbormi nezvláda. :( |
||
| Bubák Profil |
#4 · Zasláno: 12. 10. 2006, 18:17:26 · Upravil/a: Bubák
PSPad přeformátuje HTML kód takto (tečky jsou tady místo mezer)
. . . . <p> . . . . . . . . text na jednom řádku . . . . </p> Nebo pouľít funkci PSPadu "Komprese HTML kódu", kód bude na několika řádcích (pokle nasavení Maximální délka rádků, implicitní je 1024) a mezi tagy není zalomen. To by ti mohlo vyhovovat. Testoval jsem to na souboru o cca 300 000 slov (nikoliv znaků) z Lorem ipsum generátoru a PSPad to zvládal, i kdyľ to nějakou minutu trvalo. |
||
| peteo Profil |
#5 · Zasláno: 12. 10. 2006, 19:26:18
Bubák
PSpad je veeeeeeeµmi nepraktický, uľ len z časových dôvodov (tých súborov je okolo 50). Okrem toho prasí odkazy. Ale aj tak Ďakujem Vie eąte niekto niečo poradi»? |
||
| Dero Profil |
#6 · Zasláno: 12. 10. 2006, 19:36:05
Vie eąte niekto niečo poradi»?
Napią si PHP skriptík, který pomocí RE dokument projde a problémová místa nahradí. Můľeą ho pak pustit na celý adresář a za pár sekund máą hotovo. Chce to vąak umět alespoň základy PHP. |
||
| Anonymní Profil * |
#7 · Zasláno: 14. 10. 2006, 15:20:25
Upresním to:
Pôvodne som pouľíval pre vyhµadávanie php (2 súbory), ale to pri pouľívaní OpenOffice.org X.X nefunguje: formulár hlada_.php: <htm> <HEAD> <META HTTP-EQUIV="Content-Type" CONTENT="text/htm; charset=utf-8"> </HEAD> <BODY > <FONT face=Arial size=3> Vyhµadáva sa slovo bez ohµadu na malé a veµké písmená, vyhµadávanie rozoznáva diakritiku. <br> <FONT face=Arial size=2> <form method="get" action="hladaj.php"> <input name="slovo"> <br> <br> <input type="Submit" name="hladaj" value="Hµadaj"> </form> </font></P> </BODY> </HTML> samotný skript na hµadanie hladaj.php: <html> <HEAD> <META HTTP-EQUIV="Content-Type" CONTENT="text/htm; charset=utf-8"> </HEAD> <BODY> <? define ("NAZEV_SOUBORU", "hladane.txt"); $soubor=fopen(NAZEV_SOUBORU, "a"); fwrite($soubor," .$slovo"." - "); fclose($soubor); echo "Hµadané slovo: <font color=red>".$slovo."</font><br>"; $strednik=chr(59); $meno=Array("0-9","a", "aaa", "aaaa", "b", "c","cs","d","dj","e","eee","f","g","h","ch","i","iii","j","k","l","lj ","m","n","nj","o","oe","ooo","p","q","r","rs","s","sz","t","tj","u"," uuu","v","w","x","y","z","zs"); $najdene=0; for ($i=0; $i<=42; $i++){ $riadok=1; $subor = file("http://adresa/".$meno[$i].".htm"); $text = $subor[$riadok]; while ($text<>"") { $test=eregi($slovo,$text); if ($test) { echo "<p>".$text."</p><br>"; $najdene=$najdene+1; } $riadok=$riadok+1; $text = $subor[$riadok]; } } $testnajdene=($najdene==0); if ($testnajdene) echo " <font color=red><script>alert('Hµadanie ukončené. Nenájdené ľiadne heslo.')".$strednik."</script></font>"; $testnajdene=($najdene==1); if ($testnajdene) echo "<font color=red><script>alert('Hµadanie ukončené. Nájdené ".$najdene." heslo.')".$strednik."</script></font>"; $testnajdene=($najdene==2); if ($testnajdene) echo "<font color=red><script>alert('Hµadanie ukončené. Nájdené ".$najdene. " heslá.')".$strednik."</script></font>"; $testnajdene=($najdene==3); if ($testnajdene) echo "<font color=red><script>alert('Hµadanie ukončené. Nájdené ".$najdene. " heslá.')".$strednik."</script></font>"; $testnajdene=($najdene==4); if ($testnajdene) echo "<font color=red><script>alert('Hµadanie ukončené. Nájdené ".$najdene. " heslá.')".$strednik."</script></font>"; $testnajdene=($najdene>4); if ($testnajdene) echo "<font color=red><script>alert('Hµadanie ukončené. Nájdených ".$najdene. " hesiel.')".$strednik."</script></font>"; ?> </body> </html> Keď som generoval html kód vo Worde, vyzerá takto (riadky medzi tagmi <p> a </p> nie sú zalomené): <HTML> <HEAD> <META HTTP-EQUIV="Content-Type" CONTENT="text/html; charset=utf-8"> </HEAD> <BODY> <FONT COLOR="#ff0000"><P>Ĭalekohĵad</FONT><FONT> - teleskop;s optickĂ˝ prĂstroj zväīŷujĂşci zornĂ˝ uhol, pod ktorĂ˝m sa oku javĂ vzdialenĂ˝ predmet. ObjektĂv tvorĂ spojnĂ· Ĺ·oĹ·ovka a okulĂ·r rozptylka.</P> </FONT><FONT COLOR="#ff0000"><P>Ĭalekohĵad, Spitzerov</FONT><FONT> - Ĭalekohĵad umiestnenĂ˝ na obeŵnĂş drĂ·hu Zeme v auguste 2003.</P> </FONT><FONT COLOR="#ff0000"><P>Ĭalekozrakosš</FONT><FONT> - </FONT><FONT>refrakÄ«nĂ· vada oka. PostihnutĂ˝ lepĹ·ie vidĂ do diaĵky, zle vidĂ na blĂzko.</P> </FONT><FONT COLOR="#ff0000"><P>Ĭasno</FONT><FONT> - gingiva - sliznica Ăşstnej dutiny.</P> </FONT><FONT COLOR="#ff0000"><P>Ĭatelina</FONT><FONT> - Trifolium; rod bylĂn z Ä«eĵade motýĵokvetĂ˝ch. DĂ´leŵitĂ· bylina pre poĵnohospodĂ·rstvo, kde sa pouŵĂva ako krmivo.</P> </FONT><FONT COLOR="#ff0000"><P>Ĭateĵ</FONT><FONT> - Dryocopus </FONT><FONT>- rod vtĂ·kov z rĂ·du Ĺ·plhavcov z Ä«eĵade datlovitĂ˝ch. Ĺ˝ivĂ sa hmyzom.</P> </FONT><FONT COLOR="#ff0000"><P>Ĭateĵ zlatĂ˝</FONT><FONT> - Colaptes auratus; ŵije v púŷti. ObĂ˝va mohutnĂ© kaktusovĂ© kmene.</P> </FONT><FONT COLOR="#ff0000"><P>Ä®ekšarjov, Vasilij AlexejeviÄ«</FONT><FONT> - ZSSR; 1880-1949; konĹ·truktĂ©r guĵometnĂ˝ch zbranĂ.</P> </FONT><FONT COLOR="#ff0000"><P>Ä®omin, Lev StepanoviÄ«</FONT><FONT> - ZSSR; *11.1.1926 (Moskva); kozmonaut. Let na Sojuz 15.</P> </FONT><FONT COLOR="#ff0000"><P>Ä®uriĹ·, JĂşlius</FONT><FONT> - SR; *1904; politik. 1945-1951: minister poĵnohospodĂ·rstva. 1945-1963: Ä«len ĂąV KSĦ. 1951-1953: predseda zboru poverencov. 1953-1963: minister financiĂ.</P> </FONT><FONT><P></P></FONT></BODY> </HTML> Keď som generoval html kód vo OpenOffice.org X.X, vyzerá takto (aj s balastom; riadky medzi tagmi <p> a </p> sú zalomené): <!DOCTYPE HTML PUBLIC "-//W3C//DTD HTML 4.0 Transitional//EN"> <HTML> <HEAD> <META HTTP-EQUIV="CONTENT-TYPE" CONTENT="text/html; charset=utf-8"> <TITLE>Ĭalekohĵad - teleskop;s optický prístroj zväīŷujúci zorný uhol,</TITLE> <META NAME="GENERATOR" CONTENT="OpenOffice.org 1.1.0 (Win32)"> <META NAME="AUTHOR" CONTENT="Martin Adámaš"> <META NAME="CREATED" CONTENT="20061005;15440000"> <META NAME="CHANGED" CONTENT="20061014;15002641"> <STYLE> <!-- @page { size: 21cm 29.7cm; margin-right: 2.25cm; margin-top: 2.5cm; margin-bottom: 2cm } P { margin-bottom: 0.21cm; direction: ltr; color: #000000; widows: 2; orphans: 2 } P.western { font-family: "Times New Roman", serif; font-size: 10pt; so-language: cs-CZ } P.cjk { font-family: "Times New Roman", serif; font-size: 10pt } P.ctl { font-family: "Times New Roman", serif; font-size: 10pt } --> </STYLE> </HEAD> <BODY LANG="cs-CZ" TEXT="#000000" LINK="#000080" VLINK="#800000" DIR="LTR"> <P CLASS="western" ALIGN=JUSTIFY STYLE="margin-bottom: 0cm"><FONT SIZE=1 STYLE="font-size: 8pt"><FONT FACE="Arial, sans-serif"><FONT COLOR="#ff0000">Ĭalekohĵad</FONT> - teleskop;s optický prístroj zväīŷujúci zorný uhol, pod ktorým sa oku javí vzdialený predmet. Objektív tvorí spojná Ĺ·oĹ·ovka a okulár rozptylka.</FONT></FONT></P> <P CLASS="western" ALIGN=JUSTIFY STYLE="margin-bottom: 0cm"><FONT SIZE=1 STYLE="font-size: 8pt"><FONT FACE="Arial, sans-serif"><FONT COLOR="#ff0000">Ĭalekohĵad, Spitzerov</FONT> - Ĭalekohĵad umiestnený na obeŵnú dráhu Zeme v auguste 2003.</FONT></FONT></P> <P CLASS="western" ALIGN=JUSTIFY STYLE="margin-bottom: 0cm"><FONT SIZE=1 STYLE="font-size: 8pt"><FONT FACE="Arial, sans-serif"><FONT COLOR="#ff0000">Ĭalekozrakosš</FONT> - refrakÄ«ná vada oka. Postihnutý lepĹ·ie vidí do diaĵky, zle vidí na blízko.</FONT></FONT></P> <P CLASS="western" ALIGN=JUSTIFY STYLE="margin-bottom: 0cm"><FONT SIZE=1 STYLE="font-size: 8pt"><FONT FACE="Arial, sans-serif"><FONT COLOR="#ff0000">Ĭasno</FONT> - gingiva - sliznica ústnej dutiny.</FONT></FONT></P> <P CLASS="western" ALIGN=JUSTIFY STYLE="margin-bottom: 0cm"><FONT SIZE=1 STYLE="font-size: 8pt"><FONT FACE="Arial, sans-serif"><FONT COLOR="#ff0000">Ĭatelina</FONT> - Trifolium; rod bylín z Ä«eĵade motýĵokvetých. Dôleŵitá bylina pre poĵnohospodárstvo, kde sa pouŵíva ako krmivo.</FONT></FONT></P> <P CLASS="western" ALIGN=JUSTIFY STYLE="margin-bottom: 0cm"><F |
||
| peteo Profil |
#8 · Zasláno: 14. 10. 2006, 15:22:04 · Upravil/a: peteo
mno, neposlalo to celé.
Takľe celý text je na http://lexikon.sk.sweb.cz/zdroj_html_kodu.htm Jedná sa o objasnenie, prečo potrebujem práve to, čo potrebujem (včítane php skriptov, zdrojov kódu z Wordu a OpenOffice.org. Prosím o pomoc. Ďakijem |
||
| Joker Profil |
#9 · Zasláno: 15. 10. 2006, 11:25:09
Pre mňa je dôleľité, aby html kód odstavca bol práve v jednom riadku
Napadl mě celkem jednoduchý způsob jak to zařídit: 1. odstranit řádkování ze vąech souborů 2. globální záměna "<p>" na "\n<p>" 3. globální záměna "</p>" na "</p>\n" Tím budete mít kaľdý odstavec právě na jednom řádku, akorát mezi dvěma odstavci bude prázdný řádek. Teď jenom najít nějaký program, který to zvládne. |
||
| peteo Profil |
#10 · Zasláno: 15. 10. 2006, 11:46:57
Joker
Napadl mě celkem jednoduchý způsob jak to zařídit: 1. odstranit řádkování ze vąech souborů 2. globální záměna "<p>" na "\n<p>" 3. globální záměna "</p>" na "</p>\n" Wo to go. To nejde. Iba spracovávam vygenerovaný kód odstraňovaním nepotrebných tagov programom replall, takľe neovplyvním zalomenie riadkov priamo v kóde. A kompresiu kódu si takisto nemôľem dovoli» - potrebujem jeden odstavec v jednom riadku. Uľ som rozmýąµal o tom, ľe priamo vo Worde napácham nejaké makro, ktoré celý (naformátováný) text preloľí podµa mojich poľiadaviek priamo vo formáte .doc a to potom uloľi» ako .txt (to je právo to - word kaľdý odstavec uloľí do jedného riadku v .txt, ale nezachová si záloľky, odkazy, obrázky, nič). Eąte by tu bola moľnos» vyuľi» existuhúci skript na vyhµadávanie v php je na http://lexikon.sk.sweb.cz/zdroj_html_kodu.htm, a to tak, aby prehµadával nie riadky, ale text medzi tagmi <p> a </p> |
||
|
Časová prodleva: 5 dní
|
|||
| Anonymní Profil * |
#11 · Zasláno: 20. 10. 2006, 09:31:16
Eąte by tu bola moľnos» vyuľi» existuhúci skript na vyhµadávanie v php je na http://lexikon.sk.sweb.cz/zdroj_html_kodu.htm, a to tak, aby prehµadával nie riadky, ale text medzi tagmi <p> a </p>
Pomôľe mi s tým niekto? |
||
| peteo Profil |
#12 · Zasláno: 20. 10. 2006, 09:31:58
Eąte by tu bola moľnos» vyuľi» existuhúci skript na vyhµadávanie v php je na http://lexikon.sk.sweb.cz/zdroj_html_kodu.htm, a to tak, aby prehµadával nie riadky, ale text medzi tagmi <p> a </p>
pomôľe mi s tým niekto? |
||
|
Časová prodleva: 20 let
|
|||
Toto téma je uzamčeno. Odpověď nelze zaslat.
0