| Autor | Zpráva | ||
|---|---|---|---|
| MilanJ Profil |
#1 · Zasláno: 19. 4. 2006, 21:38:43
Zajímalo by mě, jestli lze nějakou funkcí zjistit pozici nějakého webu (www.firma.cz) na určitém vyhledávači (Google, Seznam, apod.) na určité klíčové slovo?
Na webu jsem našel stránky, které tohle dovedou (Position Report) a mě by docela zajímalo, jakým způsobem je možné se k těmto informacím dostat. |
||
| nightfish Profil |
#2 · Zasláno: 19. 4. 2006, 21:48:34
možnosti mě napadají dvě
1) parsovat stránky s výsledky 2) u Googlu použít Google API, u ostatních bohužel nic takového není |
||
| MilanJ Profil |
#3 · Zasláno: 19. 4. 2006, 21:52:06
nightfish
1) parsovat stránky s výsledky Obávám se, že nerozumím. 2) u Googlu použít Google API, u ostatních bohužel nic takového není Takže stránky Position Report jsou zpracovány parsováním? |
||
| Peca Profil |
#4 · Zasláno: 19. 4. 2006, 22:26:01
Asi ano. Pár měsíců zpátky jsem přesně takový skript dělal :-)
Další možnosti jsou třeba na http://2mstudio.cz/pozice-ve-vyhledavacich/index.php?kw=&site= |
||
| MilanJ Profil |
#5 · Zasláno: 19. 4. 2006, 22:31:52 · Upravil/a: MilanJ
Peca
Pár měsíců zpátky jsem přesně takový skript dělal :-) A povedl se? :-) Jsem v PHP začátečník a zajímalo by mě ják na to, aspoň nastínit postup. Nebo je Tvůj script na prodej? =) |
||
| nightfish Profil |
#6 · Zasláno: 20. 4. 2006, 00:58:28
2MilanJ:
nejdřív se podíváš, jaké URL má stránka s výsledky - např. u googlu při hledání "drogy" je to http://www.google.com/search?q=drogy&start=0&ie=utf-8&oe=utf-8 jednotlivé parametry jsou q - hledané slovo (popřípadě fráze) start - kterým výsledkem počínaje má zobrazovat (0 - první, 20 - dvacátý +-) - to se hodí pro odhalování pozic na dalších stránkách ie, oe - zřejmě vstupní a výstupní kódování (vstupní = v jakém kódování je řetězec v parametru "q", výstupní = v jakém kódování se zobrazí stránka s výsledky) pak už není nic jednoduššího, než si tuto stránku s výsledky přes fopen() otevřít a postupně procházet její obsah a hledat, kde se nachází tebou hledaná doména = hledáš stejné úseky HTML kódu, které se nachází u každého výsledku a počítáš je do doby, než najdeš tebou hledanou doménu u googlu by se možná dalo hledat podle <!--m-->, která se vyskytuje vždy na začátku každé položky výsledku... |
||
| MilanJ Profil |
#7 · Zasláno: 20. 4. 2006, 08:18:26
nightfish
Dík, zkusím se s tím nějak popasovat.:-) |
||
| Honza Hučín Profil |
#8 · Zasláno: 20. 4. 2006, 09:27:42
nightfish
Technická poznámka - je-li k dipozici PHP 4.3 či vyšší, doporučuji spíš get_file_contents. |
||
|
Časová prodleva: 20 let
|
|||
Toto téma je uzamčeno. Odpověď nelze zaslat.
0