| Version | 1.0 |
|---|---|
| Éditeur | SqrBox |
| Date de sortie | 18 mars 2013 |
| Date ajoutée | 18 mars 2013 |
| Exigences OS | Windows |
| Exigences | .NET Framework 3.5 |
| Total téléchargements | 292 |
| Prix | Free |
La description
Il existe un nombre infini de raisons pour lesquelles une personne ou une entreprise souhaiterait utiliser un logiciel de recherche Web. Ce type de programme navigue sur le Web d'une manière désignée qui peut être automatisée, méthodique ou ordonnée. Si vous débutez avec le terme logiciel de robot d'indexation, avez-vous peut-être entendu parler d'araignées, de bots, de fourmis, d'index automatiques, de robots ou de scutters ? Ils sont tous fondamentalement la même chose!
Le but du logiciel Web Crawler
Lorsque vous pensez à un logiciel d'exploration de sites Web, vous imaginez probablement les grands moteurs de recherche tels que Google, Bing et Yahoo. Leurs robots parcourent les pages Web pour déterminer le contenu, la pertinence et l'indexation. En créant une copie des pages visitées, ils peuvent fournir des recherches plus rapides et plus précises. SqrBox vous dira que vous n'avez certainement pas besoin d'être un moteur de recherche pour avoir besoin d'un logiciel de recherche Web. Vous devez simplement être quelqu'un qui a besoin de rassembler de grandes quantités ou des informations extrêmement complexes.
Types de logiciels de robot d'exploration Web
Si vous envisagez d'utiliser les services d'une entreprise professionnelle telle que SqrBox, vous n'avez pas vraiment besoin de vous préoccuper de tout le jargon compliqué concernant les logiciels de robot d'indexation. Néanmoins, il est utile de comprendre certaines choses à ce sujet.
Exploration ciblée - Le but de ce type de logiciel de robot d'exploration est de télécharger des pages qui semblent contenir des informations similaires. Cependant, il existe souvent des défauts associés à cette méthode et les performances réelles du robot d'exploration et les résultats dépendent de la richesse des liens sur le sujet spécifique recherché. Ce type de logiciel de robot d'exploration Web est souvent utilisé comme point de départ pour affiner les recherches en vue d'une exploration plus approfondie.
Normalisation d'URL - les logiciels d'indexation Web effectuent souvent un certain niveau de normalisation d'URL, ce qui permet de réduire l'exploration répétitive de la même source plus d'une fois.
Restreindre les liens suivis - Dans certains cas, le logiciel de robot d'indexation peut vouloir éviter certains contenus Web et rechercher uniquement les pages .html. Pour ce faire, l'URL est souvent examinée et les ressources ne seront alors demandées que s'il y a certains caractères dans l'URL tels que .html, .asp, .htm, .php, .aspx, .jspx ou .jsp. le logiciel de robot d'exploration Web ignorera généralement les ressources avec un "?" pour éviter les pièges à araignées.