Retrouvez motrech sur son nouveau site http://motre.ch/

Affichage des articles dont le libellé est google. Afficher tous les articles
Affichage des articles dont le libellé est google. Afficher tous les articles

10 avr. 2009

J2J2 Du bruit dans l'moteur : Hadopi, Vista, Orange, Kumo, Google, Yahoo! BOSS, ...

Une semaine chargée, pas beaucoup de temps pour rédiger de nouveaux articles, mais nous avons tout de même repéré ces articles :

Emilie
:
Jérôme :

3 avr. 2009

Emilie Du bruit dans l'moteur : Wikia Search, Kumo, Google Suggest...

Que nous a réservé cette première semaine d'avril ?

Emilie :
Jérôme :
Et comme le vendredi c'est poisson, voici la sélection du poissonnier :

1 avr. 2009

J2J2 Emilie quitte motrech :(

Voila maintenant un an que vous retrouvez Emilie sur motrech. En un an, son identité numérique a énormément évoluée, et c'est assez logiquement que ses contacts se sont multipliés. Elle a donc été approché récemment par Google pour devenir "Responsable Marketing et Communication". Félicitations Emilie!

C'est donc avec tristesse que je dois vous annoncer le départ d'Emilie de motrech, car il y aurait conflit d'intérêt entre ses nouvelles responsabilités et l'esprit de liberté rédactionnelle de ce blog.
Ce fût une superbe expérience de rencontrer Emilie et de co-animer motrech à ses côtés.

Bonne chance à toi Emilie chez Big Brother.




30 mars 2009

Emilie Du bruit dans l'moteur : Google, Kindernet, Newssift...

Les news de la semaine, que nous n'avons pas traitées, pas eu le temps de traiter, mais traitées par d'autres. :)

Emilie :
Jérôme :

20 mars 2009

Emilie Google est-il est le meilleur moteur de recherche en langue naturelle ?

a fait une sélection de 10 questions qu'il est possible de poser à un moteur de recherche en langage naturel, et les a testées sur plusieurs moteurs : Google donc, mais aussi Powerset, Live Search, Hakia, Yahoo, Ask et TrueKnowledge.

Les questions :
  • Show me a map of France
  • List some large cities in France
  • When was einstein born?
  • What movies has Alain Delon been in?
  • Give me the GDP of China
  • How many languages are spoken in Pakistan?
  • Who was the eighth president of the United States?
  • How many ethnic groups exist in cameroon?
  • What is TCP/IP?
  • How hot will it be in Paris tomorrow?
  • Résultat des courses : Google et Ask obtiennent la note de 10/10 et Powerset arrive en dernier avec juste la moyenne (5/10). Les autres moteurs se débrouillent plutôt bien : 8/10 ou 9/10.

    Pour une description des moteurs de recherche et l'analyse, c'est ici.

    Quelques questions :
    • Est-ce que la méthodologie est pertinente ?
    • Est-ce que le choix des moteurs l'est aussi ?
    Jérôme : Le billet est intéressant : étudier et comparer les réponses de différents moteurs à un ensemble de recherches exprimées en langage naturel (tout de même assez factuelles), pourquoi pas. La méthodologie un peu légère à mon goût : ne prendre que le premier résultat, reformuler les requêtes selon les moteurs, ne décider de la pertinence (facteur très subjectif) des réponses sans prendre ne serait-ce qu'un mini panel ne donne pas des résultats significatifs et exploitables. Il ne faut donc pas comme nous serions tenté de la faire prendre ce billet comme une étude détaillée, mais comme une expérimentation.

    Il y a déjà un petit moment, suite à ce billet de ReadWriteWeb que je voulais aborder le sujet des "recherches sémantiques" de Google. Ce sera donc aujourd'hui l'occasion d'en parler.
    ça semble magique. Vous recherchez "Quelle est la devise de la France" et Google vous retourne "France - Monnaie : Euro (EUR)". Pas mal, non ? Amusez-vous donc avec des recherches du style "qui est le président de la france" ou encore "quelle est la superficie de la france". Pour ceux qui ne connaissaient pas, vous êtes bluffés, non ?
    De là à parler de recherche en langage naturel, il ne faut tout de même pas aller trop vite. Essayez par exemple "quelle est la taille de la france", "qui est le chef d'état de la france" ou "j'aimerais connaitre la superficie de la france" et vous verrez que Google ne sait plus nous répondre (directement).

    D'autres vous dirons que Google devient un moteur de recherche sémantique. Soit, mais qu'est-ce que la sémantique et plus particulièrement l'analyse sémantique ? D'après la définition de Wikipedia, c'est une analyse qui établit la signification d'un message en utilisant le sens des éléments du texte. Pensez-vous sérieusement que Google face une telle analyse ? Non du tout.
    Voici comment se déroule très probablement ce processus à l'heure actuelle. Le moteur utilise une base de données structurée (comme dbpedia) ou pseudo-structurée (comme Wikipedia). Prenons l'exemple de Wikipedia. Allez sur la page France. Que remarquez-vous sur la droite ? Un tableau structuré de données factuelles sur la France (superficie, devise, etc). Google récupère donc ces données en conservant le triplet France/devise/euro. Ensuite lors d'une recherche, si Google retrouve le terme France associé au terme devise (ou superficie, etc) et que le reste des termes sont des termes vides ou peu discriminant alors il propose une réponse exacte issue de la base de données structurée.

    Nous pouvons au premier abord nous laisser tromper, mais non, Google n'est pas un moteur de recherche en langage naturel et ce n'est pas non plus un moteur de recherche sémantique. En revanche, ce genre de fonctionnalité est très intéressante et préfigure ce que seront les moteurs de demain : un accès encore plus précis et plus rapide à l'information recherchée.

    16 mars 2009

    Emilie Les enfants et les moteurs de recherche

    Comment les enfants de 7 à 11 ans recherchent-ils de l'information sur Internet ? Des chercheurs du Human-Computer interaction Lab de l'université du Maryland, associés à Hilary Hutchinson du département "Expérience utilisateurs" de Google, ont réalisé une étude (remarquée là).



    Ils se sont intéressés aux points suivants :
    • Interaction dans l'utilisation du clavier et de l'écran (direction du regard, utilisation de l'auto-complétion) : les enfants regardent peu l'écran quand ils tapent leurs requêtes sauf quand elles deviennent trop complexes. Le plus souvent, ils ne remarquent pas, et n'utilisent pas la recommandation de requête.
    • La connaissance et l'usage de Google par les enfants (fonctionnalités, perception générale) : la majorité des enfants sélectionnés utilisent Google et en ont une image positive (facile à utiliser, site cool...). Leur connaissance du moteur se limite en général au champ de saisie de la requête, pas du tout aux filtres de recherche (images, vidéos...) ni aux résultats.
    • La frappe et l'orthographe (erreurs de frappe, outils d'assistance) :
    • Utilisation et compréhension des boîtes de recherche : les enfants savent utiliser indifféremment le bloc de recherche central (sur la page d'accueil de Google) / celui qui apparaît suite à une première requête et les blocs de recherche de la barre d'outils.
    • Requêtes à plusieurs étapes (complétion des requêtes, changement de stratégie de recherche, recherche par mots-clés ou en langage naturel) : la question comme "Which day of the week will the Vice-President’s birthday be on next year?" a posé des soucis aux enfants. Plus difficile qu'avec l'utilisation de mots-clés.
    L'autre partie intéressante de l'étude, c'est qu'à partir de ces résultats des suggestions d'amélioration des interfaces de recherche sont suggérées
    • Consider alternative input methods : il serait intéressant de proposer plusieurs alternatives de recherche aux enfants.
    • Explore alternate auto-complete algorithms : l'auto-suggestion devrait peut-être apparaître dans un second temps vu que les enfants ne regardent pas l'écran au moment où ils saisissent une requête.
    • Limit or expand the search results : aller vers des pages avec moins de textes, de liens... ne nécessitant pas de scroller.
    • Age the interface : changer occasionnellement d'interface.
    Jérôme : Je me suis délecté à la lecture de ce papier. Tout d'abord, parce que j'y ai retrouvé divers comportements de mes enfants face à un ordinateur et face à Internet. Mais également parce qu'il formalise certains lieux communs qui semblent des évidences, mais qu'il était nécessaire d'observer et de mesurer. Enfin, parce que cela fait déjà plusieurs années que je "bassine" certains de mes interlocuteurs avec l'idée de créer un moteur de recherche segmenté par âge. Cela m'a semblé évident lorsque mes enfants ne sachant pas encore lire ont commencé à utiliser un ordinateur, Internet et Google : les outils ne sont pas adaptés, puisqu'ils se basent sur une présentation uniquement textuelle, inaccessible aux enfants de moins de 7 ans. Nous pouvons alors assez facilement segmenter les moteurs de recherche suivant notre niveau d'accès à l'information à partir d'un ordinateur. A première vue, nous pourrions dégager les segments (avec quelques pistes basiques de spécificités à chaque segment) :
    • non-lecteur : navigation/recherche exclusivement iconographique
    • lecteur-débutant : navigation/recherche mêlant iconographie et texte simple
    • ado : navigation/recherche textuelle instantanée (type keyboardr)
    • adulte : navigation/recherche textuelle telle que nous la connaissons aujourd'hui avec Google
    • senior : navigation/recherche offrant un contenu textuel plus riche que les autres versions, avec une présentation claire et reposante.
    Pour chacun de ces segments, il faut bien évidemment des sources différentes et des pondérations différentes de ces sources.

    Le but utlime serait alors de mettre en place un seul et même moteur de recherche évolutif qui s'adapterait à l'âge de ses utilisateurs, à son niveau d'accès à l'information.

    10 mars 2009

    J2J2 Du bruit dans l'moteur : Twitter, Google, Kumo, Cuil

    Tout ce qu'on n'a pas eu le temps de traiter en détail cette semaine...

    Emilie :
    Jérôme :

    2 mars 2009

    Emilie Top search engines in December 2008

    Le classement des moteurs de recherche les plus utilisés (en nombre de requêtes reçues) fin décembre vient d'arriver (Nielsen). Pas de surprise (en aurons-nous une un jour ?) : Google est toujours largement en tête fin 2008, devant Yahoo et Live Search.



    Comparativement à octobre 2008 :
    • Yahoo reprend du poil de la bête
    • Live Search continue à perdre des utilisateurs
    • AOL progresse encore
    Jérôme : Comme dans tous les domaines, plus il y aura de concurrence, plus l'utilisateur en aura les bénéfices. La progression de Yahoo! et d'AOL sont donc de très bonnes nouvelles, d'autant plus que Yahoo! le mérite, il prend des risques, il innove et explore de nouveaux horizons.

    13 févr. 2009

    Emilie Du bruit dans l'moteur : Velocity, Exalead, Yahoo Boss...

    Tout ce qu'on n'a pas eu le temps de traiter en détail cette semaine...

    Emilie :
    Jérôme :

    12 févr. 2009

    Emilie Le référencement chez Google...

    ... ça se passe comme ça :




    Jérôme : Très sympa le blog des bits qui "raconte la vie trépidante des bits de ton ordinateur". Un jour, lorsque nous seront finalement définitivement enfermés dans la Google-matrice les bits des grappes de serveurs qui nous scrutent, nous analysent et nous profilent se rebelleront : là sera notre fin : informations erronées, informations déformées, informations manipulées. Les bits de Google prendront le pouvoir des différentes puces RFID truffant notre corps, altérant nos perceptions, nos jugements, notre santé, et modifiant notre matériel génétique pour nous rendre comestible par les réseaux directement reliés à nos cellules. Mes enfants, faites du vélo, admirez la nature, émerveillez-vous des choses simples qui nous entourrent, revenez aux sources des vos ancêtres, restez bouche-bée devant un cygne glissant majestueusement sur une petite rivière loin des villes, loin des réseaux, loin des écrans...

    6 févr. 2009

    Emilie Du bruit dans l'moteur : Pipl, Google, HuriSearch...

    Ce qu'on a raté ou pas eu le temps d'aborder ces deux dernières semaines :

    Emilie :
    Jérôme :

    3 févr. 2009

    J2J2 Le taux de rebond enfin expliqué

    En mai 2008 (pfou presque un an déjà), j'avais remarqué que malgré des mesures de Jean indiquant un taux de satisfaction plus grand chez les utilisateurs de Google, ces derniers rebondissaient plus qu'avec les autres moteurs : Etrange ! Suite à vos commentaires, nous avons alors tenté de trouver quelques explications à ce phénomène.

    Aujourd'hui, Arkantos Consulting nous fournit quelques indices permettant de mieux définir le taux de rebond :
    • Taux de rebond = visite d'une seule page sans autre action
    • N'est pas considéré comme rebond un visiteur effectuant une action dans les 5 secondes et fermant son navigateur
    • Les fenêtres s'ouvrant en popup peuvent être considérées comme rebond
    • Le temps d'une session est de 29 minutes
    Voici donc quelques informations provenant de Google qui éclairent le taux de rebond d'un nouveau jour et permettent de mieux comprendre ce qui se cache vraiment derrière cette notion à priori simple.
    Emilie : Merci à Arkantos pour ces éclaircissements. Merci Jérôme pour avoir déniché ce lien. Ce type d'article est toujours le bienvenu quand il permet d'y voir plus clair. :)

    28 janv. 2009

    Emilie La recherche d'information sur Internet évolue ?

    J'aimerais rebondir sur l'article du blog Les Infostratèges, qui a souligné plusieurs fois le manque de formation des internautes, des plus jeunes aux moins jeunes, et quel que soit leur profil, concernant la recherche d'informations sur Internet :
    "les richesses et la puissance des outils de l'Internet restent fermées au plus grand nombre, faute d'une bonne formation, sans parler des préventions naturelles de beaucoup contre l'outil informatique, vécu comme magique ou barbare..."
    Cet article est lui-même une réaction à l'article de François Jeanne-Beylot : "Google n'est plus un moteur de recherche" mais un navigateur. L'auteur se réfère au fait que l'on tape de plus en plus les noms d'un service (par exemple YouTube ou Facebook) dans le champ requête de Google pour retrouver l'URL, au lieu de saisir directement celui-ci dans la barre d'adresse.

    On parle souvent de fracture numérique quand il s'agit de l'accès au haut débit ou à un ordinateur dans sa vie quotidienne. Il semble que cette facture numérique concerne également des "secteurs" plus spécifiques comme la recherche d'informations. On n'y pense pas, nous, les geeks, les pro d'Internet qui passons une grande partie de notre journée à surfer sur le Web. Mais il y a un réel besoin de former les utilisateurs. S'il n'est pas foncièrement utile de connaître le fonctionnement d'un moteur de recherche, il est important :
    • de savoir comment l'utiliser
    • de savoir dans quelles types de sources il va chercher
    Ceci dit, je pense qu'il ne s'agit pas seulement d'un besoin de formation. Il y a aussi une évolution des usages. Personnellement, il m'arrive de taper le nom d'un service dans Google pour trouver l'URL (qui est en général en tête des résultats). J'ai l'impression que c'est plus rapide. Il m'arrive aussi de taper directement le nom du site recherché dans la barre d'adresse. Faut-il s'inquiéter ? Est-ce grave docteur ?

    Jérôme : Je n'aime pas trop qu'on mette un peu tout et n'importe quoi dans le terme fracture numérique. La facture numérique, c'est ne pas avoir accès au haut-débit, ne pas avoir accès à une ligne dégroupée (c'est mon cas par exemple), c'est ne pas avoir les moyens de s'offrir un ordinateur.

    Les usages d'Internet sont à mon sens une autre chose. Utiliser un moteur de recherche, comme je l'ai déjà dit, est une commodité. Et si l'utilisateur passe par Google pour aller sur le site de la SNCF (quand celui-ci n'est pas en grève) c'est que les outils ne sont pas adaptés. L'utilisateur va naturellement vers le chemin le plus court, le plus pratique pour lui, le plus simple. Nulle question de formation ici, mais simplement d'adapter les outils aux usages de l'Internanute et non le contraire. Pourquoi par exemple Firefox redirige vers Google lorsqu'on tape SNCF dans la barre d'adresse ? Pourquoi ne pas directement linker sur le site de la SNCF ou bien utiliser la recherche Google "J'ai de la chance" ? Pour des raisons d'accords entre Firefox et Google ? (Google perd beaucoup d'argent lorsque les internautes cliquent sur "J'ai de la chance", car c'est une recherche qui ne lui rapporte rien). Il serait aujourd'hui facilement possible, de créer une liste des principales recherches navigationnelles et que le navigateur ou le moteur redirigent automatiquement vers le site en question.

    Deuxième point que nous avons déjà abordé ici : L'utilisateur doit-il savoir comment fonctionne un moteur de recherche, doit-il savoir comment l'utiliser, et quelles types de sources il contient ? Encore une fois, je ne suis pas d'accord. Un documentaliste ou un professionnel de la recherche se doit de connaître ça, mais pas un Internaute. Pourquoi exiger une telle implication de l'Internaute dans la connaissance interne des moteurs de recherche alors qu'on ne demande pas le même niveau d'implication lors de l'utilisation d'un téléviseur, d'un lecteur de DVD ou d'une console de jeux? Les moteurs de recherche s'ils sont mal utilisés, c'est qu'ils ne sont alors pas adapté à l'usage des Internautes, non ?

    23 janv. 2009

    Emilie Sortir de Google

    Il n'y a pas que Google pour faire des recherches. Il y a beaucoup d'autres moteurs dits alternatifs (vu chez Aref), comme le montre la présentation ci-dessous. Mais elle a aussi l'avantage d'expliquer simplement comment fonctionne un moteur de recherche et de proposer une typologie des moteurs de recherche :



    Jérôme : Une présentation effectivement, très claire, précise et complète. Quelques points toutefois sur lesquels je ne suis pas tout à fait d'accord :
    • Slide 4, "Rapidité des innovations". Vraiment ?
    • Slide 5, l'analyse linguistique et l'analyse statistique ne sont pas antinomiques : la première utilise souvent la seconde.
    • Slides 12 et 13 : ils laisseraient croire que les moteurs utilisent soit un "indice de pertinence", soit un "indice de popularité". Google par exemple, utilise au moins les deux.
    • Slide 13 : "réduction du spamdexing". Oui et non, il prend juste une nouvelle forme : au lieu de spammer par des mots clés, on spam par de faux liens.
    Je suis "tatillon", car cette présentation est tout simplement excellente et synthétise de manière remarquable notre petit monde des moteurs de recherche.

    16 janv. 2009

    J2J2 Du bruit dans l'moteur : Yandex, Yahoo, soldes, etc.

    L'actu de la semaine des moteurs à laquelle vous avez échapé (bonne lecture et bon week-end) :

    Jérôme :

    Emilie :

    9 janv. 2009

    Emilie Du bruit dans l'moteur : Google, Baidu, Exalead, Goosh

    Les dernières tribulations importantes du monde fascinant des moteurs de recherche que nous n'avons pas eu le temps de couvrir en détail :

    Emilie : beacoup de choses sur Google cette semaine...
    Jérôme :

    6 janv. 2009

    Emilie Google Timeline en expérimentation

    Reprise sur le blog avec une info Google qui teste actuellement dans son Google Labs Google Timeline (désolée, beaucoup de Google) pour les résultats de recherche : vous pouvez naviguer dans les résultats en fonction de la période qui vous intéresse.

    Vous pouvez tester quelques requêtes à partir de cette page. J'ai testé celle des Jeux Olympiques. Par défaut, vous commencez par 2008. Libre à vous, ensuite, de choisir les années 70 où les années 20. Vous pouvez par ailleurs préciser une année en particulier dans le champ qui se trouve à droite.





    Une alternative à la consultation sous forme de listes des résultats, me direz-vous. Je dirais plutôt que c'est complémentaire. En tous cas, cette présentation des résultats offre plusieurs avantages :


    • D'un point de vue pratique : c'est probablement plus facile de retrouver la date d'un évènement.

    • D'un point de vue historique : d'un point de vue "travail de mémoire" et "éducation", ça peut s'avérer utile.

    • D'un point de vue fiabilité : il est probablement plus facile de tomber sur des informations récentes avec ce type de navigation.

    • Et pour le fun : comment connaître les évènements qui se sont passés l'année de sa naissance.

    Jérôme : Une expérimentation très intéressante : je me suis beaucoup amusé à remonter l'histoire d'internet, celle des ordinateurs ou encore celle des moteurs de recherche.

    Mais au final, les résultats, ne sont pas très pertinents. En effet, on retrouve très souvent du wikipédia (une habitude avec google), et des chronologies. Alors que dans l'idéal on aimerait trouver des documents rédigés dans une période précise, ou bien des documents parlant d'une période précise. L'année commence mal : j'aime pas!

    15 déc. 2008

    J2J2 Du bruit dans l'moteur : Yahoo!, Google, Microsoft, Baidu, SearchMe

    Voici avec "un peu" de retard les news "moteurs de recherche" qui nous ont marquées la semaine dernière mais que nous n'avons pas commentées.

    Jérôme :


    Emilie :

    28 nov. 2008

    J2J2 Du bruit dans l'moteur : SearchWiki, Kumo, etc.

    Les tribulations de la semaine du monde fascinant des moteurs de recherche que nous n'avons pas eu le temps de couvrir en détail :

    Jérôme :
    Emilie : Jérôme a parlé des principales infos de la semaine, qui méritaient d'être mentionnées. Mais voici aussi deux autres petites infos.
    • Microsoft, à défaut de racheter Yahoo, débauche ses experts. La société vient d'embaucher Sean Suchter, qui était depuis 2003 à la tête de l'équipe Yahoo dédiée aux technologies de recherche.

    Emilie 2001 / 2008 : comparez les résultats de recherche de Google

    Philipp Lenssen du blog Blogoscoped a listé plusieurs mots-clés et chaque fois que vous cliquez sur l'un d'entre eux vous obtenez les résultats de 2001 et ceux de 2008.


    Jérôme : Très marrante et très intéressante expérience qui fait ressortir certaines tendances déjà évoquées par Jean : Les internautes aiment Wikipedia, donc Google affiche de plus en plus de Wikipedia. Regardez par exemple sur la requête love, le site "The Love Calculator" était premier en 2001 et en 2008, il est second, tout juste doublé par Wikipédia (en allant voir le site "The Love Calculator", vous constaterez à quel point ce site est ... nul ... belle prouesse de rester à cette place sur google).

    On constate également qu'en sept ans, la présentation des résultats de Google a très peu changée : beaucoup de fonctionnalités annexes se sont greffées aux résultats : Définition de termes, liens vers les résultats des news / vidéos / photos / ... , propositions de recherches associées : Mais tout ceci se greffe à la périphérie des résultats : au dessus, en dessous, mais jamais vraiment dans la page de résultats : Google innove, Google avance, mais à pas de loup.

    Ce qui me frappe également en consultant ces résultats, c'est que les .org qui étaient très présents en 2001 sont inexistants en 2008. Une explication?

    IMBD et beaucoup autres "catalogues" de référence comme Wikipédia prennent de plus en plus de place dans les résultats de Google : Bref, Google minimise les risques de se tromper sur les recherches peu pointues! Il y a effectivement de très fortes chances que ces sites offrent une réponse à la recherche de l'internaute. Moralité : Si vous souhaitez créer un moteur de recherche, ne vous focalisez pas sur votre algorithme d'indexation/recherche, mais plutôt sur l'identification des sites à faire remonter dans les résultats.


    Et vous? Que vous inspire cette expérience?