Posts tonen met het label Search. Alle posts tonen
Posts tonen met het label Search. Alle posts tonen
zondag, juli 03, 2005
Ablogger goes engels door de vissen van Babel
Dit las ik op Cyberjournalist:
[quote]"U kunt CyberJournalist.net in 12 verschillende talen nu lezen, dankzij de Vertaling van de Vissen van Babel van SYSTRAN. De vertaling is niet perfect, maar hopelijk zal het helpen de plaats voor een breder publiek toegankelijker maken."[/quote]
Het gaat hier over Babelfish, het vertaalprogramma van Altavista. Bablefish vertaalt ook van het Nederlands naar het Engels. Dus voortaan kun je ablogger in het Engels lezen. De link staat hiernaast, bij gebrek aan een betere vertaler, want de huidige Googletranslator werkt (nog) niet voor het Nederlands.
Er komt een nieuwe aan, zoals je kunt lezen op Google Blogoscoped. Google maakt hierbij gebruik van - de door mensen vertaalde - documenten van de VN. De Googlemachines vergelijken de documenten. Uit de gevonden patronen worden regels afgeleid om teksten in een willekeurige taal te vertalen.
donderdag, juni 30, 2005
Google video, multimedian en Blinkx
Het valt me op dat google video zo ad-hoc-erig lijkt opgezet. Het uploadproces was onduidelijk, volgens erwin. Ook is het volgens Battelle niet duidelijk hoe het materiaal beschermd is en of een uploader geld krijgt of zelfs moet betalen. Daarnaast is er weinig geautomatiseerd, getuige deze uitspraken van Battelle op zijn blog:
[quote]"I neglected to mention that all the video in the "free" category has been "human scanned" for adult content and copyright violations, I'm told by a good source."
"The video will be searchable via the meta data provided by the submission process (no, there's no PageRank for video, yet)."[/quote]
Niet echt des Googles. Dat er meer mogelijk is dan het doorzoeken van metadata en handmatig scannen, wordt duidelijk bij Multimedian, een Nederlands high-tech, high science initiatief met een budget van 35 miljoen. Op de site staan allerlei projecten met als doel multimediale data zoals bv nieuwsarchieven te ontsluiten. Bij concurrent blinkx zijn video's (en sinds kort podcasts) al wel volledig doorzoekbaar obv spraakherkenning en videoanalyse.
dinsdag, juni 28, 2005
zoekmachine manipulaties
donderdag, maart 24, 2005
Aladin vs Brainboost vs Google Answers
dinsdag, maart 15, 2005
Europa's antwoord op Google
De universiteit van Glasgow verspreidt het bericht dat haar onderzoekers een zoekmachine hebben ontwikkeld die de concurrentie aankan met Google. Terrier (Terabyte Retriever), de naam van deze machine, is al 3 jaar in ontwikkeling met geld van EPSRC. Het schijnt al in gebruik te zijn op de intranets van verschillende Europese instellingen. Professor Keith van Rijsbergen, hoofd van de information retrieval groep vertelt over Terrier in Research Information:
[quote]"Terrier is a better engine than Google, if you measure it, but it not so much better that people are going to say forget about Google and start using Terrier"[...]"Google gives a kind of universal feedback from the connectivity of the web. But you don't always want the most popular site. Some very important work is often very badly connected to the outside world, and people want to find it. The feedback I am talking about is personalised. What guidance does Google give you on changing your query? One of our aims is to build systems that incorporate relevance feedback."[/quote]
In de Terrier Wiki is meer informatie te vinden maar die is nogal geeky. Terrier is open source software. Versie 1.01 is hier te downloaden.
dinsdag, februari 22, 2005
mspace, een semantische webbrowser
zaterdag, januari 29, 2005
Vloeibare informatie
Webpagina's waarop ieder woord een hyperlink is. Is dat de toekomst van het web? Volgens Dougland Engelbert wel. Op de liquid information project website heeft hij een demo van de CNN-website, om een idee te krijgen van zijn bedoelingen.
[quote]"But this is only the beginning, Hegland insisted. The Liquid Information project has much grander aims. Eventually, users would be allowed to process information in any way imaginable. For example, if readers prefer The New York Times to Wired News, or Fox News to AlterNet, they will be able to add subsets of preferred sites to hyperword menus."[/quote]
(via Wired)
Het heeft wel iets weg van de tags(hype) van Technorati en del.icio.us. Handig, die woorden of categorieen waar je doorheen kunt browsen, maar ze zijn nooit specifiek genoeg. Wat moet je nu met de tag music en 8000 hits? 1 woord is vaak niet genoeg om de juiste informatie te vinden. Dat clusteren en categoriseren kun je toch beter over laten aan zoekmachines?
Blinkx pakt het slimmer aan. Deze zoekmachine scant het document (mail, webpagina, officedocument, etc.) dat je leest en levert, 'on the fly', gerelateerde informatie, gebaseerd op de inhoud van het document en niet op grond van een enkel woord, zonder enige context. Bovendien clustert Blinkx informatie naar categorieen en daar komt geen handmatig ingevoerde tag aan te pas.
woensdag, januari 12, 2005
Technorati 2.0
maandag, januari 10, 2005
zoekresultaten Clusteren
dinsdag, december 14, 2004
Aggregatie en Google
Misschien een eigenzinnige gedachte[s]n[/s]-ex[s]c[/s]ercitie, maar waar blijft Google toch met nieuws/zoekaggregatie via RSS? Leuk dat Google suggest maar het is zo web 1.0 terwijl rss-aggregatiediensten het web overspoelen. Bekijk maar eens de ppt van The shifted librarian . Zelfs deze lijst is al niet meer compleet. Blogpulse en het geheimzinnige Rojo zijn de nieuwste spruiten aan de web 2.0 boom.
zaterdag, november 13, 2004
Niches in de zoekmarkt
Je moet wel een rasoptimist zijn of een superieure techniek hebben om in een markt waar Google alleenheerser is, een zoekmachine te beginnen. Toch wemelt het op het internet van de zoekmachinestartups. Begrijpen wat er op the string coffee Table, een weblog over de stringtheorie, staat, lijkt me een makkelijker opgave dan concurreren met Google.
Misschien dat de bedrijfjes wel een betere of verfijndere zoektechnologie in huis hebben dan de Pageranktruc maar tegen de marketing-, reken- en indexeringskracht van Google kunnen nog maar weinig internetbedrijven opboksen. Amazon met het hele fraaie A9 en Microsoft search maken nog enige kans. Forbes bespreekt 8 van die Google Wannabes.
De meest originele van het stel is manyone, dat nog in Beta is. Geen zoekmachine, maar een nieuw soort browse-ervaring om door het heelal te surfen of het Barrier Reef onder water te verkennen.
Die anderen moeten afwachten of een grote jongen hun zoektechnologie interessant genoeg vindt om over te nemen. Of ze moeten op zoek naar een niche in de markt. Is er al een zoekmachine die niches vindt?
donderdag, november 11, 2004
10 X 10
dinsdag, oktober 26, 2004
RFID camera
zaterdag, september 25, 2004
My Google
woensdag, september 22, 2004
Infojunkietools
RSS is een van de betere uitvindingen van de laatste tijd op het internet. Wat een tijdsbesparing levert dat op. Of zou het moeten opleveren want de gewonnen tijd gebruik je natuurlijk om nog meer sites te scoren.
Na rssreader voor sharpreader te hebben omgeruild neem ik regelmatig wat extra nieuwsshots met de ingebouwde Feedster zoekfunctie. Een aantal onderwerpen volg ik met de feeds van mijn favoriete nieuwsdealer topix.net.
Met het succes onstaan de eerste initiatieven om geld met RSS te verdienen. Zesser verwijst naar blender en Battelle filosofeert over een aantal businessmodellen met RSS.
Naast RSS houd ik, heel ouderwets, via dagelijkse Google newsalerts mijn nieuwsgehalte op peil. Vooral om nieuws te scoren dat niet uit de blogosphere afkomstig is. Die emailalerts vervuilen al snel de inbox als je ze niet dagelijks bijhoudt. Het is geen geniale tip maar ik heb voor iedere alert een mapje aangemaakt en een rule om ze naar dat mapje te verplaatsen. Zo komen Cyber en science fiction netjes in een mapje terecht waar ik ze regelmatig scan op interessante nieuwsfeitjes. Het is grappig om te zien hoe zo'n nieuwsfeitje of meme zich vaak langzaam en soms snel via andere sites over de wereld verspreidt.
dinsdag, juli 20, 2004
Blinkx
zaterdag, mei 22, 2004
Scopeware en de cyberbody
donderdag, mei 13, 2004
Mr Knowitall
woensdag, mei 05, 2004
Superbieb
In Business week een interview met Larry Page, een van de oprichters van Google. Google's doel: "Understand Everything". Het woord superlibrary is gevallen! Conspiracy theorists start your engines! http://www.google.com/blog/ (van Ben Hammersley's Dangerous Precedent)
Dit is de toekomstvisie die ik met die linkjes probeer duidelijk te maken; Via foto- en videomobieltjes zetten wij, bloggers, binnenkort alles, wat ons 'buiten op straat' interesseert, op het web. Dat wordt naast o.a. email en sms en weer geindexeerd door Google. Als die informatie voor anderen interessant genoeg is, willen ze daarvoor eventueel betalen en via een nog te realiseren systeem van Google komt dat geld weer bij de 'dataleverancier' terecht. Google wordt de Central Intelligence Corporation (CIC) uit Snowcrash. Dit klinkt misschien enger dan het zal zijn.
zondag, april 25, 2004
Google wordt persoonlijk
Uit het interview van Steve Gillmor met Google's Sergey Brin komt duidelijk naar voren dat Google de data van Gmail aan de andere diensten wil koppelen (zie de vorige post over Gmail). Ik had het ook raar gevonden als ze dat niet gingen doen. Brin noemt 2 voorbeelden: Als je zoekt met Google krijg je bij de resultaten te zien of je nieuwe mail hebt ontvangen. Hetzelfde gebeurt als je aanlogt bij Orkut.
Met die gekoppelde data kan Google marketingtechnisch veel meer doen dan alleen het personaliseren van advertenties in email en "you've got mail" alerts. Misschien weer iets vernieuwends want naast de nieuwste technologie beheersen ze ook het marketingvak erg goed. Google is viraal geintroduceerd; van contentads had, tot Google ermee kwam, nog nooit iemand gehoord; Orkut is gebracht als een exclusieve dienst voor de internetelite waar je alleen op invitatie bij mag, met als gevolg dat iedereen er bij wil en Gmail bleek toch geen 1 aprilgrap te zijn.
Abonneren op:
Posts (Atom)