viernes, noviembre 28, 2008

Notas cortas en Intelligencia Artificial (and ML): Google muestra anuncios pro-terrorismo Google Ads <2>

   Cuando la Inteligencia Artificial resulta ser poco inteligente nos puede meter en problemas. Y esto es lo que le pasó a Google (y no es la primera vez) cuando su algoritmo de Google Ads decidió mostrar anuncios pro-terrorismo en los sitios que reportaban los atentados en Bombay.  Las imágenes de la captura de pantalla las pueden ver en Mashable aquí. El anuncio dice:

Terrorism: Pursue a certificate in terrorism 100% online. Enroll today

Terrorismo: Consiga un certificado en terrorismo 100% en línea. Inscríbase ahora.

Esto nos recuerda que la IA a veces no es tan inteligente, vamos al final es programada por humanos. Y aunque creo Google a invertido mucho esfuerzo para eliminar spammers, phishers y ahora terroristas aún veremos este tipo de cosas durante algún tiempo. ¿Quién dijo que los anuncios en línea era negocio fácil?




lunes, noviembre 24, 2008

Notas cortas en Intelligencia Artificial (and Machine Learning): Learning (Aprender) <1>

¿Realmente existe la Inteligencia Artificial?

¿Son las máquinas inteligentes?

¿Las máquinas aprenden?

Bueno, estas son algunas preguntas que nos hemos hecho durante los últimos quizá 60 años y aún seguimos sin responderlas. Ni siquiera mentes tan brillantes como Alan Turing fueron capaces de definir como identificar a una máquina inteligente. Así que sería inútil tratar de hacerlo aquí en un simple post de un humilde blog acerca de muchas cosas.

Sin embargo para ponernos en contexto empezaremos por definir que significa aprender desde el punto de vista maquinal. De acuerdo a Tom Mitchel [1] podemos de decir que un programa aprende cuando ejecuta una tarea T y adquiere una experience E y el desempeño medido P (Performance) de T aumenta con la experiencia E. Estando de acuerdo con el término aprender podemos definir algunos formas en que las máquinas aprenden (Machine Learning).

En general el aprendizaje maquinal puede ser dividido en Aprendizaje Supervisado (Supervised Learning), Aprendizaje No-Supervisado (Unsupervised Learning) y Aprendizaje Reforzado (Reinforcement Learning). En aprendizaje supervisado el programa intenta aprender un concepto o hipótesis a partir de ejemplos etiquetados. Para aprender el concepto, el programa genera una función a partir de los ejemplos dados. Redes Neuronales, Arboles de Decisión y Redes de Bayes son ejemplos de este tipo de aprendizaje máquina.

Contrario a aprendizaje supervisado, el aprendizaje no-supervisado usa ejemplos no etiquetados o categorizados. El objetivo es encontrar las relaciones entre los ejemplos para generar categorías. Ejemplos de este tipo de aprendizaje son Factorización de Matrices no negativas y Mapas auto-organizados. Finalmente en aprendizaje reforzado (RL) el agente aprende interactuando con el ambiente. En RL el agente sensa el ambiente y ejecuta acciones. A través de refuerzos positivos o negativos el agente aprende que acciones llevan a mejores refuerzos (rewards) a largo plazo en determinados estados del medio ambiente [2]. Algoritmos basados en RL son Q-Learning [3] y SARSA.

Por lo pronto esta fue una pequeña introducción a Aprendizaje Maquinal. En otros posts iré ahondando en cada uno de los temas.


viernes, noviembre 14, 2008

Adios SPAM ... Hola SPAM


   Si han notado que en estos últimos días han recibido menos SPAM no es su imaginación. A partir del "desenmascaramiento" de una red de SPAMers a partir de un artículo del Washington Post el ISP que hosteaba a los servidores de esta red decidió cortales la conexión. De acuerdo a las estadísticas de Iron Port y Spamcop  el envío de SPAM bajó entre un 66% y un 75%. Si creen que esto es sorprendente, se dice que el 80% del SPAM es controlado por sólo 100 spammers.

Sin embargo nuestro descanso  no va a durar mucho, hay ya algunas teorías de que los "desconectados" están buscando otros ISPs donde hostear sus servers. Mientras tanto disfruten su inbox menos cargado de e-mail chatarra.

miércoles, noviembre 12, 2008

Notas cortas en Intelligencia Artificial (and Machine Learning): Introducción <0>


   Desde hace tiempo tengo deseos de escribir algunas notas cortas sobre temas en Inteligencia Artificial (AI) y Machine Learning (ML). De alguna manera trateré de explicar algunos temas sobre estas áreas y en lo posible incluso pondré algunos ejemplos de apliaciones en web que pueden usar estas técnicas.

    Mi primera impresión de AI y ML es que eran complicadas, que usaban muchas matemáticas y que nunca se usaban para aplicaciones reales. Bueno, la realidad es que sin son algo complicadas en un principio pero después terminas por entender de que se trata el asunto, si usan muchas matemáticas y si, se usan mucho para aplicaciones reales. Es más, muchas aplicaciones están ahí en nuestra vida diaria cuando navegamos en la Web. Solo piensen por ejemplo como indexa y rankea sus páginas Google, como Picasa reconoce las caras que etiquetas en tus fotos, como delicious encuentra bookmarks que pueden interesarte y como Amazon lo hace con sus productos y como Last.fm sabe que una canción esta relacionada con otra. Si bien "el fine tunning" de los algoritmos que mueven estas aplicaciones son secretos, hasta cierto punto podemos replicarlos y explicarlos en algunas líneas. Y bueno, ese será el objetivo de mis posts futuros en el tema.

Por lo pronto los dejo con unas fotos de unos robots y un video de RAVON (Robust Autonomous Vehicle for Offroad Navigation) que tomé en la Conferencia Alemana de Inteligencia Artificial. Algunas especificaciones de RAVON.








martes, noviembre 04, 2008

RIP La Cofradia Digital


   Después de muchos años La Cofradia Digital llega su fin. Inspirado creo yo en el modelo de control de edición de notas al estilo Slashdot, La Cofradia no siguió adelante y hoy ha cerrado sus puertas (bueno, al menos hoy me di cuenta gracias al post de David Treviño).

   No se que uso le quieran dar al sitio o si sus creadores quieran seguir adelante, pero considerando lo conocido de su nombre aquí hay algunas ideas que pueden seguir:

- Sitio de noticias sociales al estilo Digg. Aunque en México ya hay muchos como Efecto Tequila, Enchílame y Chido.
- Sitio de blogs y podcasts. Junten a algunos buenos blogueros y creen un sitio con varias categorias de blogs. Creo que aunque en México hay buenos blogueros ya, hace falta un buen espacio que incluya blogs con varios autores y en varios temas, no solo tecnología. 
- Repositorio tecnológico al estilo wikipedia. Algo así como un wiki pero de temas de tecnología (recordemos que una buena parte de los cofrades era de perfil técnico). Y aquí pueden buscar un modelo de negocio donde al autor del artículo técnico le caiga algo de la lana del advertising.
- Un mexican craiglist, quiza enfocado a publicar empleos ahora que empieza la crisis (o sigue). Creo que en México no hay muy buenos sitios de búsquedas de empleos. Aquí se me ocurre que pueden fusionar algunas tecnologías como Web 2.0, RSS, alertas, mashups, etc. que los sitios actuales no tienen (de hecho ver algunos es como regresar al 2000 sin CSS).
- Instalen laconi.ca y hagan un clon de twitter al muy estilo mexicano.

O de plano a lo fácil, vendan el dominio a alguién que tenga tiempo y $$$ para invertir y sacarle provecho.


Nueva vulnerabilidad RCP de Microsoft explotada y en la red.


   Un nuevo post en mi blog de investigación de ataques de DoS/DDoS. Está en inglés, pero si quieren la traducción "pochona" y al buen estilo de los bots les dejo este link de Google Translate.


Nueva vulnerabilidad RCP de Microsoft


  Si no se dieron cuenta el ISC (Internet Storm Center) cambió de verde a amarillo (nuevamente esta en verde) debido al anuncio de una nueva vulnerabilidad (MS08-067) RPC de Microsoft. La vulnerabilidad esta en los servicios RCP e intercambio de archivos y es similar a la que explotaron los worms Blaster y similares. Afecta a la familia XP, Windows Server 2003, Windows Server 2008 y Windows Vista.

Microsoft anunció un parche crítico fuera del ciclo normal de parcheo. Así que administradores de redes Windows, a probar e instalar parches. Nadie quiere otra semanita como la de hace unos años en donde muchos anduvimos de apaga fuegos y cazadores de máquinas comprometidas. Más información:


Update: Si quieren saber si su máquina ya se infectó aquí pueden encontrar que buscar en los registros de windows.




viernes, octubre 17, 2008

Cloud Computing ¿Sobre Valorado?

¿Cómo sabes cuando un término tecnológico está sobrevalorado?


Cuando el CEO de Microsoft dice que hay una versión de sistema operativo para éste y saldrá en unos pocos meses. Incluso si después anuncian algo medio tanglible.
Cuando es una tecnología que conocemos desde hace años pero simplemente le cambiamos el nombre.
Cuando no sabes que es o como se come pero todo mundo habla de él.

Y bueno, por muchas cosas más creo que el término de "cloud computing" esta sobrevalorado. Y no solo eso, sino también que no es la panacea que todo mundo (o muchos) creen o dicen que es. Si bien esfuerzos como Google Chrome hacen que este tipo de aplicaciones pueden ser llevadas a las masas aún hay muchas cosas que resolver como:

  • La conexión siempre disponible de los clientes a la nube: En ambientes corporativos representa que tu centro de datos y la red de tu usuario tienen que tener altos niveles de disponibilidad. En ambientes personales, pues solo es cuestión de confiar en nuestros infalibles ISPs y sus SLA.
  • Costo de conexión de los clientes:
  • Propiedad y movilidad de la información de la nube
  • Disponibilidad de la información dentro de la nube
Personalmente creo que "cloud computing" es algo importante para la industria de TI y puede ayudar a bajar costos e incrementar productividad. Sin embargo no va  a ser para todo mundo ni para todas las apliaciones. Así que úsese con cuidado.


viernes, octubre 03, 2008

Dinero sucio en línea

Es indiscutible que el Internet (y aunque en el discovery channel le digan "la Internet", para mi al menos por cacofonía me parece mejor "el") es una fuente de ingreso para muchos y para algunos es una gran fuente de ingresos. Desafortunadamente como en muchos lugares donde se manejan grandes cantidades de dinero hay algunos que intentan enriquecerse de forma inmediata y para ello recurren a prácticas no-legítimas o al menos en algunos casos poco éticas.

Y aunque este tipo de actividad no es nada nuevo y en general no es ninguna noticia en estos últimos días hubo algunas noticias que me gustaría comentar.

Usuarios cansados de ser víctimas de scams se tomaron la justicia por sus manos y publicaron las fotografías y direcciones postales de los supuestos scammers. De acuerdo a Ars Technica los scamers vendían suscripciones de búsquedas de términos específicos (las cuales pueden ser obtenidas gratuitamente). Pero además utilizaban la inforamción de tarjetas de crédito para hacer pequeños cargos sin autorización de los usuarios. Sin poder cancelar la "subscripción" algunos usuarios llegaron al límite y expusieron a los scammers junto con la información de sus novias. Los sitios usados actualmente se encuentran redirigos a páginas genéricas de aterrizado (park domains).

En otra noticia interesante Microsoft ha demandado a varias compañías de "Scareware". Estas compañías "asustan" a los usuarios enviando falsas alertas de seguridad acerca de los sistemas en donde están corriendo. Estás alertas piden a los usuarios bajar y pagar una nueva versión de software de "protección" para actualizaciones de seguridad, por supuesto la actualización no es necesaria. De acuerdo a Alex Eckelberry, presidente de la comapañía de seguridad Clearwater, este problema está en crecimiento y cada vez es más común. Por mi parte creo que Microsoft ha tomado una buena decisión al demandar a estás compañías. Vamos, Windows no es perfecto pero cargarle santitos de más creo es demasiado.

Y ya entrados en fraudes, resulta que los empleados de varias compañías de apuestas y juegos de mesas en línea (como pocker) abusaron de varias vulnerabilidades en los sistemas para poder tomar ventaja en los juegos. Entre las trampas estaba ver las cartas de los contrincantes. Esto fue descubierto por un jugador australiano que detectó irregularidades estadísticas en las ganancias de algunos jugadores. Esto llevó a las compañias de apuestas a investigar y descubrir que sus empleados habían estafado a los jugadores por más de tres años.

Dos europeos han sido acusados en Estados Unidos con cargos por haber realizado ataques de Negación de Servicio. Los supuestos acusados utilizaron los bots que tenían en su botnet para activar una serie ataques de negación de servicio. Los ataques fueron aparentemente contratados por la empresa Orbit Communication para ser realizados contra dos de sus competidores, Rapid Satellite y Weaknees. Los ataques trajeron pérdidas de acuerdo a los abogados de alrededor $200,000 usd.

Para castigar más fuertemente a los ejecutores de este tipo de ataques en en en el Reino Unido se han hecho algunas modificaciones al "Computer Misuse Act (CMA)" entre las cuales se incluyen la posiblidad de extradición de criminales a ataques computacionales, penas más altas y la inclusión de DoS como parte de los crímenes.

Y para terminar las noticias de las semana resulta que nustros amigos de Skype han estado trabajando con el gobierno Chino para desencriptar información de llamadas hechas a China usando Skype. Entre la información expuesta hay direcciones de IP, número de teléfonos de líneas locales, usernames, passwords, etc. El reporte aquí. Esto nos deja pensando que las compañías son capaces de hacer cualquier cosa con tal forma de cumplir con los "requisitos" gubernamentales que los dejen operar libremente. Esto no es solo en China, también sucede en otros países "más" desarrollados pero "bajo leyes" (hint: CALEA).

miércoles, octubre 01, 2008

Mañana se vuelve a acabar el Internet: Un nuevo ataque de negación de servicio

Dos investigadores de seguridad han dado a conocer que cuentan con información sobre un nuevo ataque de negación de servicio que podría traer severas consecuencias al Internet. Esta no sería la primera vez que un descubrimiento de seguridad amenaza la estabilidad de la red y posiblemente como tantas otras no sea la que finalmente acabe con el Internet (si algún día alguna realmente lo hace). 


Entre las vulnerabilidades que han amenzado con acabar con el Internet están los ataques de negación de servicio tipo Synflood (que irónicamente regresan con esta nueva vulnerabilidad), el bug de SNMP, los hacks al IOS de Cisco, la recontra publicitada vulnerabilidad de los DNS y la reciente vulnerabiliad de BGP (de un tema parecido escribí aquí).

Ahora, ¿de qué se trata esta nueva vulnerabilidad? Bueno, pues resulta que una de las estrategias para defenderse de los SynFlood Attacks son las Syn Cookies. Recordemos que los SynFlood attacks se basan en nunca terminar el Three Handshake de TCP lo cual hace que el server atacado se quede con recursos y muchas conexiones a la mitad. Para evitar este ataque las Syn Cookies calculan (mediante un hash que puede ser visto aquí) un el número de secuencia de TCP que se envía en el SYN+ACK para "trackear" la conexión del cliente (el servidor es el que recibe el SYN inicial y envia el SYN+ACK con un número de secuencia "llave" por cada conexión). De esta forma el servidor no tiene que mantener la conexión abierta y ahorra recursos. Si el cliente es real y contesta, mediante el número de secuencia de TCP el servidor puede recrear la conexión. 

Los detalles del ataque aún no están claros, pero de acuerdo a a Robert Lee y Jack Louis (los que descubrieron la vulnerabilidad) es posible acabar con los recursos de los servidores sin afectar los del cliente. Algunas de las teorias que surgen en varias discusiones es que el cliente usa la misma técnica de Syn Cookies para responder al SYN+ACK. Como nunca se crea la conexion el servidor termina con una conexión que nunca será usada y con menos recursos, mientras que el cliente que nunca inicio la conexión puede seguir abriendo conexiones a tasas muy altas, lo cual al final ocasiona un DoS.

Por lo pronto esperaremos a que los vendors de equipo de redes y sistemas operativos encuentren una forma de resolver este problema y los investigadores revelen los detalles del problema en la Conferencia T2.

Update: Fyodor, el autor de NMAP explica un poco más el ataque. Es similar a lo explicado anteriormente con algunas diferencias. Por ejemplo las SYN Cookies no son necesarias. El ataque es como sigue:

1) Filtra con un host-firewall las conexiones de un puerto específico, por ejemplo el 80 de http.
2) Haz una conexión a un servidor en el puerto filtrado. El servidor contestará con un SYN+ACK.
3) Como el puerto está "firewaleado" en tu host nunca contestas el SYN+ACK de la forma normal y nunca creas la conexión.
4) Pero ... si contestas el SYN+ACK con tu ataque, esto hace que ahorres recursos al NO crear la conexión en tu host pero SI crees una conexion en el servidor remoto. De esta forma el servidor comienza a usar recursos. 
5) Puedes repetir esto las veces que quieras hasta que afectes al servidor.


 

martes, septiembre 30, 2008

Google Time Machine

Google Time Machine, bueno, "sort of". Como parte de los "festejos" de Google por su aniversario número 10 ha puesto en línea un sitio para hacer búsquedas usando el index que tenían en el 2001. Las búsquedas incluyen una liga a los archivos de webarchive para que puedas acceder el sitio tal como se veía en el 2001.

La verdad es una buena pasada hacer búsquedas y ver como se veían sitios como el del Tec de Monterrey, NIC-México Yahoo!

Update: Me encontré en twitter este link al iPhone del 2001 (via Vaan)

Ataques de negación de Servicio son ahora crimen en el Reino Unido

A partir del 1 de Octubre de 2008 entran en vigor modificaciones al Computer Misuse Act (CMA). Entre las más importantes están el incremento de penas de 6 meses a 2 años, también puedes ser extraditado y que ahora los ataques de negación de servicio se consideran un crimen. Anteriormente estos ataques estaban un poco grises en la legislación de acuerdo a esta nota. Sin embargo Spybot hace un análisis interesante de algunas implicaciones de la ley como el hecho de cometer un error y ocasionar un DoS (ej. un parche mal aplicado)

Una medida que afortunadamente no pasó es la de incluir la distribución de software de hackeo como ilegal, lo cual nos hubiera hecho a muchos unos criminales. Una ley similar es válida en Alemania donde el solo hecho de tener NMAP o AirSnort te hace romper la ley.

miércoles, septiembre 17, 2008

Nueva "Ad Network" en Español


Leo en twitter el anuncio (o lo que yo creo que es el anuncio) de la red publicitaria Q de hipertextual. En pocas palabras Q ofrece espacio publicitario en varios blogs de la red de hipertextual por 900 dólares al mes. Después de analizar un poco el asunto me aventuro a ofrecer mi punto de vista. 




Creo que es un excelente esfuerzo el que se quiera aprovechar el crecimiento del contenido y usuarios del Internet en Español y el que puedan ofrecer una nueva alternativa a las redes de anuncios que ya todos conocemos como los es Google Adwords y Fox. Ahora, porqué creo que no va a funcionar o por qué creo que si lo puede hacer:

Por qué no:
- De acuerdo a Fred Wilson (Union Square Ventures, inversionistas en delicious, Twitter, feedburner y tumblr entre otros)  el mercado para anuncios por banner o por impresión se ha vuelto más competido y difícil en E.U. Anunciantes ya no solo buscan que alguien les imprima sus anuncios porque se han dado cuenta que esto no genera más ventas o mayores ingresos y el "brand awarness" que se les vende aún no está tan claro que realmente se genere. Hoy en día la tendencia es que los anunciantes busquen que el anuncio genera una acción por parte del usuario, ya sea un click, un registro o una venta.
- Hoy en día para generar mejores anuncios es necesario saber más del usuario y del contenido. En este caso solo se sabe algo del contenido y se tiene una idea del tipo de usuario que visita el sitio. Sin embargo cadenas de anuncios de redes sociales como Facebook se baten por levantar sus ganancias por CPM (miles de impresiones); hoy en dia esta en centavos. Sólo redes como Linkedin que incluso acaba de sacar su red de anuncios son capaces de generar altas ganancias por impresión; y esto debido a la demografía de sus usuarios que generalmente son profesionistas de altos ingresos.
- Son muy pocos blogs y la demografía tiende a ser el usuario experto en Internet más que el usuario de adopción masiva. Esto puede ser un contra aliciente para los anunciantes para pagar 900 USD al mes por anunciarse en sitios que es posible no sean visitados por la demografía que ellos requieren.
- Este es un modelo antiguo (impresiones por banner) y muy competido en sociedades Internet más antiguas que la nuestra. Solo echen un vistazo a las nuevas redes de anuncios en Estados Unidos y Europa para ver que mercados están atacando y que estrategias están usando. La competencia es fiera y el costo de entrada puede ser alto.

Por qué si:
- En la misma ocasión platicando con Fred Wilson acerca de oportunidades de inversión de Union Square Capital en latinoamérica comentó que una de las posibilidades por la cultura que tenemos es, anuncios por impresión.
- El precio de CPM es entre $4.5 o $9 usd para generar 100,000 impresiones por mes. De acuerdo a el promedio en México por millar de impresiones debe andar entre $5 y $25 USD. 
- La blogsfera en Español esta creciendo y es posible que llegue a generar grandes cantidades de ganancias por anuncios en línea. Si mi cálculo de que en México estamos de 3 a 5 años rezagados con respecto a otras sociedades de Internet es posible que esta cadena de anuncios tome la ola de subida y pueda ser capaz de producir buenas ganancias.

Y como comenté previamente, me da gusto que haya nuevos jugadores en la arena de anuncios en línea en Español; por un lado habrá mas oferta para aquellos que quieran anunciarse y posiblemente también para aquellos que quieran asociarse para usar su contenido para generar algunas ganancias. Sin embargo me hubiera gustado que la solución hubiera venido acompañada por nuevas tecnologías o estrategias como en otros lugares se está haciendo.





martes, septiembre 16, 2008

Explosiones en Morelia

Este post es sólo para presentar mi malestar y protesta como ciudadano mexicano a los recientes acontecimientos cobardes que tuvieron lugar en la ciudad de Morelia, Michoacán durante los festejos de la independencia de México.

Yo espero que esto no quede impune como muchos crímenes en México y algún día se capture y castigue a los autores de estos crímenes cobardes en contra de gente inocente. Es triste ver como día a día la seguridad en nuestro país es un recuerdo y como entre una mezcla mezquina de corrupción, complicidad e ineficiencia las autoridades son incapaces de poner un alto a la inseguridad en nuestro país.

Para quizá para mi sea mucho más fácil que para todos ustedes vivir con esto, pero creanme que es triste ver desde afuera como nuestro pais se unde poco a poco en este mar de impunidad y falta de estado de derecho.

Notas relacionadas:
http://michoacano.com.mx/atentado-de-morelia-durante-el-grito-de-independencia/
docId=144081&docTipo=1&orderby=docid&sortby=ASC
http://www.elfinanciero.com.mx/ElFinanciero/Portal/cfpages/contentmgr.cfm?
http://www.milenio.com/node/80302
http://www.eluniversal.com.mx/primera/31639.html


De google news:
http://news.google.com/news?ned=es_mx&ncl=1249257544&hl=es&topic=h

Android Developers Blog: Divide and Conquer

A veces quisiera tener todo el tiempo del mundo para estar probando código y nuevos ambientes de programación. En este caso probar Android Developers Blog: Divide and Conquer en Android por supuesto pero además portar la aplicación al iPhone y porque no a Symbian o a Windows Mobile. Pero como todo en esta vida el tiempo es finito y hay que priorizar, así que por lo pronto sigo programando en mi ambiente de simulación y si me queda tiempo libre un poco de geolocalización.

jueves, septiembre 11, 2008

One Connect de Yahoo!


   Pues decidí probar la nueva aplicación de directorio en línea de Yahoo! para iPhone/iPodtouch. La aplicación se llama OneConnect y básicamente es un libreta de directorio que agrega información de tus contactos en Yahoo!. Además tiene interacción con:
  • Bebo
  • Dopplr
  • Facebook
  • Twitter
  • Bebo
  • MySpace
  • last.fm
  • Flickr
  • Friendster

Hasta ayer no me aparecia en la Apple Store en las búsquedas pero el link directo está aquí. Yahoo! OneConnect es como una mezcla de Friendfeed, Facebook, Twitter y Pownce. Toma elementos de otros servicios web que han tenido éxito como:
  • Pulse: Un río de eventos en tu red de amigos similar al newsfeed de Facebook, al Pulse de Plaxo, inherentemente como Friendfeed y el river de Elgg.  
  • Status: Igual, heredado de otras redes sociales.
  • Update de Status a otras redes: Idéntico a ping.fm, con OneConnect es posible hacer un update a varias redes sociales.
  • Address Book: Si no me equivoco este fue uno de los primeros conceptos de Plaxo, el hacer un directorio de contactos en línea.

Después de usarlo lo encontré bastante útil como un reemplazo de twitterrific para el iPhone para ver twitts, además que me pasa todo el chisme de que fotos comparten mis amigos en Facebook y Flickr, los updates de status facebook, videos compartidos de Youtube, las canciones que mis amigos escuchan o comparten en last.fm. En general un friendfeed con una mejor interfaz y quizá un poco más personal (aunque eso se debe en que en FF sigo a mucha gente que no conozco personalmente mientras que en FB están mis amigos de la vida real). 

En cuanto al directorio no hay forma de mezclarlo con tu directorio local en tu PC/Mac, pero creo que es bueno para no hacerlo tan complicado. En general una aplicación muy útil, ya la pasé a la primera página de mi iPod. Lo único que no es posible hacer y que sería bueno es poder contestar twitts.


P.D. Las funciones de SMS no las pude probar porque no tengo un iPhone, si alguien quiere coperar será bienvenida la cooperación.

El negocio 90-10 de los motores de búsqueda


  Hace unos días Marissa Mayer (Vicepresidente de Productos Búsquedas de Google) comentó en un artículo del LA Times que el 90% del problema de búsqueda estaba resuelto y que ahora había que concentrarse en el 10% restante. A simple vista se pudiera pensar que ya no hay mucho que hacer, sin embargo aclarando el punto en el Official Google Blog: The future of search las cosas se ponen más claras.

Si bien el 90% está hecho, esto ha representado sólo el 10% del total de trabajo; para terminar el otro 10% habrá que dedicarle el 90% de esfuerzo que han hace falta dedicar. Esto es similar al común 80-20 que muchas veces usamos en la resolución de problemas de acuerdo a Techcrunch pero en este caso, "Search" es un problema 90-10.

Y creo que si lo analizamos tiene mucho sentido. Google se ha tomado el tiempo para indexar mucho del contenido en el Internet, sin embargo este proceso ha sido mucha fuerza bruta de cientos de miles de CPUs buscando páginas web, contando y guardando las palabras y sus posiciones en el texto, buscando ligas que liguen a otros documentos, "rankeando" páginas, etc. Esto es sencillo desde el punto de vista máquina, no se necesita mucha inteligencia para hacer este proceso, más que nada se necesita tiempo, dinero, ancho de banda y mucho tiempo de CPU. Pero para poder encontrar el significado de una página y su contexto más allá de las palabras que contiene se necesita algo más que las máquinas no tienen.

Para encontrar ese significado semántico se requieren muchas cosas, entre ellas ponerse de acuerdo de como hacerle para que una página web diga más y las tontas máquinas puedan ejecutar algoritmos tratando de interpretar esa información. Algunas cosas se han hecho con microformatos y RDF (Resource Description Framework) pero aún falta mucho camino que recorrer en estandarización.

Otros problemas con un mayor grado de dificultad serán las búsquedas en medios; por ejemplo en video, en audio o en imágenes. Si bien las etiquetas o microformatos pueden ayudar puede que resuelvan solo el 10% del problema. Por ejemplo, que tal buscar "escena de película de ciencia ficción donde el villano le confiesa al héroe que es su padre" (si, creo que el ejemplo fue un poco tonto pero es de madrugada y no se me ocurre algo más). Esto me recuerda al "experimento" de Picassa (el servicio de fotos de google) que te permite etiquetar caras de personas para que después automáticamente Picassa identifique a las personas. Si bien por el momento es asistido, imaginen lo que se hará dentro de poco usando esos patrones para encontrar personas (junto con fotografías, bio y videos) en el Internet.

Auguro buenos tiempos para desarrollos tecnológicos en el área de motores de búsquedas en la parte semántica, geográfica, medios y procesamiento de lenguaje entre otras áreas, lo que si es que cada día la barrera de entrada será mayor por el grado de dificultad que requerirá resolver un problema. Y bueno, esperamos que no se vuelva un negocio de pocos. 

miércoles, septiembre 10, 2008

Sigue los Juegos Paralímpicos vía Twitter o tu gadget móvil


Hace unos días Mashable publicó un post con algunas recomendaciones de como seguir los Juegos Paralímpicos. Otros servicios que pueden ser útiles son Twittolympic y Twittolympic_es. Básicamente son dos bots que reciben noticias, las filtran y las envían a twitter. Ambos fueron un par de experimentos que hicimos para probar el uso de algunos APIs, cómo generar contenido simple para móviles y algunas utilerías que hemos encontrado en Internet. Inicialmente los creamos para los Juegos Olímpicos pero hace unos días los modificamos para agregar noticias de los Juegos Paralímpicos. Y bueno, esperamos mejorlos con el tiempo para los juegos de invierno y las próximas olimpiadas en Londres en el 2012.

    Si quieren pueden seguirlos via twitter aquí y aquí o checar la página móvil o la versión iPhone.


Metáforas en el comercial de Microsoft con Gates y Seinfeld


  El domingo se estrenó el tan esperado comercial de Microsoft creado por el comediante Jerry Seinfeld. Si no lo han visto lo pueden ver en Youtube. Después de ver el comercial la primera vez me quedé con una cara de "What?". La segunda me quedó más claro pero siguió sin buscarme. Convencido de que bloguear acerca de él era una pérdida de tiempo dejé el asunto por la paz. 

Hoy acabo de escuchar TWIT 159 con Leo Laporte. En el program Leo, John C. Dvorak, Patrick Norton y Ryan Block hacen un buen análisis de las metáforas que están dentro del anuncio. De verdad vale la pena escuchar el podcast para reirse un poco de los contenidos ocultos del comercial (según ellos) como la crítica a Apple, humor geek, homosexualismo, supremacia del 1er mundo y un hasta un poco de racismo.

lunes, septiembre 08, 2008

Blogger estrena funcionalidades sociales

Me encuentro con que Blogger ahora te permite "seguir" y mostrar estas preferencias. Inicialmente parecía que solo podían ser blogs de Blogger pero ahora que lo instalo y uso veo que también es posible seguir otros blogs independientes. Creo que para la blogsfera esto es muy importante porque nos permite relacionarnos con otros blogueros con gustos similares a los nuestros o que son fans de nuestro blog.

Es muy sencillo habilitar tu lista de blogs que sigues, simplemente en el Panel de Control de Blogger (Dashboard) encontrarás un "Reading List". En esta puedes añadir manualmente el URL de los blogs que quieres seguir o si usas Google Reader automáticamente importará tus feeds. Posteriormente solo seleccionas los blogs que quieres seguir de forma pública o privada.

El último paso es modificar el "layout" de tu blog y añadir el gadget "Mi lista de Blogs". Inicialmente te dirá que tu lista está vacía, sólo hay que decirle que quieres añadir tu lista de blogs que sigues y eso es todo. Si aún tienes dudas de como instalar esta función puedes checar la página oficial de ayuda.


Update: Al importar tus blogs favoritos de Google Reader, éste es un poco tonto y te re-agrega los blogs a tu lista de subscripciones. Al final terminas con feeds duplicados o con un aquelarre si algunos de los feeds los pre-procesas con Yahoo! pipes.