Mostrando entradas con la etiqueta Información. Mostrar todas las entradas
Mostrando entradas con la etiqueta Información. Mostrar todas las entradas

lunes, 18 de marzo de 2013

Cómo los datos cambian la forma de hacer negocios


http://online.wsj.com/article/SB10001424127887324323904578366520027998576.html?mod=WSJ_ESP_CarouselHighglights_1

[image]Getty Images











La información abunda y las empresas están buscando la mejor forma de aprovecharla.
Los expertos ya bautizaron este fenómeno como big data. La definición es amorfa, pero normalmente significa lo siguiente: las empresas tienen acceso a mucha más información que antes, que proviene de muchas más fuentes y la obtienen casi al momento en que se genera.
El concepto de big data a menudo se relaciona con las empresas que ya operan en el mundo de la información, como Google, GOOG -0.90% Facebook FB -0.54% y Amazon. Pero compañías en múltiples industrias están colocando los datos en el corazón de sus operaciones. Están recolectando cantidades enormes de información, a menudo combinando indicadores tradicionales como las ventas, con comentarios de redes sociales e información de ubicación que viene de los dispositivos móviles.
Las empresas escrudiñan esta información para mejorar sus productos, recortar costos y mantener la fidelidad de sus clientes.
Las firmas de logística, por ejemplo, instalan sensores en sus camionetas para detectar formas de acelerar las entregas. Los fabricantes revisan miles de publicaciones en foros de Internet para determinar si a los clientes les gusta una nueva característica. Los gerentes de personal estudian cómo los candidatos a un empleo responden preguntas para ver si encajan bien con la compañía.
Aún quedan numerosos obstáculos en el camino. Algunos son técnicos, pero en la mayoría de las empresas las decisiones se siguen basando en la opinión de la persona con el salario más alto y podría ser difícil convencer a un ejecutivo de que los datos superan su intuición.
A continuación repasaremos varias formas en que las empresas usan el poder de la información para transformar sus negocios.
Recursos Humanos
En Estados Unidos, las prestaciones que reciben los empleados —sobre todo las de salud— pueden ser costosas. Algunas empresas usan big data para mantenerlos bajo control.
Caesars Entertainment Corp. CZR +5.55% analiza cómo sus 65.000 empleados y sus familiares usan el seguro médico. Los gerentes pueden seguir miles de variables, como el número de visitas a la sala de emergencia y si eligen un medicamento genérico o uno de marca.
Los datos en 2010, por ejemplo, mostraron que en una de las propiedades de la empresa, Harrah's en Filadelfia, sólo 11% de las emergencias eran atendidas en instalaciones más económicas de cuidado urgente, comparado con 34% en el resto del conglomerado. La plantilla de Harrah's lanzó una campaña recordándoles a los empleados sobre los altos costos de las visitas a salas de emergencia y proporcionó una lista de instalaciones alternativas. En total, desde 2009, cuando Caesars comenzó a seguir los datos de las visitas a las salas de emergencia, unas 10.000 emergencias ha sido tratadas en salas de cuidado urgente lo que le ha ahorrado a la empresa unos US$4,5 millones.
La forma en que las empresas contratan personal también está cambiando. Catalyst IT Services, una empresa de tercerización de tecnología que reúne a grupos para empleos de programación, filtra a más de 10.000 candidatos. La contratación tradicional no sólo es lenta y abrumadora, dice la compañía, sino que también las preferencias subjetivas de los gerentes a menudo resultan en nuevos empleados que no son la mejor opción.
Catalyst pide a los candidatos que completen una evaluación en línea, algo que muchas empresas, como Google, solicitan. Luego, utiliza esta evaluación para reunir miles de unidades de información sobre cada postulante. En realidad, obtiene más información al ver cómo responden que con lo que responden.
La evaluación, por ejemplo, podría ofrecer un problema que requiere conocimiento de cálculo a un solicitante que no estaría obligado a dominar esa materia. La reacción del candidato —si se esfuerza por encontrar una respuesta; la responde rápidamente y después regresa a la pregunta; o la salta por completo— proporciona mucha información sobre cómo alguien abordará desafíos difíciles.
Desarrollo de productos
Zynga Inc., ZNGA -3.31% el desarrollador de juegos como FarmVille, extrae 25 terabytes diarios de información sobre sus juegos, lo suficiente para llenar 1.000 discos blu-ray. Utiliza esa información para mejorar la atención al cliente, el control de calidad y determinar que características se integrarán a la siguiente generación de juegos.
En la versión original de FarmVille, por ejemplo, los animales fueron incluidos principalmente como decoración. Pero los analistas de Zynga hallaron que los jugadores interactuaban con los animales mucho más de lo que los diseñadores habían previsto. En FarmVille 2, los animales cobraron mayor relevancia.
Cuando Ford Motor Co. F -1.34% diseñaba el primer subcompacto en su nueva plataforma global, tenía que decidir qué rasgos de una región haría disponible para todas las regiones. Un estudio exhaustivo de mercado era considerado demasiado caro y demoroso, así que Ford optó por estudiar a fondo los sitios web de aficionados a los autos y foros de propietarios para ver qué decían sobre las direccionales, ya que Ford consideraba introducir direccionales que parpadeaban tres veces. Usando una serie de algoritmos, los investigadores seleccionaron más de 10.000 menciones y resumieron los comentarios más relevantes. La direccional de tres parpadeos fue introducida en el nuevo Fiesta en 2010 y está disponible en la mayoría de los modelos de Ford.
Operaciones
United Parcel Service Inc. UPS -0.30% (UPS) comenzó a instalar sensores en sus vehículos de reparto para documentar su velocidad y ubicación, el número de veces que se pone en reversa y si el cinturón de seguridad del conductor está abrochado. Gran parte de esta información se sube a un centro de datos de UPS al final del día y es analizada por la noche. Al combinar su información de GPS y los datos de sensores sobre rendimiento en más de 46.000 vehículos, UPS recortó 136 millones de kilómetros de sus rutas.
Marketing
La cadena británica InterContinental Hotels Group IHG.LN +0.35% PLC ha recabado información acerca de los cerca de los 71 millones miembros de su programa de recompensas Priority Club, como niveles de ingresos y si prefieren instalaciones más orientadas hacia viajes de placer o de negocios. La empresa consolidó hace varios años la información en un solo almacén de datos, que reúne también información de redes sociales y procesa búsquedas más rápido que nunca.

jueves, 1 de diciembre de 2011

Exceso de información: ¿La búsqueda de datos sobre el consumidor ha ido demasiado lejos?

Por Wharton 
En un mundo de reparto infinito de informaciones, el consumidor se ha convertido en un producto. 

Plataformas como Google, Facebook, Foursquare y Twitter son las nuevas plantas de producción, y el usuario online, que deja migajas digitales por el ciberespacio cuando navega por Internet y participa en las redes sociales, genera datos que pueden ser comprados y vendidos. Todo tweet enviado, toda web buscada y botón "Me gusta" pulsado contribuye a aumentar la información disponible sobre el usuario. A continuación, los responsables de la búsqueda de esos datos clasifican la información, crean "paquetes" de datos y los venden a empresas que así pueden canalizar mejor su oferta al consumidor.

"Incluso empresas tradicionales ya han descubierto que pueden crear líneas completamente nuevas de negocios a través de la recogida y de la utilización de información sobre el consumidor", dice Andrea Matwyshyn, profesora de Estudios jurídicos y de Ética en los negocios de Wharton. 

Supermercados, gasolineras y otros minoristas ofrecen tarjetas de fidelidad que rastrean las compras realizadas. La administradora de tarjetas Visa registró la patente de un método para el envío de publicidad online dirigida al consumidor basado, en parte, en sus gastos con la tarjeta de crédito física. Y a través de webs de medios sociales como Foursquare, las personas trasladan información sobre sus gastos en el mundo real al mundo virtual.

Los defensores de la privacidad dicen que la acumulación de datos ya ha ido demasiado lejos, explotando a los consumidores que tienen cada vez menos control sobre la forma en que se distribuye su información personal. El movimiento a favor de la privacidad digital está volviéndose cada vez más fuerte desde hace algún tiempo. Jon Leibowitz, presidente de FTC (Comisión Federal de Negocios, según sus siglas en inglés), acusó de "cyberazzi", en octubre, a los recolectores de datos digitales, y defendió la creación de un mecanismo que impida el seguimiento de datos, lo que ayudaría al consumidor a controlar mejor la información online que comparte. Facebook está cerca de llegar a un acuerdo con el Gobierno americano que lo acusó de haber hecho "cambios retroactivos sustanciales" en su política de privacidad en diciembre de 2009, haciendo públicas, por definición, las informaciones sobre sus usuarios sin su consentimiento. Personas físicas y grupos diversos han procesado a empresas de informaciones, motores de búsqueda y empresas de medios sociales alegando violación de privacidad. Los legisladores han introducido diversas leyes que hacen más transparente la recogida de datos.

Otros dicen que esa montaña de datos derrumba barreras y abre puertas, dando a las empresas una información sin precedentes sobre lo que los consumidores desean ayudándolas a proporcionarles aquello que más necesitan. Según Anindya Ghose, profesor visitante en Wharton y director adjunto del Centro de Investigación Económica Digital [Center for Digital Economy Research] de la Universidad de Nueva York, el consumidor está beneficiándose más que nunca de ese libre flujo de informaciones. "Las empresas pueden recurrir a la interacción que tengo con mis amigos en Facebook para personalizar y adaptar con extrema precisión los productos y servicios dirigidos a mí", dice. Esa personalización tomaría en cuenta no sólo los hábitos de navegación de la persona, sino también el tipo de conexión que la persona tiene en su red social.

Además, "los medios sociales están democratizando el mercado", dice Ghose, ya que la difusión viral de informaciones está forzando a las empresas a que se comuniquen mejor con sus clientes proporcionándoles, al mismo tiempo, una mayor participación. Cuanta más rica sea esa comunicación de doble dirección, mejor podrán atender las empresas a la demanda del consumidor. "El volumen de venta explícita de datos es pequeño. Los datos están ahí disponibles, almacenados y reunidos a disposición de cualquier intermediario que desee usarlos de manera eficaz [...] Creo que la expresión correcta en ese caso es reparto de información".

Esa es una buena noticia para las empresas que proveen a los anunciantes que dan prioridad a los hábitos online del consumidor, que dirigen su publicidad según sus hábitos de navegación, intereses y comportamiento de compras. La publicidad en Internet está creciendo de forma más rápida que en cualquiera otro medio, una media del 14,6% al año, según ZenithOptimedia, agencia de servicios de medios. La publicidad online va a superar a la de los periódicos alcanzando un 18,9% del mercado de propaganda mundial hasta 2013, convirtiéndose así en el segundo mayor canal de publicidad del mundo, lo que le sitúa bastante cerca del total emitido por la televisión, prevé la agencia.

En 2011, es muy probable que Facebook alcance US$ 3.800 millones en ingresos por anuncios, prevé la empresa de informaciones digitales eMarketer. El peso pesado de las redes sociales recoge datos hoy en día de más de 800 millones de usuarios activos que publican mensajes en 70 idiomas. Google, gigante del sector de búsqueda, que sumó US$ 9.720 millones en ingresos por anuncios solamente en el tercer trimestre, obtiene un total del 96% de sus ingresos procedentes de la publicidad. En la presentación de los documentos de la empresa a los órganos reguladores, Google atribuye sus buenos márgenes de beneficios "a la importancia y a la calidad de nuestros resultados de búsqueda y a los anuncios mostrados".

Historia antigua en nueva versión

No hay nada nuevo en usar las informaciones sobre el consumidor como producto, dice Jonah Berger, profesor de Marketing de Wharton, para quien la discusión sobre la prospección de datos online remite a la misma "historia de siempre, sólo que en nueva versión". La radio, la televisión, las revistas y periódicos hace tiempo que utilizan la audiencia para atraer anunciantes. Durante años, el 
marketing directo y las empresas de catálogos pusieron a la venta teléfonos y listas de direcciones. 

"Hace tiempo que las empresas explotan los datos del consumidor", dice Berger. Hoy en día, dice, el volumen de información simplemente ha aumentado.

El montante de datos continúa creciendo a medida que aumentan los usuarios online que renuncian a la privacidad a cambio de conexiones sociales. Una encuesta hecha en junio de 2011 por el Centro Nacional de Investigaciones de Consumer Reports constató que un 34% de los usuarios de Facebook compartían su fecha de nacimiento completa online y un 21% compartían fotos y los nombres de los hijos. Cerca de uno de cada cinco no se molestaba en usar el control de privacidad de Facebook.

"La personalización es algo que el consumidor espera; él espera también disfrutar de la sociabilidad que la red proporciona, y por eso no duda en compartir informaciones, generalmente en público, con otros online", dice Shawndra Hill, profesora de Gestión de las Operaciones y de la Información de Wharton. "A medida que el marketing personalizado y los motores de recomendaciones se vuelven, cada vez más, parte de nuestra experiencia cotidiana, el usuario percibe que sus informaciones personales y de comportamiento están siendo usadas por las empresas con fines publicitarios [...] Hay quien se preocupa por la privacidad digital. Pero muchas veces el consumidor está dispuesto a renunciar a la 'libertad de controlar sus datos' a cambio de algo útil, deseable y supuestamente gratis. Por lo tanto, básicamente, el consumidor paga por los servicios que recibe con sus datos personales".

Se ha creado un vasto ecosistema de empresas para capturar, agregar, controlar y distribuir esos datos. El consumidor deja informaciones sobre su comportamiento online a través de cookies, pequeños archivos de textos enviados por el servidor de la web y archivados en el ordenador del usuario o en su aparato móvil. Las cookies permiten a las webs reconocer el navegador siempre que el usuario vuelve a una página visitada, permitiendo almacenar informaciones sobre su perfil en sus webs favoritas y mantener las preferencias de la página inicial. Las cookies pueden también captar informaciones sobre el comportamiento del usuario, que los agregadores de datos, agencias de propaganda y redes de publicidad usan en la creación de anuncios dirigidos. Una única web muchas veces se relaciona con una serie de terceros que recogen datos en forma de cookies para fines diversos.

La industria de publicidad online dice que no compra y no vende informaciones que identifiquen a los individuos de forma personal, tales como nombres o direcciones de correo electrónico, sin embargo agrega datos anónimos para la creación de perfiles de grupos de consumidores. "Las buenas empresas del sector no comercializan informaciones que puedan identificar al individuo", observa Sherrill Mane, vicepresidente senior de servicios para la industria del Interactive Advertising Bureau, una asociación de más de 500 empresas de medios y tecnología que produce un 86% de la publicidad online en EEUU. El objetivo es desarrollar una segmentación de público más sólida, dice, "y no tomar nombres de personas y perseguirlas".

Eso no significa que otras partes no puedan usar los datos digitales para dirigirse a personas específicas, dice Lee Tien, abogado senior de Electronic Frontier Foundation, empresa sin fines de lucro de San Francisco especializada en la defensa de los derechos digitales. "Los anunciantes [...] están interesados en nosotros sólo como posibles consumidores y compradores, sin embargo los datos disponibles son fuente riquísima de incontables informaciones. Hay agencias que pueden estar interesadas en usted de manera más personal", dice, señalando que muchas webs de gran popularidad hospedan, de media, 65 rastreadores de terceros. Empleadores o compañías de seguros, por ejemplo, pueden negar empleo o seguro de salud según la información suministrada por los datos cosechados. "No es el aspecto de la publicidad" lo que preocupa, dijo. "Nosotros nos preocupamos por el rastreo que se hace a las personas porque no sabemos para qué fin se utilizarán los datos cosechados".

"Factor miedo"

Los estudios muestran que la mayor parte de los usuarios online sospecha que su comportamiento esté siendo rastreado, pero o no les importa o no saben cómo evitarlo. Una encuesta hecha en 2011 por la empresa de investigación neoyorquina Harris Interactive y por TRUSTe, empresa que asesora clientes como Facebook, Microsoft y Apple y las ayuda a cumplir con los requisitos de privacidad, constató que un 30% de los consumidores cree que los anunciantes estén obteniendo información personal —como número de teléfono, correo y direcciones físicas— sin su consentimiento. Más de la mitad (un 52%) creía que se había compartido la navegación de su browser con varios anunciantes sin su aprobación.

Pero aunque un 94% de los consumidores consideren la privacidad online importante, solamente un 37% utilizan medidas para proteger su información personal online, según mostró la investigación. Solamente un usuario entre cuatro optó por no ser monitorizado online, y menos de uno de cada cinco (un 19%) dijo que se había bajado y usado un bloqueador de rastreo.

A pesar de la concienciación cada vez mayor del seguimiento online, un cierto "factor miedo" se apodera del consumidor cuando ve un anuncio en una web que refleja su navegación en otra web, sobre todo si el usuario del ordenador "no tenía la mínima idea de que las dos webs pudieran conversar entre ellas", dice Matwyshyn, de Wharton. "Es cada vez más fuerte la percepción que tiene el consumidor de que está perdiendo el control sobre su identidad digital y su información online". Esa tensión creciente deriva, en parte, de un "conflicto de visión del mundo entre los consumidores, que tienen conciencia de su privacidad, y de los empresarios que defienden una transparencia radical", dice. El empresario del sector tecnológico parte de una mentalidad distinta de la del consumidor medio: él cree que el reparto ilimitado de informaciones es bueno. Ya que el código de los ordenadores tiende a transportar los valores de sus creadores, es natural que ellos incorporen su visión a las plataformas. "Sin una apertura completa acerca de cómo se están compartiendo las informaciones, la mayor parte de los consumidores no podrá comprender cómo funciona el código en las webs que utilizan, y por eso sienten que están siendo transformados de forma injusta en producto".

Los contratos complejos y no negociables con el usuario no sirven de nada. Diversos contratos online permiten a las empresas modificarlos incluso después de haber sido suscritos por el usuario, dándole poca elección sobre el modo en que se comparten sus datos. "No conozco a nadie que tenga tiempo de leer un contrato de 58 páginas en una pantalla de smartphone de tres pulgadas, aunque la vista de la persona en cuestión sea excepcionalmente buena", dice Matwyshyn. Mientras, la industria sigue por la vía de la autorregulación. La Alianza de Publicidad Digital, una coalición de anunciantes y de empresas de medios, está adoptando una serie de principios e incluso ha creado un icono, el "Ad Choices", que puede aparecer en las webs indicando al consumidor que tiene la posibilidad de evitar, si quisiera, la publicidad personalizada.

Hay quien duda de que ese mecanismo funcione. Un estudio reciente de la Universidad Carnegie Mellon titulado "Por qué es imposible evitar la publicidad: una evaluación del uso de herramientas para limitar la publicidad online dictada por el comportamiento del consumidor" ("Why Johnny Can't Opt Out: A Usability Evaluation of Tools to Limit Online Behavioral Advertising"), mostró que los consumidores que intentaron limitar el rastreo con diversas herramientas no consiguieron comprenderlas lo suficiente para hacerlas funcionar. "Los resultados obtenidos muestran que la actual estrategia de autorregulación de la industria de la publicidad por medio de mecanismos que permitan al usuario evitar la publicidad indeseada simplemente no funciona", según muestra el estudio. "Las expectativas y el conocimiento del usuario no encuentran respaldo en los sistemas existentes [...] Aún con más instrucciones e interfaces de mejor calidad, no se sabe a ciencia cierta cuando el usuario podrá hacer elecciones realmente eficaces en lo que concierne a los rastreadores".

De vuelta al consumidor

Peter Fader, profesor de Marketing de Wharton, cree que buena parte de la controversia en torno a la recogida de datos surge de un marketing mal hecho. "Interpretar de forma demasiado literal los datos lleva a conclusiones engañosas y envía mensajes que no son sólo ineficaces, sino también preocupantes", dice Fader, director adjunto del Proyecto de Estudios Analíticos del Cliente de Wharton [Wharton Customer Analytics Initiative]. "No habría todo ese barullo sobre la privacidad si las empresas aprendieran las lecciones que la historia enseña".

En el pasado, los datos eran escasos, por lo tanto las empresas se limitaban a analizar aquello de que disponían, observa Fader. Empresas como Pillsbury y Procter & Gamble recurrían a especialistas para monitorizar las compras repetidas, ampliando el descubrimiento hecho con datos y resultados demográficos de investigaciones caras. El sector de marketing directo elaboraba listas que probaba incontables veces. Las compañías de seguros aprendían a clasificar sus clientes en grupos de alto y de bajo riesgo. "Las empresas lidiaban de forma inteligente con los datos porque eran muy difíciles de obtener", dice Fader. "Hoy, hay montañas de información. Tenemos todo, millones de variables [...] y los exploradores de datos quieren usar todo lo que tienen a su disposición".

En la prisa por reunir datos y conectar, añade Fader, los datos se han vuelto un fin en sí mismos, en vez de arrojar luz sobre el consumidor. El individuo hace compras online por diversas razones que no llevan de forma necesaria a un perfil significativo, dice Fader. "¿Hasta qué grado de detalle debe llegar el mensaje? Llevar el asunto al 'cuerpo a cuerpo' es ir lejos demasiado. Sólo porque tengamos dos o tres unidades de información sobre un cliente eso no significa que nosotros lo hayamos capturado".

El mundo, sin embargo, está dirigiéndose a una mayor segmentación, y no a la disminución de la misma, dice Joseph Turow, profesor y decano adjunto de estudios de graduación de la Escuela Annenberg de Comunicación de la Universidad de Pensilvania. Autor de un libro que todavía no se ha publicado, The Daily You: How the New Advertising Industry Is Defining Your Identity and Your Worth. Para el autor, estamos entrando en un mundo en que no sólo la publicidad, sino también otras formas de contenido se dirigirán a los consumidores según los datos de su perfil. "Con el tiempo, a medida que vayamos avanzando, el contenido de las noticias y del entretenimiento será variado, inclusive en la televisión, según un modelo de consumidor creado por los anunciantes, profesionales del marketing y webs donde se emiten los anuncios", dice. "Estamos sólo al principio de esa transformación".

Los argumentos tradicionales sobre privacidad se olvidan de lo central, añade Turow. Las personas en general se preocupan por la información que pueda identificarlas personalmente —nombre, dirección— y creen que su privacidad se ha visto violada cuando se comparte ese tipo de datos. Pero, aunque continúen siendo anónimas, resalta Turow, "la reputación de esas personas se está construyendo [...] Si una empresa tiene 100 unidades de información sobre mí en el mundo digital, y eso afecta la forma en que la empresa me trata en el ciberespacio, ¿qué diferencia hay si ella sabe o no mi nombre?"

martes, 23 de agosto de 2011

El reto de los grandes volúmenes de datos


Los grandes volúmenes de datos actuales están forzando a los investigadores a encontrar nuevas técnicas para el descubrimiento de conocimientos y la extracción de datos.

Por Erica Naone

Científicos de alto nivel de empresas como Google y Yahoo se reúnen junto a destacados académicos en la 17 conferencia sobre el Descubrimiento de Conocimientos y la Extracción de Datos (KDD, por sus siglas en inglés) de la Asociación para la Maquinaria de Computación (ACM, también por sus siglas en inglés) en San Diego, EE.UU., esta semana. Presentarán las últimas técnicas para capturar información entre la avalancha de datos producidos hoy día y para dar sentido a una información que nos llega en una variedad de formas más amplia que nunca.

Hace veinte años, los únicos que se preocupaban por los llamados 'grandes volúmenes de datos' (big data, en inglés), los únicos que poseían enormes conjuntos de datos y la motivación para tratar de procesarlos, eran los miembros de la comunidad científica, señala Usama Fayyad, presidente ejecutivo del Grupo de Interés Especial en el Descubrimiento de Conocimientos y Extracción de Datos de la ACM y exdirector de datos de Yahoo. Incluso entonces, los resultados de la extracción de datos eran impresionantes. "Éramos capaces de resolver importantes problemas científicos a los que se había enfrentado el campo durante más de 30 años", señala Fayyad.

El crecimiento explosivo de Internet, sin embargo, cambió todo. Tanto si les gustaba como si no, las empresas se encontraron trabajando en línea y acumulando enormes volúmenes de datos sobre los clientes y su comportamiento. A medida que el poder de la extracción de esa inormación se hizo evidente, también lo hicieron las motivaciones económicas para invertir en el campo, según asegura Fayyad.

Netflix, por ejemplo, ofreció un premio de un millón de dólares (695 mil euros) a cualquier equipo que pudiera extraer su información sobre los usuarios y crear un sistema de recomendación más preciso que el que tenía. Ejemplos de alto perfil como este sólo representan la superficie de las aplicaciones para la extracción de datos.

"Las compañías y la industria están cada vez más interesadas ​​en utilizar los datos que capturan a través de los procesos empresariales", afirma Chid Apte, director de investigación de análisis de IBM y presidente de la conferencia. En particular, señala la atención médica, los medios sociales y todo lo que se lleve a cabo en la red.

En estos días, los gigantes de Internet hacen negocio con la información que recogen sobre los usuarios y los conocimientos que obtienen de la extracción. Los vendedores pueden acceder a complejos patrones de comportamiento de los compradores para ayudarles a proveer suministros a sus tiendas con más rentabilidad. Los investigadores de la industria pueden predecir los patrones de tráfico de vehículos en función de la congestión, el clima y la época del año, y ofrecer las mejores rutas.

Los datos actuales, sin embargo, no tienen la apariencia familiar de una base de datos. "La información no nos llega de forma limpia y tabular", afirma Apte. "Nos llega en forma de red". A menudo la obtenemos en forma de gráfico -explica- como los utilizados por los medios sociales. Estos gráficos suelen registrar no sólo las complejas conexiones entre los nodos, sino también otros tipos de información en diversos formatos, tales como los videos, imágenes y comentarios que la gente publica en las redes sociales.

Puede que los medios sociales hayan iniciado la tendencia hacia el análisis de estos gráficos, según explica Apte, aunque los datos de la red también provienen de otras fuentes (por ejemplo, de complejos sistemas de ingeniería tales como la red de energía eléctrica, los sistemas de distribución de agua y los sistemas de gestión del tráfico). Las redes de sensores distribuidos en estos sistemas producen conjuntos de datos en los que las conexiones entre las localizaciones son tan importantes como la amistad entre los individuos dentro de una red social.

En opinión de Apte, entender este tipo de conexiones es la clave para la optimización de los sistemas y para hacerlos sostenibles. Po eso -prosigue- la gente lleva trabajando con gráficos de datos desde hace cientos de años, aunque los gráficos actuales se trazan a partir de redes sociales o redes de sensores de una escala sin precedentes. "Son gráficos gigantescos", asegura. "Estamos hablando de millones de nodos y decenas de millones de enlaces".

Tratar con gráficos de ese tamaño y alcance, y aplicar modernas herramientas de análisis, hace necesaria la creación de mejores algoritmos y otras innovaciones. Apte afirma que uno de los objetivos de la conferencia es llevar técnicas avanzadas del mundo académico y los laboratorios de investigación a la atención de las empresas, para que puedan aplicarlas de manera más rápida. Al mismo tiempo, según esperan los organizadores de la conferencia, los académicos tendrán una idea de los retos empresariales que necesitan ser abordados con más urgencia.

Fayyad opina que el intenso interés comercial en los datos ha cambiado el campo de la extracción de datos. Los científicos -afirma- se ocupaban principalmente de datos almacenados de forma ordenada y estructurada. No obstante, la mayoría de los datos que las empresas están produciendo actualmente forman un caos no estructurado. "Si bien habían mejorado bastante a la hora de evitar esas cosas, las empresas tenían que hacerles frente", explica Fayyad. "Hizo que las empresas comenzaran a desarrollar técnicas que nadie había intentado jamás".

Sin duda, aún hay retos por superar. De todas formas, según Fayyad, "las personas son capaces de crear muchos más modelos predictivos y, mejor aún, clasificarlos para ver qué tal funcionan... Se requiere un análisis a un nivel realmente más allá de la comprensión del cerebro humano".

Copyright Technology Review 2011.

lunes, 1 de agosto de 2011

Piedra de Toque: Más información, menos conocimiento, por Mario Vargas Llosa

Piedra de Toque: Más información, menos conocimiento, por Mario Vargas Llosa

Publicado en La República.pe

¿Era usted un ávido lector hasta que un día descubrió la Internet y de pronto dejó de sentir el papel entre sus manos para sentarse horas de horas frente a una pantalla de una computadora? Si lo es, entonces no se puede perder hoy domingo la columnaPiedra de Toque, del Nobel Mario Vargas Llosa, cuyo solo título "Más información, menos conocimiento", dice todo.

Más información, menos conocimiento

Por: Mario Vargas Llosa

Nicholas Carr estudió Literatura en Dartmouth College y en la Universidad de Harvard y todo indica que fue en su juventud un voraz lector de buenos libros. Luego, como le ocurrió a toda su generación, descubrió el ordenador, el Internet, los prodigios de la gran revolución informática de nuestro tiempo, y no sólo dedicó buena parte de su vida a valerse de todos los servicios online y a navegar mañana y tarde por la red; además, se hizo un profesional y un experto en las nuevas tecnologías de la comunicación sobre las que ha escrito extensamente en prestigiosas publicaciones de Estados Unidos e Inglaterra.

Un buen día descubrió que había dejado de ser un buen lector, y, casi casi, un lector. Su concentración se disipaba luego de una o dos páginas de un libro, y, sobre todo si aquello que leía era complejo y demandaba mucha atención y reflexión, surgía en su mente algo así como un recóndito rechazo a continuar con aquel empeño intelectual. Así lo cuenta: “Pierdo el sosiego y el hilo, empiezo a pensar qué otra cosa hacer. Me siento como si estuviese siempre arrastrando mi cerebro descentrado de vuelta al texto. La lectura profunda que solía venir naturalmente se ha convertido en un esfuerzo”.

Preocupado, tomó una decisión radical. A finales de 2007, él y su esposa abandonaron sus ultramodernas instalaciones de Boston y se fueron a vivir a una cabaña de las montañas de Colorado, donde no había telefonía móvil y el Internet llegaba tarde, mal y nunca. Allí, a lo largo de dos años, escribió el polémico libro que lo ha hecho famoso. Se titula en inglés The Shallows: What the Internet is Doing to Our Brains y, en español: Superficiales: ¿Qué está haciendo Internet con nuestras mentes? (Taurus, 2011). Lo acabo de leer, de un tirón, y he quedado fascinado, asustado y entristecido.

Carr no es un renegado de la informática, no se ha vuelto un ludita contemporáneo que quisiera acabar con todas las computadoras, ni mucho menos. En su libro reconoce la extraordinaria aportación que servicios como el de Google, Twitter, Facebook o Skype prestan a la información y a la comunicación, el tiempo que ahorran, la facilidad con que una inmensa cantidad de seres humanos pueden compartir experiencias, los beneficios que todo esto acarrea a las empresas, a la investigación científica y al desarrollo económico de las naciones.

Pero todo esto tiene un precio y, en última instancia, significará una transformación tan grande en nuestra vida cultural y en la manera de operar del cerebro humano como lo fue el descubrimiento de la imprenta por Johannes Gutenberg en el siglo XV que generalizó la lectura de libros, hasta entonces confinada en una minoría insignificante de clérigos, intelectuales y aristócratas. El libro de Carr es una reivindicación de las teorías del ahora olvidado Marshall McLuhan, a quien nadie hizo mucho caso cuando, hace más de medio siglo, aseguró que los medios no son nunca meros vehículos de un contenido, que ejercen una solapada influencia sobre éste, y que, a largo plazo, modifican nuestra manera de pensar y de actuar. McLuhan se refería sobre todo a la televisión, pero la argumentación del libro de Carr y los abundantes experimentos y testimonios que cita en su apoyo indican que semejante tesis alcanza una extraordinaria actualidad relacionada con el mundo del Internet.

Los defensores recalcitrantes del software alegan que se trata de una herramienta y que está al servicio de quien la usa y, desde luego, hay abundantes experimentos que parecen corroborarlo, siempre y cuando estas pruebas se efectúen en el campo de acción en el que los beneficios de aquella tecnología son indiscutibles: ¿quién podría negar que es un avance casi milagroso que, ahora, en pocos segundos, haciendo un pequeño clic con el ratón, un internauta recabe una información que hace pocos años le exigía semanas o meses de consultas en bibliotecas y a especialistas? Pero también hay pruebas concluyentes de que, cuando la memoria de una persona deja de ejercitarse porque para ello cuenta con el archivo infinito que pone a su alcance un ordenador, se entumece y debilita como los músculos que dejan de usarse.

No es verdad que el Internet sea sólo una herramienta. Es un utensilio que pasa a ser una prolongación de nuestro propio cuerpo, de nuestro propio cerebro, el que, también, de una manera discreta, se va adaptando poco a poco a ese nuevo sistema de informarse y de pensar, renunciando poco a poco a las funciones que este sistema hace por él y, a veces, mejor que él. No es una metáfora poética decir que la “inteligencia artificial” que está a su servicio, soborna y sensualiza a nuestros órganos pensantes, los que se van volviendo, de manera paulatina, dependientes de aquellas herramientas, y, por fin, en sus esclavos. ¿Para qué mantener fresca y activa la memoria si toda ella está almacenada en algo que un programador de sistemas ha llamado “la mejor y más grande biblioteca del mundo”? ¿Y para qué aguzar la atención si pulsando las teclas adecuadas los recuerdos que necesito vienen a mí, resucitados por esas diligentes máquinas?

No es extraño, por eso, que algunos fanáticos de la Web, como el profesor Joe O’Shea, filósofo de la Universidad de Florida, afirme: “Sentarse y leer un libro de cabo a rabo no tiene sentido. No es un buen uso de mi tiempo, ya que puedo tener toda la información que quiera con mayor rapidez a través de la Web. Cuando uno se vuelve un cazador experimentado en Internet, los libros son superfluos”. Lo atroz de esta frase no es la afirmación final, sino que el filósofo de marras crea que uno lee libros sólo para “informarse”. Es uno de los estragos que puede causar la adicción frenética a la pantallita. De ahí, la patética confesión de la doctora Katherine Hayles, profesora de Literatura de la Universidad de Duke: “Ya no puedo conseguir que mis alumnos lean libros enteros”.

Esos alumnos no tienen la culpa de ser ahora incapaces de leer La Guerra y la Paz o el Quijote. Acostumbrados a picotear información en sus computadoras, sin tener necesidad de hacer prolongados esfuerzos de concentración, han ido perdiendo el hábito y hasta la facultad de hacerlo, y han sido condicionados para contentarse con ese mariposeo cognitivo a que los acostumbra la red, con sus infinitas conexiones y saltos hacia añadidos y complementos, de modo que han quedado en cierta forma vacunados contra el tipo de atención, reflexión, paciencia y prolongado abandono a aquello que se lee, y que es la única manera de leer, gozando, la gran literatura. Pero no creo que sea sólo la literatura a la que el Internet vuelve superflua: toda obra de creación gratuita, no subordinada a la utilización pragmática, queda fuera del tipo de conocimiento y cultura que propicia la Web. Sin duda que ésta almacenará con facilidad a Proust, Homero, Popper y Platón, pero difícilmente sus obras tendrán muchos lectores. ¿Para qué tomarse el trabajo de leerlas si en Google puedo encontrar síntesis sencillas, claras y amenas de lo que inventaron en esos farragosos librotes que leían los lectores prehistóricos?

La revolución de la información está lejos de haber concluido. Por el contrario, en este dominio cada día surgen nuevas posibilidades, logros, y lo imposible retrocede velozmente. ¿Debemos alegrarnos? Si el género de cultura que está reemplazando a la antigua nos parece un progreso, sin duda sí. Pero debemos inquietarnos si ese progreso significa aquello que un erudito estudioso de los efectos del Internet en nuestro cerebro y en nuestras costumbres, Van Nimwegen, dedujo luego de uno de sus experimentos: que confiar a los ordenadores la solución de todos los problemas cognitivos reduce “la capacidad de nuestros cerebros para construir estructuras estables de conocimientos”. En otras palabras: cuanto más inteligente sea nuestro ordenador, más tontos seremos.

Tal vez haya exageraciones en el libro de Nicholas Carr, como ocurre siempre con los argumentos que defienden tesis controvertidas. Yo carezco de los conocimientos neurológicos y de informática para juzgar hasta qué punto son confiables las pruebas y experimentos científicos que describe en su libro. Pero éste me da la impresión de ser riguroso y sensato, un llamado de atención que –para qué engañarnos– no será escuchado. Lo que significa, si él tiene razón, que la robotización de una humanidad organizada en función de la “inteligencia artificial” es imparable. A menos, claro, que un cataclismo nuclear, por obra de un accidente o una acción terrorista, nos regrese a las cavernas. Habría que empezar de nuevo, entonces, y a ver si esta segunda vez lo hacemos mejor.

viernes, 27 de mayo de 2011

El reto de controlar una gran cantidad de datos en la red inteligente

Redes inteligentes: La "red inteligente" será un caso de estudio en la gestión de datos. Las compañías eléctricas recibirán una gran cantidad de información en tiempo real desde los hogares, empresas, centrales eléctricas y las infraestructuras de transmisión, tales como esta subestación.
Fuente: OSHA


La instalación de "contadores inteligentes" y la modernización de las redes eléctricas obligará a los proveedores de electricidad a procesar mucha más información de la que están acostumbrados a manejar.


Por Lee Gomes

El promedio de compañía eléctrica de gran tamaño está formado por una extensa red repleta de energía, pero que sorprendentemente contiene pocos datos sobre dicha energía. Los gerentes de las compañías eléctricas no pueden "observar" con profundidad las miles de subestaciones y unidades de relé que componen la red eléctrica. Algunas empresas todavía se enteran de un corte eléctrico en un barrio no porque aparezca en cualquiera de sus sofisticados equipos de control, sino porque los clientes llaman por teléfono y se quejan de que se ha ido la luz.

Esta escasez de información en tiempo real es uno de los retos que las compañías eléctricas y los proveedores de TI están tratando de solucionar mediante un esfuerzo de modernización conocido como la "red inteligente". Una vez que las compañías y los consumidores dispongan de información más precisa sobre el uso de energía, tanto el suministro de energía como la demanda se podrán gestionar de manera más eficiente. Por ejemplo, los consumidores podrían ser aconsejados para trasladar una parte del consumo de electricidad a las horas no punta, lo que reduciría la necesidad de activar plantas de energía más sucias y más caras en las horas punta.

Pero antes de que esto pueda ocurrir de forma generalizada, las compañías necesitan prepararse para una avalancha de datos—algo que otras industrias ya han hecho. El reto de la mejora de los sistemas de TI en consecuencia es una de las razones por las que la red inteligente está "en pañales", señala Donald Kintner Jr., portavoz del Instituto de Investigación de Energía Eléctrica, patrocinado por compañías eléctricas.

"Lo que las empresas de energía están a punto de experimentar no es simplemente una duplicación o triplicación de la cantidad de datos que van a obtener", afirma Jeff Taft, que trabaja para la iniciativa de red inteligente dentro de Cisco Systems, la empresa de redes. "En su lugar, va a darse un aumento de múltiples órdenes de magnitud. La industria lo sabe y poco a poco va haciendo la transición. Sin embargo la energía es una de esas áreas donde no se puede simplemente quitar todo y empezar de nuevo".

Un desafío adicional para las empresas es que ejecutan sus operaciones de control central en una combinación de sistemas informáticos antiguos, la mayoría de los cuales no se pueden comunicar entre sí.

"He estado en salas de control donde los operadores tienen que sentarse en sillas giratorias y controlar seis monitores diferentes para que todo funcione", afirma Glenn Booth, jefe de marketing de Green Energy, que ofrece software de gestión de red de próxima generación. "Estamos hablando de nuestra red nacional de energía, y esta no es la forma en que deberían estar funcionando las cosas".

Es relativamente fácil equipar una casa con un "contador inteligente" que pueda generar datos segundo a segundo acerca del uso de energía en la casa. Sin embargo, dado que la mayoría de las compañías eléctricas no poseen los sistemas informáticos para transmitir o almacenar estos datos, aquellos que ya han instalado contadores inteligentes generalmente "miran" los medidores individuales sólo una vez al día, para no acabar abrumados con datos que no pueden manejar.

Pacific Gas & Electric, la compañía principal en el norte de California, posee contadores inteligentes en el 80 por ciento de los hogares que sirve y espera tenerlos en todos los hogares el próximo año. Sin embargo, para hacer pleno uso de los nuevos datos, según un portavoz de PG & E, Greg Pargo, la empresa necesitará "complejos motores de procesamiento de eventos" que se encuentran todavía en proceso de desarrollo.

Copyright Technology Review 2011.

martes, 3 de mayo de 2011

El análisis de datos está creando nuevas oportunidades de negocio

La explosión de las herramientas de análisis de datos está siendo impulsada por una verdad económica fundamental: el hundimiento del coste de las tecnologías de memoria. El término "Disco de empresa" se refiere a las unidades de almacenamiento de gran tamaño utilizadas en los centros de datos.
Fuente: Credit Suisse and Gartner
























Las tecnologías están convergiendo para dar a las empresas más capacidad para detectar lo que sus clientes podrían desear.


Por Lee Gomes (*)

Sentarse en la cubierta superior izquierda para ver el partido de béisbol de los San Francisco Giants el 11 de mayo le costaría ocho dólares si usted hubiese comprado el ticket a finales de abril. Sin embargo, si quisiese el mismo ticket para el partido del 21 de mayo, usted tendría que pagar 45,50 dólares.

Las capacidades del software finalmente se han encontrado con lo que los revendedores siempre han sabido: los precios de los tickets deberían depender de la demanda. Con la ayuda de un sistema de análisis de datos de Qcue, una compañía de Austin, Texas, los Giants han adoptado la fijación dinámica de precios, lo que permite cambiar los precios de los tickets dependiendo de las circunstancias que afectan a la demanda—incluso hasta el último minuto. El sistema cuantificó hasta qué punto tenían que bajar los precios con el fin de llenar todos los asientos en un partido celebrado un miércoles por la noche contra los mediocres Arizona Diamondbacks, y cuánto más estaría dispuesta a pagar la gente por un partido un sábado por la tarde contra los rivales de los Giants: los Oakland A's.

La organización de los Giants señala que la fijación dinámica de precios ha logrado un aumento del 6 por ciento en los ingresos por venta de entradas el año pasado, por encima de lo que el equipo podía haber esperado de una temporada ganadora que culminó en una victoria de la Serie Mundial. De hecho, los Giants están experimentando con otras versiones de fijación dinámica de precios, como el uso de datos meteorológicos para determinar el precio óptimo para la cerveza.

Es sólo un ejemplo de una nueva generación de tecnologías de análisis de bases de datos y datos que ofrecen a las empresas nuevas formas de alcanzar y—según esperan—complacer a sus clientes. Esta es la gran idea que vamos a explorar a lo largo de mayo en Business Impact.

Las bases de datos son tan antiguas como los ordenadores y han formado parte del corazón de las operaciones de la mayoría de las empresas durante décadas, aunque durante los últimos años hemos asistido a avances significativos tanto en el hardware y el software involucrados. Los grupos de datos son cada vez más grandes, y los métodos de análisis se están haciendo mucho más rápidos.

Es por eso que los precios dinámicos están pasando más allá de la industria de las aerolíneas y sus ordenadores centrales. Sin embargo, aún cuando el análisis se puede hacer hoy día usando hardware menos sofisticado, es capaz de funcionar en situaciones más complejas que un estadio de béisbol, que puede tener miles de asientos en múltiples niveles de precios. Debido a esta potencia mejorada para el análisis de muchas clases de datos, cada vez más empresas tienden a tratar de utilizar dicha potencia para conseguir mejorar sus operaciones, desde atraer y mantener a clientes hasta averiguar qué nuevos productos introducir y a qué precio.

Estas nuevas tecnologías todavía no tienen un nombre pegadizo, como por ejemplo el uso de la palabra "nube" para la computación centralizada. A veces se les llama "Big Data", aunque ese término es aplicable sólo a algunos de los cambios en curso. Su magnitud fue resumida en un informe publicado en marzo por un equipo de analistas de Credit Suisse, que afirmaban que el mundo de las TI "se sitúa en la cúspide de la revolución más importante en las arquitecturas de bases de datos y aplicaciones en 20 años".

Grandes empresas de tecnología como IBM, Oracle y Hewlett-Packard han gastado miles de millones de dólares en adquirir empresas que ofrecen análisis de negocio y tecnologías de bases de datos. Las startups relacionadas con los datos también están en aumento en Silicon Valley; la mayoría de las grandes firmas de capital riesgo tienen ahora un socio especializado en ese campo. Los datos que se analizan ni siquiera tienen que venir en forma de registros de transacciones u otras cifras. Por ejemplo, CalmSea, una startup formada en 2009 por varios veteranos de la industria de los datos, vende un producto que permite a los minoristas recabar información útil procedente de la enorme cantidad de información sobre ellos en las redes sociales. Los minoristas podrían decidir lanzar ofertas especiales para sus clientes leales, o lanzar esfuerzos de marketing bien diseñados en respuesta a los cambios en el sentimiento público.

Las grandes empresas de consultoría también están aumentando sus prácticas relacionadas con los datos. "Existe una gran cantidad de datos nuevos hay ahí fuera", señaló Brian McCarthy, director de estrategia para el análisis en Accenture. "Las compañías están tratando de encontrar la manera de extraer valor de todo el ruido".

Todo esto es posible gracias a dos ramas tecnológicas distintas.

* Las herramientas de base de datos y análisis de negocio tradicionales están siendo rediseñadas para que no tengan que almacenar datos en una unidad de disco tradicional. En su lugar, pueden funcionar en su totalidad en la memoria de un ordenador—la que no está en una unidad independiente, sino conectada al corazón de la máquina. Este enfoque "en memoria" (“in-memory”) habría sido prohibitivo hace unos años pero ahora es factible debido a la continua disminución de los precios de la memoria flash, la misma tecnología de estado sólido utilizada en los teléfonos móviles y reproductores de música.

Las operaciones dentro de la memoria de estado sólido de un ordenador van más rápido que las que necesitan acceder a las piezas móviles de una unidad de disco, a veces por un factor de 100. Como resultado, el software de base de datos recibe un aumento de rendimiento inmediato.

Sin embargo también existen muchas otras ventajas menos evidentes. Steve Graves, director general de McObject, que vende una base de datos en memoria, afirma que el software de base de datos tradicional por lo general intenta reducir al mínimo el uso del disco, así como mejorar el rendimiento. Esas líneas de código simplemente se pueden omitir en una versión en memoria del programa, por lo que el rendimiento es aún más ágil.

Otra de las ventajas de los sistemas en memoria es que simplifican una serie de tareas complejas y que consumen mucho tiempo, y que ahora deben suceder antes de que los datos almacenados a efectos contables se puedan utilizar para analizar las operaciones de una empresa. Este trabajo generalmente se asigna al ya de por sí sobrecargado departamento de TI de la empresa, creando un embotellamiento para aquellos departamentos que traten de hacer un buen uso de los datos corporativos. El cofundador de SAP Hasso Plattner se muestra tan entusiasta acerca de la búsqueda de nuevas herramientas de datos en memoria que ha co-escrito un libro sobre el tema.

* La otra novedad significativa dentro del campo de los datos consiste en el ensamblaje de unidades tradicionales de disco en configuraciones antes impensables. Gran parte de este trabajo fue realizado por primera vez en Google, en conexión por sus esfuerzos por indexar toda la web. Sin embargo, desde aquel entonces han sido desarrolladas versiones públicas de muchas de esas herramientas, al estilo Linux, por la comunidad de código abierto.

La más conocida es Hadoop, un enfoque de almacenamiento de datos a gran escala utilizado por un número creciente de empresas. El mayor cluster conocido de Hadoop es un sistema de 25 petabytes de 2.000 máquinas en Facebook. (Un petabyte son mil terabytes, o un 1 seguido de 15 ceros). Se cree que Google opera clusters aún más grandes, aunque la compañía no discute el asunto.

Estos dos planteamientos arquitectónicos de bases de datos—en memoria y a mega-escala—están siendo mejorados por los cambios en el software de base de datos.

Las bases de datos tradicionales fueron diseñadas para facilitar "transacciones", tales como la actualización de una cuenta bancaria cuando se hace un retiro del cajero automático. Tienden a ser rígidamente estructuradas, con campos bien definidos; la base de datos para un departamento de nóminas probablemente incluya campos para el nombre de un empleado, su número de Seguro Social, el estado de la declaración de impuestos, y cosas similares. Las preguntas que usted puede preguntar acerca de los datos están limitadas por los campos en los que se introdujeron los datos en primer lugar. Por el contrario, los nuevos enfoques tienen una forma más indulgente de manipulación de datos "no estructurados", como el contenido de una página web. Como resultado, los usuarios pueden hacer preguntas en las que podrían no haber siquiera pensado cuando establecieron la base de datos por primera vez.

Estos dos nuevos enfoques en cuanto a los datos tienen algo en común: aprovechar los nuevos conocimientos algorítmicos. Un ejemplo es "noSQL", un nuevo enfoque, del tipo ‘menos es más’, dentro de las consultas de bases de datos; en aras de la rapidez, prescinde de muchas de las funciones menos utilizadas del Structured Query Language, un estándar de base de datos usado desde hace tiempo. Otro ejemplo son las bases de datos "columnares", basadas en investigaciones que muestran que el software de datos se ejecuta con mayor rapidez cuando la información es, en efecto, almacenada en columnas en lugar de filas.

Obviamente, algunas enormes propiedades web como Google o Facebook necesitan nuevos enfoques de base de datos. Sin embargo los vendedores de tecnología de datos también se jactan de historias de éxito que poco o nada tienen que ver con la web.

Por ejemplo, un sistema en memoria llamado HANA, creado por SAP, permite a la compañía de herramientas eléctricas Hilti obtener información de los clientes para sus equipos de ventas en unos pocos segundos, en lugar de las varias horas que requiere su software de almacenamiento de datos tradicional. Esto proporciona al personal de ventas ideas prácticamente instantáneas acerca de las operaciones de un cliente y el historial de pedidos.

Circle of Blue, una organización no lucrativa dedicada al estudio de problemáticas mundiales relacionadas con el agua, está a punto de utilizar los productos en memoria de QlikTech para agregar masas de datos para un complejo estudio de los Grandes Lagos, afirma su director ejecutivo J. Carl Ganter.

Los proveedores de servicios financieros están utilizando sistemas Hadoop de una empresa llamada Cloudera en sus esfuerzos de detección de fraudes, básicamente añadiendo toda la información que pueden recabar en un intento por encontrar nuevos métodos por los que sus redes de pagos podrían ser objeto de abusos.

Un denominador común es que los nuevos sistemas hacen a las bases de datos tan rápidas y sencillas que las empresas siempre empiezan a encontrar nuevos usos para ellas. Un gran minorista, por ejemplo, podría comenzar a llevar un registro de cada movimiento de ratón y clic de todos los visitantes de su sitio, con el objetivo de encontrar nuevas ideas acerca de las opciones del cliente.

Y a medida que las empresas ven caer en picado el coste del almacenamiento de datos, ajustan sus nociones sobre la cantidad de datos que necesitan mantener. Los petabytes de almacenamiento han dejado de ser sólo propiedad de Google.

(*) Lee Gomes, escritor en San Francisco, ha cubierto Silicon Valley durante 20 años. Durante gran parte de ese tiempo ha sido reportero del Wall Street Journal.