F1: GP de Barhein

Después del paréntesis vacacional volvemos con la F1 a un circuito de los modernos, en los que solo se han disputado 5 Grandes Premios. En formulaf1 teneis un muy buen análisis de las escuderías y el circuito así que me salto ese paso y vamos directamente con las estadísticas:

CARRERA:

De los pilotos que han corrido las 5 carreras el más consistente en cuanto a resultados es Kimi, con el 80% de las carreras en el podio. Fernando también ha tenido buenos resultados en este circuito, como también los han tenido Massa y Trulli. Ojo con Webber también que ha acabado en los puntos el 80% de las veces y los Red Bull vienen con la moral a tope después del 1-2 de China.



ENTRENAMIENTOS Y VUELTAS RAPIDAS:

Destaca entre todos los resultados los de Massa, que o no entra en la Q3 o clasifica primero o segundo. Trulli también lo ha hecho bien en este circuito y este año los Toyota parten con más ventaja por los test pretemporada que han hecho aquí.



CIRCUITO:

Sólo un año la diferencia entre el primero y segundo ha superado los 3.5 segundos, el % de coches que finalizan la carrera es bastante alto también y no suele ser muy común ver al Safety Car en carrera. Aunque no aparece en las estadísticas la mayoría de las veces el primer abandono se ha producido en la primera vuelta.


Esperaremos a que salgan las cuotas y tener un poco más de información para colocar algún pick.

F1: Gran Premio Malasia

Después de la apabullante victoria de los Brawn la semana pasada, dejamos Australia y nos trasladamos a Malasia, al circuito de Sepang. Un circuito moderno en el que destaca la calidad tanto del trazado como de la seguridad pasiva. Es un trazado con una gran variedad de curvas: cinco de 1ª o 2ª, y luego otras diez de 3ª o 4ª y dos rectas de 800 metros cada una, para un total de 5.543 Km. En él, el aspecto aerodinámico cobra una gran importancia ya que hay que llegar a una solución de compromiso entre el agarre en las horquillas y curvas lentas y la velocidad punta en las dos rectas. Esto va a perjudicar a las escuderías como McLaren que vienen arrastrando problemas en la aerodinámica del coche desde la pretemporada.

A diferencia de Melbourne, es una pista mucho más amplia, rápida y limpia, además el asfalto está mucho menos bacheado y las rachas de viento no son tan importantes como en el trazado australiano. Estos dos últimos factores hicieron que, según los técnicos de Renault, el coche no fuese lo suficientemente competitivo el pasado fin de semana.

Escuderías que deberían mejorar con respecto a Australia: Renault, por lo ya comentado, Ferrari, poco que decir tras el fiasco de Australia, y Williams, que tienen un coche con gran potencial y tanto Nakajima como Rogsberg se encuentran a gusto en este trazado. Esto parece que se ha confirmado en los primeros entrenos libres.

Neumáticos: Pieza clave en este gran premio. Bridgestone este año va a traer dos compuestos, duro y blando, cuando en años anteriores se optaba por el duro y el medio debido a las altas temperaturas. La durabilidad de el neumático blando será la clave.

KERS: Importante en la salida porque se puede aprovechar el exceso de potencia en la larga recta de meta, aunque habrá que tener cuidado en la horquilla final. Ferrari ha confesado que, si bien puede ser beneficioso en la salida, acelera el desgaste de los neumáticos traseros. Este punto habrá que tenerlo en cuenta cuando se monte el juego de neumáticos blandos.

Climatología: Se preveen lluvias tanto para carrera como para entrenamientos. La carrera se celebra a las 17:00 hora local, con lo que existe la posibilidad de que la visibilidad sea muy baja debido a la lluvia y a la falta de luz. Este factor incrementa las probabilidades de accidente y debería afectar también negativamente a la cantidad de coches que finalicen la carrera.

Pilotos que se crecen en Sepang: Batton, Alonso (es su circuito favorito), Heifield y Nakajima.

Resultados de las últimos 8 años en carrera:

Destaca Alonso que incluso corriendo con Minardi ha llegado a terminar en los puntos.

Resultados Entrenamientos y vueltas rápida en carrera:

Massa y Alonso son los hombres Pole del circuito, y en carrera Kimi parece que mejora sus resultados.

Resultados del circuito:


Circuito exigente para los coches con una media de abandonos del 32%, no ha habido ningún safety car en los últimos años, pero este año dependiendo de la lluvia las cosas pueden cambiar. Las diferencias entre el primero y segundo son muy variables.

Con todo esto vamos con, todo en Paddy Power:

Alonso en los puntos @ 1.8. Los Renault deben mejorar en este circuito, es el circuito preferido de Alonso y siempre ha acabado en los puntos excepto un año con Minardi. Además si aparece la lluvia Alonso es uno de los mejores pilotos en estas circunstancias.

K Nakajima en los puntos @ 3.00 Ya hemos visto que los Williams son rápidos y el piloto japonés ha corrido ya varios años en el circuito cuando era piloto de la GP2 en Japón. Confiamos en él para esta carrera.

Escudería con más puntos: Ferrari @ 3. Barrichelo sale 5 puestos atrás por sustituir la caja de cambios, la fiabilidad de los Brawn está por demostrar y Ferrari no se puede permitir otro fiasco.

Esperemos tener un poco más de suerte que el otro GP.

Llega la Formula1

Pues ya tenemos aqui de nuevo a la F1, con muchas modificaciones respecto a la temporada pasada, y si no que se lo digan a Hamilton, que le ha tocado vivir lo que vivio Alonso en la temporada pasada.

Los KERS, alerones moviles, neumaticos lisos, una sola marca de gomas... Bueno a lo que voy que esta primera carrera es una lotería. Por lo visto en la pretemporada parece que los Brawn han hecho un gran trabajo, ¡quien lo iba a decir despues de estar casi fuera y que en la pasada temporada no se comian un rosco!. Muchos opinan que han hecho estos tiempos buscando un patrocinador para toda la temporada, se ha hablado de Bwin y de Virgin, aunque parece ser que no se ha concretado nada todavía. Otros equipos que han trabajado bien son Williams, Toyota y Renault.

Para la carrera, llevarán Kers Renault, McLaren, Ferrari y Heifield. Bmw lo decidirá carrera a carrera y en esta Kubica no va a ir con el por el tema del peso. Es uno de los pilotos más altos de la categoría y también con más peso. Según parece para los entrenos no se gana demasiado pero en carrera puede ser una ayuda en adelantamientos aunque el paso por curva, al llevar más peso, puede ser un poco más lento.

En cuanto a estadisticas, este es uno de los deportes que menos páginas de estadísticas buenas he encontrado, solo tengo dos interesantes:

http://www.statsf1.com/
http://www.grandprixstats.com/en/

Tengo la intención de hacer una buena recopilación de estadisticas antes de cada carrera, pero ya empezamos un poco justos para esta, así que a ver si en la siguiente podemos hacerlo un poco mejor.

Pilotos que se crecen en este circuito: Raikonen (8 participaciones, 4 podiums, 4 vueltas rápidas), Alonso (7 participaciones, 4 podiums, 1 vuelta rápida), Hamilton (2 participaciones, 2 podiums), Barrichelo (13 participaciones, 4 podiums, 1 Vuelta rapida) y Rogsber (3 participaciones, 1 podium). Todos ellos deberían estar por delante de sus compañeros de equipo en los H2H tanto en carrera (mucho más probable) como en calificación.

Pilotos que no les va mucho: Massa (6 participaciones, 1 vez en los puntos), Trulli (12-2), Button (9-1, aunque con 1 pole).

Así que para la lotería de la carrera yo voy con (todo en PaddyPower y Stake bajito 1):

Escudería con más puntos: Williams @6 (esperemos que Nakajima no nos gaste una mala pasada)
Vuelta rápida: Raikonen @5
¡¡¡A MADRUGAR TOCAAAAA!!!

Manejo de datos en Excel: Ejemplo BetExplorer

En esta tercera entrega de la serie relacionada con el manejo de datos en excel, vamos a hacer un ejemplo de como se puede arreglar la información obtenida de una página web como es BetExplorer.

Partiremos de los datos que ofrece la web, que tienen el siguiente aspecto:


Para llegar a esto otro.


Para ello lo primero que debemos hacer es seleccionar todos los datos, copiarlos y hacer un Pegado Especial > Texto en Excel.

Con esto habremos conseguido la primera parte de la tabla (la zona verde). Ahora nos queda rematar la faena y rellenar usando funciones de excel la zona azul.

Las dos primeras columnas son los nombres de los equipos y los vamos a separar utilizando las funciones IZQUIERDA(Texto; Numero de caracteres), ENCONTRAR(Texto buscado; Texto donde busca; Posicion inicial), y EXTRAE(Texto; Posicion inicial; Numero de Caracteres). Esta es la parte más complicada de la hoja, porque lleva varias funciones de texto anidadas, pero una vez la tienes acabada funciona a la perfección.

Lo más importante para poder separar los equipos es ver si hay algún texto que sirva de separardor entre ambos. En este caso se utiliza el guión "-". Esto nos facilita mucho la tarea, porque lo que haremos es decirle a excel que el primer equipo es el texto que hay antes del guion y el segundo es el que hay después. Vamos a ver como traducimos esto a funciones de excel.

La función ENCONTRAR nos devuelve la posición dentro del texto que ocupa el caracter o caracteres que deseamos buscar. Así = ENCONTRAR(Partido;"-") nos va a devolver la posición en la que se encuentra el guión dentro del Partido.

La función IZQUIERDA nos va a devolver los n primeros carácteres del texto. Con esto lo tenemos casi hecho, lo que queremos es pedirle a Excel que nos devuelva los primeros caracteres hasta el guión. Es decir:

Equipo1 = ESPACIOS(IZQUIERDA(Partido;ENCONTRAR("-";Partido)-1))

La función ESPACIOS la coloco para quitar todos los espacios en blanco que sobren y el -1 de después de ENCONTRAR sirve para eliminar el "-" del texto.

Para el Equipo2 es un poco más complicado, porque cambiando la función IZQUIERDA por DERECHA no nos funciona, debido a que necesitamos saber cuantos caracteres hay empezando por la derecha hasta el guión y la función ENCONTRAR nos dice eso pero empezando por la izquierda. Así que tenemos dos alternativas, utilizar la función derecha y calcular el número de caracteres que necesitamos como la longitud total del texto menos la posición del guión, o bien utilizar la función extrae que nos devuelve un trozo de texto desde la posición que nosotros le digamos. Yo voy a utilizar esta última

Equipo2 = ESPACIOS(EXTRAE(Partido;ENCONTRAR("-";Partido)+1;100))

El +1 que hay después de ENCONTRAR, se usa en este caso para que no nos devuelva el guión junto al nombre del segundo equipo, y el 100 del final es para que extraiga 100 caracteres, como no hay tantos, lo que hace es extraer hasta el final del texto.

Ya tenemos hecho lo más difícil y solo nos queda completar la tabla con las columnas finales.

Los goles marcados por el equipo 1 y el equipo 2 los obteníamos con las funciones HORA() y MINUTO(), como vimos en el anterior artículo. Para obtener el resultado del partido, vamos a usar la función SI(condición; accion si verdadero; accion si falso). Esta función se puede anidar hasta un máximo de 7 veces, y para este caso deberemos anidar dos de ellas. Y nos quedaría algo así:

Res = SI (Eq1>Eq2; 1; SI(Eq1=Eq2; "X"; 2))

Con esta función lo que hacemos es comparar si los goles que ha metido el equipo1 son mayores que los que ha metido el equipo2 y si es así nos devuelve 1, si no es así, miramos si los goles del equipo1 son iguales a los del 2, si es así nos devuelve una X, que como es un texto debemos colocarla entre comillas dobles, y si no es así nos devuelve un 2. Como podeis ver la X la debemos de colocar entre comillas porque es un texto.

Para el cálculo del Over2.5 hacemos algo parecido.

O2.5 = SI (Eq1+Eq2>2;1;0)

Si la suma de los goles es mayor que 2, devuelve 1 y si es menor devuelve 0. El 1 y el 0 lo podríamos cambiar por lo que nosotros quisieramos "OVER" y "UNDER", "O" y "U"... pero yo suelo utilizar 1 y 0 porque para saber el % de overs que han salido solo tengo que hacer la media de esta columna. Si utilizamos cualquier otra nomenclatura el cálculo se complica un poco más.

La columna de O1.5, se calcula prácticamente igual que la de O2.5 y no lo voy a hacer. Lo dejo como deberes ;-)

La columna Par se calcula también usando la función Si y la función Es.Par() de la siguiente manera:

Par = SI (ES.PAR(Eq1+Eq2);1;0)

Con estas funciones ya tendríamos completada nuestra tabla.

La hoja de cálculo completa la he subido a GoogleDocs y la podeis encontrar pinchando en este enlace. El funcionamiento es sencillo, copiais los datos de BetExplorer y los pegais en la hoja con CTRL+V. El resto funciona automático. Espero que os sirva.

Manejo de datos en Excel

Siguiendo con los post relacionados con el manejo de datos en excel, vamos a repasar una serie de funciones avanzadas en Excel que nos van a permitir ajustar a nuestras necesidades, datos copiados desde páginas web.

Las páginas que ofrecen resultados de partidos no suelen seguir un criterio único para mostrar estos datos. Las opciones más comunes son tres: presentar el resultado separado por un guión (1-1), por dos puntos (1:1), o en diferentes columnas (1 1).

El primer paso que debemos dar es copiar los datos y hacer un Pegado Especial > Texto en Excel. Cuando hacemos esto con resultados separados por guiones (1-1), Excel los interpreta como una fecha, siempre que no se presente ninguna incoherencia (días de la supuesta fecha, primer número normalmente, sea menor que 1 o mayor que 31, o cuando los meses sean menor que 1 o mayor que 12). Si Excel advierte una incoherencia en la supuesta fecha, copiará el resultado como una cadena de texto. Para salir de dudas y conocer con que formato ha pegado Excel los datos lo mas apropiado es utilizar la funcion =ESNUMERO(celda). Esta función nos devolvera verdadero o falso segun la celda contenga un valor o no. Hay que tener en cuenta que Excel trata las fechas y las horas como un numero, que representa el numero de días transcurridos desde el 1 de enero de 1990. Así, si el dato que hemos copiado lo ha pegado como una fecha, la funcion nos devolvera verdadero.

Otra manera de detectarlo es viendo la alineación de la celda. Una alineación a la izquierda se usa para cadena de texto y la alineación a la derecha para los números.

Así pues, tenemos 2 opciones, el dato ha sido pegado como fecha o como texto. Si se ha pegado como fecha debemos de utilizar las funciones =DIA(Dato) y MES(Dato). Con la funcion dia obtendremos los goles o puntos anotados por el equipo1 y con la funcion mes los del equipo 2.

Si los datos de partida estan en formato 1:1. Al pegarlos los interpretará como horas, con lo que para separar el marcador utilizaremos las funciones =HORA(Dato) (para obtener los goles del equipo de casa) y =MINUTO(Dato), para el segundo. con este formato segimos teniendo restricciones con respecto a los numeros a pegar y si Excel detecta una incoherencia, hará lo mismo que para el caso de las fechas, pegará los datos como texto.

Para estos casos en que Excel convierte los datos en texto podemos hacer lo siguiente. si los datos siempre tienen el mismo numero de digitos, por ejemplo resultados de futbol el 99% de las vecs los goles seran un solo digito, goles de balonmano 2 digitos (en partido completo). se pueden usar las funciones =DERECHA(Texto; Numero de Caracteres) e =IZQUIERDA(Texto; Numero de Caracteres) combinadas co las funciones =ESPACIOS(Texto) y =VALOR(Texto). las funciones izquierda y derecha son similares y lo que hacen es devolver una cantidad especifica de caracteres empezando por la izquierda o por la derecha del texto selecionado. Estas funciones siempre nos devuelven un texto, que convertiremos en numero con la funcion valor.

La función espacios es muy importante, ya que elimina del texto todos los espacios excepto los que hay entre palabras. nos servira para eliminar espacios sobrantes al comienzo y al final del texto.

El resultado final de todo esto seria algo asi (los datos son de BetExplorer.com)


En la siguiente entada veremos como podemos arreglar nuestros datos cuando tenemos entre los valores pegados textos y numeros, y como se pueden obtener automaticamente los nombres de los equipos.

¿Ha cambiado el Madrid su estilo de juego?

Desde el día 9 de Diciembre pasado, Juande Ramos se hizo con las riendas del Real Madrid sustituyendo a Bernd Schuster al frente del equipo. Es claro que cada entrenador tiene unas características particulares y le gusta un tipo de juego determinado. Cuando dirigen a un equipo, cambian jugadores, el esquema de juego, la disposición del equipo en el campo, o el tipo de juego. Todo con el fin de imprimir su sello particular en el equipo.

Esto podría ser una buena base para el comienzo de una tertulia después de una buena comida con los amigos, pero, ¿se podrá demostrar estadísticamente?. ¿Será posible demostrar que el Madrid de Juande tiene un estilo de juego diferente al de Schuster utilizando la estadística?. Pues a ello vamos en esta entrada.

Para hacerlo vamos a utilizar dos variables, los goles que ha marcado el Real Madrid y los que ha recibido en los partidos dirigidos por uno y otro técnico.

GOLES A FAVOR:


En el gráfico podemos ver los goles que ha marcado el Real Madrid en los dos períodos. A la izquierda tenemos los goles marcados con Juande como entrenador y a la izquierda los marcados con Schuster. Se puede apreciar que las líneas medias (lineas en verde) son bastante similares, con Schuster habían marcado una media de 2.36 goles por partido y con Juande ese valor baja hasta los 1.57. Hay una diferencia de casi 0.8 goles por partido a favor de Schuster, pero esta diferencia no es lo suficientemente grande como para que sea significativa en un test 2-Sample T test. Dejaremos la explicación de este test para futuras entradas.

GOLES EN CONTRA:


Si analizamos los goles en contra las diferencias se agrandan. Con Schuster el Madrid recibía una media de 1.71 goles por partido, mientras que con Juande el equipo defiende bastante mejor y encaja una media de 0.43. Bastante más de 1 gol menos de media por partido. Esta diferencia, utilizando el mismo test, SI ES SIGNIFICATIVA con un nivel de significación del 95%. Lo que quiere decir que es bastante improbable que esta diferencia entre las medias sea debida al azar, una racha de buena suerte, la disposición de partidos en el calendario, etc.

Con esto se puede concluir que Juande ha cambiado el estilo de juego que tenía el Madrid de Schuster y ahora son un equipo que defiende mejor y al que es más difícil hacerle un gol.

Así que la siguiente vez que alguien os plantee la típica pregunta de ¿para qué sirve la estadistica? podeís decir sin ningún temor a equivocaros, que sirve para comprobar que el Madrid de Juande defiende mejor que el de Schuster. Y quedareis como unos campeones.

Relacion entre cuota y probabilidad

Como ya hemos comentado en otras entradas existe una relación inversa entre la cuota y la probabilidad. Esto quiere decir que cuanto mayor es la cuota menor es la probabilidad teórica de que aparezca ese resultado.

En un juego justo, donde ninguno de los dos jugadores ganaría usando una estrategia de picks aleatorios a largo plazo, esta relación viene determinada por la siguiente fórmula:

Probabilidad = 1 / Cuota

Sin embargo ante las casas de apuestas tradicionales no estamos jugando a un juego justo. Las casas ofrecen unas cuotas relacionadas con la probabilidad de que aparezca ese resultado pero no podemos calcularla directamente con esta ecuación. Veamos por qué y como se puede calcular la probabilidad estimada de cada evento partiendo de las cuotas ofrecidas.

Tomaremos como ejemplo las cuotas que teníamos para el resultado exacto de sets, en el partido de Nadal contra Verdasco:

Nadal 3-0 @1.7
Nadal 3-1 @2.9
Nadal 3-2 @7
Verdasco 3-0 @25
Verdasco 3-1 @14.1
Verdasco 3-2 @13.5

Aquí tenemos todos los resultados posibles del partido. Si apostasemos la cantidad exacta para ganar 1 ud. a todos los resultado, al final del partido acertaríamos siempre uno de ellos y nuestro retorno sería de 1 ud. Estaríamos ante un suceso cierto o seguro. Pero ¿cuanto nos costaría esta apuesta?. Vamos a calcularlo.

Para el primer resultado si apostamos 1/1.7 = 0.588 uds nos devolverían 1 ud si Nadal gana 3-0, ya que apostaríamos 1/1.7 uds. a una cuota 1.7 con lo que el retorno sería de 1/1.7 x 1.7 = 1

Haciendo la misma operación con todos los resultados posibles tendríamos:


Para cada una de las opciones hemos apostado las unidades necesarias para que nos devuelvan 1 ud si acertamos (Apuesta Ganancia Unitaria). Al final, como ya hemos dicho, acertaremos una de ellas seguro con lo que la casa nos pagará 1 ud, pero hacer todas estas apuestas nos habrá costado un total de 1.26 uds. Es decir perderemos 0.26 uds por cada 1.26 uds. apostadas (un 20.6%). Mal negocio.

Visto desde el punto de vista de la casa, la cosa cambia. Pase lo que pase en el partido la casa va a pagar 1 ud y va a ingresar 1.26. Es decir va a pagar 1/1.26 = 79.31% de lo que ingresa, a esto se le llama fracción de pago. Si paga el 79.31% de lo que ingresa, ofertando estas cuotas, eso quiere decir que va a tener unos beneficios de 100 - 79.31 = 20.69%. ¡Justamente lo que nosotros perdemos!

Evidentemente la ecuación Probabilidad = 1 / Cuota no puede ser correcta en este tipo de juegos. Ya que 1 / Cuota es lo que nosotros hemos llamado Apuesta Ganancia Unitaria y la suma total de todas nuestras apuestas es 1.26 cuando debería ser 1, puesto que estamos ante la suma de las probabilidades de un suceso cierto. Entonces, ¿Cuales son las probabilidades correctas?. El cálculo sigue siendo bastante sencillo, añadiremos el término de la fracción de pago a la ecuación y con ello tendremos las probabilidades estimadas correctas. Así la ecuación quedaría:

Probabilidad = Fracción de pago / Cuota

Todo estos cálculos los he colocado en un nuevo libro de GoogleDocs que podeis encontrar en este enlace, y lo utilizaremos en la siguiente entrada para analizar los resultados esperados de apuestas equivalentes. Pero eso será otro día.