Entradas

Modelo de regresión lineal y su aplicación en la Inteligencia Artificial?

Imagen
 Modelo de regresión lineal y su aplicación en la Inteligencia Artificial?  La regresión lineal es una técnica estadística utilizada  para poder modelar la relación entre una variable dependiente y una o más variables independientes, en el contexto de la inteligencia artificial se utiliza para predecir valores continuos, como por ejemplo el precio de una casa en función de su tamaño,  ubicación.  Existen varios tipos de modelos de regresión en la IA cada uno de estos se pueden utilizar en diferentes situaciones y cada uno tiene sus ventajas y desventajas, algunos de los más utilizados son  Regresión lineal Regresión logística  Regresión polinomica  Regresión no lineal  La regresión lineal es un método usado ampliamente el cual se utiliza en diversas disciplinas como la economía, la sicología y la ciencia de datos para predecir y poder comprender mejor el comportamiento de una variable en función   ...

Utilidad tienen las técnicas de reducción de dimensionalidad en la Ciencia de Datos.

Imagen
  técnicas de reducción de dimensionalidad en la Ciencia de Datos La reducción de la dimensionalidad es una técnica que se utiliza en la ciencia de datos la cual es utilizada para poder reducir el número de variables en un conjunto de datos, esto se hace con el fin de poder facilitar el análisis y la visualización de los mismos para poder mejorar el rendimiento del modelo de aprendizaje que se vaya a utilizar.  Algunas técnicas comunes de reducción incluyen  la selección de las variables, luego el análisis de componentes principales (PCA),la extracción de las características y la proyección , estas técnicas pueden llegar a ser lineales o no lineales y estas se utilizan para poder transformar los datos en una menor dimensión mientras conservamos la  mayor cantidad posible de información.  La selección de las variables es una técnica que implica seleccionar un subconjunto de las variables relevantes para poder analizar y descartar las variables que no aportan...

Uso de un Data Warehouse y un Data Lake en una solución particular en Ciencia de Datos

Imagen
Data Warehouse y un Data Lake Los Data Lakes y Data Warehouse son términos utilizados en el almacenamiento de Big Data, pero no son sinónimos y tienen diferencias funcionales distintas. Un Data Lake es un repositorio de datos sin procesar y sin una estructura definida, mientras que un Data Warehouse es un almacén de datos con una estructura definida y filtrada para un propósito específico. Aunque pueden llegar a parecer similares esto debido a su capacidad de poder manejar grandes volúmenes de datos, es muy importante comprender sus diferencias ya que son capaces de satisfacer las necesidades de diferentes perspectivas.  mirando un poco sus diferentes propósitos un data Warehouse están diseñados para almacenar datos ya han sido limpiados y analizados mientras que un Data Lake es altamente escalable el cual contiene grandes volúmenes de datos pero que no se encuentran procesados si no que se encuentran en su formato nativo hasta que se necesiten para su uso, estos pueden almacenar c...

Ciencia de Datos: origen, utilidad y futuro

Imagen
 Ciencia de Datos Algo de historia  El en artículo científico "The future of data analysis" escrito por john W. Tukey que en 1961 fue uno de los primeros en el campo de la ciencia de datos, este científico hablo sobre la necesidad de las herramientas para poder procesar  grandes volúmenes de datos.  En 1974, El científico Peter Naur   mencionó por primera vez el concepto de "data science" en su libro "Concise Survey of Computer Methods". A partir de entonces, se acumularon libros, artículos y reportes técnicos que exploraban diversas formas de tratar los datos, separándose gradualmente de la estadística y brindando oportunidades para los teóricos de la computación. Luego de esto podemos decir que la ciencia de datos es un enfoque multidisciplinario el cual combina una serie de principios de varias matemáticas y estadísticas con un poco de la ayuda de el ser humano que es el que coge los datos y los analiza para así poder  ...

Presentación personal en el curso de Ciencia de Datos

Imagen
  Hola! Mi nombre es Laura Marin soy técnica en sistemas y actualmente me encuentro cursando la ingeniería en software me encuentro en el 9 semestre , y también me encuentro realizando las practicas empresariales.  Mis expectativas frente al curso es adquirir nuevos conocimientos y habilidades que me peritan poder mejorar mi desempeño en mi trabajo y en mi futuro, aprender de la minería de datos y extracciones para lograr un buen análisis.  En cuanto a mis conocimientos en base de datos y python  he tenido alguna experiancia tanto en la universidad como en el trabajo, haciendo varios proyectos