Test cuestionario de ciencia de datos - the question form

Preguntas: 16 · 10 minutos
1. Un modelo de detección médica predice una afección poco frecuente. No detectar a una persona que tiene la afección resulta especialmente costoso. ¿Qué métrica mide más directamente la proporción de casos realmente positivos que identifica el modelo?
Especificidad
Precisión
Sensibilidad
Exactitud
2. Un analista estandariza cada columna numérica utilizando la media y la desviación estándar del conjunto de datos completo y luego divide los datos en conjuntos de entrenamiento y prueba. ¿Cuál es el principal problema?
Se filtró información del conjunto de prueba al preprocesamiento
El conjunto de entrenamiento necesariamente será demasiado pequeño
Los modelos predictivos no pueden utilizar características estandarizadas
La estandarización solo puede utilizarse con variables categóricas
3. Un conjunto de datos observacionales muestra que las personas que usan con mayor frecuencia una aplicación de actividad física también hacen más ejercicio. ¿Qué respaldaría mejor la afirmación causal de que la aplicación aumenta el ejercicio?
Una correlación más fuerte en el mismo conjunto de datos observacionales
Una muestra más grande recopilada con el mismo diseño observacional
Un gráfico que muestre que, en el conjunto de datos, el uso de la aplicación ocurre antes del ejercicio
Un experimento aleatorizado bien diseñado que compare el acceso a la aplicación con una condición de control
4. Un equipo quiere estimar qué tan bien funcionará un modelo predictivo con registros nuevos que no ha visto antes. ¿Cuál es el objetivo principal de mantener un conjunto de prueba independiente?
Garantizar que el modelo funcionará igual de bien después de implementarlo
Aumentar la cantidad de características disponibles durante el entrenamiento
Evaluar el modelo final con datos que no se utilizaron para el ajuste ni para la selección del modelo
Eliminar la necesidad de validación durante el desarrollo del modelo
5. Un equipo de detección de fraude revisa cada transacción que un modelo marca como sospechosa, y resulta muy costoso enviar transacciones legítimas a revisión. ¿Qué métrica se enfoca en cuántas de las transacciones marcadas son realmente fraudulentas?
Sensibilidad
Error cuadrático medio
Especificidad
Precisión
6. Los ingresos de los hogares de una muestra presentan un fuerte sesgo hacia la derecha porque algunos valores son extremadamente altos. ¿Qué medida representa mejor un ingreso típico y limita la influencia de esos valores extremos?
El rango
La media aritmética
La mediana
La varianza
7. En una prueba A/B, un intervalo de confianza para la diferencia entre los resultados promedio está completamente por encima de cero en el nivel de confianza elegido. ¿Qué conclusión está más justificada?
La nueva versión mejorará el resultado para todos los usuarios
La magnitud de la mejora es automáticamente importante en la práctica
Ya no queda ninguna incertidumbre sobre el efecto verdadero
Los datos aportan evidencia de una diferencia promedio positiva en ese nivel de confianza
8. Un científico de datos quiere que las ejecuciones repetidas de la misma división aleatoria entre entrenamiento y prueba seleccionen los mismos registros. ¿Cuál es la medida más directa?
Agregar más filas después de cada ejecución
Establecer y registrar la semilla aleatoria utilizada por el procedimiento de división
Ordenar los valores objetivo de mayor a menor antes de realizar la división
Eliminar la columna objetivo antes de guardar el conjunto de datos
9. Durante el desarrollo de un modelo, ¿cuál es el objetivo principal de la validación cruzada de k particiones?
Convertir una variable objetivo de regresión en categorías
Eliminar todas las fuentes de sesgo de muestreo
Estimar el rendimiento con múltiples divisiones de entrenamiento y validación
Reemplazar en todos los casos la necesidad de un conjunto de prueba final que no se haya utilizado previamente
10. ¿Cuál es un objetivo habitual de la regularización en un modelo predictivo?
Hacer que todas las características tengan la misma correlación con la variable objetivo
Convertir una tarea no supervisada en una supervisada
Garantizar que todos los ejemplos de entrenamiento se predigan correctamente
Desalentar una complejidad excesiva del modelo y ayudar a reducir el sobreajuste
11. Seis meses después de la implementación, el rendimiento de un modelo disminuye porque cambió la relación entre el comportamiento de los clientes y la variable objetivo. ¿Qué ilustra esto de manera más directa?
Un error de sintaxis en el código de entrenamiento
Deriva de concepto que afecta al modelo después de la implementación
Regularización exitosa durante el entrenamiento
Multicolinealidad perfecta en todas las características de entrada
12. Un conjunto de datos tiene muchas características numéricas correlacionadas y un analista quiere un conjunto más pequeño de componentes no correlacionados que conserve tanta varianza como sea posible. ¿Qué técnica se ajusta a este objetivo?
Análisis de componentes principales
Regresión logística
Codificación one-hot
Muestreo estratificado
13. Una tabla llamada sales contiene las columnas region y revenue. ¿Qué consulta SQL calcula correctamente el ingreso promedio de cada región?
SELECT region, AVG(revenue) FROM sales GROUP BY revenue;
SELECT region, AVG(revenue) FROM sales GROUP BY region;
SELECT AVG(region), revenue FROM sales GROUP BY region;
SELECT region, revenue FROM sales WHERE revenue = AVG(revenue);
14. Una característica registra el canal de contacto preferido de los clientes como correo electrónico, teléfono, chat o correo postal, sin ningún orden natural. ¿Qué codificación básica evita dar a entender que una categoría ocupa un nivel superior a otra?
Codificación one-hot
Asignar los valores 1, 2, 3 y 4 a las categorías
Reemplazar cada categoría por el número de fila
Aplicar escalamiento mínimo-máximo a los nombres de las categorías
15. Una empresa minorista tiene datos sobre el comportamiento de sus clientes, pero no cuenta con tipos de clientes predefinidos. Quiere descubrir grupos de clientes con comportamientos similares. ¿Qué enfoque es el más adecuado?
Regresión lineal
Agrupamiento
Clasificación binaria
Pronóstico de series temporales
16. Un modelo alcanza una exactitud del 99 % con sus datos de entrenamiento, pero solo del 68 % con datos de prueba que no ha visto antes. ¿Cuál es la explicación más probable?
El modelo está sobreajustando patrones específicos de los datos de entrenamiento
El modelo presenta subajuste porque ambas puntuaciones son igualmente bajas
La variable objetivo debe ser continua
Los datos de prueba se utilizaron demasiadas veces durante el entrenamiento
Pruebas populares
Inventario de Personalidad Narcisista (NPI)
Se utiliza una medida de autorreporte para explorar la presencia de rasgos…
Iniciar el test
Escala Obsesivo-Compulsiva de Yale-Brown (Y-BOCS)
Se utiliza para estimar la gravedad de síntomas obsesivo-compulsivos, con é…
Iniciar el test
Cuestionario CRAFFT 2.1
Se utiliza como herramienta breve de tamizaje el Cuestionario CRAFFT 2.1 pa…
Iniciar el test
Cuestionario de Salud del Paciente (PHQ-9)
Se utiliza un instrumento breve como el Cuestionario de Salud del Paciente…
Iniciar el test
Inventario de Burnout de Maslach (MBI)
Esta prueba permite evaluar manifestaciones de desgaste laboral mediante au…
Iniciar el test
Cuestionario De Ansiedad En Adolescentes
En la evaluación clínica de adolescentes, el Cuestionario De Ansiedad En Ad…
Iniciar el test
Cuestionario de Creatividad Emocional (ECI)
Se utiliza el Cuestionario de Creatividad Emocional (ECI) para explorar la…
Iniciar el test
Cuestionario de Matutinidad-Vespertinidad (MEQ)
Se utiliza el Cuestionario de Matutinidad-Vespertinidad (MEQ) para estimar…
Iniciar el test
Escala De Sexismo Ambivalente (ASI)
Se utiliza la Escala De Sexismo Ambivalente (ASI) para evaluar actitudes y…
Iniciar el test
Escala De Misoginia Interiorizada (IMS)
Se utiliza la Escala De Misoginia Interiorizada (IMS) para explorar la pres…
Iniciar el test
Escala De Estrés Percibido (PSS-10)
Se utiliza la Escala De Estrés Percibido (PSS-10) para estimar el nivel de…
Iniciar el test
Escala De Conducta Impulsiva (SUPPS-P)
Se utiliza la Escala De Conducta Impulsiva (SUPPS-P) para una evaluación br…
Iniciar el test
Escala De Evaluación Del Síndrome De Abstinencia De Alcohol (CIWA-AR)
Se utiliza para valorar de forma breve la intensidad de signos y síntomas a…
Iniciar el test
Escala De Afecto Positivo Y Negativo (PANAS)
Se utiliza para estimar la intensidad de afecto positivo y afecto negativo…
Iniciar el test
Escala de la Tríada Luminosa (LTS)
Este instrumento de autoinforme permite explorar rasgos de orientación pros…
Iniciar el test
Escala De Ideación Suicida
Se utiliza para estimar la intensidad y las características de la ideación…
Iniciar el test
Escala Del Trastorno Dismórfico Corporal (BDD-D)
Se trata de un instrumento breve de tamizaje para explorar preocupaciones p…
Iniciar el test
Inventario de Ansiedad de Beck (BAI)
Se utiliza el Inventario de Ansiedad de Beck (BAI) como instrumento de auto…
Iniciar el test
Prueba Diferencial de Perfeccionismo
Este instrumento de autoinforme, la Prueba Diferencial de Perfeccionismo, s…
Iniciar el test
Escala De Locus De Control
Este instrumento permite explorar la percepción del grado de control person…
Iniciar el test
Nueva Escala de Apatía
Se utiliza la Nueva Escala de Apatía como instrumento de tamizaje para expl…
Iniciar el test
Cuestionario Perth de Alexitimia (PAQ)
Se utiliza el Cuestionario Perth de Alexitimia (PAQ) para evaluar dificulta…
Iniciar el test
Escala De Inteligencia Social
Se utiliza para explorar aspectos del funcionamiento interpersonal y la com…
Iniciar el test
Prueba de Miedo
Esta herramienta de evaluación psicológica permite explorar respuestas de t…
Iniciar el test
Nivel De Neuroticismo
Se utiliza para una estimación inicial de la tendencia a reacciones neuróti…
Iniciar el test
Cuestionario Breve de Indicadores de Agresividad
Se utiliza para obtener una estimación rápida de indicadores conductuales a…
Iniciar el test