Paniere domande

207 domande totali nel paniere. Usa i filtri per studiare per area o per tipo.

Tutte LOGICA (27) TECNICA (22) CAD (22) PUB165 (18) GDPR (17) RETI (17) SIT (19) CLOUD (8) NIS2 (7) SIC (7) INGLESE (10) BIGDATA (6) AIACT (6) DAMM (5) DATABASE (5) DEVOPS (4) ENTI (7)
inglese logica normativa profilo situazionale

6 domande — Area BIGDATA — Tipo: profilo

1/6 · BIGDATA · profilo · INF-0114

Le '5 V' del Big Data includono Volume, Velocity, Variety, Veracity e:

[A] Visualization
[B] Value
[C] Virtualization
[D] Validation
Spiegazione

Le 5V del Big Data: Volume (quantità), Velocity (velocità), Variety (formati eterogenei), Veracity (qualità/affidabilità), Value (valore estraibile).

2/6 · BIGDATA · profilo · INF-0115

In Machine Learning, cosa si intende per 'overfitting'?

[A] Il modello non riesce ad apprendere i pattern del training set
[B] Il modello performa bene sul training set ma generalizza male su dati nuovi
[C] Il modello impiega troppo tempo per la fase di training
[D] Il dataset di training è troppo piccolo per l'algoritmo scelto
Spiegazione

L'overfitting si verifica quando il modello memorizza i dati di training (incluso il rumore) invece di apprendere pattern generalizzabili, risultando in alta accuracy sul training e bassa su dati nuovi. Il contrario è underfitting.

3/6 · BIGDATA · profilo · INF-0116

Quale framework è specificamente progettato per l'elaborazione distribuita di grandi dataset (batch processing)?

[A] Apache Kafka
[B] Apache Hadoop MapReduce
[C] Apache NiFi
[D] Redis
Spiegazione

Apache Hadoop MapReduce è il framework classico per batch processing distribuito su grandi dataset (HDFS + job MapReduce). Kafka è un message broker per streaming. NiFi è per data flow/ETL. Redis è un in-memory data store.

4/6 · BIGDATA · profilo · INF-0117

Cosa fa un 'data lake' rispetto a un data warehouse tradizionale?

[A] Memorizza solo dati strutturati con schema rigido predefinito
[B] Memorizza dati in formato grezzo (strutturati, semi-strutturati, non strutturati) con schema applicato alla lettura
[C] Esegue solo query OLAP su cubi multidimensionali
[D] Sostituisce completamente il database transazionale OLTP
Spiegazione

Il data lake memorizza dati in formato nativo/grezzo senza imporre uno schema (schema-on-read), a differenza del data warehouse che richiede schema predefinito (schema-on-write) e dati strutturati.

5/6 · BIGDATA · profilo · INF-0118

In un sistema di raccomandazione basato su 'collaborative filtering', le raccomandazioni si basano su:

[A] Le caratteristiche intrinseche degli oggetti raccomandati
[B] Il comportamento di utenti simili per preferenze
[C] Regole predefinite dall'amministratore del sistema
[D] L'analisi del testo dei contenuti
Spiegazione

Il collaborative filtering analizza i comportamenti e le preferenze di utenti simili ('chi ha apprezzato X ha anche apprezzato Y') senza analizzare le caratteristiche degli oggetti.

6/6 · BIGDATA · profilo · INF-0119

Apache Spark rispetto a Hadoop MapReduce è generalmente:

[A] Più lento ma più affidabile
[B] Più veloce grazie all'elaborazione in-memory
[C] Adatto solo a dati strutturati
[D] Impossibile da usare con HDFS
Spiegazione

Apache Spark elabora i dati in-memory (RAM) invece di scrivere su disco tra ogni step come MapReduce, risultando generalmente 10-100x più veloce per molti workload.