Vai al contenuto
Percorso formativo Oro Operatore professionale

Covarianza

Misura non standardizzata del movimento lineare congiunto tra due variabili e matrice centrale nel rischio di portafoglio, da interpretare con unità, campione e metodo di stima dichiarati.

A chi serve — A chi deve leggere una matrice di rischio, calcolare la varianza di un portafoglio o distinguere una dipendenza espressa nelle unità originali dalla correlazione standardizzata.

La covarianza misura come due variabili si discostano congiuntamente dalle rispettive medie. È positiva quando scarti dello stesso segno tendono a presentarsi insieme, negativa quando uno scarto positivo tende ad accompagnare uno negativo, prossima a zero quando nel campione non emerge un movimento lineare congiunto rilevante. Il valore non è standardizzato: grandezza e unità dipendono dalle variabili misurate.

Nel portafoglio la covarianza collega il rischio delle singole componenti al rischio dell'insieme. Due strumenti volatili non producono necessariamente un portafoglio altrettanto volatile se i loro rendimenti non si muovono sempre nella stessa direzione. Questa relazione è però stimata da dati, finestra e convenzioni: non è una proprietà immutabile dei simboli finanziari.

Covarianza e matrice del portafoglio La diagonale contiene varianze; fuori diagonale vivono le dipendenze a coppie Covarianza e matrice del portafoglio La diagonale contiene varianze; fuori diagonale vivono le dipendenze a coppie σₚ² = wᵀΣw ; cov(i,j) = ρᵢⱼ σᵢ σⱼ ABCDσ²(A)cov(A,B)cov(A,C)cov(A,D)cov(A,B)σ²(B)cov(B,C)cov(B,D)cov(A,C)cov(B,C)σ²(C)cov(C,D)cov(A,D)cov(B,D)cov(C,D)σ²(D)varianzecovarianze Diagonale La covarianza di un asset con sé stesso è la suavarianza. Fuori diagonale Segno e grandezza dipendono da scala, frequenza ecampione. Stima Dati mancanti e instabilità possono rendere fragile lamatrice. Cyclepedia · schema didattico: convenzioni, periodo e dati vanno dichiarati
La diagonale misura il rischio proprio; gli elementi fuori diagonale descrivono il movimento lineare congiunto. Pesi e intera matrice determinano la varianza stimata del portafoglio.

Definizione di popolazione e stima campionaria

Per due variabili casuali X e Y con medie finite, la covarianza di popolazione è:

Cov(X,Y) = E[(X − μₓ)(Y − μᵧ)]

L'operatore di attesa riguarda la distribuzione teorica. Nella pratica si dispone di un campione di n osservazioni allineate. Quando le medie sono stimate dallo stesso campione, una convenzione comune è:

sₓᵧ = [1 / (n − 1)] × ∑ₜ₌₁ⁿ (xₜ − x̄)(yₜ − ȳ)

Il denominatore n − 1 identifica la covarianza campionaria corretta per i gradi di libertà; alcune librerie, modelli di massima verosimiglianza e statistiche descrittive usano invece n. Nessuna delle due uscite è interpretabile senza sapere quale convenzione è stata applicata. Le osservazioni devono riferirsi agli stessi intervalli economici: accostare il rendimento europeo di chiusura con quello statunitense di una finestra temporale diversa può introdurre asincronia invece di dipendenza.

Per i prezzi finanziari si stimano normalmente covarianze tra rendimenti o variazioni di P&L coerenti, non tra livelli di prezzo cumulativi. Livelli con trend comuni possono produrre relazioni spurie; rendimenti semplici, logaritmici e P&L monetari rispondono inoltre a domande differenti.


Unità: perché covarianza e correlazione non sono sinonimi

La covarianza conserva il prodotto delle unità delle due variabili. Se X è espresso in punti percentuali e Y in punti percentuali, l'unità è «punti percentuali al quadrato». Se entrambi i rendimenti sono decimali, l'unità è «decimale al quadrato». Un cambio di scala moltiplica il numero anche quando la relazione economica resta identica.

La correlazione elimina tale scala dividendo per le deviazioni standard:

ρₓᵧ = Cov(X,Y) / (σₓ × σᵧ)

Quando σₓ e σᵧ sono positive, ρ è adimensionale e compresa tra −1 e +1. Se una deviazione standard è zero, la correlazione non è definita, mentre la covarianza con la variabile costante è zero. Una correlazione uguale tra due coppie non implica la stessa covarianza: volatilità diverse producono scale di rischio diverse.

Esempio: due rendimenti hanno volatilità 10% e 20% e correlazione 0,25. In notazione decimale la covarianza è:

0,10 × 0,20 × 0,25 = 0,005 decimali²

Espressa in punti percentuali diventa 10 × 20 × 0,25 = 50 punti percentuali². I due numeri descrivono lo stesso caso, con un fattore di scala 10.000. Mescolare una volatilità in decimali con una in percentuale produce un errore di unità, non una diversa opinione sul rischio.


Dalla coppia alla matrice di covarianza

Per p rendimenti raccolti nel vettore R, la matrice di covarianza Σ contiene un elemento per ogni coppia:

Σᵢⱼ = Cov(Rᵢ,Rⱼ)

La matrice è simmetrica perché Cov(Rᵢ,Rⱼ) = Cov(Rⱼ,Rᵢ). Sulla diagonale compaiono le varianze σᵢ²; fuori diagonale compaiono le covarianze. Con due asset:

Σ = (σ₁², σ₁₂; σ₁₂, σ₂²)

Per un vettore di pesi w, in un modello lineare coerente, la varianza del portafoglio è:

σₚ² = wᵀΣw

Con i dati dell'esempio e pesi 60% e 40% si ottiene:

σₚ² = 0,60²×0,10² + 0,40²×0,20² + 2×0,60×0,40×0,005 = 0,0124

La volatilità stimata è quindi √0,0124 ≈ 11,14%. La formula include due volte il termine incrociato perché nella forma matriciale sono presenti entrambe le posizioni simmetriche. Non misura perdite massime, rischio di liquidità o payoff non lineari: descrive la varianza del modello scelto.


Semidefinita positiva non significa invertibile

Una matrice di covarianza valida è semidefinita positiva (PSD):

aᵀΣa ≥ 0   per ogni vettore a

La ragione è economica e matematica: aᵀΣa è la varianza della combinazione lineare aᵀR, che non può essere negativa. PSD non significa necessariamente definita positiva. Una matrice può essere singolare quando una serie è combinazione lineare delle altre, quando vi sono duplicati o quando il numero effettivo di osservazioni è insufficiente rispetto al numero di variabili. In quel caso l'inversa ordinaria non esiste.

Anche una matrice invertibile può essere mal condizionata: piccoli cambiamenti negli input possono generare grandi cambiamenti nei pesi di un'ottimizzazione. L'articolo di Ledoit e Wolf propone uno stimatore shrinkage che combina la matrice campionaria con un target strutturato per ridurre l'errore e migliorare il condizionamento. Shrinkage, modelli fattoriali e regolarizzazione sono scelte di stima da documentare, non riparazioni che rendono i dati «veri».

Se tutte le serie usano lo stesso campione completo e la stessa centratura, la matrice campionaria costruita coerentemente è PSD salvo tolleranze numeriche. Una matrice assemblata con cancellazione a coppie dei dati mancanti può invece usare campioni diversi per elementi diversi e diventare indefinita. Lo stesso problema può derivare da arrotondamenti aggressivi, correlazioni modificate a mano, volatilità prese a date diverse o fusioni tra fornitori. Forzare gli autovalori negativi a zero cambia la stima e richiede una traccia metodologica.


Come cambia con dati, finestra e annualizzazione

Una stima riproducibile dichiara almeno universo, valuta, tipo di rendimento, frequenza, calendario, finestra, trattamento dei dati mancanti, corporate action, outlier e metodo. Per strategie vanno chiariti P&L lordo o netto, notional, collateral e sincronizzazione. Una matrice in valuta locale non è la stessa matrice vista dall'investitore in valuta base: il cambio aggiunge varianza e covarianze.

Finestra breve significa maggiore reattività ma meno osservazioni; finestra lunga riduce parte del rumore campionario ma può mescolare regimi diversi. Rendimenti illiquidi o valutazioni stale possono attenuare artificialmente le covarianze contemporanee. Outlier ed eventi comuni possono dominarle. La scelta non si risolve con una durata universale: dipende dall'orizzonte della decisione e va sottoposta ad analisi di sensibilità.

Moltiplicare una covarianza giornaliera per il numero di periodi annui è coerente solo sotto ipotesi appropriate sull'aggregazione temporale, fra cui l'assenza delle covarianze incrociate ai ritardi rilevanti. In generale la covarianza di rendimenti aggregati include anche termini lead-lag. Serialità, asincronia e autocorrelazione rendono quindi l'annualizzazione lineare una scelta di modello, non un'identità universale.


Limiti interpretativi e controlli

La covarianza misura dipendenza lineare di secondo momento. Non dimostra causalità, non equivale a indipendenza quando vale zero e non descrive da sola relazioni non lineari, asimmetrie o dipendenza nelle code. Può cambiare in periodi di stress proprio quando la diversificazione è più richiesta. Un'unica matrice storica non contiene gap, default, liquidità, impatto, margin call o variazioni del modello di business.

Prima di usarla in costruzione o controllo del portafoglio conviene:

  1. riconciliare unità, valuta, timestamp e definizione dei rendimenti;
  2. riportare dimensione effettiva del campione e regola sui dati mancanti;
  3. verificare simmetria, diagonale, autovalori e condizionamento numerico;
  4. confrontare finestre, frequenze e stimatori alternativi;
  5. affiancare scenari di stress e misure di dipendenza non lineare quando pertinenti;
  6. conservare dati, codice, parametri e data della stima;
  7. separare stima descrittiva, input previsionale e decisione di portafoglio.

Michaud mostra come l'errore negli input possa essere amplificato dall'ottimizzazione; DeMiguel, Garlappi e Uppal valutano fuori campione quanto sia difficile trasformare stime complesse in benefici affidabili. Questi risultati non decretano uno stimatore sempre superiore: richiedono confronto fuori campione, costi e robustezza coerenti con il caso d'uso.

Errore tipico — Leggere una matrice senza unità o costruita con campioni diversi, poi trattarla come previsione stabile. PSD, invertibilità e accuratezza sono proprietà distinte; nessuna soglia universale rende una covarianza “buona” o “cattiva”.


Fonti

Collegamenti