Crash sotto carico GPU: come trovare la causa

Introduzione
PC crasha sotto carico GPU (riavvii, spegnimenti o BSOD) spesso dipende da alimentazione al limite, cavi PCIe, temperature o instabilità RAM/XMP. Qui c’è una diagnosi progressiva: controlli su PSU e connettori, monitoraggio termico, stress test combinati e lettura dei log di Windows, una variabile alla volta.
Sintomi di instabilità della scheda video sotto carico
Per “instabilità sotto carico” intendo un PC desktop che va in crisi quando la GPU, e/o la piattaforma, viene spinta: tipicamente in gioco, benchmark o rendering. Il problema può presentarsi in modi diversi: l’app si chiude, il driver si resetta, il sistema si blocca oppure il PC si riavvia.
Prima di fare prove, conviene distinguere bene il tipo di evento. Cambia molto sia la causa probabile sia cosa ha senso testare per primo.
- Chiusura del gioco o ritorno al desktop con messaggio di driver, spesso con schermo che lampeggia e poi recupera: può indicare un reset legato a un timeout driver GPU.
- Freeze totale, con immagine ferma o nera, input morto e riavvio forzato se il sistema non recupera: può essere instabilità GPU, ma anche memoria/CPU o alimentazione con poco margine. Per questo conviene partire da impostazioni stock e da uno scenario ripetibile.
- Riavvio “secco” senza preavviso, come se mancasse corrente: in questo caso aumenta il peso di alimentazione e transitori.
- Artefatti visivi prima del crash, come puntini, flash, scacchiere o texture corrotte: non trattarlo come “solo crash” generico, gli artefatti scheda video sono un segnale da considerare a parte.
Conta anche il momento in cui succede: se il problema arriva quasi sempre durante una transizione, per esempio caricamento mappa, cambio modalità schermo o avvio di overlay/registrazione, è meno probabile che sia un crash del tutto casuale. Quella ripetibilità può diventare un indizio utile per la diagnosi.
Errori ricorrenti che fanno perdere tempo
Molte diagnosi si allungano perché si mescolano sintomi diversi o si cambiano troppe variabili insieme. Prima di intervenire, evita soprattutto questi errori:
- Confondere micro-scatti o frametime irregolare con instabilità: stuttering e frametime possono essere fastidiosi, ma non implicano per forza crash.
- Dichiarare “stabile” un tuning perché “regge un gioco”: molti profili al limite possono cedere soprattutto in certe API, in certe scene o dopo 10–20 minuti, spesso quando cambi area o fai alt-tab.
- Continuare a forzare carichi dopo due riavvii secchi: può peggiorare la situazione, con file corrotti, peggioramento progressivo o connettori che scaldano.
- Cambiare insieme driver, impostazioni e profili: quando poi “migliora”, non sai cosa lo ha davvero causato.
Cosa annotare (prima di fare prove)
Spesso bastano pochi dati, purché siano precisi e confrontabili. Prima di modificare driver, profili o impostazioni, annota almeno:
- Che tipo di evento è: reset driver, freeze o riavvio secco.
- Quando accade: subito, dopo X minuti, dopo alt-tab, al caricamento di una mappa o al primo avvio.
- Se succede con solo un gioco o con “qualunque carico 3D”.
- Cosa è cambiato di recente: driver, GPU, alimentatore/cavi o tuning, quindi OC/UV.
- Se noti segnali “fisici”: ventole che impennano, odore anomalo o connettori caldi.
- Se dopo l’evento resta un errore dispositivo o un blocco persistente, per esempio Code 43, invece di tornare “pulito”.
STOP (sicurezza): se senti odore di bruciato, noti plastica calda, connettori molto caldi o anneriti, smetti subito di stressare e passa a controlli mirati/assistenza.
Cause di crash e riavvii sotto carico
Di solito il problema non nasce da una sola causa “misteriosa”: spesso rientra in alcune famiglie ricorrenti. Separarle subito aiuta a evitare prove casuali e rende più chiaro cosa controllare.
- Tuning GPU con poco margine (OC/UV): può sembrare stabile in idle/desktop, ma diventare instabile in transizioni di carico o con certe API, spesso si manifesta come crash “random” o freeze improvvisi.
- Limiti termici/hotspot o VRAM al limite: non serve arrivare al thermal shutdown, anche un comportamento oscillante, con frequenza/power “a denti di sega”, può contribuire a instabilità o reset.
- Alimentazione e transitori: PSU al limite, picchi improvvisi o contatti non perfetti possono portare a riavvii secchi, soprattutto quando il carico parte “di colpo”.
- Driver/componenti grafici incoerenti: dopo update, cambio GPU o installazioni ripetute possono diventare instabili solo sotto carico reale.
- Piattaforma instabile (RAM/CPU/IMC): alcune instabilità “silenziose” possono emergere proprio quando anche la GPU mette pressione al sistema.
- Contatto/meccanica: GPU che flette, slot stressato o fissaggio non perfetto, situazione tipica dopo spostamenti del case o trasporti.
Mappa rapida: sintomo → pista da verificare
- Riavvio secco immediato
- Alimentazione/transitori o contatti sono tra le prime piste da verificare.
- Freeze dopo 10–20 minuti
- Termico/power o tuning con poco margine sono compatibili con un cedimento “a caldo”.
- Crash con recupero driver
- Driver/overlay o timeout driver sono tra le ipotesi da controllare.
- Artefatti prima del crash
- Instabilità VRAM/core o temperature fuori controllo diventano piste da considerare con più attenzione.
Casi limite credibili (senza inseguire fantasmi)
Un caso credibile è l’instabilità che compare solo con più monitor/VRR o cambiando frequenza di aggiornamento. Spesso può essere un incastro tra display e driver più che una “GPU guasta”: in questi casi conviene provare a isolare proprio quella combinazione.
Lo stesso vale per l’instabilità che accade solo dopo standby/riattivazione: può essere un mix tra driver e stato energetico. Anche qui conta la ripetibilità, non il numero di “fix provati”.
Controlli pratici per isolare l’instabilità
Qui l’obiettivo è togliere variabili in modo ordinato, senza interventi invasivi. La regola è semplice: cambia una variabile alla volta e ripeti lo stesso scenario. Se tocchi tre cose insieme, perdi la causa e allunghi la diagnosi.
Torna a stock (se c’è qualunque tuning attivo)
Se hai OC/UV o profili automatici aggressivi, tratta prima di tutto l’ipotesi di una GPU instabile dopo OC/UV: una verifica sensata è capire se il problema sparisce a impostazioni stock. Se l’instabilità è comparsa dopo undervolt GPU, trattalo come uno dei sospetti principali anche se “in altri giochi sembra ok”.
Seleziona un solo scenario ripetibile
Scegli un punto o una situazione che fa crashare spesso e resta su quello. Se il comportamento si ripete, spesso bastano meno tentativi e diminuisce il rischio di inseguire falsi indizi.
Temperatura/hotspot: controlla con criterio
Se peggiora dopo alcuni minuti o solo con carico pesante, la lettura corretta delle temperature GPU, insieme alla loro interpretazione, può diventare parte della diagnosi.
Se è iniziato dopo update driver o cambio GPU, evita reinstallazioni sovrapposte
Quando sospetti residui o conflitti, ha più senso ripartire da una reinstallazione pulita e controllata con DDU su Windows.
Se i sintomi assomigliano a un problema di alimentazione, non forzare carichi
Riavvii secchi e crolli improvvisi sotto carico conviene inquadrarli prima lato PSU, transitori, watt e margine dell’alimentatore per GPU. Se sospetti un tema elettrico, per esempio riavvii secchi ripetuti o connettori caldi, è più sicuro ridurre i carichi e passare a verifiche mirate, non aumentare lo stress “per vedere se regge”.
Se serve confermare la stabilità, usa segnali di stop conservativi
Qui conta soprattutto quando fermarsi: primo artefatto nuovo, freeze, reset a catena, odori o rumori anomali. L’obiettivo non è “spingere di più”, ma capire se il sistema resta stabile senza peggiorare la situazione.
STOP (criterio chiaro): se durante le prove compaiono artefatti nuovi, freeze più frequenti, riavvii a catena o rumori/odori anomali, interrompi. Continuare può peggiorare la situazione e aumentare il rischio di danni.
Crash, riavvii e instabilità in casi specifici
- Crash solo in un gioco specifico, altrove è stabile: spesso è un incastro software, quindi shader/patch/impostazioni, o un carico “particolare”. Se tutti gli altri titoli sono solidi, evita conclusioni drastiche.
- Instabilità che compare solo “a caldo” (dopo 10–20 minuti): è coerente con comportamento termico/power o tuning con poco margine che cede col tempo.
- Riavvio secco immediato appena parte un carico pesante: è uno schema molto compatibile con alimentazione/transitori o margine insufficiente.
- Dopo il crash compare un errore dispositivo persistente: se resta un blocco tipo Code 43 o la GPU non torna “pulita” dopo il riavvio, è meglio non trattare il problema come un semplice crash momentaneo.
Come capire se il PC è stabile
Puoi considerare il sistema più credibilmente stabile quando lo stesso scenario che causava il problema resta stabile per più sessioni, non solo una, e quando non compaiono nuovi reset, freeze o riavvii dopo più riavvii del PC e uso normale.
Serve anche uno stress test della GPU ripetibile: sotto carico, il difetto non dovrebbe riemergere. Se “sembra risolto” ma torna solo con una combinazione, per esempio un gioco, una frequenza di aggiornamento o un profilo, quella combinazione è uno dei dati più utili: è lì che la diagnosi va verificata meglio.
Quando fare test incrociati e assistenza
Ha senso passare a escalation quando la diagnosi ordinata non cambia il quadro e il comportamento resta coerente. In particolare, valuta questo passaggio se:
- l’instabilità persiste a stock, con variabili ridotte e criteri ripetibili.
- i riavvii secchi diventano frequenti o peggiorano nel tempo.
- compaiono segnali fisici, come odore anomalo, connettori caldi/anneriti o instabilità “di alimentazione” evidente.
- dopo driver pulito e controlli di contesto il comportamento resta identico e riproducibile.
A quel punto ha senso ragionare per esclusione con test incrociati, cioè altra GPU sul tuo desktop o la tua GPU su un altro desktop. Se la scheda è in garanzia, valuta RMA/assistenza evitando tentativi invasivi o “riparazioni” improvvisate.
