$$\rightleftharpoonup{xx}$$
$$\longleftharp{xx}$$,
$$\longrightharp{xx}$$,
Enrolamento do paciente e determinação da CIE
Um total de 161 pacientes submetidos a procedimentos neurointervencionais foram incluídos neste estudo, dos quais 12 (7,5%) desenvolveram EIC, enquanto 149 (92,5%) não desenvolveram. O processo detalhado de triagem e agrupamento dos pacientes é mostrado na Figura 2. O diagnóstico de EIC foi estabelecido com base na associação temporal entre o início dos sintomas e os procedimentos neurointervencionais, combinada com achados de imagem excluídos. Achados representativos de neuroimagem de EIC são apresentados nas Figuras 3A–D.
As características demográficas, clínicas, laboratoriais e procedimentais basais dos dois grupos são resumidas na Tabela 1. Não foram observadas diferenças significativas entre os grupos CIE e não-CIE em relação à idade, distribuição por sexo ou peso corporal (todos p > 0,05). Da mesma forma, a prevalência de comorbidades comuns, incluindo hipertensão, diabetes mellitus e doença cardíaca coronariana, não diferiu significativamente entre os dois grupos (todos p > 0,05). Fatores relacionados ao estilo de vida, como consumo de álcool e status de tabagismo, também foram comparáveis.
Em contraste, várias variáveis relacionadas ao laboratório e ao procedimento mostraram diferenças significativas entre os dois grupos. Os pacientes do grupo CIE apresentaram níveis séricos significativamente mais elevados de creatinina em comparação com os do grupo sem CIE (mediana: 85,2 versus 65,3 µmol/L, p = 0,004), enquanto seu eGFR foi significativamente menor (mediana: 81 versus 102,7 mL/min/1,73 m2, p < 0,001). Em relação às características do procedimento, os procedimentos de embolização foram significativamente mais frequentes no grupo CIE do que no grupo sem CIE (41,7% versus 2,0%, p < 0,001). Além disso, lesões na circulação posterior foram significativamente mais comuns entre os pacientes que desenvolveram CIE (58,3% versus 6,0%, p < 0,001). Nenhuma diferença significativa foi observada quanto ao tipo de meio de contraste utilizado entre os dois grupos (p = 0,982). Além disso, os pacientes do grupo CIE receberam um volume significativamente maior de agente de contraste durante o procedimento (mediana: 200,0 versus 165,0 mL, p = 0,005) e tiveram durações de procedimento mais longas (mediana: 78,5 versus 50,0 min, p = 0,008). Notavelmente, o CGR, um índice composto proposto neste estudo, foi significativamente maior no grupo CIE em comparação com o grupo sem CIE (mediana: 2,35 versus 1,63, p < 0,001), indicando uma forte associação entre o CGR e a ocorrência de CIE.
Aquisição de variáveis perioperatórias e construção da RCG
As variáveis demográficas, laboratoriais e procedimentais perioperatórias foram sistematicamente coletadas e analisadas conforme descrito no protocolo. Dentre essas variáveis, a RC, definida como a razão entre o volume total de contraste e a TFG, foi construída como um indicador composto que reflete o equilíbrio entre a exposição ao agente de contraste e a capacidade de depuração renal. A RC esteve associada à ocorrência de LEC nesta coorte e foi incluída como preditora candidata nas análises de seleção de características e desenvolvimento de modelos. Para comparar a RC com seus componentes individuais, realizamos uma análise ROC comparativa utilizando a RC, o volume total de contraste e a TFG. A RC apresentou a maior capacidade discriminatória para LEC, com uma AUC de 0,959 (IC 95%: 0,924–0,985), em comparação com o volume total de contraste (AUC = 0,745, IC 95%: 0,559–0,886) e a TFG analisada na direção de risco inverso (AUC = 0,865, IC 95%: 0,764–0,951). A diferença de AUC entre a RC e o volume total de contraste foi de 0,214, e a diferença de AUC entre a RC e a TFG foi de 0,093. Os resultados detalhados estão apresentados na Supplementary Table 4.
Seleção de características e fluxo de trabalho de ML
Para identificar os preditores mais relevantes minimizando a multicolinearidade, foi aplicada regressão LASSO com validação cruzada de 10 dobras às variáveis candidatas. O perfil dos coeficientes e as curvas de validação cruzada do modelo LASSO são apresentados em Figura 4A e Figura 4B, respectivamente. A classificação dos coeficientes LASSO do modelo final é apresentada na Figura 5. No valor ótimo de λ, um subconjunto de variáveis foi mantido, incluindo CGR, tipo de procedimento, localização da lesão, níveis de triglicerídeos, creatinina sérica, TFG e vários covariáveis clínicos. A classificação quantitativa dos preditores mantidos com base nos coeficientes LASSO é fornecida em Tabela Suplementar 5.
Comparações do desempenho do modelo
Cinco abordagens de ML — Naive Bayes, SVM, KNN, LightGBM e MLP — foram desenvolvidas para prever o risco de CIE. O desempenho nos conjuntos de treinamento e teste é resumido na Tabela 2, a comparação de precisão dos cinco modelos é mostrada na Figura 6, e as matrizes de confusão correspondentes são fornecidas nas Figura Suplementar 1, Figura Suplementar 2, Figura Suplementar 3, Figura Suplementar 4 e Figura Suplementar 5. Como o conjunto de dados era marcadamente desequilibrado, com 12 casos de CIE e 149 casos sem CIE, a precisão e as métricas baseadas em limiar devem ser interpretadas com cautela e em conjunto com sensibilidade, especificidade, AUC e intervalos de confiança. No conjunto de treinamento, todos os modelos exibiram boa capacidade discriminatória, com valores de AUC variando de 0,961 a 0,999. No conjunto de teste interno, o modelo Naive Bayes apresentou o valor numérico mais alto (AUC = 0,952, IC 95%: 0,843–1,000), seguido pelo LightGBM (AUC = 0,944, IC 95%: 0,822–1,000) e pelo SVM (AUC = 0,935, IC 95%: 0,796–1,000).
No limiar de classificação ótimo determinado pelo índice de Youden, o modelo Naive Bayes apresentou sensibilidade de 100% e especificidade de 90,3%. Como comparações estatísticas formais pareadas entre as AUCs dos modelos não foram realizadas, as diferenças observadas entre os modelos devem ser interpretadas como descritivas e exploratórias. Além disso, como o conjunto de dados era acentuadamente desequilibrado e a coorte de teste interna era pequena, com apenas um número muito limitado de eventos de CIE, métricas baseadas em limiar, como sensibilidade e especificidade, podem ser instáveis e devem ser interpretadas com cautela. As curvas da característica de operação do receptor (ROC) do modelo Naive Bayes nos conjuntos de treinamento e teste são apresentadas na Figura 7.
Embora o modelo MLP tenha apresentado bom desempenho no conjunto de treinamento (AUC = 0,961), seu desempenho diminuiu substancialmente no conjunto de teste (AUC = 0,742), sugerindo possível sobreajuste. De forma semelhante, o modelo KNN demonstrou capacidade discriminatória limitada no conjunto de teste (AUC = 0,718), com um intervalo de confiança amplo, indicando instabilidade. A estratégia baseada no índice de Youden foi utilizada para determinar o limiar ótimo de classificação para métricas dependentes de limiar, incluindo sensibilidade, especificidade e acurácia. Os próprios valores de ROC-AUC são independentes de limiar. Portanto, as métricas de desempenho dependentes de limiar relatadas refletem o comportamento do modelo no ponto operacional ótimo. Os limiares ótimos de Youden e as métricas correspondentes baseadas em limiar estão apresentados na Tabela Suplementar 6. De modo geral, o modelo Naive Bayes mostrou desempenho descritivo relativamente estável entre os conjuntos de treinamento e de teste interno, com declínio numérico mínimo na AUC.
Análise da curva de decisão
A ADC foi realizada para avaliar a utilidade clínica dos modelos em uma variedade de probabilidades de limiar. As curvas de ADC são apresentadas na Figura 8. Todos os modelos demonstraram benefício líquido positivo em faixas específicas de probabilidades de limiar, comparados às estratégias de tratar-todos e não-tratar-ninguém. Dentre os modelos avaliados, SVM apresentou a faixa mais ampla de benefício líquido positivo, enquanto os demais modelos também mostraram potencial utilidade clínica dentro de faixas de limiar específicas.
DISPONIBILIDADE DE DADOS:
Os dados brutos desidentificados utilizados para apoiar as principais análises foram enviados ao GitHub e estão disponíveis em: https://doi.org/10.5281/zenodo.20043331. Todos os identificadores diretos dos pacientes foram removidos antes do compartilhamento dos dados. Como este foi um estudo clínico retrospectivo baseado em prontuários hospitalares, o acesso a quaisquer informações adicionais em nível de paciente permanece restrito por exigências institucionais de ética e privacidade. Dados adicionais desidentificados podem ser disponibilizados pelo autor correspondente mediante solicitação razoável e com aprovação do comitê de ética institucional. Os scripts de análise estatística, o código de treinamento do modelo de aprendizado de máquina (ML) e o código de geração de figuras foram fornecidos como arquivos suplementares para apoiar a reprodutibilidade.

Figura 1: Fluxo de trabalho da modelagem de risco de EIC com base em dados perioperatórios. (A) Mecanismos da EIC e derivação da razão entre volume de contraste e TFG estimado (RTC). (B) Integração de dados e seleção de características baseada em LASSO. (C) Desenvolvimento e comparação de modelos de ML, com Naive Bayes apresentando a maior AUC numérica no conjunto de teste interno (AUC ≈ 0,95). Abreviaturas: EIC = encefalopatia induzida por contraste; RTC = razão entre volume de contraste e TFG estimado; TFG = taxa de filtração glomerular estimada; AUC = área sob a curva. A figura foi elaborada a partir dos dados clínicos dos autores, e a ilustração esquemática foi originalmente criada pelos autores utilizando ícones modificados do Microsoft PowerPoint. Clique aqui para visualizar uma versão maior desta figura.

Figura 2: Seleção dos pacientes e alocação da coorte. Fluxograma ilustrando a triagem dos pacientes, avaliação de elegibilidade, critérios de exclusão e atribuição da coorte. Um total de 225 pacientes foram inicialmente avaliados. Após a aplicação dos critérios de inclusão, incluindo idade entre 30 e 80 anos, disponibilidade de dados clínicos completos e tomografia computadorizada de crânio pós-operatória dentro de 3 dias, 190 pacientes foram considerados elegíveis. Os pacientes foram excluídos com base em infarto cerebral agudo, doença renal crônica estágio ≥ G4 (eGFR < 30 mL/min/1.73 m2), doença cardiovascular grave, ausência de tratamento endovascular, déficit neurológico grave (escore da Escala de Rankin Modificada ≥ 4) ou dados incompletos. Finalmente, 161 pacientes foram incluídos e divididos aleatoriamente entre a coorte de treinamento (n = 128) e a coorte de teste interna (n = 33) em uma proporção de 8:2. Abreviaturas: CT = tomografia computadorizada; eGFR = taxa de filtração glomerular estimada; CKD = doença renal crônica; mRS = Escala de Rankin Modificada. Clique aqui para visualizar uma versão maior desta figura.

Figura 3: Imagens seriadas de tomografia sem contraste em um paciente com EIC. (A) Tomografia basal antes do procedimento. (B) Tomografia no início dos sintomas mostrando hiperdensidade cortical no lobo parietal direito (seta). (C) Tomografia no primeiro dia pós-operatório mostrando resolução parcial. (D) Tomografia no segundo dia pós-operatório mostrando maior resolução. Clique aqui para visualizar uma versão maior desta figura.

Figura 4: Seleção de características baseada em LASSO. (A) Curva de validação cruzada com dez dobras utilizada para determinar o valor ótimo de λ com base no MSE mínimo. (B) Perfis dos coeficientes das variáveis candidatas plotados em função de log(λ), mostrando as alterações nos coeficientes das variáveis com o aumento da intensidade da regularização. Abreviações: LASSO = operador de redução e seleção por mínima absoluta; λ = parâmetro de regularização; MSE = erro quadrático médio. Clique aqui para visualizar uma versão maior desta figura.

Figura 5: Coeficientes das variáveis selecionadas. Gráfico de barras mostrando os coeficientes das variáveis mantidas após a seleção por LASSO. Coeficientes positivos indicam associação positiva; coeficientes negativos indicam associação inversa. Clique aqui para visualizar uma versão maior desta figura.

Figura 6: Precisão no treinamento e no teste dos cinco modelos de ML. Precisão de cinco modelos de ML (Naive Bayes, SVM, KNN, LightGBM, MLP) nos conjuntos de treinamento e teste. Abreviações: SVM = máquina de vetores de suporte; KNN = k-vizinhos mais próximos; LightGBM = máquina de reforço gradiente leve; MLP = perceptron multicamadas. Clique aqui para visualizar uma versão maior desta figura.

Figura 7: Curvas ROC do modelo Naive Bayes. Curvas da característica operacional do receptor para as coortes de treinamento e teste interno, com os respectivos valores da área sob a curva. Abreviações: ROC = característica operacional do receptor; AUC = área sob a curva. Clique aqui para visualizar uma versão maior desta figura.

Figura 8: Análise de curva de decisão. DCA mostrando o benefício líquido de diferentes modelos ao longo de probabilidades de limiar, comparado às estratégias de tratar-todos e não-tratar-ninguém. Regiões sombreadas indicam faixas de probabilidade de limiar nas quais o modelo obteve benefício líquido positivo em comparação com as estratégias de tratar-todos e não-tratar-ninguém. Abreviações: DCA = análise de curva de decisão. Clique aqui para visualizar uma versão maior desta figura.
Figura Suplementar 1: Matriz de confusão do modelo Naive Bayes na coorte de teste interna. A matriz exibe os números de amostras correta e incorretamente classificadas no limiar de classificação selecionado.Clique aqui para baixar este arquivo.
Figura Suplementar 2: Matriz de confusão do modelo SVM na coorte de teste interna. A matriz exibe os números de amostras corretamente e incorretamente classificadas no limiar de classificação selecionado.Clique aqui para baixar este arquivo.
Figura Suplementar 3: Matriz de confusão do modelo KNN na coorte de teste interna. A matriz exibe os números de amostras corretamente e incorretamente classificadas no limiar de classificação selecionado.Clique aqui para baixar este arquivo.
Figura Suplementar 4: Matriz de confusão do modelo LightGBM na coorte de teste interna. A matriz exibe os números de amostras classificadas correta e incorretamente no limiar de classificação selecionado.Clique aqui para baixar este arquivo.
Figura Suplementar 5: Matriz de confusão do modelo MLP na coorte de teste interna. A matriz exibe os números de amostras classificadas correta e incorretamente no limiar de classificação selecionado.Clique aqui para baixar este arquivo.
| Característica | CIE (n = 12) | Não-CIE (n = 149) | valor p |
| Dados demográficos | | | |
| Idade (anos), mediana (IQR) | 67 (62,5–69,0) | 63 (55,0–70,0) | 0,194 |
| Masculino, n (%) | 9 (75,0) | 105 (70,5) | 1,000 |
| Peso (kg), mediana (IQR) | 65 (55,0–70,0) | 70 (60,0–77,5) | 0,160 |
| Comorbidades, n (%) | | | |
| Hipertensão | 7 (58,3) | 102 (68,5) | 0,526 |
| Diabetes | 4 (33,0) | 57 (38,3) | 1,000 |
| Doença arterial coronariana | 2 (16,7) | 23 (15,4) | 1,000 |
| Hábitos, n (%) | | | |
| Uso de álcool | 7 (58,3) | 78 (52,3) | 0,770 |
| Tabagismo | 7 (58,3) | 59 (39,6) | 0,233 |
| Valores laboratoriais, mediana (IQR) | | | |
| Creatinina sérica (μmol/L) | 85,2 (65,0–89,0) | 65,3 (54,9–75,7) | 0,004 |
| TFG estimado (mL/min/1,73m²) | 81,0 (60,6–90,3) | 102,7 (89,0–116,3) | <0,001 |
| Colesterol total (mmol/L) | 3,3 (3,0–4,4) | 3,4 (2,9–4,1) | 0,775 |
| Triglicerídeos (mmol/L) | 1,8 (1,2–2,1) | 1,2 (0,8–1,6) | 0,017 |
| Características do procedimento | | | |
| Tipo de procedimento, n (%) | | | <0,001 |
| - Angioplastia com stent | 7 (58,3) | 146 (98,0) | |
| - Embolização | 5 (41,7) | 3 (2,0) | |
| Localização da lesão, n (%) | | | <0,001 |
| - Circulação posterior | 7 (58,3) | 9 (6,0) | |
| - Circulação anterior | 5 (41,7) | 140 (94,0) | |
| Tipo de meio de contraste, n (%) | | | 0,982 |
| - 2ª geração | 6 (50,0) | 75 (50,3) | |
| - 3ª geração | 6 (50,0) | 74 (49,7) | |
| Volume total de contraste (mL), mediana (IQR) | 200 (188,0–200,0) | 165 (155,0–180,0) | 0,005 |
| Duração do procedimento (min), mediana (IQR) | 78,5 (52,5–124,5) | 50 (47,0–57,0) | 0,008 |
| Índice novo | | | |
| CGR, mediana (IQR) | 2,35 (2,17–2,70) | 1,63 (1,40–1,85) | <0,001 |
Tabela 1: Características clínicas basais dos pacientes. As características demográficas, clínicas, laboratoriais e relacionadas aos procedimentos dos pacientes foram comparadas entre os grupos com EIC e sem EIC. As variáveis contínuas são apresentadas como média ± desvio padrão ou mediana (intervalo interquartil), e as variáveis categóricas são apresentadas como número e porcentagem. As comparações estatísticas entre os grupos foram realizadas utilizando testes paramétricos ou não paramétricos apropriados. Abreviações: EIC = encefalopatia induzida por contraste; eGFR = taxa de filtração glomerular estimada; CGR = razão entre volume de contraste e eGFR; IQR = intervalo interquartil; SD = desvio padrão.
| Nome do modelo | Exatidão | AUC | IC 95% | Sensibilidade | Especificidade | Conjunto de dados |
| Naive Bayes | 0,875 | 0,961 | 0,924–0,998 | 1,0 | 0,864 | treinamento |
| Naive Bayes | 0,909 | 0,952 | 0,843–1,000 | 1,0 | 0,903 | teste |
| SVM | 0,992 | 0,999 | 0,997–1,000 | 1,0 | 0,992 | treinamento |
| SVM | 0,879 | 0,935 | 0,796–1,000 | 1,0 | 0,871 | teste |
| KNN | 0,891 | 0,969 | 0,941–0,997 | 1,0 | 0,881 | treinamento |
| KNN | 0,939 | 0,718 | 0,194–1,000 | 0,5 | 0,968 | teste |
| LightGBM | 0,969 | 0,988 | 0,973–1,000 | 1,0 | 0,966 | treinamento |
| LightGBM | 0,848 | 0,944 | 0,822–1,000 | 1,0 | 0,839 | teste |
| MLP | 0,914 | 0,961 | 0,908–1,000 | 0,9 | 0,915 | treinamento |
| MLP | 0,970 | 0,742 | 0,228–1,000 | 0,5 | 1,000 | teste |
Tabela 2: Comparação do desempenho dos modelos. O desempenho preditivo de diferentes modelos de ML foi avaliado utilizando acurácia, área sob a curva (AUC), intervalo de confiança de 95% (IC), sensibilidade e especificidade nos conjuntos de dados de treinamento e de teste interno. Abreviações: IC = intervalo de confiança.
Tabela Suplementar 1: Resumo da avaliação de dados ausentes antes do desenvolvimento do modelo. Resumo dos valores ausentes para todas as variáveis preditoras candidatas antes do desenvolvimento do modelo. Não foram observados valores ausentes entre as variáveis incluídas; portanto, nenhuma imputação foi realizada.Clique aqui para baixar este arquivo.
Tabela Suplementar 2: Dicionário de variáveis do conjunto de dados analítico. Definições, métodos de codificação, categorias de variáveis e descrições das variáveis clínicas, laboratoriais e relacionadas a procedimentos incluídas na análise de ML.Clique aqui para baixar este arquivo.
Tabela Suplementar 3: Espaço de busca de hiperparâmetros e parâmetros selecionados para modelos de ML. Resumem-se os intervalos candidatos de hiperparâmetros e os parâmetros otimizados obtidos durante o ajuste do modelo para cada algoritmo de ML.Clique aqui para baixar este arquivo.
Tabela Suplementar 4: Análise comparativa ROC da CGR e de seus componentes individuais. Foi realizada uma análise de característica operacional do receptor para comparar o desempenho preditivo da CGR e de seus componentes individuais na previsão de CIE.Clique aqui para baixar este arquivo.
Tabela Suplementar 5: Classificação das características quantitativas com base nos coeficientes LASSO. As variáveis selecionadas foram classificadas de acordo com seus valores de coeficiente após a regressão LASSO, mostrando a contribuição relativa e a direção da associação de cada variável no modelo preditivo.Clique aqui para baixar este arquivo.
Tabela Suplementar 6: Limites de Youden determinados na coorte de treinamento e respectivas métricas de desempenho de classificação. O limite ideal para cada modelo foi determinado exclusivamente na coorte de treinamento utilizando o índice de Youden e posteriormente fixado e aplicado à coorte de teste interna. A acurácia, sensibilidade e especificidade na coorte de teste interna foram calculadas utilizando esses limites fixos.Clique aqui para baixar este arquivo.