方法文章

一种可重复的人工智能辅助增强数字化历史神经解剖学插图的实验方案

DOI:

10.3791/72309

2026年8月7日

本文内容

摘要

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

本文介绍了一种可重复且经过质量控制的人工智能辅助数字化历史神经解剖学插图增强工作流程。该方案定义了源图像的选择、提取、文件标准化、本地超分辨率处理、原始图像与增强图像配对归档、技术质量控制审查,以及对可接受和次优输出结果的记录。

摘要

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

数字化的历史神经解剖学图谱是解剖学教育、历史学术研究和数字存档的宝贵资源。然而,由于表观分辨率低、褪色、纸张变色、压缩伪影,以及精细解剖线条或标签的可读性降低,这些图谱在教学材料和学术展示中的实际应用常常受到限制。人工智能辅助的超分辨率技术可提升这些数字化复制品的视觉可用性,但不受控的增强可能引入人工纹理、线条连续性改变、标签扭曲,或生成在源图像中并无依据但视觉上看似合理的内容。因此,在对历史科学插图应用人工智能辅助增强时,必须采用标准化且透明的操作流程。

本文介绍了一种逐步优化数字化历史神经解剖学插图的标准化工作流程。该方案包括源图像选择、来源与使用权限记录、图像提取、保守性预处理、采用固定参数进行局部超分辨率增强、原始图像与增强图像配对归档、基于感兴趣区域的检查,以及结构化的技术质量控制文档记录。该工作流程旨在提升图像在教学、展示和初步视觉观察中的可视性,同时确保每一幅增强后的图像与其原始数字化版本之间保持直接且可追溯的解读关联。

该方法应被视为对扫描数字复制品的辅助性增强,而非对原始艺术品的修复、历史资料的认证或丢失解剖信息的恢复。原始版本与增强版本必须共同归档,且在使用前应对增强结果进行审查,以排除可能的人工伪影。本方案提供了一种实用、低成本且可重复的方法,用于将历史神经解剖学图像制备为成对的对照可视化资料,同时保持对解剖学和历史真实性的审慎态度。

引言

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

历史神经解剖学插图在神经系统视觉记录、教学与解读中发挥了重要作用。在现代神经影像技术发展之前,解剖图谱是传播大脑、脑室、颅神经、血管结构及脑干解剖学观察结果的主要媒介1,2,3。如今,许多此类著作可通过数字化图书、扫描档案馆藏以及在线资源库获取。然而,数字化历史插图在现代教学、演示和数字存档中的直接应用常受限于分辨率低、褪色、纸张变色、压缩伪影、扫描导致的模糊,以及精细线条或标签可读性下降等问题4,5,6,7,8

人工智能辅助的图像增强与超分辨率方法为改善退化或低分辨率数字化图像的视觉可用性提供了切实可行的机遇。基于深度学习的超分辨率算法能够提高图像的表观分辨率、增强边缘定义,并减少数字图像中的扫描相关性视觉退化9,10,11,12。对于历史神经解剖学插图,此类方法可能有助于清晰呈现原始数字化复制品中难以辨识的细微解剖线条、标注及结构边界。然而,对历史解剖图像的处理需格外谨慎。这些插图不仅是视觉教学材料,更是科学与历史文献。增强处理虽可提升清晰度,但若缺乏标准化工作流程,也可能改变线条纹理、过度强化边缘、修改明暗阴影,或生成虚假细节。

因此,对历史解剖学插图的人工智能辅助增强应作为受控的技术流程进行,而非无限制的图像处理。一个可重复的实验方案应明确说明源图像的选择方法、来源与使用状态的记录方式、图像的提取与标准化流程、所采用的增强参数设置、输出文件的归档方式,以及增强图像如何进行可能伪影的检查。在整个工作流程中,原始版本与增强版本应始终保持关联,以确保增强后的图像始终被理解为经过处理的数字复制品,而非修复后的或具有历史原始性的图像。

采用标准化工作流程优于临时的人工智能辅助增强,因为它能在图像处理前明确源图像选择、保守性预处理、固定增强参数、原始图像与增强图像配对存档以及增强后的质量控制。预期的最终用户包括解剖学家、神经外科医生、医学教育工作者、解剖学史研究者、医学插画师和数字档案使用者,这些用户在需要视觉上清晰可辨的配图副本的同时,仍需保持对原始资料的直接访问。

本文介绍了一种对数字化历史神经解剖学插图进行人工智能辅助增强的分步操作方案。核心图像处理流程包括图像准备、固定16×超分辨率增强及PNG格式导出,详见图1。后续操作步骤涵盖原始图像与增强图像的配对存档、增强后的质量控制、基于感兴趣区域的视觉检查,以及对成功与非理想结果的记录。本方案并非旨在宣称恢复原始艺术作品或重建已丢失的解剖学信息,而是旨在提升数字化复制品的视觉可读性,同时保持增强图像与原始来源之间的可解释性关联。

方案

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

本方案仅适用于数字化的历史神经解剖学插图,未涉及人类受试者、患者数据、动物实验、生物样本或可识别的个人信息,因此无需机构审查委员会对涉及人类受试者的研究进行审批。所有图像均来自公共领域、已获授权或适当许可的历史资料。

1. 来源使用注意事项

  1. 处理前核实每幅图像的来源信息,包括历史作者、来源标题、大致出版年份以及数字资源来源。
  2. 将增强后的输出结果视为经过处理的数字复制品,而非复原的原始艺术作品,也不作为已恢复丢失解剖学信息的证据。
  3. 将原始文件与增强文件一并归档,以便始终能够将处理后的图像与原始图像进行直接比较。

2. 数字化历史神经解剖学插图的选择

  1. 选取16至19世纪出版的数字化历史插图。
  2. 包含描绘神经解剖结构的插图,例如大脑、大脑半球、脑回与脑沟、脑室系统、脑干、颅神经、脑血管系统或相关神经系统解剖结构。
  3. 仅纳入来源可追溯且属于公共领域或可合法重用的图像。须确认每幅选定插图的出版时间在16至19世纪之间,并在纳入前逐一核实其来源信息与可重用状态。
  4. 排除重复图像、严重裁剪的图像、不完整的图版、现代重绘的复制品,或来源信息不清晰的图像;包括当存在更高清版本时长轴分辨率低于约1,000像素的源文件、缺失或裁剪导致解剖内容损失超过约20%的图像、所选区域内标签无法辨认的图像、存在严重压缩伪影,或因扫描质量问题导致无法与原始图像进行比对的图像。
  5. 通过比较历史作者、来源书名、出版年份、图版或页码(如可获取)、收藏机构元数据以及视觉内容,识别重复插图。当存在多个扫描版本时,保留分辨率更高、图版边界更完整、标签更清晰的版本。
  6. 在处理前为每幅纳入的图像分配唯一的文件标识。
  7. 在整个工作流程中保留每幅图像的原始版本与增强版本配对。

3. 从数字化资源中提取图像

  1. 使用可获得的最高质量版本打开数字化源文件。
  2. 通过从源便携式文档格式(PDF)文件中导出,或在无法直接导出时从数字源中截取,获取每幅目标插图。
  3. 对于基于PDF的图像提取,使用PDF阅读器或导出软件;仅在无法直接导出时使用标准屏幕截图工具。
  4. 对于基于PDF的提取,应优先采用原始嵌入图像的分辨率,并在导出过程中避免降采样;对于基于截图的提取,应将源文件以100%或200%的放大倍率显示,并记录显示分辨率、放大倍率、显示器缩放设置以及最终截图的尺寸。
  5. 根据源文件的可用性及提取方法,将提取的图像保存为联合图像专家组(JPEG)或便携式网络图形(PNG)格式。
  6. 在提取过程中应尽可能保留完整的解剖插图;若无法保留完整插图,则应用第2.4步中的排除标准,并记录裁剪情况。
  7. 若标签和具有历史意义的标记属于主插图的一部分,则应予以保留;在提取过程中不得手动重绘、重新着色、重建或修整解剖结构。

4. 增强前的预处理与文件标准化

  1. 在增强之前,逐一审阅每张提取的图像。
  2. 仅裁剪无信息内容的外边距或空白周围区域。除裁剪外,不得进行其他手动视觉校正。 特别是,在增强前不得应用手动锐化、去噪、重新着色、重绘、选择性清理或解剖结构修饰。
  3. 仅使用图像编辑软件进行保守的图像裁剪和简单的版面准备。不得进行解剖结构修饰。
  4. 在增强前,将原始图像保留为原始参考文件。在处理前不要强制将原始图像的尺寸和分辨率统一为单一的像素尺寸,因为不同历史图版的原始来源尺寸各不相同。
  5. 在进入人工智能辅助增强之前,确认每个预处理文件仍然是原始来源图像的忠实数字化复制品。

5. 人工智能辅助增强

  1. 在本地安装的基于人工智能的图像超分辨率软件中打开标准化输入图像。
  2. 除非特别需要批量处理,否则使用单图像处理模式。
  3. 使用选择图像功能选定输入图像。
  4. 在处理前选择一个固定的超分辨率模型或预设,并对所有包含的图像使用相同的模型。
  5. 将图像缩放倍数设置为16倍,以复现本工作流程中使用的固定设置,并记录默认软件参数未被手动修改。不得将所选缩放倍数解释为优于其他缩放因子的优化或更优设置。
  6. 对所有包含的图像使用相同的增强设置,以保持工作流程中的一致性。
  7. 将输出文件夹设置为与输入图像相同的目录,或设置为预定义的项目输出文件夹;在可能的情况下使用独立的输出目录,以防止意外覆盖原始文件。
  8. 在配备第13代16核24线程移动中央处理器、具有8 GB显存的独立笔记本显卡以及32 GB内存的计算机上执行增强处理。在图像处理期间启用图形处理器(GPU)加速,使每幅图像的处理时间缩短至约3分钟,具体时间取决于输入图像的尺寸。
    注意:软件及模型文件本地安装完成后,无需互联网连接。
  9. 使用软件的增强或开始处理命令运行增强过程。
  10. 以PNG格式导出增强后的输出图像。
  11. 尽可能保留软件自动生成的输出文件名,或分配一个结构化的文件名,记录源图像标识、增强倍数和输出格式。
    注意在AI增强后,不得手动重绘、修饰、重新着色或选择性修正解剖细节。
  12. 将增强后的PNG文件与原始基线图像一并归档保存。

6. 增强后质量控制审查

  1. 将每张增强图像与其对应的原始图像同时打开。确认增强文件已完整生成,且未发生文件损坏或导出不完整的情况。
  2. 在低倍和高倍放大下比较增强图像与原始图像。检查增强效果是否改善了线条、解剖轮廓、标签及扫描细节的可见性。
  3. 应用结构化的技术质量控制清单。该清单为记录步骤,而非正式的专家评分验证研究。
  4. 特别检查输出结果中是否存在以下与增强相关的问题:人工纹理生成;过度锐化,包括细线变粗、纸张纹理过度突出或边缘比原始图像更明显;文字或标签变形;原本分离的线条之间出现虚假连接;细小解剖线条增粗;纸张纹理过度增强;以及在原始图像中无明确依据的结构出现。
  5. 将每项输出结果分类为技术上可接受或次优。
    1. 若解剖轮廓、标签和历史标记在视觉上与原始数字化图像保持一致,则视为技术上可接受。
    2. 若增强导致出现误导性纹理、文字变形、人工线条生成或对历史外观过度修改,则视为次优。当次优结果能够体现方法局限性时,应予以保留以供记录。
  6. 不得用增强图像替换原始图像。增强图像仅作为处理后的辅助版本使用。

7. 配对比较的感兴趣区域选择

  1. 在原始图像和增强后的完整图像归档后,从每对图像中手动选择一个或多个具有代表性的感兴趣区域(ROIs)。选择能够体现增强对神经解剖可视化实际效果的区域。优先选择包含视觉上复杂或具有丰富深度解剖细节的区域,例如脑室结构、脑回与脑沟、血管线条、脑干轮廓、颅神经相关细节或小型标签。避免仅选择视觉效果最佳的区域;应包含能公正反映增强方法优势与局限性的区域。
  2. 针对每个选定区域,使用相同的比例坐标从原始图像和增强图像中裁剪出相同的解剖区域。若因图像尺寸不同而无法精确匹配坐标,需记录所做的调整。ROI 的大小应约为图像宽度和高度的 10%–20%,仅在必要时调整大小,以确保两个图中均包含相同的解剖结构或标签。
  3. 确保原始图像和增强图像的 ROI 图块显示相同的解剖视野。裁剪后不得对 ROI 图块进行额外的锐化、对比度调整或手动校正。
  4. ROI 图块仅用于直观展示增强效果,不得作为独立的专家评分材料使用。

8. 代表性图像的制备

  1. 准备一张工作流程图,概括完整的实验方案。
  2. 准备具有代表性的配对图像图,展示原始版本与增强版本。
  3. 对于每张代表性图像图,尽可能采用四图面板结构:将原始数字化插图置于图A;AI增强后的插图置于图B;原始图像中感兴趣区域(ROI)的放大图置于图C;增强图像中对应位置的放大ROI置于图D。
  4. 在配对的原始-增强图面板中,保持一致的面板间距、对齐方式、面板标签和放大倍数。使用标准无衬线字体,字号统一且清晰可读,并记录所选字体及字号。
  5. 仅在必要时使用箭头或箭头标记,以指示特定线条、标签或伪影;不得添加暗示原始图像中不可见的解剖学解释的箭头。
  6. 仅当源图像提供可靠空间校准时,才添加比例尺。对于无有效空间比例的历史图版,不得添加比例尺。
  7. 在准备配对的原始与增强图面板时,不得进行任何额外的亮度或对比度调整。图像导出分辨率为300 dpi;若精细线条或标签需要更高分辨率显示,则导出为600 dpi。
  8. 应包含来自不同历史资料的示例,以证明该工作流程可适用于多种绘图风格和扫描质量。至少提供一个增强效果不理想的示例(如出现人工纹理或文字扭曲),以展示该方法的局限性。
  9. 将图像分别导出为高质量的PDF、TIFF或JPEG文件,且不嵌入图注。导出PDF时,应保持源图像尺寸,避免下采样或有损压缩。
  10. 图注仅在稿件文件中提供。
  11. 提交前须检查所有图像面板的裁剪、分辨率及面板完整性。

9. 文档记录与数据管理

  1. 将每张图像的原始版本和增强版本作为配对文件存储,确保每个增强后的输出均可追溯到其对应的源图像。
  2. 记录每幅插图的来源数据库,包括档案或数据库名称、稳定 URL 或登录号信息(如可获取)、重用状态以及访问日期。
  3. 记录每张图像的处理方法,包括提取方法、预处理步骤、增强软件、软件版本、所选模型、放大倍数、输出格式和最终文件名。
  4. 记录每张图像是否通过 PDF 导出或屏幕截图获取,裁剪是否仅限于无信息的页边空白,以及增强是否使用了固定的 16 倍超分辨率设置。
  5. 尽可能保留软件生成的输出文件名,或分配结构化的文件名,以记录源图像标识、增强倍数和输出格式。
  6. 记录每张增强图像在技术上是否可接受或存在不足。不足的情况可能包括人工纹理生成、过度锐化、标签失真或视觉上误导的线条变化。

结果

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

文稿中的图示提供了代表性原始图像与增强图像的对比。本研究中包含的40幅历史插图,每幅的出版日期、来源出处、资料库信息及重用状态均经过核实并予以记录。

图像数据集与来源特征
本方案应用于40幅数字化的历史神经解剖学插图。在纳入前,每幅插图的出版日期、来源及可重用状态均经过 individually 核实,所有选入的插图均来自16至19世纪期间出版的著作。所包含的插图涵盖了多种神经解剖学主题,包括大脑皮层表面解剖、大脑脑回与脑沟、脑室结构、脑干区域、颅神经相关解剖以及血管特征。这些图像来源于公共领域、已获授权或允许重用的数字化历史资料;所有40幅插图的资料库信息及重用状态均已 individually 记录。

原始数字化复制品显示出历史资料中常见的局限性,包括表观分辨率低、线条褪色、背景变色、扫描相关的模糊、压缩伪影以及微小标签的可读性降低。这些局限性为应用标准化增强工作流程提供了实际的测试案例。原始未增强图像被保留为基线文件,并在整个工作流程中与其对应的增强后输出图像配对使用。

增强工作流程的技术输出
所有40幅基线图像均使用同一款本地安装的AI辅助图像超分辨率软件,并采用固定的增强设置进行处理。所有纳入的图像均一致应用了16倍超分辨率预设,增强后的输出结果以PNG格式导出。在增强前后,未进行任何手动重绘、重新着色、选择性校正或解剖结构修饰。处理过程在一台配备第13代16核24线程移动中央处理器、具有8 GB显存的独立笔记本显卡以及32 GB内存的计算机上完成,并启用了显卡加速。每幅图像的处理时间约为3分钟,具体时长取决于输入图像的尺寸。

增强后的图像通常表现出更明显的清晰度、更清晰的线条定义、解剖线条与背景之间更清晰的区分,以及微小解剖结构或文字细节的可见性提高。这些效果在墨迹褪色、对比度低或存在扫描相关模糊的图像中尤为显著。此类增强被视为对数字化复制品进行的技术处理,而非对原始历史艺术作品的修复。

该工作流程的一个实际限制是输出文件大小显著增加。在某些情况下,约1 MB的文件在16倍增强后增大至超过200 MB。因此,在将该工作流程应用于更大规模图像集合时,应考虑存储容量、文件管理和图像准备。

具有代表性的成功增强效果
成对的代表性示例展示了本方案对来自不同来源和历史时期的神经解剖学插图的实际增强效果(图2图3图4图5)。在成功案例中,增强后的图像显示出更清晰的解剖轮廓、更连续的精细线条,以及对复杂区域(包括大脑皮层脑回、脑室结构、血管线条和脑干相关细节)的可视性显著提升。

成对图像的格式便于直接比较原始版本与增强版本。在低倍放大下,最明显的改进体现在整体清晰度、对比度和可读性方面。在高倍放大下,线条连续性、边缘定义以及小标签的可见性差异变得更加明显。匹配的兴趣区域有助于展示增强处理对解剖学相关细节的局部影响。

在所有情况下,原始图像对于解读仍然至关重要。因此,增强后的图像应作为原始历史资料的辅助处理图像呈现,而不应取代原始资料。

次优增强效果与质量控制发现
尽管该工作流程在大多数代表性示例中产生了技术上可接受的结果,但在质量控制审查过程中仍观察到若干局限性。在某些图像中,增强过程增加了人工纹理,夸大了纸张纹理,或扭曲了小号文字和标签。在其他情况下,细线显得过度锐化或在视觉上比原始图像更粗。

这些次优结果更可能出现在基线退化严重、源分辨率低、标记密集或纸张纹理明显的图像中。这些发现凸显了在图像增强后需与原始图像进行直接比较的必要性。同时,在将增强后的图像用于教学材料、演示文稿或学术插图之前,应实施质量控制步骤。本结构化评审被用作技术质量控制文档,而非正式的专家评分验证研究。

为说明该方法的局限性,文中包含了一个非理想示例(图6)。这一点尤为重要,因为人工智能辅助增强虽可提高视觉清晰度,但也可能引入一些变化,这些变化可能被误认为是真实的历史或解剖学细节。

增强输出结果的推荐解读
本实验方案的结果应被理解为技术可行性与工作流程可重复性的证明。该方法可能提升数字化历史神经解剖学插图的视觉可及性,尤其适用于原始数字图像存在模糊、褪色或线条清晰度降低的情况。然而,增强后的输出结果并不意味着原始艺术作品已得到复原、丢失信息已被恢复,或解剖结构的准确性已得到保证。

用于教学、展示或存档呈现时,应将增强后的图像与原始数字化资料并列展示,或通过明确链接关联。这种配对方式可保持历史透明性,并降低因增强处理而产生误读的风险。因此,本方案最适合作为数字化复制品的受控视觉增强流程,而不应用于替代原始历史资料。

使用超分辨率技术通过人工智能辅助工作流增强历史神经解剖学图像的示意图。
图1:人工智能辅助增强数字化历史神经解剖学插图的工作流程。该示意图总结了从数字资源库获取图像、图像预处理、固定16倍人工智能辅助增强,以及导出增强后图像以进行后续评估和记录的全过程。请点击此处查看该图的放大版本。

带有血管细节的大脑解剖图;皮层结构的比较示意图。
图 2:维萨里所著数字化历史神经解剖图的代表性增强效果。 该图源自安德烈亚斯·维萨里(Andreas Vesalius)所著《人体构造七书》(De humani corporis fabrica libri septem)的数字化历史资料13。(A) 增强前的原始数字化图像。(B) 同一图像的超分辨率增强版本。(C) 原始图像中选定区域的放大图。(D) 增强图像中对应区域的放大图。红色框标示了图 CD 中放大的区域。成对比较显示,增强图像在视觉上线条定义更清晰、对比度更高、整体可视性更佳,同时仍可与原始数字化图像进行直接比对。请点击此处查看该图的高清版本。

突出显示神经科学研究详细截面视图的冠状脑解剖图。
图 3:斯滕森(Steno)数字化历史神经解剖图的代表性增强效果。 该图源自尼古拉斯·斯滕森(Nicolas Steno)所著《论脑的解剖》(Discours de Monsieur Stenon sur l’anatomie du cerveau)的数字化历史资料14。(A) 增强前的原始数字化图像。(B) 同一图像的超分辨率增强版本。(C) 原始图像中选定区域的放大图。(D) 增强图像中对应区域的放大图。红色框标示了图 CD 中放大的区域。增强后的图像显示出更清晰的细线结构,且扫描相关的视觉退化现象减少。请点击此处查看该图的高清版本。

Brain anatomy diagram highlighting hippocampus structure, comparison details, educational use.
图4罗兰多数字化历史神经解剖学图谱的代表性增强 该插图取自一份数字化的历史资料 大脑半球的结构 by Luigi Rolando15. (A) 增强前的原始数字化插图。B) 相同示意图的超分辨率增强版本。C) 原始图像中感兴趣区域的放大图。D) 增强图像中匹配的放大感兴趣区域。红色框表示各图中放大的区域 C D对比显示,增强后皮层表面细节和解剖线条连续性的表观可见度更高。 请点击此处以查看此图的放大版本。

人脑解剖图;小脑切片;详细标注的示意图。
图 5:Vicq d’Azyr 所著数字化历史神经解剖图的代表性增强效果。 该图源自 Félix Vicq d’Azyr 所著《解剖学与生理学论著》(Traité d’anatomie et de physiologie)的数字化历史资料16。(A) 增强前的原始数字化图像。(B) 同一图像的超分辨率增强版本。(C) 原始图像中选定区域的放大图。(D) 增强图像中对应区域的放大图。红色框标示了图 CD 中放大的区域。成对图像显示,在历史解剖图中,增强后图像的对比度和细节可见性明显提升。请点击此处查看该图的高清大图。

大脑冠状切面图;微结构分析;神经元排列;组织学比较。
图6:AI辅助增强在阿诺德(Arnold)数字化历史神经解剖图中的次优效果。 该图源自弗里德里希·阿诺德(Friedrich Arnold)所著《解剖图谱》(Tabulae anatomicae)的数字化历史资料17。(A) 增强前的原始数字化图像。(B) 同一图像的超分辨率增强版本。(C) 原始图像中感兴趣区域的放大图。(D) 增强图像中对应感兴趣区域的放大图。红色框标示了在图 CD 中被放大的区域。增强图像显示出与方法相关的局限性,包括人为的纸张纹理、过度锐化、部分小标签的畸变以及线条视觉上的增粗。此例说明了为何在使用前,增强图像应始终与原始图像并列呈现,并经过质量控制审查。请点击此处查看该图的高清版本。

讨论

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

本文介绍了一种可重复的流程,用于借助人工智能增强数字化的历史神经解剖学插图。长期以来,历史解剖图像一直是解剖学记录、教学和科学交流的重要工具,其中许多作品如今可通过数字化图书、扫描档案和在线资源库获取。然而,这些图像在现代教学、演示和数字存档中的应用常受到以下因素的限制:表观分辨率较低、线条褪色、背景变色、扫描引起的模糊、压缩伪影,以及微小标签的可读性下降12,18,19,20

该方案的主要优势在于其简单性和可重复性。本方案并非旨在引入一种新的超分辨率算法,也并非声称增强后的图像比原始图像更具历史真实性。相反,其贡献在于标准化了一种谨慎的操作流程,以降低无控制、临时性增强所带来的风险。该流程采用公共领域或可再利用的数字资源、保守的裁剪方式,并在易于使用的图像放大应用中采用固定的增强设置。所有包含的图像均应用了相同的16倍超分辨率预设,且未进行任何手动解剖结构修饰、重绘、重新着色或选择性校正。这一点至关重要,因为历史神经解剖学插图并非普通的数字图像,而是兼具科学性、教育性、艺术性和历史性的文献资料。因此,图像增强应被理解为对数字化复制品的处理,而非对原始艺术作品的修复,也不意味着已恢复丢失的解剖学信息19,21,22

人工智能辅助的图像增强与超分辨率方法可提升退化或低分辨率图像的表观分辨率、边缘定义、对比度及视觉可读性。在成功案例中,当前工作流程显著增强了精细解剖线条、皮层与脑室轮廓、血管细节、脑干相关结构以及微小标签的可见度。这些改进在将历史神经解剖学插图用于讲座、教学图示、数字档案或学术展示时可能具有重要价值。然而,原始图像应始终保留作为参考源,增强后的图像应仅作为辅助处理图像使用,而非替代原始图像9,23,24

增强后的质量控制是该方案中的关键步骤。人工智能辅助增强有时可能产生次优结果,特别是在基线退化严重、标记密集、原始分辨率低或纸张纹理明显的图像中。潜在问题包括人工纹理的形成、过度锐化、细线增粗、小字母变形以及线条连续性的视觉误导性改变。这些风险与更广泛存在的关于人工智能生成或修改的医学插图在解剖学可靠性方面的担忧一致,即视觉上的合理并不一定保证解剖结构的准确性。因此,在使用每个增强后的图像之前,都应将其与原始数字化图像进行直接比对12,25,26

本方案存在若干局限性。首先,增强后输出的质量在很大程度上依赖于源图像的质量。严重退化、不完整或扫描质量差的图像可能无法产生可靠的结果。其次,16倍增强会显著增加输出文件的大小,这可能给存储、传输和图表准备带来困难。所选的16倍放大倍数未与其它可选的缩放因子进行比较,不应将其视为最优选择。第三,本文未提供客观的图像质量评估指标、专家评分或教育效果数据。相反,本方案提供了结构化的技术质量控制文档,并明确将增强图像定位为原始历史资料的辅助可视化工具,而非经过验证的替代品。其目的是描述一种标准化的技术操作流程,而非证明该方法优于其他图像增强算法,或衡量学习效果。

未来的研究可比较不同的增强模型、缩放倍数以及客观的图像质量指标,例如锐度、对比度、边缘保持性、文字可读性、文件大小和处理时间。教育研究还可评估增强后的历史图像是否能够提高学习者的参与度或解剖学理解能力。在当前的形式下,该方案为改善数字化历史神经解剖图谱的视觉可及性提供了一种实用且可重复的方法,同时保持了原始资料的透明性与解释上的谨慎性。增强后的图像应被视为原始资料的加工版数字辅助材料,而非独立的解剖学参考依据。

披露

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

作者声明不存在利益冲突。

致谢

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

作者感谢提供数字化历史解剖学著作访问权限的公共领域数字存储库和档案馆藏。本研究未获得任何资金支持。

材料

本文使用的材料清单
姓名公司目录编号评论
Adobe AcrobatAdobe版本未记录基于 PDF 的图像提取
计算机工作站提交文件中未报告配置未报告用于本地人工智能辅助图像增强的硬件
显示/截图设置Windows 屏幕截图工具或等效工具100% 或 200% 显示放大倍数;已记录显示器缩放比例在无法直接导出 PDF 时,采用标准化的基于截图的提取方法
GallicaBibliothèque nationale de France在线资源库数字化历史文献的来源
通用照片 Real-ESRGAN 预设Upscayl / 基于 Real-ESRGAN 的模型16 倍设置对数字化插图进行超分辨率增强
Google 图书Google在线资源库数字化历史书籍的来源
图形处理器(GPU)提交文件中未报告型号及加速状态未报告启用时用于图像放大处理的 GPU 加速
Internet ArchiveInternet Archive在线资源库公共领域数字化历史作品的来源
本地存储驱动器用户指定的工作站具备足够的可用存储空间用于存储原始图像、增强后图像及可用于发表的图像文件
PDF 导出设置Adobe Acrobat 或等效的 PDF 阅读器/导出软件尽可能保留原始嵌入分辨率从数字化 PDF 资源中提取图像,避免有意降采样
PhotoScape XMOOII Techv4.1.1保守裁剪与图像制备
PNG 图像格式增强后图像的输出格式
处理日志电子表格Microsoft Excel 或等效电子表格软件版本无特殊要求记录图像来源、提取方法、增强参数、处理时间、输出文件名及质量控制分类
质量控制检查清单作者自制检查清单不适用结构化技术审查,检查是否存在人工纹理、过度锐化、标签变形、线条加粗及无依据的视觉更改
系统内存提交文件中未报告内存容量未报告用于大规模图像增强的可用内存
UpscaylUpscaylv2.11.5人工智能辅助图像放大
Wellcome CollectionWellcome Collection在线资源库公共领域数字化历史作品的来源
Wikimedia CommonsWikimedia Foundation在线资源库公共领域或可重用图像的来源
Windows 操作系统MicrosoftWindows 10用于图像提取与处理的操作系统
Windows 屏幕截图工具MicrosoftWindows 10 内置工具在无法导出 PDF 时,基于截图的图像捕获方法

重印与许可

申请许可以重复使用本 JoVE 文章的文本或图表

申请许可

标签

234

相关文章