术语表
A
B
白点
定义色彩空间中"白色"的色度坐标。对应光源的色温,是白平衡和色彩管理的参考基准。
白平衡
相机功能和图像处理技术,调整色调使白色物体在任何光源下都呈现白色。
百万像素
代表一百万个像素的单位,用于表示相机传感器能够捕获的总像素数。
曝光
到达相机传感器的总光量,由光圈、快门速度和 ISO 感光度的组合决定。
饱和度
颜色的鲜艳程度或纯度。高饱和度产生鲜明的颜色,低饱和度趋近灰色。饱和度为零时呈现完全无彩色的色调。
背景去除
将前景主体从背景中分离,并将背景替换为透明或纯色的处理过程。
背景虚化
一种图像处理技术,对背景施加模糊效果同时保持主体清晰,模拟大光圈镜头的散景效果。
贝塞尔曲线
由控制点定义的平滑数学曲线,是字体、矢量图形和动画缓动函数的基础技术。
边框
绘制在图像或 UI 元素周围的线条,用于视觉分隔、装饰或强调。
编码器-解码器
一种由编码器将输入压缩为紧凑潜在表示、解码器从该表示重建目标输出的神经网络架构。
Blob
Binary Large Object - 浏览器中表示原始二进制数据的不可变对象,在 JavaScript 图像文件读写中广泛使用。
BMP
Windows 原生光栅格式,以未压缩方式存储像素数据。读写速度快但文件体积非常大。
不透明度
表示图层或元素遮挡其下方内容程度的值。范围从 0% (完全透明) 到 100% (完全不透明)。
C
裁剪
去除图像中不需要的区域,仅保留所需部分的处理操作,常用于构图调整和宽高比校正。
Canvas API
用于在 HTML5 canvas 元素上进行像素级绘图和图像处理的 JavaScript API,直接在浏览器中运行。
CDN
地理分布式服务器网络,从最近的边缘节点缓存和分发内容,降低图像传输延迟。
插值
在图像缩放、旋转或变形过程中估算新像素值的数学方法,在质量与计算成本之间取得平衡。
超分辨率
一种深度学习技术,从低分辨率输入推断并生成高分辨率图像,重建源图中不存在的细节。
撤销/重做
撤销可逆转上一步操作恢复到之前的状态;重做可重新应用被撤销的操作。
尺度空间
在不同细节层次上表示图像的连续框架。通过改变高斯模糊参数 sigma,可以在各分辨率下统一分析图像结构。
池化
通过聚合局部区域内的值来降低特征图空间维度的下采样操作,在降低计算量的同时增加平移不变性。
CMYK
使用青色、品红色、黄色和黑色油墨在纸张上再现颜色的减色模型,是商业印刷的标准。
CNN(卷积神经网络)
一种使用卷积层和池化层从图像中分层提取空间特征的深度学习架构,已成为图像识别的标准模型。
D
单应性
表示两个平面之间射影变换的 3x3 矩阵,用于全景拼接、透视校正和 AR 标记识别,描述几何对应关系。
Data URL
一种将二进制数据以 Base64 编码字符串嵌入 URL 的方案,常用于在 HTML 或 CSS 中内联小图像以减少 HTTP 请求。
点云
由空间中大量 3D 坐标点 (x, y, z) 组成的数据格式。通过 LiDAR 或立体相机获取,是 3D 建模、自动驾驶和测量的基础数据。
动态范围
图像或设备能表示的最暗与最亮亮度级别之间的比率。更宽的动态范围可在不丢失高光或暗部细节的情况下捕捉高对比度场景。
DPI
每英寸点数的分辨率单位。是印刷质量的主要指标;对网页显示无影响。
Dropout
一种在训练期间随机停用神经元的正则化技术,通过隐式训练子网络集成来防止共适应并减少过拟合。
对比度
图像中最亮和最暗区域之间的亮度差异。决定图像的感知深度、立体感和视觉冲击力。
对焦
相机镜头正确汇聚来自被摄体的光线,产生清晰锐利图像的状态。
E
F
法线贴图
将表面法线方向编码为 RGB 颜色值的纹理,在实时渲染中实现逐像素光照计算,模拟低多边形模型上的几何细节。
反向传播
一种利用链式法则将误差从输出层向输入层反向传播,高效计算损失函数对各网络参数梯度的算法。
翻转
通过沿某一轴反转像素排列来水平或垂直镜像图像。
仿射变换
一种结合平移、旋转、缩放和剪切的线性几何变换,在保持平行线的同时改变图像几何形状,是图像处理的基础操作。
方向标签
EXIF 元数据字段 (Tag 0x0112),指定图像像素应如何旋转或翻转以正确显示方向。
Favicon
显示在浏览器标签页、书签和历史记录中的小图标,作为网站的视觉标识。
分辨率
衡量图像细节程度的指标,根据语境表示为像素尺寸(宽×高)或像素密度(PPI/DPI)。
傅里叶变换
将图像分解为空间频率分量的数学技术,其中低频代表平滑区域,高频对应边缘和噪声。
G
Gamma
定义输入信号值与输出亮度之间非线性关系的指数。Gamma 校正确保显示器上的亮度感知自然。
GAN (生成对抗网络)
一种深度学习框架,以对抗方式训练生成器和判别器两个网络,生成与真实图像无法区分的图像。
高光贴图
一种纹理,用于逐像素控制 3D 模型表面镜面 (类镜面) 反射的强度和颜色,使单一材质内可呈现不同的光泽度。
高斯模糊
使用高斯核对图像进行卷积的滤镜,通过衰减高频细节产生平滑自然的模糊效果。
GIF
一种支持最多 256 色的无损索引色格式,具有帧动画功能,广泛用于短循环动画片段。
GPS 标签
存储在 EXIF 元数据中的位置数据(纬度、经度、海拔),记录照片的拍摄地点。也称为地理标签。
光流
将连续帧之间每个像素的表观运动表示为向量场的技术。是视频分析、运动检测和视频稳定的基础技术。
光栅图像
由像素矩形网格组成的数字图像,每个像素存储独立的颜色数据。适用于照片和复杂颜色渐变。
光线追踪
一种渲染技术,通过追踪光线从相机穿过每个像素的路径,以物理精度模拟反射、折射和阴影,生成照片级真实感图像。
过拟合
模型过度学习训练数据 (包括噪声和特异性) 导致在未见数据上性能下降 (泛化能力差) 的现象。
H
Harris 角点检测
通过分析局部梯度自相关矩阵的特征值来检测图像中角点的算法,识别在两个方向上具有显著强度变化的点。
HDR 照片
一种通过合并多次曝光来捕捉极端亮度差异场景的摄影技术,在不丢失高光或暗部细节的情况下记录完整色调范围。
合成
将多个图像或视频元素组合成单一最终图像的过程,使用图层混合、蒙版和色彩校正实现无缝效果。
HEIC
Apple 默认的图像容器格式,使用 HEVC 编解码器。在同等质量下文件大小约为 JPEG 的一半。
红眼消除
检测并校正闪光灯摄影中产生的红眼效应,恢复自然瞳孔颜色的处理过程。
HSV
使用色相、饱和度和明度三个轴表示颜色的色彩模型。符合人类色彩感知,广泛用于取色器和图像调整工具。
缓存清除
通过在文件名或查询参数中附加版本信息,强制浏览器和 CDN 获取更新文件的技术。
环境光遮蔽
一种渲染技术,模拟环境光在缝隙、角落和物体接触面被遮挡的效果,通过添加细微阴影增强深度感和空间真实感。
灰度
仅包含亮度信息的图像格式,表示从黑到白的色调而不含任何颜色数据。
混合模式
一种将两个图层的像素值进行数学运算以实现合成的方法。包括正片叠底、滤色、叠加等模式,可产生多样的视觉效果。
I
J
激活函数
应用于神经网络中每个神经元输出的非线性函数,使模型能够学习超越线性变换的复杂模式。
渐变
两种或多种颜色之间的平滑过渡。有线性、径向和锥形等类型,用于背景、蒙版和艺术效果。
渐变填充
两种或多种颜色之间的平滑过渡,广泛用于背景、叠加层和设计元素。
渐进式 JPEG
一种 JPEG 编码方法,以逐步清晰的多次扫描渲染整幅图像,允许用户在完全加载前看到低分辨率预览。
剪切路径
定义图像可见区域的闭合矢量路径,隐藏路径外的所有内容。用于印刷制作和 Web CSS 中的精确裁切。
剪贴画
为插入文档、演示文稿和网页而设计的预制插图和图形元素。
截图
将当前屏幕显示内容捕获为图像文件的功能,常用于文档记录、分享和故障排除。
景深
场景中呈现可接受清晰度的距离范围。由光圈、焦距和拍摄距离决定 - 浅景深可突出主体,深景深则使整个场景保持清晰。
镜头畸变
由于镜头光学特性导致场景中的直线被渲染为曲线的几何像差。桶形畸变和枕形畸变是两种主要类型,在广角镜头中最为明显。
JPEG
针对照片优化的有损格式,使用 DCT 实现高压缩率,但重复压缩会导致画质下降。
卷积
一种基础图像处理操作,将卷积核(小矩阵)在图像上滑动,在每个位置计算加权和,用于模糊、边缘检测和锐化。
卷积核
卷积运算中使用的小型数值矩阵。卷积核的值决定滤波器类型 - 模糊、边缘检测、锐化或浮雕。
K
L
Lab 色彩空间
一种感知均匀的色彩空间,两种颜色之间的数值距离与感知差异相关。它作为 ICC 色彩管理中与设备无关的连接空间。
懒加载
将屏幕外图像的加载推迟到用户滚动到附近时才执行的技术,显著提升初始页面加载速度。
立体匹配
在双目相机拍摄的一对图像之间寻找对应像素以恢复深度信息的技术。是自动驾驶和机器人领域三维测量的基础方法。
亮度
每个像素的感知光强度。用于显示器校准和图像色调调整的基本量。
亮度调整
统一增加或减少图像中所有像素亮度值的处理过程,用于校正整体明暗。
量化
以更低位精度 (如 INT8) 表示模型权重和激活值的优化技术,加速推理并减少内存占用。
滤镜
对图像应用特定效果的处理的总称,包括模糊、锐化、复古色调和马赛克等多种类型。
M
N
O
P
PDF
Adobe 开发的文档格式,能在所有平台和设备上忠实保留文本、图像和矢量图形。
批处理
对多张图像同时应用相同操作,实现高效的批量缩放、压缩和格式转换。
批量处理
对多个图像文件同时应用相同操作(缩放、压缩、转换等),自动化重复性任务。
批量归一化
一种将各层输入在 mini-batch 范围内归一化为零均值和单位方差的技术,用于稳定和加速深度网络训练。
拼贴
将多张照片或图像排列在单一画布上形成新的合成作品的创意技术。
屏幕录制
将屏幕上的操作活动录制为视频文件的功能,常用于制作教程、记录操作流程和捕获游戏画面。
PNG
支持完整透明度的无损格式。适用于 Logo 和截图等边缘锐利的图像。
PPI
Pixels Per Inch - 衡量显示器像素密度的单位,表示一英寸屏幕空间内容纳多少像素。
Q
R
S
散景
图像中焦外模糊区域的美学品质。源自日语的模糊一词,评价的是失焦区域的视觉美感而非单纯的模糊程度。
色彩校正
调整图像颜色以获得自然色调或修复由光照条件引起的色偏的过程。
色彩空间
用数值表示颜色的坐标系统。sRGB、Display P3 和 Adobe RGB 定义了不同的色域。
色彩深度
每个像素表示颜色的位数。位深度越高,渐变越平滑,色调范围越宽。
色差
一种光学缺陷,镜头将不同波长的光聚焦在不同位置,导致色彩边缘或错位。分为纵向色差和横向色差两种类型。
色调曲线
将输入亮度值映射到输出值的图形。是精确控制图像亮度、对比度和色调分布的最强大色调调整工具。
色度键
一种将特定颜色(通常为绿色或蓝色)视为透明的合成技术,允许将背景替换为不同的素材或图像。
色度子采样
一种相对于亮度降低色度通道分辨率的压缩技术,利用人眼对颜色细节敏感度较低的特性。
色相
区分红与蓝、绿与黄的颜色属性 - 以色轮上的角度 (0-360 度) 表示,代表主波长。
上采样
通过插值或深度学习技术添加像素并估计缺失信息,从而提高图像或信号分辨率的过程。
上传
通过互联网将文件从本地设备发送到服务器或云存储的过程。
社交媒体图片尺寸
各社交媒体平台推荐的图片尺寸和宽高比,确保最佳显示效果而不会被意外裁剪或重新压缩。
神经网络
受生物神经回路启发的数学模型,由输入层、隐藏层和输出层组成,是高级图像处理任务的基础。
视差图
记录立体图像对中对应点之间水平像素位移(视差)的图像。可通过三角测量从视差计算深度,是三维重建的中间表示。
矢量图像
由点、路径、曲线和填充等数学对象定义的数字图像。可缩放到任意大小而不损失质量。
十六进制颜色代码
使用六位十六进制数字表示 RGB 通道值的颜色表示法,以 # 为前缀。Web 开发中的标准颜色格式。
数据增强
通过对训练数据施加旋转、翻转、色彩抖动等变换来人为增加数据多样性的技术,可提升模型泛化能力并减少过拟合。
水印
叠加在图像上的半透明 Logo 或文字,用于表明版权归属并阻止未经授权的使用。
SIFT
尺度不变特征变换。一种提取对尺度变化和旋转不变的局部图像特征的算法,是图像匹配的基础技术。
srcset
HTML img 属性,用于指定多个图片候选项,使浏览器能根据设备条件自动选择最优图片。
缩略图
图像的缩小版本,用于预览和列表显示,帮助用户快速识别内容。
SVG
基于 XML 的矢量图像格式,可缩放到任意分辨率而不损失质量。适用于图标、Logo 和图表。
T
特征点
图像中局部具有显著特征的点,如角点或边缘交叉点,可在不同视角间可靠检测和匹配,用于图像对齐和跟踪。
体素
将 3D 空间划分为规则网格时的最小单元 (体积元素)。是像素的 3D 等价物,用于医学影像、3D 建模和游戏中离散表示空间数据。
填充
用纯色、渐变或图案填充指定区域的操作,通常称为油漆桶工具。
调色
在视频和摄影中对颜色进行创意操控以建立情绪、情感和视觉叙事。在色彩校正之后作为艺术过程执行。
跳跃连接
神经网络中绕过一层或多层的快捷路径,将输入直接加到或拼接到后续层的输出上,以缓解梯度消失问题。
调整大小
通过插值算法计算目标分辨率的新像素值,改变图像的像素尺寸。
TIFF
印刷和出版领域的标准高质量光栅格式,灵活性强。支持无损压缩,适合存档用途。
透明度
使图像部分区域变为透明的能力,对于创建带有透明背景的 Logo、图标以及图像合成至关重要。
图层
将图像分离为多个透明薄片叠加的系统,允许对每个层级进行独立编辑。
图库照片
提供专业拍摄的照片和插画,可通过授权或免费下载用于商业和编辑用途的服务。
图像编辑器
用于通过裁剪、色彩校正、合成和修饰等操作修改数字图像的软件应用程序。
图像编码器
将原始像素数据压缩为特定图像格式 (JPEG、PNG、WebP 等) 的软件模块,具有可配置的质量和压缩设置。
图像尺寸
图像维度的度量,指像素尺寸(宽 x 高)或文件大小(KB/MB 数据量)。
图像放大
使用插值或基于 AI 的超分辨率技术将图像像素尺寸增加到超出原始分辨率的过程。
图像分割
将图像划分为有意义的区域 (物体、背景、部件) 并为每个像素分配标签的过程,是图像分析的核心技术。
图像分类
将预定义类别标签分配给整张输入图像的基础计算机视觉任务,推动了深度学习革命并支撑许多下游视觉任务。
图像格式转换
将图像从一种文件格式重新编码为另一种格式的过程,通常出于兼容性、减小大小或功能需求。
图像解码器
读取压缩图像文件并将其解压为原始像素数据 (RGB/RGBA 缓冲区) 以供显示或进一步处理的软件模块。
图像金字塔
通过逐步降采样构建的多分辨率数据结构,用于在目标检测和模板匹配中实现尺度不变性。
图像精灵
将多个小图像合并为单个文件,使用 CSS background-position 显示特定区域以减少 HTTP 请求数的技术。
图像搜索
基于文本关键词检索相关图像的搜索功能,Google Images 是使用最广泛的服务。
图像压缩
减小图像文件大小的技术,大致分为无损(可逆)和有损(不可逆)两类方法。
图像映射
一种在单张图像中定义多个可点击区域的 HTML 技术,每个区域链接到不同的目标。
图像优化
在保持可接受视觉质量的同时最小化文件大小的一系列技术,直接改善 Web 性能和 Core Web Vitals。
图像质量
涵盖分辨率、色深、压缩级别、噪声和锐度的视觉保真度综合度量。
推理
将新数据输入已训练模型以获得预测的过程。与训练不同,推理不更新模型参数。
拖放
一种 UI 模式,允许用户将文件从桌面直接拖入浏览器放置区来加载文件,无需文件对话框。
U
W
Web Worker
浏览器中在独立于主 UI 线程的后台线程上运行 JavaScript 的机制,防止繁重图像处理时界面冻结。
WebAssembly
一种二进制指令格式,可在浏览器中实现接近原生的执行速度,使 C/C++/Rust 编写的图像处理库能在客户端运行。
WebP
Google 开发的新一代格式,同时支持有损和无损模式。压缩效率优于 JPEG 和 PNG。
位深度
每个像素用于表示颜色信息的位数。位深度越高,可表示的颜色越多,渐变越平滑。
文件大小
图像文件占用的存储空间,以字节 (B)、千字节 (KB) 或兆字节 (MB) 为单位。
文件格式
定义图像数据如何以二进制形式结构化和存储的规范,决定压缩方法、色彩深度和元数据处理方式。
文件扩展名
文件名中点号后面的后缀,用于标识文件类型并帮助操作系统确定如何处理该文件。
纹理映射
使用 UV 坐标系统将 2D 图像 (纹理) 应用到 3D 模型表面以添加颜色、图案和材质属性等视觉细节的技术。
文字叠加
在图像上方放置文字的技术,常用于制作缩略图、横幅和社交媒体图形。
无损
解压时能完美保留原始数据的压缩方法。不会发生质量劣化,但文件大小缩减幅度小于有损压缩。
无损格式
通过压缩保留所有原始像素数据的图像文件格式,解码时可完美重建。
无损压缩
能够逐位还原原始数据的压缩方法。在零质量损失的情况下减小文件大小。
X
下采样
通过减少像素数量来降低图像分辨率的过程,同时应用适当的滤波以防止混叠并保持视觉质量。
瑕疵去除
用于减少人像照片中痘痘、斑点、毛孔等皮肤瑕疵可见度的图像处理技术。
下载
从服务器或云存储接收文件并保存到本地设备的过程。
相机抖动
曝光期间相机移动导致的图像模糊,表现为整个画面沿某一方向出现拖影。
像素
数字图像中最小的可寻址元素。每个像素保存颜色数据,它们的集合构成图像。
响应式图片
根据浏览设备的屏幕尺寸和像素密度提供最佳尺寸和格式的图片,避免不必要的数据传输。
小波
将图像分解为同时保留空间和频率信息的多分辨率表示的技术,是 JPEG 2000 的压缩基础,也有效用于去噪。
选区
指定图像中特定区域的功能,使编辑操作仅在该区域内生效。
旋转
围绕中心点将图像按指定角度转动的处理,常用于校正图像方向。
Y
压缩比
原始数据与压缩后数据大小的比率。更高的压缩比产生更小的文件,但有损格式可能引入质量损失。
颜色模型
将颜色表示为数值的数学框架。RGB、CMYK、HSV 等多种模型适用于数字成像和印刷的不同应用。
颜色配置文件
描述设备或色彩空间颜色再现特性的数据文件,实现不同设备间一致的颜色外观。
以图搜图
以图片作为查询条件,在网络上查找相同或视觉相似图片的搜索技术。
阴影 / 投影
在图像、文字或 UI 元素后方渲染阴影的视觉效果,营造深度感和悬浮外观。
有损
丢弃感知上不重要的信息以实现大幅文件缩减的压缩方法。原始数据无法完美重建。
有损压缩
丢弃人眼不可感知的数据以实现高压缩率的压缩方法。无法还原原始数据。
预览
在最终输出前显示编辑或转换结果的临时显示功能,允许用户验证更改。
阈值
图像处理中用于将像素强度分类为二值 (黑/白) 或多类的边界值,是二值化和分割的基础。
圆角
将图像或 UI 元素的角进行圆弧处理的装饰效果,营造更柔和、更亲切的视觉印象。
元数据
嵌入图像文件中的补充数据,描述拍摄设置、版权、位置和其他属性。标准包括 Exif、IPTC 和 XMP。
运动模糊
在曝光期间由于被摄体或相机移动导致的图像拖影或涂抹现象。沿运动轴方向呈现方向性模糊。
Z
噪点
与实际场景内容无关的亮度或颜色随机变化。在高 ISO 摄影和长曝光中尤为明显。
照片修饰
对照片进行后期处理以改善外观,包括去除瑕疵、调整颜色和消除不需要的元素。
证件照
用于护照、身份证和官方文件的标准化肖像照片,需满足严格的尺寸、背景和面部比例要求。
正则化
一系列通过约束模型复杂度来防止过拟合、提高泛化能力的技术。权重衰减和 Dropout 是最常见的方法。
直方图
显示图像中像素强度分布的图形表示。用于客观评估曝光、对比度和色调范围。
置换贴图
一种灰度纹理,根据亮度值沿法线方向物理移动网格顶点,创建影响轮廓、阴影和遮挡的真实几何细节。
知识共享
一种标准化的许可系统,允许创作者为其作品指定使用权限,广泛用于图像素材和媒体。
注意力机制
一种神经网络组件,动态计算输入元素间的相关性分数,使模型能够聚焦于数据中最具信息量的部分。
转描
逐帧手动或半自动描绘遮罩轮廓以将主体从背景中分离的技术。当自动抠像失败时作为最终手段使用。