计算机多媒体技术基础作业答案
计算机多媒体技术基础
第一章作业
1、请根据多媒体的特性判断以下哪些属于计算机多媒体的范畴?
(1)交互式视频游戏 (2)有声图书 (3)彩色画报 (4)彩色电视
(a)仅(1) (b)(1)(2) (c)(1)(2)(3) (d)全部
答:(b)
2、下列哪些不是多媒体核心软件?
(1)avss (2)avk (3)dos (4)amiga vision
(a)(3) (b)(4) (c)(3)(4) (d)(1)(2)
答:(a)
3、要把一台普通的计算机变成多媒体计算机要解决的关键技术是:
(1)视频音频信号的获取 (2)多媒体数据压编码和解码技术
(3)视频音频数据的实时处理和特技 (4)视频音频数据的输出技术
(a)(1)(2)(3) (b)(1)(2)(4) (c)(1)(3)(4) (d)全部
答:(d)
4、Commodore 公司在 1985 年率先在世界上推出了第一个多媒体计算机系统 Amiga,其主要
功能是:
(1)用硬件显示移动数据,允许高速的动画制作;
(2)显示同步协处理器;
(3)控制 25 个通道的 dma,使 CPU 以最小的开销处理盘、声音和视频信息;
(4)从 28hz 震荡器产生系统时钟;
(5)为视频 RAM(VRAM)和扩展 RAM 卡提供所有的控制信号;
(6)为 VRAM 和扩展 RAM 卡提供地址。
(a)(1)(2)(3) (b)(2)(3)(5) (c)(4)(5)(6) (d)全部
答:(d)
5、国际标准 MPEG-Ⅰ采用了分层的编码体系,提供了四种技术,它们是:
(1)空间可扩展性;信噪比可扩充性;框架技术;等级技术。
(2)时间可扩充性;空间可扩展性;硬件扩展技术;软件扩展技术。
(3)数据分块技术;空间可扩展性;信噪比可扩充性;框架技术。
(4)空间可扩展性;时间可扩充性;信噪比可扩充性;数据分块技术。
(a)(1) (b)(2) (c)(3) (d)(4)
答:(d)
6、多媒体技术未来发展的方向是:
(1)高分辨率,提高显示质量; (2)高速度化,缩短处理时间;
(3)简单化,便于操作; (4)智能化,提高信息识别能力。
(a)(1)(2)(3) (b(1)(2)(4) (c)(1)(3)(4) (d)全部
答:(d)
7、简述多媒体计算机的关键技术及其主要应用领域?
答:多媒体计算机的关键技术是:(1)视频音频信号获取技术;(2)多媒体数据压缩编
码和解码技术;(3)视频音频数据的实时处理和特技;(4)视频音频数据的输出技术。
多媒体技术促进了通信、娱乐和计算机的融合。多媒体计算机的主要应用领域有三个
方面:(1)多媒体技术是解决常规电视数字化及高清晰度电视(HDTV)切实可行的方案。
采用多媒体计算机技术制造 HDTV,它可支持任意分辨率的输出,输入输出分辨率可以独
立,输出分辨率可以任意变化,可以用任意窗口尺寸输出。与此同时,它还赋予 HDTV 很
多新的功能,如图形功能,视频音频特技以及交互功能。多媒体计算机技术在常规电视和
高清晰度电视的影视节目制作中的应用可分成两个层次:一是影视画面的制作:采用计算
机软件生成二维、三维动画画面;摄象机在摄影真实的影视画面后采用数字图象处理技术
制作影视特技画面,最后是采用计算机将生成和实时结合用图象处理技术制作影视特技画
面。另一个层次是影视后期制作,如现在常用的数字式非线性编辑器,实质上是一台多媒
体计算机,它需要有广播级质量的视频音频的获取和输出、压缩解压缩,实时处理和特技
以及编辑功能。(2)用多媒体技术制作 V-CD 及影视音响卡拉 OK 机。多媒体数据压缩和
解压缩技术是多媒体计算机系统中的关键技术,V-CD 就是利用 MPEG-Ⅰ的音频编码技术
将压缩到原来的六分之一。(3)采用多媒体技术创造 PIC(个人信息通信中心),即采用多
媒体技术使一台个人计算机具有录音电话机、可视电话机、图文传真机、立体声音响设备、
电视机和录像机等多种功能,即完成通信、娱乐和计算机的功能。如果计算机再配备丰富
的软件连接上网,还可以完成许多功能进一步提高用户的工作效率。
问:多媒体计算机与普通计算机相比的主要特点是什么?
答:首先要了解多媒体计算机的定义,就是综合处理声、文、图信息,具有集成性和交互
性。多媒体计算机具有多样性、集成性(集成多种媒体信息)、交互性
第二章作业
1、在数字音频信息获取与处理过程中,下述顺序哪个是正确的:
(1)A/D 变换、采样、压缩、存储、解压缩、D/A 变换。
(2)采样、压缩、A/D 变换、存储、解压缩、D/A 变换。
(3)采样、A/D 变换、压缩、存储、解压缩、D/A 变换。
(4)采样、D/A 变换、压缩、存储、解压缩、A/D 变换。
答:(3)
2.下列哪种论述是正确的:
(a)音频卡的分类主要是根据采样的频率来分,频率越高,音质越好。
(b)音频卡的分类主要是根据采样信息的压缩比来分,压缩比越大,音质越好。
(c)音频卡的分类主要是根据接口功能来分,接口功能越多,音质越好。
(d)音频卡的分类主要是根据采样量化的位数来分,位数越高,量化精度越高,音质越好。
答:d
3、音频卡的主要功能是: Ⅰ , Ⅰ , Ⅰ , Ⅰ 。
Ⅰ音频的录制与播放
Ⅰ 编辑与合成
Ⅰ MIDI 接口
Ⅰ CD-ROM 接口及游戏接口等
4、什么是 MIDI 接口?
答:MIDI 是指乐器数字接口(Musical instrument digital interface),它规定了不同厂家的电子
乐器和计算机连接的电缆和硬件及设备间数据传输的接口标准。
5、声音卡是根据什么分类的?常用有哪几种?
答:声音卡是根据采样量化的位数来分的,常用有 8 位、16 位和 32 位声卡
第二章 作业
单项选择题 1-9:
1、数字音频采样和量化过程所用的主要硬件是:
(a)数字编码器 (b)数字解码器
(c)模拟到数字的转换器(A/D 转换器) (d)数字到模拟的转换器(D/A 转换器)
答:(c)
2、音频卡是按( )分类的。
(a)采样频率 (b)声道数 (c)采样量化位数 (d)压缩方式
答:(c)
3、两分钟双声道,16 位采样位数, 采样频率声音的不压缩的数据量是:
(a) (b) (c) (d)
答:(b)
4、目前音频卡具备以下( )功能。
(1)录制和回放数字音频文件 (2)混音
(3)语音特征识别 (4)实时解/压缩数字单频文件
(a)(1)(3)(4) (b)(1)(2)(4) (c)(2)(3)(4) (d)全部
答:(b)
5、以下的采样频率中哪个是目前音频卡所支持的。
(a)20khz (b) khz (c)100 khz (d)50 khz
答:(b)
6、1984 年公布的音频编码标准 ,它采用的是( )编码。
(a)均匀量化 (b)自适应量化 (c)自适应差分脉冲 (d)线性预测
答:(c)
7、ac-3 数字音频编码提供了五个声道的频率范围是:
(a)20hz 到 2 khz (b)100hz 到 1 khz
(c)20hz 到 20 khz (d)20hz 到 200 khz
答:(c)
8、midi 的音乐合成器有:
(1)fm (2)波表 (3)复音 (4)音轨
(a)仅(1) (b)(1)(2) (c)(1)(2)(3) (d)全部
答:(b)
9、下列采集的波形声音质量最好的是:
(a)单声道、8 位量化、 khz 采样频率
(b)双声道、8 位量化、 khz 采样频率
(c)单声道、16 位量化、 khz 采样频率
(d)双声道、16 位量化、 khz 采样频率
答:(d)
10、简述音频编码的分类及常用编码算法和标准。
答:音频编码分为:
(1)基于音频数据的统计特性进行编码,其典型技术是波形编码。其目标是使重建语
音波形保持原波形的形状,PCM(脉冲编码调制)是最简单的编码方法。还有差值量化
(DPCM)、自适应量化(APCM)和自适应预测编码(ADPCM)等算法。
(2)基于音频声学参数进行参数编码,可进一步降低数据率。其目标是使重建音频保
持原音频特性。常用的音频参数有共振峰、线性预测系数、滤波器组等。这种编码技术的优
点是数据率低,但还原信号的质量较差,自然度低。
(3)基于人的听觉特性进行编码。从人的听觉系统出发,利用掩蔽效应设计心理学模
型,从而实现更高效率的数字音频压缩。而最有代表性的是 MPEG 标准中的高频编码和
DOLBY AC-3。
国际电报电话咨询委员会(CCITT)和国际标准化组织(ISO)提出了一系列有关音频
编码算法和国际标准。如
64kbps A 律 PCM 非均匀量化编码标准,
G7. 21 采用 ADPCM 自适应差值量化数据率为 32bps。还有
、,SB-ADPCM 子带自适应差值量化,
和 低延时激励混合编码等。
第三章 作业
1、视频卡的种类很多,主要包括:
(1)视频捕获卡 (2)电影卡 (3)电视卡 (4)视频转换卡
(a)(1) (b)(1)(2) (c)(1)(2)(3) (d)全部
答:d
2.帧频率为 25 帧/秒的制式为:
(1)pal (2)secam (3)ntsc (4)yuv
(a) (1) (b)(1)(2) (c)(1)(2)(3) (d)全部
答:b
3、全电视信号是由 Ⅰ , Ⅰ , Ⅰ 组成。
Ⅰ 图像信号(视频信号)
Ⅰ 复合消隐信号
Ⅰ 复合同步信号
4、多媒体计算机获取常用的图形、静态图像和动态图像(视频)的方法是: Ⅰ , Ⅰ , Ⅰ 。
Ⅰ 计算机产生彩色图形,静态图像和动态图像;
Ⅰ 用彩色扫描仪,扫描输入彩色图形和静态图像;
Ⅰ 用视频信号数字化仪,将彩色全电视信号数字化后,输入到多媒体计算机中 。
5、彩色全电视信号是由哪几部分组成?
答:彩色全电视信号是由图像信号(色度信号、亮度信号)、复合消隐信号(包括行消隐和
场消隐信号)、复合同步信号(包括行同步和场同步信号)等迭加在一起组成的。
6、视频采集卡主要是由哪几部分组成?
答:视频采集卡主要由六部分组成:
Ⅰ a/d 变换和数字解码
Ⅰ 窗口控制器
Ⅰ 帧存储器系统
Ⅰ d/a 变换和彩色空间变换
Ⅰ 视频信号和 vga 信号的叠加
Ⅰ 视频信号编码
7、论述视频信息获取的流程,并画出视频信息获取的流程框图。
答:视频信息获取的基本流程概述为
Ⅰ 彩色全电视信号经过采集设备分解成模拟的 r、g、b 信号或 y、u、v 信号;
Ⅰ 各个分量的 a/d 变换、解码、将模拟的 r、g、b 或 y、u、v 信号变换成数字信号的 r、g、
b 或 y、u、v 信号,存入帧存储器;
Ⅰ 主机可通过总线对帧存储器中的图像数据进行处理,帧存储器的数据 r、g、b 或 y、u、v
经过 d/a 变换转换成模拟的 r、g、b 或 y、u、v 信号;
Ⅰ 经过编码器合成彩色电视信号,输出到显示器上。
(2) 视频信息获取流程框图如下:
第四章 多媒体数据压缩编码技术
单项选择题 1-7:
1、下列哪些说法是正确的:
(1)冗余压缩法不会减少信息量,可以原样恢复原始数据。
(2)冗余压缩法减少冗余,不能原样恢复原始数据。
(3)冗余压缩法是有损压缩法。、
(4)冗余压缩的压缩比一般都比较小。
(a)(1)(3) (b)(1)(4) (c)(1)(3)(4) (d)仅(3)
答:(b)
2、图象序列中的两幅相邻图象,后一幅图象与前一幅图象之间有较大的相关,这是:
(a)空间冗余 (b)时间冗余 (c)信息熵冗余 (d)视觉冗余
答:(b)
3、下列哪一种说法是不正确的:
(a)预测编码是一种只能针对空间冗余进行压缩的方法
(b)预测编码是根据某一种模型进行的
(c)预测编码需将预测的误差进行存储或传输
(d)预测编码中典型的压缩方法有 dpcm、adpcm
答:(a)
4、下列哪一种说法是正确的:
(a)信息量等于数据量与冗余量之和
(b)信息量等于信息熵与数据量之差
(c)信息量等于数据量与冗余量之差
(d)信息量等于信息熵与冗余量之和
答:(c)
5、pⅠ64k 是视频通信编码标准,要支持通用中间格式 cif,要求 p 至少为:
(a)1 (b)2 (c)4 (d)6
答:(d)
6、在 mpeg 中为了提高数据压缩比,采用了哪些方法:
(a)运动补偿与运行估计 (b)减少时域冗余与空间冗余
(c)帧内图象数据与帧间图象数据压缩 (d)向前预测与向后预测
答:(c)
7、在 jpeg 中使用了哪两种熵编码方法:
(a)统计编码和算术编码 (b)pcm 编码和 dpcm 编码
(c)预测编码和变换编码 (d)哈夫曼编码和自适应二进制算术编码
答:(d)
8、简述 mpeg 和 jpeg 的主要差别。
答:mpeg 视频压缩技术是针对运动图象的数据压缩技术。为了提高压缩比,帧内图象数据
和帧间图象数据压缩技术必须同时使用。
mpeg 通过帧运动补偿有效地压缩了数据的比特数,它采用了三种图象,帧内图、预测
图和双向预测图。有效地减少了冗余信息。对于 mpeg 来说,帧间数据压缩、运动补偿和双
向预测,这是和 jpeg 主要不同的地方。而 jpeg 和 mpeg 相同的地方均采用了 dct 帧内图象数
据压缩编码。
在 jpeg 压缩算法中,针对静态图象对 dct 系数采用等宽量化,而是 mpeg 中视频信号包
含有静止画面(帧内图)和运动信息(帧间预测图)等不同的内容,量化器的设计不能采用
等宽量化需要作特殊考虑。从两方面设计,一是量化器综合行程编码能使大部分数据得到压
缩;另一方面是通过量化器、编码器使之输出一个与信道传输速率匹配的比特流。
8、信源符号及其概率如下:
a a1 a2 a3 a4 a5
p(a)
求其 huffman 编码,信息熵及平均码长。
解:
a1 ----------------------------------------------------------------0---------- 0
a2 ------1 10
a3 -------1 110
a4 ------1 1110
a5 -------1 1111
则:a1=0 a2=10 a3=110 a4=1110 a5=1111
信息熵:
&Tag=1162433038 class="MsoNormal" style="text-indent: "> a1-a5 码长分别为 1,2,3,
4,4
则 平 均 码 长
&Tag=1162433038
class="MsoNormal">10、详述 jpeg 静态图象压缩编码原理及实现技术。
答:jpeg 是由国际电报咨询委员会(ccitt)和国际标准化协会(osi)联合组成的一个图象专
家小组开发研制的连续色调、多级灰度、静止图象的数字图象压缩编码方法。jpeg 适于静止
图象的压缩,此外,电视图象序列的帧内图象的压缩编码也常采用 jpeg 压缩标准。jpeg 数
字图象压缩文件作为一种数据类型,如同文本和图形文件一样地存储和传输。基于离散余弦
变换(dct)的编码方法是 jpeg 算法的核心内容。算法的编解码过程如教材 136 页图
所示。编码处理过程包括原图象数据输入、正向 dct 变换器、量化器、熵编码器和压缩图象
数据的输出,除此之外还附有量化表和熵编码表(即哈夫曼表);接收端由信道收到压缩图
象数据流后,经过熵解码器、逆量化器、逆变换(idct),恢复并重构出数字图象,量化表和
熵编码表同发送端完全一致。编码原图象输入,可以是单色图象的灰度值,也可以是彩色图
象的亮度分量或色差分量信号。dct 的变换压缩是对一系列 8*8 采样数据作块变换压缩处理,
可以对一幅像,从左到右、从上到下、一块一块(8*8/块)地变换压缩,或者对多幅图轮流
取 8*8 采样数据块压缩。解码输出数据,需按照编码时的分块顺序作重构处理,得到恢复数
字图象。
具体的实现技术如下:
(1)首先把一幅图象分 8*8 的子块按图中的框图进行离散余弦正变换(fdct)和离散
余弦逆变换(idct)。
在编码器的输入端,原始图象被分成一系列 8*8 的块,作为离散余弦正变换(fdct)的
输入。在解码器的输出端,离散余弦逆变换(idct)输出许多 8*8 的数据块,用以重构图象。
8*8 fdct 和 8*8 idct 数学定义表达式如下:
fdct:
&Tag=1162433038
class="MsoNormal" style="text-indent: "> idct:
&Tag=1162433038 class="MsoNormal">两式中,c(u),c(v)= , 当 u=v=0
c(u),c(v)=1 , 其它情况
离散余弦正变换(fdct)可看作为一个谐波分析仪,把离散余弦逆变换(idct)看作一
个谐波合成器。每个 8*8 二维原图象采样数据块,实际上是 64 点离散信号,该信号是空间
二维参数 x 和 y 的函数。fdct 把这些信号作为输入,然后把它分解成 64 个正交基信号,每
个正交信号对应于 64 个二维(2d)空间频率中的一个,这些空间频率是由输入信号的频谱
组成。fdct 的输出是 64 个基信号的幅值(即 dct 系数),每个系数值由 64 点输入信号唯一地
确定,即离散余弦变换的变换系数。在频域平面上变换系数二维频域变量 u 和 v 的函数。对
应于 u=0,v=0 的系数,称做直流分量(dc 系数),其余 63 个系数称做交流分量(ac 系数)。
因为在一幅图象中像素之间的灰度或色差信号变化缓慢,在 8*8 子块中像素之间相关性很强,
所以通过离散余弦正变换处理后,在空间频率低频范围内集中了数值大的系数,这样为数据
压缩提供了可能。远离直流系数的高频交流系数大多为零或趋于零。如果 fdct 和 idct 变换
计算中计算精度足够高,并且 dct 系数没有被量化,那么原始的 64 点信号就能精确地恢复。
(2)量化
为了达到压缩数据的目的,对 dct 系数 f(u,v)需作量化处理。量化处理是一个多到一
的映射它是造成 dct 编解码信息损失的根源。在 jpeg 标准中采用线性均匀量化器。量化定义
为,对 64 个 dct 变换系数 f(u,v)除以量化步长 q(u,v)后四舍五入取整。即量化器步长是量
化表的元素,量化表元素随 dct 变换系数的位置而改变,同一像素的亮度量化表和色差量化
表不同值,量化表的尺寸也是 64,与 64 个变换系数一一对应。量化表中的每一个元素值为
1 至 255 之间的任意整数,其值规定了对应位置变换系数的量化器步长。在接收端要进行逆
量化,逆量化的计算公式为:
&Tag=1162433038 class="MsoNormal" style="text-indent:
"> 不同频率的余弦函数对视觉的影响不同,量化处理是在一定的主观保真度图像质量
的前提下,可据不同频率的视觉阈值来选择量化表中的元素值的大小。根据心理视觉加权函
数得到亮度化表和色度量化表。dct 变换系数 f(u,v)除以量化表中对应位置的量化步长,
其幅值下降,动态范围变窄,高频系数的零值数目增加。
(3)熵编码
为进一步达到压缩数据的目的,需对量化后的 dc 系数和行程编码后的 ac 系数进行基于
统计特性的熵编码。64 个变换系数经量化后,坐标 u=v=0 的值是直流分量(即 dc 系数)。dc
系数是 64 个图像采样平均值。因为相邻的 8×8 块之间有强的相关性,所以相邻块的 dc 系数
值很接近,对量化后前后两块之间的 dc 系数差值进行编码,可以用较少的比特数。dc 系数
包含了整个图像能量的主要部分。经量化后的 63 个 ac 系数编码时从左上方 ac(u=7,v=7)开
始,沿箭头方向,以“z”字形行程扫描,直到 ac(u=7,v=7)扫描结束。量化后特编码的 ac
系数通常有许多零值,沿“z”字形路径行进,可使零 ac 系数集中,便于使用行程编码方法。
63 个 ac 系数行程编码和码字,可用两个字节表示。jpeg 建议使用两种熵编码方法:huffman
编码和自适应二进制算术编码。熵编码可分成两步进行,首先把 dc 和 ac 系数转换成一个中
间格式的符号序列,第二步是给这些符号赋以变长码字。
第五章 多媒体计算机硬件及软件系统结构
单项选择题 1-8:
1、组成多媒体系统的途径有哪些:
(1)直接设计和实现 (2)增加多媒体升级套件进行扩展
(3)cpu 升级 (4)增加 cd-da
(a)仅(1) (b)(1)(2) (c)(1)(2)(3) (d)全部
答:(b)
2、下面硬件设备中哪些是多媒体硬件系统应包括的:
(1)计算机最基本的硬件设备 (2)cd-rom
(3)音频输入、输出和处理设备 (4)多媒体通信传输设备
(a)仅(1) (b)(1)(2) (c)(1)(2)(3) (d)全部
答:(c)
3、mpc-2、mpc-3 标准制定的时间分别是:
(1)1992 (2)1993 (3)1994 (4)1995
(a)(1)(3) (b)(2)(4) (c)(1)(4) (d)都不是
答:(b)
4、下面哪些是 mpc 对音频处理能力的基本要求:
(1)录入声波信号 (2)处理声波信号
(3)重放声波信号 (4)用 midi 技术合成音乐
(a)(1)(3)(4) (b)(2)(3)(4) (c)(1)(2)(3) (d)全部
答:(d)
5、下面哪些是 mpc 对视频处理能力的基本要求:
(1)播放已压缩好的较低质量的视频图象
(2)实时采集视频图象
(3)实时压缩视频图象
(4)播放已压缩好的高质量分辨率的视频图象
(a)仅(1) (b)(1)(2) (c)(1)(2)(3) (d)全部
答:(a)
6、下面哪些是 mmx 技术的特点:
(1)打包的数据类型 (2)与 ia 结构安全兼容
(3)64 位的 mmx 寄存储器组 (4)增强的指令系统
(a)(1)(3)(4) (b)(2)(3)(4) (c)(1)(2)(3) (d)全部
答:(d)
7、下面哪些是称得上的多媒体操作系统:
(1)windows 98 (2)quick time
(3)avss (4)authorware
(a)(1)(3) (b)(2)(4) (c)(1)(2)(3) (d)全部
答:(c)
8、下面哪些是 mpc 的图形、图象处理能力的基本要求:
(1)可产生丰富形象逼真的图形
(2)实现三维动画
(3)可以逼真、生动地显示彩色静止图象
(4)实现一定程度的二维动画
(a)(1)(3)(4) (b)(2)(3)(4) (c)(1)(2)(3) (d)全部
答:(a)
9、详述 intel/ibm 公司研制的 dvi 多媒体计算机系统成功和失败的经验教训,理想的系统如
何设计实现。
答:dvi 系统能够用计算机综合处理声、文、图信息。
从硬件方面看:
(1)选用了 plv(product leave vedio)视频压缩编码算法,产生 avi 文件。
(2)为了实现 plv 算法,dvi 系统设计制造了两个专用芯片 82750pa(pb)(象素处理器)
和 82750da(db)(显示处理器)。
( 3 ) 同 时 设 计 了 三 个 专 用 的 门 阵 电 路 , 即 82750lh ( 主 机 接 口 门 阵 )、 82750lv
(vram/scsi/capture 接口门阵)和 82750la(视频子系统接口门阵)。
(4)设计实现了 ave(视频音频引擎)。
从软件方面看:
dvi 系统设计实现了 dos 环境下的 avss(audio vedio subsystem)和 windows 环境下的
avk(audio vedio kernel),dvi 系统中最成功的部分是 ave(视频音频引擎)。ave 包括三个部
分,即视频子系统、音频子系统和 avbus(视频音频总线)。
1.视频子系统
视频子系统的作用是视频信号处理和显示引擎,它们由 82750pb(象素处理器)、vram
以及 82750db(显示处理器)组成。其中存储器阵列 vram 存放所有 dvi 系统数据,即:位
映射的数据、压缩编解码数据、算法微码、控制执行算法的数据结构以及控制显示功能的寄
存器集数据。象素处理器 82750pb 用微码执行及视频图象快速处理算法、视频特技以及数字
式运动图象和静止图象的压缩编码算法以及解码算法。显示处理器 82750db 有非常灵活的可
编程功能,它能够将不同的位映射数据转换成在监视器上显示需要的模拟信号。
82750pb 象素处理器具有较宽的指令字长(48 位),直接连到 vram 的随机或并行通道,
由于不同指令字的不同字段分别控制硬件机构,所以这些指令可以同时执行多种操作,它包
括两个分开并对称的内插 16 位数据总线、为 8 位象素计算专门分开的 alu 操作;在解压缩
时为运动补偿设计了象素插值器,解压缩编码数据流设计了统计解码器;以及为了同 dvi 的
vram 传输数据所设计的四个先进先出(fifo)数据缓冲区。82750pb 象素处理器运行较小的
微码译码器,它定时询问在 vram 中的命令表。由计算机建立主命令表,微码命令由主机直
接引导加载到 82750pb 微码存储器中,当命令表指出某些操作需要运行时,如解码操作,微
码译码器从 vram 中将一个微码块加载到 82750pb 内部的微码存储器中,并且执行它。这些
解码是由主计算机设计并加载到 vram 中的。
82750db 显示处理器连到 vram 的串行或顺序通道,显示处理器有几种不同的 vram 的位
映射格式,可直接解释成在监视器显示屏幕上所需要的模拟信号数据流,yuv 数据在 vram
中分别在三个门映射区存储,82750db 显示处理器把这三个位映射区取来并混合在一起,完
成解压缩的最后一步。同时,通过计算水平面和垂直方向每个 u 和 v 的四个采集样点的平均
值,完成色差信号的插值,然后 82750db 要进行从 yuv 到 rgb 彩色空间的转换,把三个 8 位
数字信号送到 d/a 变换器,最后输出模拟信号到彩色监视器。
2.音频子系统
音频子系统由音频信号处理器、数字到模拟的转换硬件以及模拟滤波器组成。它与视频
子系统并行操作、解决音频信号的压缩、编码和解码,还解决音频信号的 a/d、d/a 转换以及
音响声效的特技处理。
音频子系统的核心器件是 ad(analog device)公司的 ad-2105 数字信号处理器(dsp),
通过它完成所有音频信号的压缩和解压缩任务。dvi 系统采用自适应预测编码(adpcm)算
法将 16 位的采样数据压缩编码成 4 位码,最后将压缩的音频数据输出到 d/a 转换器,dsp 的
垂直消隐中断出现在每个显示帧的场逆程,以此来解决视频数据流和音频数据流的同步问题。
数字到模拟量的转换器是由 burr-brown 公司生产的 pcm66p 单片立体声 16 位串行接口组成。
跟着 d/a 变换器是双通道的模拟滤波器,其截止频率近似固定在 17khz,并且有 5 个极点。
3.avbus 视频音频总线
为了支持视频音频子系统,大量的基本数据必须在 dvi 的 vram 和 dvi 的其余设备(包
括外部设备、主机、获取子系统)之间传送。dvi 中数据的通信通道采用了 vram 的具有多
路开关功能的 32 位数据和地址总线,即 avbus。avbus 解决了视频音频流的问题。avbus 由
vram 并行通道的数据信号组成,所有三个门阵、82750pb 象素处理器以及 vram 都直接连到
总线上,很多时间 avbus 作为 vram 和 82750pb 之间单一的数据总线,因而它们是默认的
avbus 的主设备。为了在 avbus 上传输数据,首先必须把总线控制权从 82750pb 手中转让给
申请控制权的 dvi 设备,主机接口门阵是各种请求的仲裁器,通常采用主从型。一旦一个请
求信号被仲裁器承认了,总线控制权从 82750pb 转让给该设备,允许在 avbus 执行该设备的
通信协议。
avss 是在 dos 环境下运行的 dvi 系统的支撑软件,avk 是在 windows 环境下运行的 dvi
系统的支撑软件。
(1)最下层的 dvi 系统的硬件包括:视频版、音频板、多功能板以及 pc/at 的硬件。初
始化时直接和硬件打交道的软件在引导程序作用下安装到系统 ram 中常驻内存。一种多媒
体硬件设备需要一个驱动程序模块,有为视频板设计的视频驱动程序、为音频板设计的音频
驱动程序以及多功能板设计的多功能驱动程序。
(2)再上一层是驱动接口模块,驱动接口模块建立了为高层应用软件使用的虚拟设备。
在 dvi 系统中共有四个驱动接口模块,即 a)微码接口模块[mc]:它是 82750pa 的接口模块,
负责微码的加载和执行,同时也负责主机系统对 vram 的存取。b)视频接口模块[vid]:它
是 82750da 的接口模块,负责 82750da 的初始化。同时,它还包含了视频信号数字化器的接
口软件。c)多功能接口模块[utl]:它提供 cd-rom 和操纵杆的接口软件。d)音响接口模块:
它是音响板和音响数字化器的接口软件。
在同一层次上还有两个 ibmpc/dos 的扩展模块:a)实时执行模块[rtx]:它为 dvi 应用软
件提供实时多任务操作系统环境。b)microsoft cd-rom 模块[mscdex]:它是 dos 扩展模块,
能够使满足 iso 9660 的 cd-rom 用一般的方法在硬盘和软盘上自由存取。
(3)在第三层有两个高层次的软件包,即图形软件包 [gr]和音频视频支撑软件
avss[av]。a)图形软件包[gr]:它提供图象处理,图形绘图基元以及视频管理功能。b)音频
视频支撑软件 avss[av]:avss 软件可管理 avss 格式写的视频、音频文件。
(4)最上面是应用层,它可以提供大量的应用程序。在应用层下面还有两个高层的 dvi
系统的接口,即 dvi 系统生产工具软件和多媒体编程工具语言。
dvi 系统实现了 ave 和 avss 或 avk,因而比较成功地解决了声、文、图信息的综合处理
问题。它是一个比较成熟的多媒体计算机系统,它获得了“comdex 91”最佳媒体产品奖和
最佳展示奖。
dvi 系统失败的地方是:由于现行的视频压缩国际标准是 、、mpeg-1 、
mpeg-2,而 dvi 的视频压缩算法采用非国际标准(avi 文件),这便是它的失败之处。
理想系统设计和实现:
(1)采用国际标准的设计原则
标准化是产业活动成功的前提,为了使新型的计算机增加多媒体数据的获取、压缩和解
压缩、实时处理和特技、输出和通信等功能,设计时必须采用国际标准。如视频的 、
、、mpeg-1 、mpeg-2,音频的国际标准有 、、、、、
。
(2)多媒体和通信功能的单独解决变成集中解决
计算机综合处理声、文、图信息和通信功能,过去的解决办法是设计专用接口卡分散单
独解决,例如使用类似声霸卡解决声音的输入输出和实时编码、解码及处理问题,使用视频
压缩编码和解码卡解决视频信号压缩和解压缩问题等。现在希望采用微码引擎,设计制造适
合的 dsp 或阵列处理器通过微码变成综合解决这些问题。
(3)体系结构设计和算法相结合
要想使计算机具有综合处理声、文、图信息和通信功能的最佳解决办法是把计算机体系
结构设计和算法相结合。综合处理声、文、图信息和通信功能算法的核心是数字信号处理,
数组向量运算,即以乘加运算为核心的矩阵运算。
(4)把多媒体和通信技术做到 cpu 芯片中
多媒体计算要必须使其与网络相结合,为了使计算机具有多媒体和通信功能,最早的解
决办法是采用专用芯片设计制造专用接口卡;其次是把多媒体和通信功能作到母板上,最佳
的方案是将多媒体和通信功能融合到 cpu 芯片中。从目前的发展趋势看可以把融合方案分成
两类:一类是以多媒体和通信功能为主,融合 cpu 芯片原有的计算功能,其设计目标是用在
多媒体专用设备、家电和宽带通信设备上,可以取代这些设备中 cpu 及大量的 asic 及其它芯
片。另一类是以通用 cpu 计算功能为主,融合多媒体和通信功能,它们的设计目标与现有计
算机系列兼容,融合多媒体和通信功能,主要用在多媒体计算机中。
第六章 超文本和超媒体
单项选择题 1-5:
1、在超文本和超媒体中不同信息块之间的连接是通过( )连接。
(a)节点 (b)字节 (c)链 (d)字
答:(c)
2、超文本的三个基本要素是:
(1)节点 (2)链 (3)网络 (4)多媒体信息
(a)(1)(2)(4) (b)(2)(3)(4) (c)(1)(3)(4) (d)(1)(2)(3)
答:(d)
3、超文本和超媒体体系结构的三层模型是哪一年提出的?
(a)1985 (b)1988 (c)1989 (d)1990
答:(b)
4、下列的叙述哪些是正确的:
(1)节点在超文本中是信息的基本单元
(2)节点的内容可以是文本、图形、图象、动画、视频和音频
(3)节点是信息块之间连接的桥梁
(4)节点在超文本中必须经过严格的定义
(a)(1)(3)(4) (b)(1)(2) (c)(3)(4) (d)全部
答:(b)
5、下列的叙述哪些是错误的:
(2)链的结构分为三部分:链源、链缩及链的属性;
(3)链是连接节点的桥梁
(4)链在超文本中必须经过严格的定义
(5)链在超文本和超媒体中是统一的
(a)(1)(2) (b)(1)(3) (c)(3)(4) (d)全部
答:(c)
6、超文本和超媒体系统中的数据库层与传统的数据库有什么不同?
答:超文本和超媒体系统中的数据库层是模型中的最低层,比普通的数据库管理系统更为简
单,用于处理所有信息存储中的传输问题。如存储分配管理、缓冲区调度、存储控制等等,
其基本功能是对节点和链等的基本信息进行存储、管理和访问,并保证这些操作对于高层的
超文本抽象机层来说是透明的,即无论高层访问的信息是存储在本地或远地,是存储在一台
计算机中还是存储中多台计算机中,数据库层都能保证正确的存储。
超文本和超媒体系统中的数据库由于具有多媒体数据所以信息量很大,因此用到大容量
的存储技术,如大容量的磁盘、光盘等。而传统的数据库信息量没有那么大,而且信息量比
较单一,一般都是文档或数据等。但是在超文本和超媒体的数据库层的设计中也用到了大量
的传统数据库的思想方法。
7、超文本和超媒体的组成要素与操作工具有哪些?
答:超文本和超媒体的组成要素是由节点、链和网络等组成。其中节点可分为表现型用于记
录各种媒体信息,另一种是组织型用于组织并记录节点间的联结关系。
节点可归纳为以下基本类型:
文本节点、图形节点、图形节点、音频节点、视频节点、混合媒体节点、按钮节点、组
织型节点和推理型节点。
链:链由三部分组成,即链源、链缩和链的属性。而链的种类可分为:基本结构链、(基
本链、交叉检索链、节点内注释链)、推理链、隐型链等。
网络:即超文本和超媒体的数据库由声、文、图各类节点和链组成网络。
超文本和超媒体的操作工具主要有:编辑器、编译器、阅读器、导航工具等,而导航工
具又可分为:导航图、查询系统、线索、遍历、书签等。
第七章 多媒体计算机的应用技术
单项选择题 1-8:
1、下面哪一种说法是不正确的:
(a)电子出版物存储容量大,一张光盘可存储几百本书。
(b)电子出版物可以集成文本、图形、图象、动画、视频和音频等多媒体信息。
(c)电子出版物不能长期保存。
(d)电子出版物检索快。
答:(c)
2、在视频会议系统中关键技术是:
(a)视频会议系统的标准 (b)多点控制单元 mcu
(c)视频会议终端 (d)视频会议系统的安全保密
答:(b)
3、下面哪一种说法是不正确的:
(a)视频会议系统是一种分布式多媒体信息管理系统
(b)视频会议系统是一种集中式多媒体信息管理系统
(c)视频会议系统的需求是多样化的
(d)视频会议系统是一个复杂的计算机网络系统
答:(b)
4、在视频会议系统中安全密码系统包括哪些功能:
(1)秘密性、可验证性 (2)完整性、不可否认性
(3)合法性、对称性 (4)兼容性、非对称性
(a)(3)(4) (b)(1)(2) (c)(2)(4) (d)全部
答:(b)
5、视频会议系统设立了哪些访问权限:
(1)超级、优先 (2)一般、作废
(3)排除、优先 (4)超级、中断
(a)(1)(2) (b)(3)(4) (c)(1)(4) (d)全部
答:(a)
6、基于内容检索的体系结构可分为哪两个子系统:
(a)特征抽取和查询子系统
(b)多媒体数据管理和调度子系统
(c)用户访问和数据库管理子系统
(d) 多媒体数据查询和用户访问子系统
答:(a)
7、基于内容检索要解决的关键技术是:
(1)多媒体特征提取和匹配 (2)相似检索技术
(3)多媒体数据管理技术 (4)多媒体数据查询技术
(a)(3)(4) (b)(2)(3) (c)(1)(2) (d)全部
答:(c)
8、视频会议系统最著名的标准是:
(a) 和 (b) 和
(c) 和 (d) 和
答:(b)
9、在视频会议系统中为什么需要 qos?
答:视频会议系统是一种分布式多媒体信息管理系统,或称为分布式多媒体通信系统。因此
在通信的传输过程中要求有较好的服务质量(qos),不仅要求能够快速传送视频、音频和数
据,而且要求视频和音频连续媒体必须保证在明确规定的时间内无差错传送给用户,以便在
终端系统播放具备良好的质量。为了获得服务质量的保证,在业务执行过程中需要对计算机、
网络、mcu 及终端的各种资源进行控制和管理。
对于视频会议系统还要求:高数据吞吐量,经过压缩的数据一个视频流也需要 64kbps
到 2mbps 的数据吞吐率;实时性,视频会议系统的终端同时要播放视频、音频和数据信息
要有严格的时间要求,即需要为无差错传送提供时间保证;服务质量保证,用户使用视频会
议业务要和其他业务进行对比,因此不能提供一定的服务质量保证,用户就可选择其他种类
的业务。
视频会议系统需求是多样化,多媒体业务也是多样化,为使这些需求和业务能够定量化
的描述,往往采用参数化,而不必为每个应用都实行一套新的系统集。而采用国际标准化组
织采用服务质量(qos)的标准。
国际标准化组织(iso)指定著名的七层标准计算机通信协议 osi-rm。在 osi-rm 中把 qos
参数分成面向功能的 qos 参数和非面向功能的 qos 参数两类。
对于一个网络多媒体系统一般包含有三个抽象层:应用层、系统层(通信和操作系统)
和设备层(网络和多媒体终端设备),而这三层都需要考虑 qos 参数。
10、简述多媒体数据库中基于内容检索系统的工作原理。
答:多媒体数据库基于内容检索系统的工作原理概述如下:
基于内容的检索作为一种信息检索技术,接入或嵌入到其他多媒体系统中,提供基于多
媒体数据库的检索体系结构见教材 325 页图 所示。
由图 可见,基于内容检索系统分为两个子系统:特征抽取子系统和查询子系统。
系统包括如下功能模块:
(1)目标识别:为用户提供自动半自动识别静态图象、视频、镜头的代表帧,是用户
感兴趣的内容或区域。
视频序列图象动态目标,对目标进行特征抽取、查询,处理进行整体的或局部的内容检
索,可采用全局特征或局部的特征。
(2)特征抽取:提取用户感兴趣的又适合于基于内容检索的特征。如颜色分布情况、
颜色的组成情况、纹理结构、方向对称关系、轮廓形状大小。
(3)数据库:多媒体数据库,声、文、图;特征库,预处理特征;知识库,知识表达。
(4)查询接口:有三种输入方式:交互输入方式、模板选择输入方式、用户提交特征
样板输入方式。多媒体特征组合功能和查询结果浏览。
(5)检索引擎:利用特征之间的距离函数来进行相似性检索。对于不同的特征用不同
的相似性测度算法,检索引擎中系统有效的是相似性测度函数集。
(6)索引/过滤:通过索引和过滤达到快速搜索的目的。把全部的数据通过过滤器变成
新的集合再用高维特征匹配来检索。
基于内容检索的工作过程包括以下几个步骤:
(1)提交查询要求:利用系统人机交互界面输入方式形成一个查主询条件。
(2)相似性匹配:将查寻特征与数据库中的特征按一定的匹配算法进行匹配。
(3)返回侯选结果:满足一定相似性的一组侯选结果按相似度大小排列返回给用户。
(4)特征调整:对系统返回的一组初始特征的查询结果,用户通过浏览选择满意的结
果,或进行特征调整,形成新的查询,直到查询结果满意为止。
基于内容检索的工作过程见教材 326 页图 所示。