计算机系统结构三四章作业及答案

解决流水线瓶颈问题有哪两种常用方法？答：细分瓶颈段与重复设置瓶颈段有一条指令流水线如下所示：

（1

（? ?

TP =

有一个流水线由4段组成，其中每当流过第三段时，总要在该段循环一次，然后才能流到第4段。如果每段经过一次所需的时间都是△t ，问：

（1）当在流水线的输入端连续地每△t 时间输入一个任务时，该流水线会发生什么情况？

（2）此流水线的最大吞吐率为多少？如果每2△t 输入一个任务，连续处理10个任务时，其实际吞吐率和效率是多少？

（3）当每段时间不变时，如何提高流水线的吞吐率？人连续处理10个任务时，其吞吐率提高多少？

解：（1）会发生流水线阻塞情况。

（2）

（3）重复设置部件

吞吐率提高倍数＝

t ??2310

有一条动态多功能流水线由5段组成，加法用1、3、4、5段，乘法用1、2、5段，第2段的时间为2△t ，其余各段的时间均为△t ，而且流水线的输出可以直接返回输入端或暂存于相应的流水线寄存器中。现在该流水线上计算

∏=+4

)(i i i

B A

，画出时空图，并计算其吞吐率、加速比和效率。

4＋B 4；再计算(A 由图可见，它在18个△t 时间中，给出了7个结果。所以吞吐率为：

如果不用流水线，由于一次求积需3△t ，一次求和需5△t ，则产生上述7个结果共需（4×5+3×3）△t =29△t 。所以加速比为：

该流水线的效率可由阴影区的面积和5个段总时空区的面积的比值求得： △t,需经9△t 才能完成一个任务,其预约表如下所示。

（1）画出流水线任务调度的状态转移图。

时间

入

A 1

B 1 A 2 B 2 A 3 B 3 A 4 B 4

A B C

A ×

C ×D

（2）求流水线的最有调度策略和流水线的最大吞吐率。

（3）按最优调度策略连续输入6个任务，流水线的实际吞吐率是多少？

述3种向量处理方式，它们对向量处理机的结构的要求有何不同？

CRAY-l机器上，按照链接方式执行下述4条向量指令(括号中给出了相应功能部件时间)，如果向量寄存器和功能部件之间的数据传送需要1拍，试求此链接流水线的通过时间是多少拍？如果向量长度为 64，则需多少拍才能得到全部结果。

V0←存储器（从存储器中取数：７拍）

V2←V0＋V1 （向量加：３拍）

V3←V2＜A3 （按(A3)左移：４拍）

V5←V3∧V4 （向量逻辑乘：２拍）

量处理机有16个向量寄存器，其中V0-V5种分别存放有向量A,B,C,D,E,F,向量的长度是8,向量各元素均为浮点数；处理部件采用两个单功能流水线，加法功能部件时间为2拍，乘法功能部件时间为3拍。采用类似CRAY-1的链接技术，先计算(A+B)×C,在流水线不停的情况下，接着计算(D+E)×F。

（1）求此链接流水线的通过时间是多少拍?（设寄存器出入各需1拍）

（2）假如每排时间为50ns，完成这些计算并把结果存进相应寄存器，此处理部件的时间吞吐率为多少MFLOPS?

计算机系统结构三四章作业及答案

3.1 简述流水线技术的特点。（1）流水线把一个处理过程分解为若干个子过程，每个子过程由一个专门的功能部件来实现。因此，流水线实际上是把一个大的处理功能部件分解为多个独立的功能部件，并依靠它们的并行工作来提高吞吐率。（2）流水线中各段的时间应尽可能相等，否则将引起流水线堵塞和断流。（3）流水线每一个功能部件的前面都要有一个缓冲寄存器，称为流水寄存器。（4）流水技术适合于大量重复的时序过程，只有在输入端不断地提供任务，才能充分发挥流水线的效率。（5）流水线需要有通过时间和排空时间。在这两个时间段中，流水线都不是满负荷工作。 3.2 解决流水线瓶颈问题有哪两种常用方法？答：细分瓶颈段与重复设置瓶颈段 3.3 有一条指令流水线如下所示：（1 用两给出条指（1）（24? 变八级流水线（细分） ? 重复设置部件 )(ns 85 1 T n TP 1pipeline -== 3.4 有一个流水线由4段组成，其中每当流过第三段时，总要在该段循环一次，然后才能流到第4段。如果每段经过一次所需的时间都是△t ，问：（1）当在流水线的输入端连续地每△t 时间输入一个任务时，该流水线会发生什么情况？（2）此流水线的最大吞吐率为多少？如果每2△t 输入一个任务，连续处理10个任务时，其实际吞吐率和效率是多少？（3）当每段时间不变时，如何提高流水线的吞吐率？人连续处理10个任务时，其吞吐率提高多少？解：（1）会发生流水线阻塞情况。

（2）（3）重复设置部件吞吐率提高倍数＝ t t ??2310 75 ＝1.64 3.5 有一条动态多功能流水线由5段组成，加法用1、3、4、5段，乘法用1、2、5段，第2段的时间为2△t ，其余各段的时间均为△t ，而且流水线的输出可以直接返回输入端或暂存于相应的流水线寄存器中。现在该流水线上计算 ∏=+4 1 )(i i i B A ，画出时空图，并计算其吞吐率、加速比和效率。＋B 4；再计算由图可见，它在18个△t 时间中，给出了7个结果。所以吞吐率为：如果不用流水线，由于一次求积需3△t ，一次求和需5△t ，则产生上述7个结果共需（4×5+3×3）△t =29△t 。所以加速比为：该流水线的效率可由阴影区的面积和5个段总时空区的面积的比值求得： 3.6 在一个5段流水线处理机上,各段执行时间均为△t,需经9△t 才能完成一个任务,其预约表如下所示。段23 时间入 A 1 B 1 A 2 B 2 A 3 B 3 A 4 B 4 A B C D A × B C ×D

计算机系统结构第四章(习题解答)

1. 假设一条指令的执行过程分为“取指令”、“分析”和“执行”三段，每一段的时间分别是△t 、2△t 和3△t 。在下列各种情况下，分别写出连续执行n 条指令所需要的时间表达式。 ⑴ 顺序执行方式。 ⑵ 仅“取指令”和“执行”重叠。 ⑶ “取指令”、“分析”和“执行”重叠。答： 1 2 3 4 ...... 1 2 3 4 1 2 3 4 T ＝6△t ＋∑=1 -n 1 i i )t (执行＝6△t ＋(n-1)(3△t)＝(3n ＋3)△t △t 2△t 3△t

2. 一条线性流水线有4个功能段组成，每个功能段的延迟时间都相等，都为△t。开始5个任务，每间隔一个△t向流水线输入一个任务，然后停顿2个△t，如此重复。求流水线的实际吞吐率、加速比和效率。答： n→ I1：R1←A1+A2 I2：R2←A3+A4 I3：R3←A5+A6 I4：R4←A7+A8 I5：R5←A9+A10 I6：R6←R1+R2 I7：R7←R3+R4

I8：R8←R5+R6 I9：F←R7+R8 这并不是唯一可能的计算方法。假设功能段的延迟为Δt。时空图如下（图中的数字是指令号）： I4：R3←A3*B3 I11：R10←R6+R7 I5：R4←A4*B4 I12：R11←R8+R9 I6：R5←A5*B5 I13：F←R10+R11 I7：R6←A6*B6 假设功能段的延迟为Δt。时空图如下（图中的数字是指令号）： 1 2 3 4 5 6 7 8 9 10 11 12 13

1 2 3 4 5 6 7 1 2 3 4 5 6 7 8 9 10 11 12 13 8 9 10 11 12 13 1 2 3 4 5 6 7 8 9 10 11 12 13 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 222324 整个计算过程需要24Δt，所以吞吐率为： 5. S 2 ⑴ ⑵ ⑶ 答： ⑴ 下表： ⑵ 每间隔两个△t向流水线的输入端连续输入新任务（如见下表所示）可获得最佳性能。

计算机系统结构网上作业

计算机系统结构作业参考答案一、 1、试述现代计算机系统的多级层次结构。计算机系统具有层次性，它由多级层次结构组成。从功能上计算机系统可分为五个层次级别：第一级是设计级。这是一个硬件级，它由机器硬件直接执行。第二级是一般机器级，也称为机器语言级。它由微程序解释系统.这一级是硬件级。第三级是操作系统级，它由操作系统程序实现。这些操作系统由机器指令和广义指令组成，这些广义指令是操作系统定义和解释的软件指令。这一级也称混合级。第四级是汇编语言级。它给程序人员提供一种符号形式的语言，以减少程序编写的复杂性。这一级由汇编程序支持执行。第五级是高级语言级。这是面向用户为编写应用程序而设置的。这一级由各种高级语言支持。 2、试述RISC设计的基本原则和采用的技术。答：一般原则： (1)确定指令系统时，只选择使用频度很高的指令及少量有效支持操作系统，高级语言及其它功能的指令，大大减少指令条数，一般使之不超过100条； (2)减少寻址方式种类，一般不超过两种； (3)让所有指令在一个机器周期内完成； (4)扩大通用寄存器个数，一般不少于32个，尽量减少访存次数； (5)大多数指令用硬联实现，少数用微程序实现； (6)优化编译程序，简单有效地支持高级语言实现。

基本技术： (1)按RISC一般原则设计，即确定指令系统时，选最常用基本指令，附以少数对操作系统等支持最有用的指令，使指令精简。编码规整，寻址方式种类减少到1、2种。 (2)逻辑实现用硬联和微程序相结合。即大多数简单指令用硬联方式实现，功能复杂的指令用微程序实现。 (3)用重叠寄存器窗口。即：为了减少访存，减化寻址方式和指令格式，简有效地支持高级语言中的过程调用，在RISC机器中设有大量寄存嚣，井让各过程的寄存器窗口部分重叠。 (4)用流水和延迟转移实现指令，即可让本条指令执行与下条指令预取在时间上重叠。另外，将转移指令与其前面的一条指令对换位置，让成功转移总是在紧跟的指令执行之后发生，使预取指令不作废，节省一个机器周期。 (5)优化设计编译系统。即尽力优化寄存器分配，减少访存次数。不仅要利用常规手段优化编译，还可调整指令执行顺序，以尽量减少机器周期等。 3、试述全相联映像与直接映像的含义及区别（1）全相连映像主存中任何一个块均可以映像装入到Cache中的任何一个块的位置上。主存地址分为块号和块内地址两部分，Cache地址也分为块号和块内地址。Cache的块内地址部分直接取自主存地址的块内地址段。主存块号和Cache块号不相同，Cache块号根据主存块号从块表中查找。Cache保存的各数据块互不相关，Cache必须对每个块和块自身的地址加以存储。当请求数据时，Cache控制器要把请求地址同所有的地址加以比较，进行确认。（2）直接映像把主存分成若干区，每区与Cache大小相同。区内分块，主存每个区中块的大小和Cache 中块的大小相等，主存中每个区包含的块的个数与Cache中块的个数相等。任意一个主存块只能映像到Cache中唯一指定的块中，即相同块号的位置。主存地址分为三部分：区号、块号和块内地址，Cache地址分为：块号和块内地址。直接映像方式下，数据块只能映像到Cache中唯一指定的位置，故不存在替换算法的问题。它不同于全相连Cache，地址仅需比较一次。（3）区别：全相连映像比较灵活，块冲突率低，只有在Cache中的块全部装满后才会出现冲突，Cache 利用率高。但地址变换机构复杂，地址变换速度慢，成本高。直接映像的地址变换简单、速度快，可直接由主存地址提取出Cache地址。但不灵活，块冲突率较高，Cache空间得不到充分利用。 4. 画出冯?诺依曼机的结构组成？

计算机系统结构课后答案

1、数据结构和机器的数据表示之间是什么关系？确定和引入数据表示的基本原则是什么？答：数据表示是能由硬件直接识别和引用的数据类型。数据结构反映各种数据元素或信息单元之间的结构关系。数据结构要通过软件映象变换成机器所具有的各种数据表示实现，所以数据表示是数据结构的组成元素。不同的数据表示可为数据结构的实现提供不同的支持，表现在实现效率和方便性不同。数据表示和数据结构是软件、硬件的交界面。除基本数据表示不可少外，高级数据表示的引入遵循以下原则：（1）看系统的效率有否提高，是否养活了实现时间和存储空间。（2）看引入这种数据表示后，其通用性和利用率是否高。 2、标志符数据表示与描述符数据表示有何区别？描述符数据表示与向量数据表示对向量数据结构所提供的支持有什么不同？答：标志符数据表示指将数据类型与数据本身直接联系在一起，让机器中每个数所都带类型樗位。其优点是：（1）简化了指令系统和程序设计；（2）简化了编译程序；（3）便于实现一致性校验；（4）能由硬件自动变换数据类型；（5）支持数据库系统的实现与数据类型无关；（6）为软件调试和应用软件开发提供支持。缺点是：（1）会增加程序所点的主存空间；（2）在微观上对机器的性能（运算速度）不利。数据描述符指数据的描述与数据分开存放，描述所访问的数据是整块还是单个的，及访问该数据块或数据元素的地址住处它具备标志符数据表示的优点，并减少了标志符数据表示所占的空间，为向量和数组结构的实现提供支持。数据描述符方法优于标志符数据表示，数据的描述与数据分开，描述所访问的数据是整块还是单个的，及访问该数据块或数据元素的地址信息，减少了樗符数据表示所占的窨。用描述符方法实现阵列数据的索引比用变址方法实现要方便，且便于检查出程序中的阵列越界错误。但它不能解决向量和数组的高速运算问题。而在有向量、数组数据表示的向量处理机上，硬件上设置有丰富的赂量或阵列运算指令，配有流水或阵列方式处理的高速运算器，不仅能快速形成向量、数组的元素地址，更重要的是便于实现把向量各元素成块预取到中央处理机，用一条向量、数组指令流水或同时对整个向量、数组高速处理．如让硬件越界判断与元素运算并行。这些比起用与向量、阵列无关的机器语言和数据表示串行实现要高效的多。 3、堆栈型机器与通用寄存器型机器的主要区别是什么？堆栈型机器系统结构为程序调用的哪些操作提供了支持？答：有堆栈数据表示的机器称为堆栈机器。它与一般通用寄存器型机器不同。通用寄存器型

华科专升本计算机系统结构-作业全

第一章作业简答题 1、简述什么是计算机系统结构。 2、答：计算机系统结构是程序员所看到的计算机属性，即概念性结构与功能性结构。 3、 4、计算机系统的层次从下到上包括哪些？ 5、答：计算机系统的层次从上到下包括微程序机器级、机器语言、操作系统虚拟机、汇编语言虚拟机、高级语言虚拟机、应用语言虚拟机。 6、 7、Flynn分类法是以什么对计算机系统进行分类分成哪几类？ 8、答：Flynn分类法是以指令流和数据流的多倍性对计算机系统进行分类。Flynn分类法把计算机系统的结构分为以下4类：单指令流单数据流、单指令多数据流、多指令流单数据流、多指令流多数据流。 9、 10、简述Amdahl定律及加速比计算公式。答：Amdahl定律指出加快某部件执行速度所能获取得系统性加速比，受限于该部件的执行时间占系统中总执行时间的百分比。加速比计算公式=系统性能（改进后）/系统性能（改进前）=总执行时间（改进前）/总执行时间（改进后）计算题 5、如果某一些计算任务用向量方式求解比用标量方式求解快20倍。为达到加速比2，可用向量方式求解所花费时间占总的时间的百分比为多少解：由题可知，系统加速比=2，部件加速比=20，通过向量方式求解可改进比例未知，可设为X。根据Amdahl定律可知系统加速比=1/[(1-X)+X/20]=2 求解得X=10/19 由此可得，可用向量方式求解所花费时间占总的时间的百分比魏53% 第二章作业 1、简述指令集结构设计的基本原则。完整性、规整性、高效性和兼容性 2、简述RISC结构的设计原则。 1）选取使用频率最高的指令，并补充一些最有用的指令； 2）每条指令的功能应尽可能简单，并在一个机器周期内完成； 3）所有指令长度均相同； 4）只有Load和Store操作指令才访问存储器，其它指令操作均在寄存器之间进行； 5）以简单有效的方式支持高级语言。 3

(完整版)计算机系统结构试题及答案

计算机系统结构复习题单选及填空：计算机系统设计的主要方法 1、由上往下的设计（top-down） 2、由下往上的设计（bottom-up） 3、从中间开始（middle-out） Flynn分类法把计算机系统的结构分为以下四类：（1）单指令流单数据流（2）单指令流多数据流（3）多指令流单数据流 (4) 多指令流多数据流堆栈型机器：CPU 中存储操作数的单元是堆栈的机器。累加器型机器：CPU 中存储操作数的单元是累加器的机器。通用寄存器型机器：CPU 中存储操作数的单元是通用寄存器的机器。名词解释：虚拟机：用软件实现的机器叫做虚拟机，但虚拟机不一定完全由软件实现，有些操作可以由硬件或固件（固件是指具有软件功能的固件）实现。系列机：由同一厂家生产的具有相同系统结构、但具有不同组成和实现的一系列不同型号的计算机。兼容机：它是指由不同公司厂家生产的具有相同系统结构的计算机。流水线技术：将一个重复的时序过程，分解成为若干个子过程，而每一个子过程都可有效地在其专用功能段上与其它子过程同时执行。单功能流水线：指流水线的各段之间的连接固定不变、只能完成一种固定功能的流水线。多功能流水线：指各段可以进行不同的连接，以实现不同的功能的流水线。顺序流水线：流水线输出端任务流出的顺序与输入端任务流入的顺序完全相同。乱序流水线：流水线输出端任务流出的顺序与输入端任务流入的顺序可以不同，允许后进入流水线的任务先完成。这种流水线又称为无序流水线、错序流水线、异步流水线。吞吐率：在单位时间内流水线所完成的任务数量或输出结果的数量。指令的动态调度：

是指在保持数据流和异常行为的情况下，通过硬件对指令执行顺序进行重新安排，以提高流水线的利用率且减少停顿现象。是由硬件在程序实际运行时实施的。指令的静态调度：是指依靠编译器对代码进行静态调度，以减少相关和冲突。它不是在程序执行的过程中、而是在编译期间进行代码调度和优化的。超标量：一种多指令流出技术。它在每个时钟周期流出的指令条数不固定，依代码的具体情况而定，但有个上限。超流水：在一个时钟周期内分时流出多条指令。多级存储层次：采用不同的技术实现的存储器，处在离CPU不同距离的层次上，各存储器之间一般满足包容关系，即任何一层存储器中的内容都是其下一层（离CPU更远的一层）存储器中内容的子集。目标是达到离CPU最近的存储器的速度，最远的存储器的容量。写直达法：在执行写操作时，不仅把信息写入Cache中相应的块，而且也写入下一级存储器中相应的块。写回法：只把信息写入Cache中相应块，该块只有被替换时，才被写回主存。集中式共享多处理机：也称为对称式共享存储器多处理SMP。它一般由几十个处理器构成，各处理器共享一个集中式的物理存储器，这个主存相对于各处理器的关系是对称的，分布式共享多处理机：它的共享存储器分布在各台处理机中，每台处理机都带有自己的本地存储器，组成一个“处理机-存储器”单元。但是这些分布在各台处理机中的实际存储器又合在一起统一编址，在逻辑上组成一个共享存储器。这些处理机存储器单元通过互连网络连接在一起，每台处理机除了能访问本地存储器外，还能通过互连网络直接访问在其他处理机存储器单元中的“远程存储器”。多Cache一致性：多处理机中，当共享数据进入Cache，就可能出现多个处理器的Cache中都有同一存储器块的副本，要保证多个副本数据是一致的。写作废协议：在处理器对某个数据项进行写入之前，它拥有对该数据项的唯一的访问权。写更新协议：当一个处理器对某数据项进行写入时，它把该新数据广播给所有其它Cache。这些Cache用该新数据对其中的副本进行更新。机群：是一种价格低廉、易于构建、可扩放性极强的并行计算机系统。它由多台同构或异构

吉大14秋学期《计算机系统结构》在线作业二答案

吉大14秋学期《计算机系统结构》在线作业二单选题判断题一、单选题（共15 道试题，共60 分。） 1. 关于非专用总线三种控制方式中，下列叙述错误的是（）。 A. 集中式定时查询，所有部件共用同一条“总线忙”线 B. 集中式定时查询，所有部件都用同一条“总线请求”线 C. 集中式独立请求，所有部件都用同一条“总线请求”线 D. 集中式串行链接，所有部件都用同一条“总线请求”线 -----------------选择：C 2. 汇编语言源程序变换成机器语言目标程序是经( ) 来实现的。 A. 编译程序解释 B. 汇编程序解释 C. 编译程序翻译 D. 汇编程序翻译 -----------------选择：D 3. 计算机使用的语言是( )。 A. 专属软件范畴，与计算机体系结构无关 B. 分属于计算机系统各个层次 C. 属于用以建立一个用户的应用环境 D. 属于符号化的机器指令 -----------------选择：B 4. 多端口存储器适合于连接（）。 A. 紧耦合多处理机 B. 松耦合多处理机 C. 机数很多的处理机 D. 机数可变的多处理机 -----------------选择：A 5. 在系统结构设计中，提高软件功能实现的比例会( )。 A. 提高解题速度 B. 减少需要的存贮容量 C. 提高系统的灵活性 D. 提高系统的性能价格比 -----------------选择：C 6. 用户高级语言源程序中出现的读写(I/O) 语句，到读写操作全部完成，需要通过( )共同完成。 A. 编译系统和操作系统 B. I/O 总线、设备控制器和设备 C. 操作系统和I/O 设备硬件 D. 编译系统、操作系统软件和I/O 总线，设备控制器、设备硬件等 -----------------选择：D

计算机系统结构作业答案第三章(张晨曦)

3.1 -3.3为术语解释等解答题。 3.4 设一条指令的执行过程分为取指令，分析指令和执行指令3个阶段，每个阶段所需时间分别为ΔT, ΔT, 2ΔT，分别求出下列各种情况下，连续执行N条指令所需的时间。 (1) 顺序执行方式 (2) 只有“取指令”与“执行指令”重叠 (3) “取指令”，“分析指令”与“执行指令”重叠解： (1) 4NΔT (2) (3N+1) ΔT (3) 2(N+1) ΔT 3.6 解决流水线瓶颈问题有哪两种常用方法？解： (1) 细分瓶颈段将瓶颈段细分为若干个子瓶颈段 (2) 重复设置瓶颈段重复设置瓶颈段，使之并行工作，以此错开处理任务 3.9 列举下面循环中的所有相关，包括输出相关，反相关，真数据相关。 for(i = 2; i < 100; i=i+1) { a[i] = b[i] + a[i]; -----(1) c[i+1] = a[i] + d[i]; -----(2) a[i-1] = 2*b[i]; -----(3) b[i+1] = 2*b[i]; -----(4) } 解：输出相关：第k次循环时(1)与第k+1轮时(3) 反相关：第k次循环时(1)和(2)与第k-1轮时(3) 真数据相关：每次循环(1)与(2)，第k次循环(4)与k+1次循环(1)，(3)，(4) 3.12 有一指令流水线如下所示 50ns 50ns 100ns 200ns (1)求连续如入10条指令的情况下，该流水线的实际吞吐率和效率 (2)该流水线的“瓶颈”在哪一段？请采用两种不同的措施消除此“瓶颈”。对于你所给出的两种新的流水线连续输入10条指令时，其实际吞吐率和效率各是多少？解：（1）（m表示流水线级数，n 表示任务数）

计算机系统结构课后习题答案(第2版)

习题一 1、解释下列术语计算机系统的外特性：通常所讲的计算机系统结构的外特性是指机器语言程序员或编译程序编写者所看到的外特性，即由他们所看到的计算机的基本属性（概念性结构和功能特性）。计算机系统的内特性：计算机系统的设计人员所看到的基本属性，本质上是为了将有关软件人员的基本属性加以逻辑实现的基本属性。模拟：模拟方法是指用软件方法在一台现有的计算机上实现另一台计算机的指令系统。可移植性：在新型号机出台后，原来开发的软件仍能继续在升级换代的新型号机器上使用，这就要求软件具有可兼容性，即可移植性。可兼容性是指一个软件可不经修改或只需少量修改，便可由一台机器移植到另一台机器上运行，即同一软件可应用于不同环境。 Amdahl定律：系统中对于某一部件采用某种更快的执行方式所能获得的系统性能改进程度，取决于这种执行方式被使用的频度或占总执行时间的比例。虚拟机（Virtual Machine）：指通过软件模拟的具有完整硬件系统功能的、运行在一个完全隔离环境中的完整计算机系统。 6、 7、假定求浮点数平方根的操作在某台机器上的一个基准测试程序中占总执行时间的20%，为了增强该操作的性能，可采用两种不同的方法：一种是增加专门的硬件，可使求浮点数平方根操作的速度提高为原来的20倍；另一种方法是提高所有浮点运算指令的速度，使其为原来的2倍，而浮点运算指令的执行时间在总执行时间中占30%。试比较这两种方法哪一种更好些。答：增加硬件的方法的加速比Sp1=1.23, 另一种方法的加速比Sp2= 1.176，经计算可知Sp1=方法更好些。 Sp2>Sp2第一种 9、假设高速缓存Cache的工作速度为主存的5倍，且Cache被访问命中的概率 T=为90%，则采用Cache能使整个存储系统获得多高的加速比？答：加速比

计算机系统结构三四章作业及答案

简述流水线技术的特点。（1）流水线把一个处理过程分解为若干个子过程，每个子过程由一个专门的功能部件来实现。因此，流水线实际上是把一个大的处理功能部件分解为多个独立的功能部件，并依靠它们的并行工作来提高吞吐率。（2）流水线中各段的时间应尽可能相等，否则将引起流水线堵塞和断流。（3）流水线每一个功能部件的前面都要有一个缓冲寄存器，称为流水寄存器。（4）流水技术适合于大量重复的时序过程，只有在输入端不断地提供任务，才能充分发挥流水线的效率。（5）流水线需要有通过时间和排空时间。在这两个时间段中，流水线都不是满负荷工作。解决流水线瓶颈问题有哪两种常用方法？答：细分瓶颈段与重复设置瓶颈段有一条指令流水线如下所示：（1 （? ? TP = 有一个流水线由4段组成，其中每当流过第三段时，总要在该段循环一次，然后才能流到第4段。如果每段经过一次所需的时间都是△t ，问：（1）当在流水线的输入端连续地每△t 时间输入一个任务时，该流水线会发生什么情况？（2）此流水线的最大吞吐率为多少？如果每2△t 输入一个任务，连续处理10个任务时，其实际吞吐率和效率是多少？（3）当每段时间不变时，如何提高流水线的吞吐率？人连续处理10个任务时，其吞吐率提高多少？解：（1）会发生流水线阻塞情况。（2）

（3）重复设置部件吞吐率提高倍数＝ t t ??2310 75 有一条动态多功能流水线由5段组成，加法用1、3、4、5段，乘法用1、2、5段，第2段的时间为2△t ，其余各段的时间均为△t ，而且流水线的输出可以直接返回输入端或暂存于相应的流水线寄存器中。现在该流水线上计算 ∏=+4 1 )(i i i B A ，画出时空图，并计算其吞吐率、加速比和效率。 4＋B 4；再计算(A 由图可见，它在18个△t 时间中，给出了7个结果。所以吞吐率为：如果不用流水线，由于一次求积需3△t ，一次求和需5△t ，则产生上述7个结果共需（4×5+3×3）△t =29△t 。所以加速比为：该流水线的效率可由阴影区的面积和5个段总时空区的面积的比值求得： △t,需经9△t 才能完成一个任务,其预约表如下所示。（1）画出流水线任务调度的状态转移图。时间入 A 1 B 1 A 2 B 2 A 3 B 3 A 4 B 4 A B C D A × B C ×D

吉林大学计算机系统结构题库第三章

第三章流水线技术知识点汇总先行控制、流水线、单功能流水线、多功能流水线、静态流水线、动态流水线、部件级流水线、处理机级流水线、处理机间流水线、线性流水线、非线性流水线、顺序流水线、乱序流水线、时空图、流水线性能评价（吞吐率、加速比、效率）、解决流水线瓶颈问题方法、相关（数据相关、名相关、控制相关）、换名技术、流水线冲突（结构冲突、数据冲突、控制冲突）、流水线互锁机制、定向技术、指令调度、预测分支失败、预测分支成功、延迟分支（从前调度、从失败处调度、从成功处调度）、流水寄存器、3种向量处理方式（横向、纵向、纵横）、链接技术。简答题 1.流水技术有哪些特点？（答出4个即可）（知识点：流水线）答：1.将处理过程分解为若干子过程，由专门的功能部件来实现，2各段的时间尽可能相等，3各部件间都有一个缓冲寄存器，4适用于大量重复的时序过程，5需要通过时间和排空时间。 2.什么是静态流水线？什么是动态流水线？（知识点：静态流水线、动态流水线）答：同一时间段内，多功能流水线中的各段只能按同一种功能的连接方式工作；同一时间段内，多功能流水线中的各段可以按照不同的方式连接同时执行多种功能。 3.什么是单功能流水线？什么是多功能流水线？（知识点：单功能流水线、多功能流水线）答：只能完成一种固定功能的流水线。流水线的各段可以进行不同的连接，以实现不同的功能。 4.什么是线性流水线？什么是非线性流水线？（知识点：线性流水线、非线性流水线）答：流水线的各段串行连接，没有反馈回路。流水线中除了有串行的连接外，还有反馈回路。 5.列举3种相关。（知识点：相关）答：数据相关，名相关，控制相关。 6.流水线中有哪三种冲突？各是什么原因造成的？（知识点：流水线冲突）答：结构冲突，硬件资源满足不了指令重叠执行的要求；数据冲突，指令在流水线中重叠执行时需要用到前面指令的执行结果；控制冲突，流水线遇到分支指令和其他会改变PC值的指令。 7.选择至少2种解决流水线结构冲突的方法简述。（知识点：结构冲突）答：流水线停顿一个时钟周期，推迟后面的指令操作。设置相互独立的指令存储器和数据存储器。 8.选择至少2种解决流水线数据冲突的方法简述。（知识点：数据冲突）答：定向技术，将计算结果从其产生的地方直接送到其他指令需要的地方。通过编译时让编译器重新组织指令顺序来消除冲突。

《计算机系统结构》与参考答案

2．以下各类中断中，属于自愿中断的是 C. A. 外部中断 B. I/O中断 C. 执行“访管”指令 D. 机器校验中断 3.高速外部设备磁盘机适合连接于 C. A. 选择通道或字节多路通道 B. 数组多路通道或字节多路通道 C.数组多路通道或选择通道 D.任意一种通道 4.页式虚拟存储器页表的作用是 A . A. 反映虚页在主存的存储情况 B.仅反映虚页是否调入主存 C. 反映主存实页与Cache 的对应关系 D. 反映虚页在辅存的存储情况5．软件和硬件的功能在逻辑上是C的 . A.固件优于软件 B.不等价 C.等价 D.软件优于固件 6.计算机中最优化的操作码编码方法是D. A.BCD 码 B.ASCII码 C.扩展操作码 D.哈夫曼编码 7.从计算机系统执行程序的角度看，并行性等级由低到高分为四级A. A ．指令内部——指令之间——进程之间——程序之间 B ．指令之间——指令内部——进程之间——程序之间 C．进程之间——指令之间——指令内部——程序之间 D ．程序之间——进程之间——指令之间——指令内部 8.计算机系统多级层次结构中，操作系统机器级的直接上层是D. A ．传统机器级 B ．高级语言机器 C．应用语言机器级D．汇编语言机器级 9.全相联地址映像是指A. A. 任何虚页都可装入主存中任何实页的位置 B.一个虚页只装进固定的主存实页位置 C.组之间是固定的，而组内任何虚页可以装入任何实页位置 D.组间可任意装入，组内是固定装入 10．对于同一系列机，必须保证软件能够C. A ．向前兼容，并向上兼容 B ．向前兼容，并向下兼容C．向后兼容，力争向上兼容D ．向后兼容，力争向下兼容11．设有 16 个处理单元的并行处理机系统, 采用共享主存的方式. 若同时存取16 个数据 , 为避免存储器访问冲突, 共享主存的多体数量应该为C才合理 . A. 15 B. 16 C. 17 D. 19 12.软件兼容的根本特征是C. A.向前兼容 B.向后兼容 C. 向上兼容 D. 向下兼容 13.在下列机器中，能够实现软件兼容的机器是 B. A.完全不同种类的机型 B.系统结构相同的机器 C. 宿主机和目标机 D.虚拟机 14．输入输出系统硬件的功能对C是透明的。 A. 操作系统程序员 B. 所有类别的程序员 C. 应用程序员 D. 系统结构设计师 15.在下列各项选择中，对于机器( 汇编 ) 语言程序员透明的是 D. A.通用寄存器 B. 条件码 C.中断字 D.主存储器地址寄存器一、单项选择题 1．在流水机器中，全局性相关是指 B. A.指令相关 B. 由条件转移指令引起的相关 C “先读后写”相关 D.“先写后读”相关 2．以下不属于多处理机操作系统类型的是A. A ．Windows 操作系统B．主从型操作系 C．浮动型操作系统 D ．各自独立型操作系统 3.下列不是数据流计算特点的是D. A. 设置状态 B.没有指令计数器 C.没有变量的概念 D.操作结果不产生副作用 4．若输入流水线的指令既无局部性相关，也不存在全局性相关，则B. A. 可获得高的吞吐率和效率 B.出现瓶颈 C.流水线的效率和吞吐率恶化 D.可靠性提高 5.消除“一次重叠”中的“指令相关”最好方法是B. A. 不准修改指令 B.设置相关专用通路 C.推后分析下条指令 D.推后执行下条指令 6．流水线的技术指标不包括A. A. 数据宽度 B.吞吐率 C.加速比 D.效率 7.按照弗林对处理机并行性定义的分类原则，阵列机ILLIAC IV属于B. A.SISD B.SIMD C.MISD D.MIMD 8．设 8 个处理器编号分别为0，1， 2，?，7 用 Cube0 互联函数时，第7 号处理机可以与第D号处理机相联 . A. 0 B. 2 C. 4 D. 6 9．多端口存储器适合于连接 B. A ．松耦合多处理机B．紧耦合多处理机C．机数很多的多处理机 D ．机数可变的多处理机 10.以下不属于堆栈型替换算法的是A. A ．先进先出法B．近期最久未用过法 C．近期最少使用法D．页面失效频率法 11．解决主存空间数相关的办法是C. A.基址值一次相关直接通路法 B.基址值二次相关直接通路法 C.通用寄存器组相关专用通路相关法 D. 推后读法 12. 一般来说 , 以下替换算法中 , 效果最优的替换算法是C. A. LRU 替换算法 B. FIFO 替换算法 C. OPT 替换算法 D. RAND替换算法

计算机体系结构第一次作业

问答题（共4道题） 1．什么是存储系统？答：存储系统是指计算机中由存放程序和数据的各种存储设备、控制部件及管理信息调度的设备（硬件）和算法（软件）所组成的系统。计算机的主存储器不能同时满足存取速度快、存储容量大和成本低的要求，在计算机中必须有速度由慢到快、容量由大到小的多级层次存储器，以最优的控制调度算法和合理的成本，构成具有性能可接受的存储系统。 2．什么是高速缓冲存储器答：指存取速度比一般随机存取记忆体（RAM）来得快的一种RAM。一般而言它不像系统主记忆体那样使用DRAM技术，而使用昂贵但较快速的SRAM技术，也有快取记忆体的名称。高速缓冲存储器是存在于主存与CPU之间的一级存储器，由静态存储芯片(SRAM)组成，容量比较小但速度比主存高得多，接近于CPU的速度。在计算机存储系统的层次结构中，是介于中央处理器和主存储器之间的高速小容量存储器。它和主存储器一起构成一级的存储器。高速缓冲存储器和主存储器之间信息的调度和传送是由硬件自动进行的。 3．假设一台模型计算机共有10种不同的操作码，如果采用固定长操作码需要4 位。已知各种操作码在程序中出现的概率如下表所示，计算采用Huffman编码法的操作码平均长度，并计算固定长操作码和Huffman操作码的信息冗余量（假设最短平均长度H＝3.1位）。答：构造Huffman树如下：

Huffman 编码的平均码长为： ∑=10 1 i i i l p =0.17*2+（0.15+0.15+0.13+0.12）*3+（0.09+0.08+0.07）*4+（0.03+0.01）*5=3.15 冗余量=（3.15-3.10）/3.15=1.59% 固定码长=log210=4 冗余量=（4-3.10）/4=22.5% 4.若某机要求有：三地址指令4条，单地址指令192条，零地址指令16条。设指令字长为12位，每个地址码长3位。问能否以扩展操作码为其编码？答：三种指令字格式如下：

计算机系统结构课后习题答案

第1章计算机系统结构的基本概念 1.1 解释下列术语层次机构：按照计算机语言从低级到高级的次序，把计算机系统按功能划分成多级层次结构，每一层以一种不同的语言为特征。这些层次依次为：微程序机器级，传统机器语言机器级，汇编语言机器级，高级语言机器级，应用语言机器级等。虚拟机：用软件实现的机器。翻译：先用转换程序把高一级机器上的程序转换为低一级机器上等效的程序，然后再在这低一级机器上运行，实现程序的功能。解释：对于高一级机器上的程序中的每一条语句或指令，都是转去执行低一级机器上的一段等效程序。执行完后，再去高一级机器取下一条语句或指令，再进行解释执行，如此反复，直到解释执行完整个程序。计算机系统结构：传统机器程序员所看到的计算机属性，即概念性结构与功能特性。在计算机技术中，把这种本来存在的事物或属性，但从某种角度看又好像不存在的概念称为透明性。计算机组成：计算机系统结构的逻辑实现，包含物理机器级中的数据流和控制流的组成以及逻辑设计等。计算机实现：计算机组成的物理实现，包括处理机、主存等部件的物理结构，器件的集成度和速度，模块、插件、底板的划分与连接，信号传输，电源、冷却及整机装配技术等。系统加速比：对系统中某部分进行改进时，改进后系统性能提高的倍数。 Amdahl定律：当对一个系统中的某个部件进行改进后，所能获得的整个系统性能的提高，受限于该部件的执行时间占总执行时间的百分比。程序的局部性原理：程序执行时所访问的存储器地址不是随机分布的，而是相对地簇聚。包括时间局部性和空间局部性。 CPI：每条指令执行的平均时钟周期数。测试程序套件：由各种不同的真实应用程序构成的一组测试程序，用来测试计算机在各个方面的处理性能。存储程序计算机：冯·诺依曼结构计算机。其基本点是指令驱动。程序预先存放在计算机存储器中，机器一旦启动，就能按照程序指定的逻辑顺序执行这些程序，自动完成由程序所描述的处理工作。

计算机体系结构第四章练习题参考解答

第四章 4.52 浮点数系统使用的阶码基值r e =2，阶值位数q=2，尾数基值r m =10，尾数位数p ′=1，即按照使用的二进制位数来说，等价于p=4。计算在非负阶、正尾数、规格化情况下的最小尾数值、最大尾数值、最大阶值、可表示的最小值和最大值及可表示数的个数。解: 最小尾数值：r m -1 = 10-1 = 0.1 最大尾数值：1- r m -p ′ =1-10-1 = 0.9 最大阶值：2q -1=3 可表示数的最小值：1×r m -1 = 10-1 = 0.1 可表示数的最大值：r m 2q-1×（1- r m -p ′）=103（1-10-1）= 900 可表示数的个数：2q ×r m p ′（r m -1）/r m = 22×101（10-1）/10 = 36 4.53 一台机器要求浮点数的字长的精度不低于10-7.2，表数的范围正数不小于1038，且正负对称。尾数用原码、纯小数表示，阶码用移码、整数表示。设计这种浮点数的格式。解依题意，取表数范围N =1038，表数精度δ=10-7.2。由式（4-4）得：37log(log10log 21) log 2 q +> = 6.99，上取整，得到阶码字长q=7。由式（4-5）得： 16 log1053.2 log 2 p --> =，上取整，得到尾数字长p=24。从而加上一个尾数符号位和一个阶码符号位，浮点数的总字长为：p+q+2=24+7+2=33。实际浮点数总字长应为8的倍数，故取浮点数总字长为40位。多出的7位可以加到尾数字长p 中用于提高浮点数的表数精度，也可以加到阶码字长q 中来扩大浮点数的表数范围。暂且让p 增加6位，q 增加1位，即p=30，q=8。如图4-8所示是设计出来的浮点数格式。图4-8 例4.2浮点数的设计格式 4.58 用于文字处理的某专用机，每个文字符用4位十进制数字（0～9）编码表示，空格用︼表示。在对传送的文字符和空格进行统计后，得出它们的使用频度如下：︼：0.20 0:0.17 1:0.06 2:0.08 3:0.11 4:0.08 5: 0.05 6:0.08 7:0.13 8:0.03 9:0.01 （1）若对数字0～9和空格采用二进制编码，试设计编码平均长度最短的编码。（2）若传送106个文字符号，且每个文字符号后均自动跟一个空格，按最短的编码，共需传送多少个二进制位？若传送波特率为9600bPS ，共需传送多少时间？（3）若对数字0～9和空格采用4位定长码编码，重新计算问题（2）。解：（1）∵操作码编码的平均长度最短为Huffman 编码，生成的Huffman 树，如图所示，

计算机系统结构_第三章练习答案

第三章练习题（1）一、单项选择题在下面各题的4个备选答案中，只有一个答案是正确的，请把正确答案的标号（A~D）填入题后面的括号中。 1．程序员编写程序时使用的访存地址是（）。 A．物理地址 B．有效地址 C．逻辑地址 D．主存地址 2．虚拟存储器通常采用的地址映像是（D ）。 A．全相联、组相联和直接映像 B．直接映像 C．组相联映像 D．全相联映像 3．不属于堆栈型替换算法是（）。 A．近期最少使用替换算法 B．先进先出替换算法 C．最优替换算法 D．近期最久未使用替换算法 4.确保提高虚拟存储器的主存命中率的途径是（）。 A．采用LFU替换算法并增大页面数 B．采用FIFO替换算法并增大页面 C．采用FIFO替换算法并增大页面数 D．采用LRU替换算法并增大页面 5.虚拟存储器主要是为了解决（）问题。 A．便于程序的“访存操作” B．扩大存储系统的容量和提高存储系统的速度 C．提高存储系统的速度 D．扩大存储系统的容量 6.与虚拟存储器的等效访问速度无关的是（）。 A．辅存的容量 B．主存的容量 C．页面替换算法 D．访存页地址流二、填空题 1．使二级存储系统的等效访问速度接近于第一级存储器访问速度的依据是程序的（局部性原理），它包括（时间局部性）和（空间局部性）两个方面。 2．程序的空间局部性是指程序通常是（顺序）存储和执行的，程序使用的数据通常是（簇聚或集中）存储的。 3．假设T1和T2分别是CPU访问到M1和M2中信息所需要的时间，H为命中M1的概率，则由M1和M2构成的二级存储系统的等效访问时间应当表示为（H*T1+(1-H)*T2）。4．存储器速度性能可以采用存储器的（频宽）衡量，它是存储器单位时间能够访问的信息量。

计算机系统结构试题及答案

2009-2010学年度第一学期2007级《计算机系统结构》期末考试试卷（A）（闭卷）姓名：学号：专业：（注：①考试时间为120分钟；②所有解答必须写在答题纸上。）一、单项选择题（每小题3分，共30分） 1．在系列机中发展一种新型号机器，你认为下列（）设想是不行的?【A】新增加字符数据类型和若干条字符处理指令【B】将中断分级由原来的4级增加到5级【C】在CPU和主存之间增设Cache存贮器【D】将浮点数的下溢处理法由原来的恒置“1”法，改为查表舍入法 2.对计算机系统结构来说，不透明的是（）。【A】存储器采用交叉存取还是并行存取【B】CPU内部的数据通路的宽度是8位还是16位【C】采用浮点数据表示还是标志符数据表示【D】指令采用硬联逻辑实现还是微程序实现 3．一个平衡的计算机系统，应该是（）。【A】1MIPS的CPU速度【B】1MB的主存容量【C】1Mb/s的I/O吞吐率【D】A、B和C 4、（）设计是现代计算机系统设计所采用的方法。【A】由上往下【B】由下往上【C】由中间开始【D】上下同时开始5．当今微型机中实现软件移植最好的方法是（）。【A】系列机【B】兼容机【C】仿真技术【D】统一高级语言

6、不能够对向量数据结构提供直接支持的是（）数据表示。【A】向量【B】堆栈【C】描述符【D】A和C 7、采用整数边界存储技术，其主要目的是（）。【A】节约主存空间【B】提高数据的访问速度【C】一个主存周期可取多条指令【D】一个主存周期至少可取到一条指令 8、在指令的操作码编码方式中，优化实用的编码是（）。【A】Huffman编码【B】等长编码【C】Huffman扩展编码【D】BCD码 9、流水计算机中将指令Cache和数据Cache分开，主要是为了（）。【A】提高存储系统的速度【B】增加主存容量【C】解决功能部件冲突【D】解决访存冲突 10、当N=16时，能描述4组4元交换的函数是（）。【A】C1+C2 【B】C0+C1 【C】C0+C2 【D】C2+C3 二、（10分）在采用通用寄存器指令集结构的计算机上得到了如下所示的数据：假若编译器优化后能去掉50%的ALU指令，但不能去掉其它三类指令。求优化后的MIPS 与优化前的MIPS速率比。三、（10分）设某机器系统指令字长12位，每个操作码和地址均占3位，试提出一种分配

j计算机系统结构作业汇总

某台处理机的各条指令使用频度如下所示： 1)请分别设计这9条指令操作码的哈夫曼编码. 2)求出等长码长和哈夫曼的平均码长作业三：设通道在数据传送期内，选择设备需4.9 s，传送一个字节数据需0.1 s。 (1)某低速设备每隔250 s发出一个字节数据传送请求，问至多可接几台这种低速设备？ (2)对于如下5种高速设备A~E，要求字节传送请求的时间间隔如表所示。若一次通信传送作业四： 1.某机器有5级中断，中断响应次序为1→2→3→4→5，现要求中断处理次序为2→3→1→5→4。 (1)设计各级中断处理程序的中断屏蔽位的状态，令“0”为屏蔽，“1”为开放。(见下表) (2)若在运行用户程序时，同时发生1、3级中断请求，而在2级中断服务未完成时，又发生2、3、4、5级中断，请画出处理机执行程序的全过程示意图(标出交换PSW的时间)。作业五：假定处理器时钟周期为2ns,某程序由1000条指令组成，每条指令执行一次，其中的4条指令在取指令时没有在Cache中找到，其余指令都能在Cache中找到，在执行指令过程中，该程序需要3000次主存数据访问，其中6次没有在Cache中找到。试问： 1）执行该程序得到的Cache命中率是多少？ 2）若Cache中存取一个信息的时间为1个时钟周期，缺失损失为10个时钟周期，则CPU 在Cache-主存层次的平均访问时间和效率为多少？作业六：有如下页面地址流：2,1,3,1,4,2,5,3,2,1,2,3,4,1,5利用堆栈技术一次模拟LRU在n=3,4,5条件下页面变化时空图，同时分别指出命中的页面以及计算它们各自的命中率。

有一个Cache —主存存储层次，主存共8块，Cache 共4块，采用组相联映像，每组2块，LRU 替换算法。 1）对地址流124137012546472使用情况； 2）指出块失效同时块争用的时刻 3）求出命中率。作业八：有一指令流水线如下所示（1）求连续输入10条指令，该流水线的实际吞吐率和效率；（2）该流水线的“瓶颈”在哪一段？请采取两种不同的措施消除此“瓶颈”。对于你所给出的两种新的流水线，连续输入10条指令时，其实际吞吐率和效率各是多少？作业九：（1）写出流水线的禁止向量和初始冲突向量（2）画出调度流水线的状态图（3）求最佳的调度和最大的吞吐率出 50ns 50ns 100ns 200ns

计算机系统结构三四章作业及答案

计算机系统结构三四章作业及答案

计算机系统结构 第四章(习题解答)

计算机系统结构网上作业

计算机系统结构课后答案

华科专升本计算机系统结构-作业全

(完整版)计算机系统结构试题及答案

吉大14秋学期《计算机系统结构》在线作业二答案

计算机系统结构作业答案第三章(张晨曦)

计算机系统结构 课后习题答案(第2版)

计算机系统结构三四章作业及答案

吉林大学计算机系统结构题库第三章

《计算机系统结构》与参考答案

计算机体系结构第一次作业

计算机系统结构课后习题答案

计算机体系结构第四章练习题参考解答

计算机系统结构_第三章练习 答案

计算机系统结构试题及答案

j计算机系统结构作业汇总

计算机系统结构第四章(习题解答)

计算机系统结构课后习题答案(第2版)

计算机系统结构_第三章练习答案