目录
0x00 响应时间和吞吐量(Response Time and Throughput)
0x01 相对性能(Relative Performance)
0x02 执行时间测量(Measuring Execution Time)
0x03 CPU 时钟(Clocking)
0x04 CPU时间
0x05 指令计数和 CPI
0x06 性能摘要(Performance Summary)
0x00 响应时间和吞吐量(Response Time and Throughput)
响应时间 (Response time):完成任务所需的时间
吞吐量 (Throughput):每个单位时间内完成的总工作量 (比如: tasks/transactions... per hours)
存在多种因素可以对响应时间和吞吐量造成影响,包括但不限于:
- 处理能力:通过升级到更快的处理器或添加更多处理器,可以减少响应时间并增加吞吐量。这是因为更快或更强大的处理器可以在更短的时间内处理更多的任务。
- 系统负载:如果系统过载,处理过多的任务或用户,将会对响应时间和吞吐量产生负面影响。这是因为系统可能无法处理工作负荷,导致响应时间更长,吞吐量降低。
- 网络延迟:如果网络延迟较高,响应时间和吞吐量可能会受到影响。这是因为数据传输需要更长的时间,从而导致响应时间变长和吞吐量降低。
换更快的处理器?添加更多的处理器?本章我们更关注的是 响应时间 (Response time) 。
0x01 相对性能(Relative Performance)
📚 定义:性能 = 1 / 执行时间:
%20
比%20 快%20 倍:
%20%20%20💭%20举个例子:运行程序所需时间,在%20 机器上为%2010s,在%20 机器上为%2015s
%20%20因此, 比%20 快%201.5%20倍。
%20%200x02 执行时间测量(Measuring%20Execution%20Time)
%20执行时间测量%20(Measuring%20Execution%20Time)%20指的是在计算机程序中测量代码执行所需的时间。这通常是通过在代码开始和结束时记录时间戳来实现的,然后计算时间戳之间的差异来计算程序执行所需的时间。
%20执行时间测量通常是性能优化和调试代码的重要工具。通过测量程序中不同部分的执行时间,开发人员可以确定哪些部分需要进行优化,以使程序更加高效。
%20在实际应用中,执行时间测量可以使用多种不同的技术和工具来实现,例如内置的计时器函数、性能分析工具、代码覆盖率工具等等。不同的方法适用于不同的场景和需求。
%20总的反应时间%20(Elapsed%20time):
%20- 总响应时间,包括所有方面%20(Processing,%20I/O,%20OS%20overhead,%20idle%20time)
- 确定系统性能
CPU%20时间%20(CPU%20time):
%20- 用于处理给定作业的时间%20(Discounts%20I/O%20time,%20other%20jobs’%20shares)
- 包括用户%20CPU%20时间和系统%20CPU%20时间
- 不同的程序受%20CPU%20和系统性能的影响不同
0x03 CPU%20时钟(Clocking)
%20CPU%20Clocking(CPU%20时钟)指的是计算机%20CPU%20内部的时钟系统。这个时钟系统会以固定的速率来发出脉冲信号,这些信号会让%20CPU%20的不同部件在每个时钟周期内执行相应的操作。
%20数字硬件的操作受到固定速率时钟的控制:
%20时钟周期 (Clock period):时钟信号一个完整的循环所需要的时间。
时钟频率 (Clock Rate):每秒钟时钟信号产生的周期数。
0x04 计算CPU时间(T=CC/CR)
性能可以通过减少时钟周期数、增加时钟速度来改善。
硬件设计人员通常需要在时钟速度和时钟周期数量之间进行权衡。
🔺 CPU Time 计算公式如下:
CPU 时间 = CPU 时钟周期数 × 时钟周期
= CPU 时钟周期数 ÷ 时钟频率
📜 简化记忆:
- 求 CPU 时间: ,
- 求时钟频率%20(Clock Rate)%20:
- 求时钟周期%20(Clock%20Cycle)%20:
💭%20举个例子:
%20计算机 A 有 2GHz 的时钟, 10s 的CPU 时间,请设计计算机 B,目标达到 10s 的 CPU 时间。可以使用更快的时钟,但会导致 1.2 × 时钟周期,问计算机 B 的时钟应该多快?
💡 解答:已知 ,计算
%20*%20根据上述公式 ,那么 ,
%20根据题意,使用更快时钟导致 倍 ,并且目标%20CPU%20时间 为 ,可列出公式:
%20%20
此时我们需要计算%20A%20的时钟周期,根据公式 ,那么时钟周期 :
%20%20此时我们已经得到了 ,带入即可计算出 :
%20%20%200x05%20指令计数%20IC%20和%20每条指令所需的时钟周期数%20CPI
%20(Instruction%20Count),指的是%20指令计数。
%20(Cycle%20Per%20Instrution),指的是 每条指令所需的时钟周期数。即%20平均执行周期数
%20是指在一个程序中,每个时钟周期所执行的平均指令数。这两个概念都是计算机性能评估中的关键指标。通过减少指令计数或降低%20CPI,可以提高计算机系统的性能。
%20📃 简化记忆:
Execution%20time%20=%20(Instruction%20count%20*%20CPI)%20/%20Clock%20rate
%20程序的指令计数是由程序本身、指令集架构%20(ISA)%20和编译器所决定的。每个指令的平均时钟周期数取决于CPU硬件。如果不同的指令具有不同的CPI,则平均%20CPI%20受指令组合的影响。
%20💭%20CPI%20计算例子:
%20计算机 A 的周期时间 = 250ps,CPI = 2.0,计算机 B 的周期时间 为 500ps,CPI = 1.2
ISA 相同,哪台计算机更快?快多少?
💡 题解:根据题意得知:,
%20既然要比谁更快,那么我们分别计算出%20A,%20B%20的%20CPU%20Time:
%20%20%20,因此%20A%20速度更快。
%20下面计算快多少:
%20%20%200x06%20关于CPI%20的更多细节
%20如果不同的指令类别需要不同的时钟周期数:
%20%20
加权平均%20CPI%20(Avg):
%20%20💭%20例子:Alternative%20compiled%20code%20sequences%20using%20instructions%20in%20classes%20A,%20B,%20C:
%20💡 解读:Sequence 1 中
%20根据公式:
%20再根据图表给出的%20IC,%20CPI%20即可计算出%20Clock%20Cycles:
%20%20然后通过公式计算平均:
%20%20%20
0x07 性能摘要(Performance%20Summary)
%20%20性能摘要%20(Performance%20Summary)%20是指对计算机系统、软件或应用程序性能进行评估、分析和总结的过程。在性能摘要中,可以考虑多种性能指标,如执行时间、吞吐量、响应时间、负载等。通常,性能摘要的目的是发现瓶颈、评估系统的优化潜力、指导系统设计和优化、以及进行比较评估等。在实践中,性能摘要是计算机系统开发和维护中非常重要的一环,可以帮助提高系统的性能、可靠性和稳定性。
%20性能取决于%20算法%20(影响%20IC,可能影响%20CPI)、编程语言%20(影响%20IC,CPI)、编译器(影响%20IC,CPI)、指令集架构(影响%20IC,CPI,Tc)。
%20🔺%20计算公式总结:
%20📌 [ 笔者 ] 王亦优📃 [ 更新 ] 2022.3.❌ [ 勘误 ] /* 暂无 */📜 [ 声明 ] 由于作者水平有限,本文有错误和不准确之处在所难免, 本人也很想知道这些错误,恳望读者批评指正!
📜 参考资料 C++reference[EB/OL]. []. http://www.cplusplus.com/reference/. Microsoft. MSDN(Microsoft Developer Network)[EB/OL]. []. . 百度百科[EB/OL]. []. https://baike.baidu.com/. |