方克明

TMS320C6678多核DSP的核间通信方法

摘要：嵌入式应用中采用多处理系统所面临的主要难题是多处理器内核之间的通信。对Key-Stone架构TMS320C6678 处理器的多核间通信机制进行研究，利用处理器间中断和核间通信寄存器，设计并实现了多核之间的通信。从系统的角度出发，设计与仿真了两种多核通信拓扑结构，并分析对比了性能。对设计多核DSP 处理器的核间通信有一定的指导价值。

关键词： TMS320C6678；KeyStone；处理器间中断；多核通信

嵌入式领域的处理器设计已向多核处理器迅速发展，TI公司的KeyStone 架构的多核处理器就是其中之一。2010年11月，TI公司发布了最新的KeyStone 架构的8核DSP处理器TMS320C6678 ，每个C66x内核频率为1.25GHz，提供每秒高达40 GB MAC定点运算和20 GBFLOP 浮点运算能力；1片8核的TMS320C6678 提供等效达10 GHz的内核频率，单精度浮点并行运算能力理论上可达160 GB FLOP，是TS201S 的50 倍、C67x+的115.2倍，适合于诸如油气勘探、雷达信号处理以及分子动力学等对定浮点运算能力及实时性有较高要求的超高性能计算应用。

核间通信是多核处理器系统所面临的主要难点，通信机制的优劣直接影响多核处理器的性能，高效的通信机制是发挥多核处理器高性能的重要保障。TMS320C6678 采用TI全新KeyStone多核架构，属于单芯片多核架构，有别于常见的板载多芯片通信方式。而KeyStone 架构的通信研究才刚刚起步，因多核通信复杂，需要搭建合适的通信拓扑结构，因此拓扑结构的选取会直接影响通信代价和并行计算的效率。TMS320C6678采用基于KeyStone架构的中断控制器、核间通信寄存器以及合适的通信拓扑结构实现多核间的通信。通过中断系统激活处理器，触发具有通信功能的中断服务程序，调用寄存器完成相应的功能，并通过合适拓扑结构完成通信。

基于以上分析，本文针对TMS320C6678多核处理器，首先分析了中断控制器和核间中断原理及其实现；然后分析了核间通信的原理，给出了通信的发起和响应的实现方法；最后介绍了主辅和数据流两种多核通信的拓扑结构，并通过仿真对其通信代价进行了对比，得出了两种结构的优缺点以及适用范围。对设计多核处理器核间通信有一定指导意义。

1 TMS320C6678 中断控制器

TMS320C6678采用基于KeyStone架构的中断控制器INTC（Interrupt Controller ）、激活处理器触发相应的中断服务程序，完成通信的第一步。首先需要配置中断向量表，启动CPU中断功能。TMS320C6678 的CPU 可接收15个中断，其中：1个硬件异常(EXCEP)、1个不可屏蔽中断(NMI)、1个复位(RESET)和12 个可屏蔽中断(INT4~INT15)，中断源支持最多128个。

中断（IPI）和其他核心进行通信。在TMS320C6678中，核间中断（IPC_LOCAL）默认对应91号事件，而核间中断属于可屏蔽中断，通过中断控制器可以映射到INT4 ~INT15 任意一个中断上。为了实现核间中断，必须按以

下方式进行设置：

（1）控制状态寄存器（CSR）中的全局中断使能位置为1，全局中断使能；

（2）中断使能寄存器（IER）中的NMIE位置为1，可屏蔽中断使能；

（3）中断使能寄存器（IER）将要映射的可屏蔽中断的相应位置1 ；

（4）选择91 号事件作为中断源，映射事件到指定的物理中断号。中断发生后，将中断标志寄存器（IFR）的相应位置1 。

中断发生时，由事先配置好的中断向量表跳入中断服务程序（ISR），完成核间通信，如图1 所示。

2 多核处理器的核间通信机制

多核处理器由中断触发通信后，配置相应的寄存器，以完成通信。TMS320C6678主要的核间通信寄存器有16个，其中8个IPC中断生成寄存器(IPCGR0~IPCGR7) 和8个IPC中断确认寄存器(IPCAR0~IPCAR7)。将IPC 中断生成寄存器IPCGRx(0≤x≤7) 的最后一位IPCG 位置1，就能产生对core_x 的中断；1～3位是保留位，4～31位(SRCS0~SRCS27)提供了可以识别多达28种的中断来源。IPC 中断确认寄存器IPCARx(0≤x≤7) 的0～3位是保留位，4～31 位(SRCC0~SRCC27)分别对应28种不同的中断来源。当SRCSx 被置1时，寄存器将相应的中断确认寄存器的SRCCx 位置1。当中断被确认后，寄存器将SRCCx和相应的SRCSx 位同时置0 。

当TMS320C6678的一个处理器核准备与其他处理器核通信时，根据TMS320C6678 的中断事件映射表，引发91号事件，产生可屏蔽的核间中断，调用中断服务例程。中断服务例程IPC_ISR 函数设计如下：

voidIPC_ISR()

{

KICK0= KICK0_UNLOCK;

KICK1= KICK1_UNLOCK;

*(volatileuint32_t *) IPCGR[2] = 0x20;

*(volatileuint32_t *) IPCGR [2] |= 1;

KICK0= KICK0_UNLOCK;

KICK1= KICK1_UNLOCK;

}

以向core_2 发送0x20 信息的中断为例，对应的0x20 的信息存入SRCS 位中，用于识别中断源。同时将当前CPU 核心内的中断产生寄存器IPCGR2 的最后一位IPCG位置1，触发IPC 中断。当目标处理器核被中断触发后，会自动跳转到中断异常向量表中相应的入口点，读取当前核心中断产生寄存器IPCGRx （0≤x≤7 ），从寄存器的SRCS 位中获取通信发起方传来的核间信息。然后将信息存入对应的中断确认寄存器IPCARx 中，清空SRCC 和相应的SRCS位，用以接收下一次的核间中断。其中的KICK0 和KICK1 为陷阱控制寄存器，用来避免通信冲突的发生。

3 拓扑结构设计与性能测试

以上对TMS320C6678 基本核间通信机制及其实现过程进行了分析，但是要实现TMS320C6678 强大的多核功能，必须从系统的角度上设计良好的并行计算方案，设计合适的系统并行拓扑是其中的关键所在。通信代价、带宽和功能是评测通信的重要指标，下面介绍了两种多核通信并行方式，分析了它们的拓扑结构，并对上述指标做了测试对比。

3.1 通信的拓扑结构

适用于多核DSP 通信的并行方式有两种：一种是主辅拓扑结构（Master Slave ），另一种是数据流拓扑结构（Data Flow）。

主辅拓扑结构，在TMS320C6678 中如图2所示。作为主核(控制核)的处理器通过EDMA 与外部存储器DDR进行数据交换，然后主核通过核间中断与辅核通信。主核起到控制的作用，所有辅核（计算核）的中断都由控制核来处理，辅核只负责计算任务，辅核之间没有任何核间通信的产生。

数据流拓扑结构，在TMS320C6678中如图3所示，是一种基于片上互联的结构。每个处理器核均有单独的处理单元和存储媒介。第一个核与FPGA 或者外部存储器DDR 相连，核间通信顺序产生。核间通信时每个处理器核既是控制核又是计算核，核间传递的信息在每个核内都起到一个中转站的作用。

3.2 性能测试实验

本文设计了核间通信测试程序来测试两种结构。程序的功能是：当一个核收到来自其他核的中断后，立即确认并按照拓扑结构依次发出核间中断，没有其他耗时的操作。程序在TMDXEVM6678L评估板上进行仿真，板载有一块TMS320C6678芯片，处理器运行的频率设置为1 GHz ，采用的编译环境是TI 公司的CCSv5.0。

通信测试结果如表1所示，主辅结构运行完测试程序所需要的总通信代价是171 352 个时钟周期。其中，作为主核的core_0 耗费116 311个时钟周期，而7 个辅核每个核均耗费7 863个时钟周期。采用数据流结构运行完测试程序所需要的总通信代价是171 319个时钟周期，其中core_0 耗费21 385个时钟周期，core_7 耗费21 366 个时钟周期，其他6个核耗费21 428 个时钟周期。

如图4所示，采用主辅结构时，作为辅助核的7个核可以同时并行运行，理论上通信时间可以减少到124 174 个时钟周期。主辅结构由于利用了多核的并行处理，总的通信时间是数据流结构的72.5%，以测试环境中的1 GHz 的主频计算，则节省了47.1 μs 。主辅结构涉及到通信任务的分配，主核的设计困难，而且辅核之间不能通信。每个线程的执行时间可能是随机的，作为控制核的主核需要最优化负载均衡以达到系统最优的并行效率，适用于高级的操作系统( 如Linux) 上，并预先要设定好每个核的通信线程，由操作系统进行调度。

数据流结构的优点是数据带宽有保证，可扩展性好。但是设计过程复杂，而且由于具有比较高的数据传输速率，对通信带宽有较高的要求，因此数据流结构更适用于简单的实时系统。因为每个数据单元的传输都是统一的，结构相对简单，数据的通信也是有规律的，不过通信时间较长。

本文研究了基于TMS320C6678 多核DSP 处理器的核间通信，深入分析了核间中断、核间通信机制( 包括寄存器配置以及具体的实现方法)，讨论及测试了主辅结构和数据流结构两种多核通信的拓扑结构，并对比了两者的性能和优缺点。对设计多核DSP 处理器的核间通信有一定的指导价值。

DM3730调试心得之CEMEK gqb666 Linux驱动开发 CMEMK
最近被一个问题困扰了很久，就是TI的dvsdk编译出来的可加载模块cmemk.ko，这个模块是TI专门针对DSP和ARM之间共享内存，数据交互而设计的，在dvsdk编译完成后会被放在，system/ti-dsp/下面。那我遇到什么问题了呢，原来是整个android系统可以在SD卡中启动并正确的完成cmemk.ko模块的加载，加载主要是通过文件系统中内核运行的第一个脚本init.rc文件，里面有着
DM3730 调试心得4之cmemk 天才2012
最近被一个问题困扰了很久，就是TI的dvsdk编译出来的可加载模块cmemk.ko，这个模块是TI专门针对DSP和ARM之间共享内存，数据交互而设计的，在dvsdk编译完成哦会被放在，system/ti-dsp/下面。那我遇到什么问题了呢，原来是整个android系统可以在SD卡中启动并正确的完成cmemk.ko模块的加载，加载主要是通过文件系统中内核运行的第一个脚本init.rc文件，里面有着详
DM3730 调试心得4之cmemk gzzaigcn linux android 脚本 Codec linux内核
最近被一个问题困扰了很久，就是TI的dvsdk编译出来的可加载模块cmemk.ko，这个模块是TI专门针对DSP和ARM之间共享内存，数据交互而设计的，在dvsdk编译完成哦会被放在，system/ti-dsp/下面。那我遇到什么问题了呢，原来是整个android系统可以在SD卡中启动并正确的完成cmemk.ko模块的加载，加载主要是通过文件系统中内核运行的第一个脚本init.r
对于规范和实现，你会混淆吗？ yangshangchuan HotSpot
昨晚和朋友聊天，喝了点咖啡，由于我经常喝茶，很长时间没喝咖啡了，所以失眠了，于是起床读JVM规范，读完后在朋友圈发了一条信息： JVM Run-Time Data Areas：The Java Virtual Machine defines various run-time data areas that are used during execution of a program. So
android 网络百合不是茶网络
android的网络编程和java的一样没什么好分析的都是一些死的照着写就可以了,所以记录下来方便查找 , 服务器使用的是TomCat 服务器代码; servlet的使用需要在xml中注册 package servlet; import java.io.IOException; import java.util.Arr
[读书笔记]读法拉第传 comsci 读书笔记
1831年的时候,一年可以赚到1000英镑的人..应该很少的... 要成为一个科学家,没有足够的资金支持,很多实验都无法完成但是当钱赚够了以后....就不能够一直在商业和市场中徘徊......
随机数的产生沐刃青蛟随机数
c++中阐述随机数的方法有两种：一是产生假随机数（不管操作多少次，所产生的数都不会改变）这类随机数是使用了默认的种子值产生的，所以每次都是一样的。 //默认种子 for (int i = 0; i < 5; i++) { cout<<
PHP检测函数所在的文件名 IT独行者 PHP 函数
很简单的功能，用到PHP中的反射机制，具体使用的是ReflectionFunction类，可以获取指定函数所在PHP脚本中的具体位置。创建引用脚本。代码： [php] view plain copy // Filename: functions.php <?php&nbs
银行各系统功能简介文强chu 金融
银行各系统功能简介　业务系统核心业务系统业务功能包括：总账管理、卡系统管理、客户信息管理、额度控管、存款、贷款、资金业务、国际结算、支付结算、对外接口等清分清算系统以清算日期为准，将账务类交易、非账务类交易的手续费、代理费、网络服务费等相关费用，按费用类型计算应收、应付金额，经过清算人员确认后上送核心系统完成结算的过程国际结算系
Python学习1(pip django 安装以及第一个project) 小桔子 python django pip
最近开始学习python,要安装个pip的工具。听说这个工具很强大，安装了它，在安装第三方工具的话so easy!然后也下载了，按照别人给的教程开始安装，奶奶的怎么也安装不上！第一步：官方下载pip-1.5.6.tar.gz, https://pypi.python.org/pypi/pip easy! 第二部：解压这个压缩文件，会看到一个setup.p
php 数组 aichenglong PHP 排序数组循环多维数组
1 php中的创建数组 $product = array('tires','oil','spark');//array()实际上是语言结构而不是函数 2 如果需要创建一个升序的排列的数字保存在一个数组中，可以使用range()函数来自动创建数组 $numbers=range(1,10)//1 2 3 4 5 6 7 8 9 10 $numbers=range(1,10,
安装python2.7 AILIKES python
安装python2.7 1、下载可从 http://www.python.org/进行下载#wget https://www.python.org/ftp/python/2.7.10/Python-2.7.10.tgz 2、复制解压 #mkdir -p /opt/usr/python #cp /opt/soft/Python-2
java异常的处理探讨百合不是茶 JAVA异常
//java异常 /* 1，了解java 中的异常处理机制，有三种操作 a,声明异常 b,抛出异常 c,捕获异常 2，学会使用try-catch-finally来处理异常 3，学会如何声明异常和抛出异常 4，学会创建自己的异常 */ //2，学会使用try-catch-finally来处理异常
getElementsByName实例 bijian1013 element
实例1： <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd"> <html xmlns="http://www.w3.org/1999/x
探索JUnit4扩展：Runner bijian1013 java 单元测试 JUnit
参加敏捷培训时，教练提到Junit4的Runner和Rule，于是特上网查一下，发现很多都讲的太理论，或者是举的例子实在是太牵强。多搜索了几下，搜索到两篇我觉得写的非常好的文章。文章地址：http://www.blogjava.net/jiangshachina/archive/20
[MongoDB学习笔记二]MongoDB副本集 bit1129 mongodb
1. 副本集的特性 1)一台主服务器(Primary),多台从服务器(Secondary) 2)Primary挂了之后，从服务器自动完成从它们之中选举一台服务器作为主服务器，继续工作，这就解决了单点故障，因此，在这种情况下，MongoDB集群能够继续工作 3)挂了的主服务器恢复到集群中只能以Secondary服务器的角色加入进来 2
【Spark八十一】Hive in the spark assembly bit1129 assembly
Spark SQL supports most commonly used features of HiveQL. However, different HiveQL statements are executed in different manners: 1. DDL statements (e.g. CREATE TABLE, DROP TABLE, etc.)
Nginx问题定位之监控进程异常退出 ronin47
nginx在运行过程中是否稳定，是否有异常退出过？这里总结几项平时会用到的小技巧。 1. 在error.log中查看是否有signal项，如果有，看看signal是多少。比如，这是一个异常退出的情况： $grep signal error.log 2012/12/24 16:39:56 [alert] 13661#0: worker process 13666 exited on s
No grammar constraints (DTD or XML schema).....两种解决方法 byalias xml
方法一：常用方法关闭XML验证工具栏：windows => preferences => xml => xml files => validation => Indicate when no grammar is specified:选择Ignore即可。方法二：（个人推荐）添加内容如下 <?xml version=
Netty源码学习-DefaultChannelPipeline bylijinnan netty
package com.ljn.channel; /** * ChannelPipeline采用的是Intercepting Filter 模式 * 但由于用到两个双向链表和内部类，这个模式看起来不是那么明显，需要仔细查看调用过程才发现 * * 下面对ChannelPipeline作一个模拟，只模拟关键代码： */ public class Pipeline {
MYSQL数据库常用备份及恢复语句 chicony mysql
备份MySQL数据库的命令，可以加选不同的参数选项来实现不同格式的要求。 mysqldump -h主机 -u用户名 -p密码数据库名 > 文件备份MySQL数据库为带删除表的格式，能够让该备份覆盖已有数据库而不需要手动删除原有数据库。 mysqldump -–add-drop-table -uusername -ppassword databasename > ba
小白谈谈云计算--基于Google三大论文 CrazyMizzz Google 云计算 GFS
之前在没有接触到云计算之前，只是对云计算有一点点模糊的概念，觉得这是一个很高大上的东西，似乎离我们大一的还很远。后来有机会上了一节云计算的普及课程吧，并且在之前的一周里拜读了谷歌三大论文。不敢说理解，至少囫囵吞枣啃下了一大堆看不明白的理论。现在就简单聊聊我对于云计算的了解。我先说说GFS &n
hadoop 平衡空间设置方法 daizj hadoop balancer
在hdfs-site.xml中增加设置balance的带宽，默认只有1M： <property> <name>dfs.balance.bandwidthPerSec</name> <value>10485760</value> <description&g
Eclipse程序员要掌握的常用快捷键 dcj3sjt126com 编程
判断一个人的编程水平，就看他用键盘多，还是鼠标多。用键盘一是为了输入代码（当然了，也包括注释），再有就是熟练使用快捷键。曾有人在豆瓣评《卓有成效的程序员》：“人有多大懒，才有多大闲”。之前我整理了一个程序员图书列表，目的也就是通过读书，让程序员变懒。程序员作为特殊的群体，有的人可以这么懒，懒到事情都交给机器去做，而有的人又可以那么勤奋，每天都孜孜不倦得
Android学习之路 dcj3sjt126com Android学习
转自：http://blog.csdn.net/ryantang03/article/details/6901459 以前有J2EE基础，接触JAVA也有两三年的时间了，上手Android并不困难，思维上稍微转变一下就可以很快适应。以前做的都是WEB项目，现今体验移动终端项目，让我越来越觉得移动互联网应用是未来的主宰。下面说说我学习Android的感受，我学Android首先是看MARS的视
java 遍历Map的四种方法 eksliang java HashMap java 遍历Map的四种方法
转载请出自出处： http://eksliang.iteye.com/blog/2059996 package com.ickes; import java.util.HashMap; import java.util.Iterator; import java.util.Map; import java.util.Map.Entry; /** * 遍历Map的四种方式
【精典】数据库相关相关 gengzg 数据库
package C3P0; import java.sql.Connection; import java.sql.SQLException; import java.beans.PropertyVetoException; import com.mchange.v2.c3p0.ComboPooledDataSource; public class DBPool{
自动补全 huyana_town 自动补全
<!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd"><html xmlns="http://www.w3.org/1999/xhtml&quo
jquery在线预览PDF文件，打开PDF文件天梯梦 jquery
最主要的是使用到了一个jquery的插件jquery.media.js，使用这个插件就很容易实现了。核心代码 <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.
ViewPager刷新单个页面的方法 lovelease android viewpager tag 刷新
使用ViewPager做滑动切换图片的效果时，如果图片是从网络下载的，那么再子线程中下载完图片时我们会使用handler通知UI线程，然后UI线程就可以调用mViewPager.getAdapter().notifyDataSetChanged()进行页面的刷新，但是viewpager不同于listview，你会发现单纯的调用notifyDataSetChanged()并不能刷新页面
利用按位取反（~）从复合枚举值里清除枚举值草料场 enum
以 C# 中的 System.Drawing.FontStyle 为例。如果需要同时有多种效果，如：“粗体”和“下划线”的效果，可以用按位或（|） FontStyle style = FontStyle.Bold | FontStyle.Underline; 如果需要去除 style 里的某一种效果，
Linux系统新手学习的11点建议刘星宇编程工作 linux 脚本
　　随着Linux应用的扩展许多朋友开始接触Linux，根据学习Windwos的经验往往有一些茫然的感觉：不知从何处开始学起。这里介绍学习Linux的一些建议。　　一、从基础开始：常常有些朋友在Linux论坛问一些问题，不过，其中大多数的问题都是很基础的。例如：为什么我使用一个命令的时候，系统告诉我找不到该目录，我要如何限制使用者的权限等问题，这些问题其实都不是很难的，只要了解了 Linu
hibernate dao层应用之HibernateDaoSupport二次封装 wangzhezichuan DAO Hibernate
/** * 方法描述:sql语句查询返回List<Class> * 方法备注: Class 只能是自定义类 * @param calzz * @param sql * @return * 创建人：王川 * 创建时间：Jul

TMS320C6678多核DSP的核间通信方法

你可能感兴趣的:(TI-DSP)