【发布时间】:2019-12-07 03:19:30
【问题描述】:
您好,我想看看是否有人能看到我的代码有任何明显的问题。我正在尝试在两个 Nvidia Jetson 板上运行我的代码,以利用 8 个内核来加速。我想比较使用一块板和两块板的速度。我将 Chapel 环境设置为允许执行多个语言环境。 这是我的实现:
use LinearAlgebra, Norm, Random, Time;
var t : Timer;
writeln("Size of your matrix?");
var size = read(int);
var grid : [1..size, 1..size] uint(8);
var grid2 : [1..size, 1..size] uint(8);
var grid3 : [1..size, 1..size] int;
fillRandom(grid);
fillRandom(grid2);
t.start();
forall loc in Locales do
on loc do
forall i in 1..size do
forall j in 1..size do
forall k in 1..size do
grid3[i,j] += grid[i,k] * grid2[k,j];
t.stop();
writeln("Done!:");
writeln(t.elapsed(),"seconds");
t.clear();
我不断得到:
error: Only 1 locale may be used for CHPL_COMM layer 'none'
To use multiple locales, see $CHPL_HOME/doc/rst/usingchapel/multilocale.rst
当我运行 cores.chpl 文件时:
coforall loc in Locales do
on loc do
writeln("locale ", here.id, " named ", here.name, " has ", here.numPUs(), " cores.");
这是输出:
locale 0 named JetsonNano has 4 cores.
locale 1 named JetsonNano2 has 4 cores.
所以我知道环境设置正确。
我只是不确定我是否正在设置我的矩阵乘法代码,因为它允许在多个语言环境中使用。
【问题讨论】:
标签: chapel