【发布时间】:2018-06-14 22:35:13
【问题描述】:
我正在使用 GCC 为 Cortex M7 编译此代码:
// copy manually
void write_test_plain(uint8_t * ptr, uint32_t value)
{
*ptr++ = (u8)(value);
*ptr++ = (u8)(value >> 8);
*ptr++ = (u8)(value >> 16);
*ptr++ = (u8)(value >> 24);
}
// copy using memcpy
void write_test_memcpy(uint8_t * ptr, uint32_t value)
{
void *px = (void*)&value;
memcpy(ptr, px, 4);
}
int main(void)
{
extern uint8_t data[];
extern uint32_t value;
// i added some offsets to data to
// make sure the compiler cannot
// assume it's aligned in memory
write_test_plain(data + 2, value);
__asm volatile("": : :"memory"); // just to split inlined calls
write_test_memcpy(data + 5, value);
... do something with data ...
}
我得到以下带有 -O2 的 Thumb2 程序集:
// write_test_plain(data + 2, value);
800031c: 2478 movs r4, #120 ; 0x78
800031e: 2056 movs r0, #86 ; 0x56
8000320: 2134 movs r1, #52 ; 0x34
8000322: 2212 movs r2, #18 ; 0x12
8000324: 759c strb r4, [r3, #22]
8000326: 75d8 strb r0, [r3, #23]
8000328: 7619 strb r1, [r3, #24]
800032a: 765a strb r2, [r3, #25]
// write_test_memcpy(data + 5, value);
800032c: 4ac4 ldr r2, [pc, #784] ; (8000640 <main+0x3a0>)
800032e: 923b str r2, [sp, #236] ; 0xec
8000330: 983b ldr r0, [sp, #236] ; 0xec
8000332: f8c3 0019 str.w r0, [r3, #25]
有人可以解释memcpy 版本的工作原理吗?这看起来像是对目标地址的内联 32 位存储,但这不是问题吗,因为 data + 5 肯定没有与 4 字节边界对齐?
这可能是由于我的源代码中的一些未定义行为而发生的一些优化吗?
【问题讨论】:
-
你用的是什么 C 库?
-
Cortex-M7 默认支持使用
str指令的未对齐写入。这可以在运行时更改(忘记如何调用标志)。您也可以尝试使用uint64_t,因为STRD在未对齐时会触发故障。 -
@TurboJ:谢谢,Johan 提到了下面的标志,但是如果控制器支持对齐访问,你知道为什么有人会使用这个标志吗?
-
为了能够在开发过程中捕获 - 稍慢 - 未对齐的访问。也为了与 armv6-m aka Cortex-M0 兼容。
-
标志是SCB.CCR.UNALIGN_TRP;另请注意,strongly ordered 和 device 内存禁止未对齐的访问(无论此标志如何),这通常是映射外设寄存器的位置。
标签: c embedded memcpy memory-alignment cortex-m