<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:taxo="http://purl.org/rss/1.0/modules/taxonomy/" version="2.0">
  <channel>
    <title>i.MX ProcessorsのトピックiMX6Q PCIe speed performance with memcpy()</title>
    <link>https://community.nxp.com/t5/i-MX-Processors/iMX6Q-PCIe-speed-performance-with-memcpy/m-p/705316#M109569</link>
    <description>&lt;HTML&gt;&lt;HEAD&gt;&lt;/HEAD&gt;&lt;BODY&gt;&lt;P&gt;Hello all,&amp;nbsp;&lt;/P&gt;&lt;P&gt;I have a two iMX6Q based boards connected via PCIe link.&lt;/P&gt;&lt;P&gt;The first one acts as RC and runs Linux. The second one acts as EP and runs bare-metal based on Freescale SDK.&lt;/P&gt;&lt;P&gt;I can transfer data from EP to RC's DDR memory via iATU outbound translation, but the transfer performance is very poor for PCIe speeds.&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;I use memcpy() on EP side to copy data to buffers allocated in RC's memory and then calculate speed based on elapsed CPU cycles.&lt;/P&gt;&lt;P&gt;Example code on EP side:&lt;/P&gt;&lt;PRE class="language-c line-numbers"&gt;&lt;CODE&gt;uint8_t &lt;SPAN class="operator token"&gt;*&lt;/SPAN&gt;buffer&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;

buffer &lt;SPAN class="operator token"&gt;=&lt;/SPAN&gt; &lt;SPAN class="token function"&gt;malloc&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;DATASEND_SIZE&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;
&lt;SPAN class="keyword token"&gt;if&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;buffer &lt;SPAN class="operator token"&gt;==&lt;/SPAN&gt; NULL&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt; &lt;SPAN class="punctuation token"&gt;{&lt;/SPAN&gt;
&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;SPAN class="token function"&gt;printf&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;&lt;SPAN class="string token"&gt;"\nbuffer malloc failed()\n"&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;
&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;SPAN class="keyword token"&gt;return&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;
&lt;SPAN class="punctuation token"&gt;}&lt;/SPAN&gt;

wrStartTime &lt;SPAN class="operator token"&gt;=&lt;/SPAN&gt; &lt;SPAN class="token function"&gt;time_get_microseconds&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;

&lt;SPAN class="comment token"&gt;/* Copy data */&lt;/SPAN&gt;
&lt;SPAN class="token function"&gt;memcpy&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;dev&lt;SPAN class="operator token"&gt;-&amp;gt;&lt;/SPAN&gt;send&lt;SPAN class="punctuation token"&gt;.&lt;/SPAN&gt;buffer&lt;SPAN class="punctuation token"&gt;,&lt;/SPAN&gt; buffer&lt;SPAN class="punctuation token"&gt;,&lt;/SPAN&gt; DATASEND_SIZE&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;

wrCurTime &lt;SPAN class="operator token"&gt;=&lt;/SPAN&gt; &lt;SPAN class="token function"&gt;time_get_microseconds&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;

wrTimeDiff &lt;SPAN class="operator token"&gt;=&lt;/SPAN&gt; &lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;uint32_t&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt; &lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;wrCurTime &lt;SPAN class="operator token"&gt;-&lt;/SPAN&gt; wrStartTime&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;

&lt;SPAN class="token function"&gt;printf&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;&lt;SPAN class="string token"&gt;"copied to buffer in %lu usec [%d MB/s]\n"&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;,&lt;/SPAN&gt; wrTimeDiff&lt;SPAN class="punctuation token"&gt;,&lt;/SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; DATASEND_SIZE&lt;SPAN class="operator token"&gt;/&lt;/SPAN&gt;wrTimeDiff&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍&lt;SPAN class="line-numbers-rows"&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/CODE&gt;&lt;/PRE&gt;&lt;P&gt;The result I get:&lt;/P&gt;&lt;BLOCKQUOTE class="jive_macro_quote jive-quote jive_text_macro"&gt;&lt;P&gt;copied to buffer in 1806 usec [18 MB/s]&lt;/P&gt;&lt;/BLOCKQUOTE&gt;&lt;P&gt;Then I spend some time trying to optimize memcpy() function that comes with Freescale SDK.&lt;/P&gt;&lt;P&gt;I used the Linux/Android(Bionic) and NEON versions all written in assembly.&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;This are the results:&lt;/P&gt;&lt;P&gt;- NEON version of memcpy():&lt;/P&gt;&lt;BLOCKQUOTE class="jive_macro_quote jive-quote jive_text_macro"&gt;&lt;P&gt;&lt;SPAN style="background-color: #f6f6f6;"&gt;copied to buffer in 885 usec [37 MB/s]&lt;/SPAN&gt;&lt;/P&gt;&lt;/BLOCKQUOTE&gt;&lt;P&gt;&lt;SPAN&gt;-&amp;nbsp;Linux version of memcpy():&lt;/SPAN&gt;&lt;/P&gt;&lt;BLOCKQUOTE class="jive_macro_quote jive-quote jive_text_macro"&gt;&lt;P&gt;&lt;SPAN style="background-color: #f6f6f6;"&gt;copied to buffer in&lt;SPAN&gt;&amp;nbsp;&lt;/SPAN&gt;&lt;/SPAN&gt;908 usec [36 MB/s]&lt;/P&gt;&lt;/BLOCKQUOTE&gt;&lt;P&gt;Again this is still from advertised speeds!&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;Then I also tested &amp;amp; replaced EP bare-metal OS with Linux (from NXP RC/EP validation example).&lt;/P&gt;&lt;P&gt;Linux based EP now copies with memcpy() to the same RC's allocated buffer!&lt;/P&gt;&lt;P&gt;Now the result is far better:&lt;/P&gt;&lt;BLOCKQUOTE class="jive_macro_quote jive-quote jive_text_macro"&gt;&lt;P&gt;[ 2.063660] pcie ep: Data write speed:108MB/s.&lt;/P&gt;&lt;/BLOCKQUOTE&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;Thus I ask myself questions what is different between implementations of EP in Linux and bare-metal SDK?&lt;/P&gt;&lt;P&gt;Reported link speed is the same, we basically use the same memcpy() implementation, we copy to the same RC's DDR buffers, etc...?&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;Could it be that because Linux uses MMU and the bare-metal doesn't?&lt;/P&gt;&lt;P&gt;Maybe Linux enables come caching that bare-metal doesn't?&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;Thanks for any answers &amp;amp; suggestions in advance!&amp;nbsp;&lt;/P&gt;&lt;/BODY&gt;&lt;/HTML&gt;</description>
    <pubDate>Fri, 15 Sep 2017 09:47:47 GMT</pubDate>
    <dc:creator>wooosaiiii</dc:creator>
    <dc:date>2017-09-15T09:47:47Z</dc:date>
    <item>
      <title>iMX6Q PCIe speed performance with memcpy()</title>
      <link>https://community.nxp.com/t5/i-MX-Processors/iMX6Q-PCIe-speed-performance-with-memcpy/m-p/705316#M109569</link>
      <description>&lt;HTML&gt;&lt;HEAD&gt;&lt;/HEAD&gt;&lt;BODY&gt;&lt;P&gt;Hello all,&amp;nbsp;&lt;/P&gt;&lt;P&gt;I have a two iMX6Q based boards connected via PCIe link.&lt;/P&gt;&lt;P&gt;The first one acts as RC and runs Linux. The second one acts as EP and runs bare-metal based on Freescale SDK.&lt;/P&gt;&lt;P&gt;I can transfer data from EP to RC's DDR memory via iATU outbound translation, but the transfer performance is very poor for PCIe speeds.&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;I use memcpy() on EP side to copy data to buffers allocated in RC's memory and then calculate speed based on elapsed CPU cycles.&lt;/P&gt;&lt;P&gt;Example code on EP side:&lt;/P&gt;&lt;PRE class="language-c line-numbers"&gt;&lt;CODE&gt;uint8_t &lt;SPAN class="operator token"&gt;*&lt;/SPAN&gt;buffer&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;

buffer &lt;SPAN class="operator token"&gt;=&lt;/SPAN&gt; &lt;SPAN class="token function"&gt;malloc&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;DATASEND_SIZE&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;
&lt;SPAN class="keyword token"&gt;if&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;buffer &lt;SPAN class="operator token"&gt;==&lt;/SPAN&gt; NULL&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt; &lt;SPAN class="punctuation token"&gt;{&lt;/SPAN&gt;
&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;SPAN class="token function"&gt;printf&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;&lt;SPAN class="string token"&gt;"\nbuffer malloc failed()\n"&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;
&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; &lt;SPAN class="keyword token"&gt;return&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;
&lt;SPAN class="punctuation token"&gt;}&lt;/SPAN&gt;

wrStartTime &lt;SPAN class="operator token"&gt;=&lt;/SPAN&gt; &lt;SPAN class="token function"&gt;time_get_microseconds&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;

&lt;SPAN class="comment token"&gt;/* Copy data */&lt;/SPAN&gt;
&lt;SPAN class="token function"&gt;memcpy&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;dev&lt;SPAN class="operator token"&gt;-&amp;gt;&lt;/SPAN&gt;send&lt;SPAN class="punctuation token"&gt;.&lt;/SPAN&gt;buffer&lt;SPAN class="punctuation token"&gt;,&lt;/SPAN&gt; buffer&lt;SPAN class="punctuation token"&gt;,&lt;/SPAN&gt; DATASEND_SIZE&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;

wrCurTime &lt;SPAN class="operator token"&gt;=&lt;/SPAN&gt; &lt;SPAN class="token function"&gt;time_get_microseconds&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;

wrTimeDiff &lt;SPAN class="operator token"&gt;=&lt;/SPAN&gt; &lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;uint32_t&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt; &lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;wrCurTime &lt;SPAN class="operator token"&gt;-&lt;/SPAN&gt; wrStartTime&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;

&lt;SPAN class="token function"&gt;printf&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;(&lt;/SPAN&gt;&lt;SPAN class="string token"&gt;"copied to buffer in %lu usec [%d MB/s]\n"&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;,&lt;/SPAN&gt; wrTimeDiff&lt;SPAN class="punctuation token"&gt;,&lt;/SPAN&gt;&amp;nbsp;&amp;nbsp;&amp;nbsp;&amp;nbsp; DATASEND_SIZE&lt;SPAN class="operator token"&gt;/&lt;/SPAN&gt;wrTimeDiff&lt;SPAN class="punctuation token"&gt;)&lt;/SPAN&gt;&lt;SPAN class="punctuation token"&gt;;&lt;/SPAN&gt;‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍‍&lt;SPAN class="line-numbers-rows"&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;SPAN&gt;‍&lt;/SPAN&gt;&lt;/SPAN&gt;&lt;/CODE&gt;&lt;/PRE&gt;&lt;P&gt;The result I get:&lt;/P&gt;&lt;BLOCKQUOTE class="jive_macro_quote jive-quote jive_text_macro"&gt;&lt;P&gt;copied to buffer in 1806 usec [18 MB/s]&lt;/P&gt;&lt;/BLOCKQUOTE&gt;&lt;P&gt;Then I spend some time trying to optimize memcpy() function that comes with Freescale SDK.&lt;/P&gt;&lt;P&gt;I used the Linux/Android(Bionic) and NEON versions all written in assembly.&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;This are the results:&lt;/P&gt;&lt;P&gt;- NEON version of memcpy():&lt;/P&gt;&lt;BLOCKQUOTE class="jive_macro_quote jive-quote jive_text_macro"&gt;&lt;P&gt;&lt;SPAN style="background-color: #f6f6f6;"&gt;copied to buffer in 885 usec [37 MB/s]&lt;/SPAN&gt;&lt;/P&gt;&lt;/BLOCKQUOTE&gt;&lt;P&gt;&lt;SPAN&gt;-&amp;nbsp;Linux version of memcpy():&lt;/SPAN&gt;&lt;/P&gt;&lt;BLOCKQUOTE class="jive_macro_quote jive-quote jive_text_macro"&gt;&lt;P&gt;&lt;SPAN style="background-color: #f6f6f6;"&gt;copied to buffer in&lt;SPAN&gt;&amp;nbsp;&lt;/SPAN&gt;&lt;/SPAN&gt;908 usec [36 MB/s]&lt;/P&gt;&lt;/BLOCKQUOTE&gt;&lt;P&gt;Again this is still from advertised speeds!&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;Then I also tested &amp;amp; replaced EP bare-metal OS with Linux (from NXP RC/EP validation example).&lt;/P&gt;&lt;P&gt;Linux based EP now copies with memcpy() to the same RC's allocated buffer!&lt;/P&gt;&lt;P&gt;Now the result is far better:&lt;/P&gt;&lt;BLOCKQUOTE class="jive_macro_quote jive-quote jive_text_macro"&gt;&lt;P&gt;[ 2.063660] pcie ep: Data write speed:108MB/s.&lt;/P&gt;&lt;/BLOCKQUOTE&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;Thus I ask myself questions what is different between implementations of EP in Linux and bare-metal SDK?&lt;/P&gt;&lt;P&gt;Reported link speed is the same, we basically use the same memcpy() implementation, we copy to the same RC's DDR buffers, etc...?&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;Could it be that because Linux uses MMU and the bare-metal doesn't?&lt;/P&gt;&lt;P&gt;Maybe Linux enables come caching that bare-metal doesn't?&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;Thanks for any answers &amp;amp; suggestions in advance!&amp;nbsp;&lt;/P&gt;&lt;/BODY&gt;&lt;/HTML&gt;</description>
      <pubDate>Fri, 15 Sep 2017 09:47:47 GMT</pubDate>
      <guid>https://community.nxp.com/t5/i-MX-Processors/iMX6Q-PCIe-speed-performance-with-memcpy/m-p/705316#M109569</guid>
      <dc:creator>wooosaiiii</dc:creator>
      <dc:date>2017-09-15T09:47:47Z</dc:date>
    </item>
    <item>
      <title>Re: iMX6Q PCIe speed performance with memcpy()</title>
      <link>https://community.nxp.com/t5/i-MX-Processors/iMX6Q-PCIe-speed-performance-with-memcpy/m-p/705317#M109570</link>
      <description>&lt;HTML&gt;&lt;HEAD&gt;&lt;/HEAD&gt;&lt;BODY&gt;&lt;P&gt;Hi Primoz&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;you are right, original SDK does not use MMU and one can try patch on&lt;/P&gt;&lt;P&gt;&lt;A href="https://community.nxp.com/docs/DOC-94572"&gt;Enabling MMU and Caches on i.MX6 Series Platform SDK&lt;/A&gt;&amp;nbsp;&lt;/P&gt;&lt;P&gt;&lt;/P&gt;&lt;P&gt;Best regards&lt;BR /&gt;igor&lt;BR /&gt;-----------------------------------------------------------------------------------------------------------------------&lt;BR /&gt;Note: If this post answers your question, please click the Correct Answer button. Thank you!&lt;BR /&gt;-----------------------------------------------------------------------------------------------------------------------&lt;/P&gt;&lt;/BODY&gt;&lt;/HTML&gt;</description>
      <pubDate>Fri, 15 Sep 2017 11:24:09 GMT</pubDate>
      <guid>https://community.nxp.com/t5/i-MX-Processors/iMX6Q-PCIe-speed-performance-with-memcpy/m-p/705317#M109570</guid>
      <dc:creator>igorpadykov</dc:creator>
      <dc:date>2017-09-15T11:24:09Z</dc:date>
    </item>
    <item>
      <title>Re: iMX6Q PCIe speed performance with memcpy()</title>
      <link>https://community.nxp.com/t5/i-MX-Processors/iMX6Q-PCIe-speed-performance-with-memcpy/m-p/705318#M109571</link>
      <description>&lt;HTML&gt;&lt;HEAD&gt;&lt;/HEAD&gt;&lt;BODY&gt;&lt;P&gt;&lt;A class="jx-jive-macro-user" href="https://community.nxp.com/people/igorpadykov"&gt;igorpadykov&lt;/A&gt;‌ thanks for pointing me in the right direction!&lt;/P&gt;&lt;P&gt;I added 1:1 MMU mapping to PCIe address space in apps/common/platform_init.c!&amp;nbsp;&lt;/P&gt;&lt;P&gt;Now bare-metal SDK memcpy() speeds match that of Linux counterpart!&lt;/P&gt;&lt;P&gt;Regards,&lt;/P&gt;&lt;P&gt;Primoz&lt;/P&gt;&lt;/BODY&gt;&lt;/HTML&gt;</description>
      <pubDate>Fri, 15 Sep 2017 12:37:58 GMT</pubDate>
      <guid>https://community.nxp.com/t5/i-MX-Processors/iMX6Q-PCIe-speed-performance-with-memcpy/m-p/705318#M109571</guid>
      <dc:creator>wooosaiiii</dc:creator>
      <dc:date>2017-09-15T12:37:58Z</dc:date>
    </item>
  </channel>
</rss>

