<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>memcpy &#8211; richliu&#039;s blog</title>
	<atom:link href="https://richliu.com/tag/memcpy/feed/" rel="self" type="application/rss+xml" />
	<link>https://richliu.com</link>
	<description>Linux, 工作, 生活, 家人</description>
	<lastBuildDate>Thu, 11 Apr 2013 03:35:51 +0000</lastBuildDate>
	<language>zh-TW</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=6.9.4</generator>
	<item>
		<title>ARM NEON memcpy</title>
		<link>https://richliu.com/2013/03/21/1429/neon-memcpy/</link>
					<comments>https://richliu.com/2013/03/21/1429/neon-memcpy/#respond</comments>
		
		<dc:creator><![CDATA[richliu]]></dc:creator>
		<pubDate>Thu, 21 Mar 2013 08:28:40 +0000</pubDate>
				<category><![CDATA[ARM]]></category>
		<category><![CDATA[arm]]></category>
		<category><![CDATA[memcpy]]></category>
		<category><![CDATA[neon]]></category>
		<guid isPermaLink="false">https://richliu.com/?p=1429</guid>

					<description><![CDATA[<p>FourDollar 在 Plurk 上提到的, NEON 是 SIMD 的指令, 可以同時做矩陣運算, 拿來 [&#8230;]</p>
<p>The post <a rel="nofollow" href="https://richliu.com/2013/03/21/1429/neon-memcpy/">ARM NEON memcpy</a> appeared first on <a rel="nofollow" href="https://richliu.com">richliu&#039;s blog</a>.</p>
]]></description>
										<content:encoded><![CDATA[<p>FourDollar 在 <a href="http://www.plurk.com/p/ibz9tg" target="_blank" rel="noopener">Plurk </a>上提到的, NEON 是 SIMD 的指令, 可以同時做矩陣運算, 拿來做一些記憶體搬移和運算都會比較快.<br />
VFP 是 SIMD 的指令, 不過背後是循序運算, 還是比 CPU 快, 但是相對上不會比較快.</p>
<p><a href="http://gitorious.org/0xdroid/bionic/commit/2ccf85280eb59b90bdf540dcc06e5d00c7f4be63/diffs" target="_blank" rel="noopener"> Added NEON optimized memcpy + armv6 unaligned memory access.</a><br />
<a href="https://github.com/genesi/imx-libc-neon/blob/master/memcpy-neon.S" target="_blank" rel="noopener">imx-libc-neon / memcpy-neon.S </a><br />
<a href="http://jserv.blogspot.tw/2009/06/android-memcpy.html" target="_blank" rel="noopener">改善 Android 中 memcpy 效能</a><br />
<a href="http://sourceware.org/ml/libc-ports/2009-07/msg00000.html" target="_blank" rel="noopener">ARM: NEON optimized implementation of memcpy.</a><br />
<a href="http://sourceware.org/ml/libc-ports/2009-07/msg00000.html" target="_blank" rel="noopener">http://sourceware.org/ml/libc-ports/2009-07/msg00000.html</a></p>
<p>之前有碰過 DMA 搬 Data 和 CPU 搬速度差不多的狀況.<br />
看起來拿閒置的 NEON 來用也是不錯的.<br />
但是 NEON dimension 太大, 如果不是有關影像處理, 只拿來做 data copy 就有點浪費了.</p>
<p>Update:<br />
NEON 是要配合 prefetch 才會快, 如果沒有 prefetch 是差不多的, 和我之前的認知類似. </p>
<p>The post <a rel="nofollow" href="https://richliu.com/2013/03/21/1429/neon-memcpy/">ARM NEON memcpy</a> appeared first on <a rel="nofollow" href="https://richliu.com">richliu&#039;s blog</a>.</p>
]]></content:encoded>
					
					<wfw:commentRss>https://richliu.com/2013/03/21/1429/neon-memcpy/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
	</channel>
</rss>
