处理获取到的大量html数据

文章目录[隐藏]

回复讨论(解决方案)

获取到一大堆的html数据，大概有3万个字符的大小。但是前面没用的，只有后面几千字符是有用的，想从里面提取数据。如果直接用正则去处理就浪费了很多资源，有没有什么方法可以从字符串的最后面开始正则，然后取到某个地方就停止。
刚刚一开始尝试用simple_html_dom类来处理，但是后来卡住了…
因为每次去到的东西都不一定长短，所以直接截取固定数量的长度的字符这个方法不太好。

回复讨论(解决方案)

既然你并不能准确的你需要的内容从什么位置开始，那么就不

+本文来源gao!%daima.com搞$代*!码9网(

搞gaodaima代码存在资源浪费的问题

获取html
file_get_contents
curl

正则解析html，可以获取想要的文本。

没什么好办法，因为你要过滤数据，要么正则匹配，要么用你用的那个类。

搞代码网（gaodaima.com）提供的所有资源部分来自互联网，如果有侵犯您的版权或其他权益，请说明详细缘由并提供版权或权益证明然后发送到邮箱[email protected]‍，我们会在看到邮件的第一时间内为您处理，或直接联系QQ：872152909。本网站采用BY-NC-SA协议进行授权
转载请注明原文链接：处理获取到的大量html数据

回复讨论(解决方案)

Hi，您需要填写昵称和邮箱！