首先添加 HtmlAgilityPack.dll引用
private void JieXiHTML(string htmlURL)
{
WirteLog("加载网页内容 -- 开始");
HtmlWeb webClient = new HtmlWeb();
HtmlAgilityPack.HtmlDocument doc = webClient.Load(htmlURL);
var rootNode = doc.GetElementbyId("main-list-table");
WirteLog("加载网页内容 -- 结束");
WirteLog("解析网页内容 -- 开始");
string xml = "<?xml version=\"1.0\" encoding=\"utf-8\" ?>" + "<table>" + rootNode.InnerHtml + "</table>";
XmlDocument xmlDoc = new XmlDocument();
xmlDoc.LoadXml(xml);
Wirte

本文档展示了如何使用C#中的HtmlAgilityPack库来解析HTML网页,提取特定ID的节点,并进一步转换为XML进行处理。通过加载网页、查找元素、解析内容并下载PDF,演示了对HTML内容的详细操作。

303

被折叠的 条评论
为什么被折叠?



