利用webBrowser获取框架内Html页面内容

系统 1545 0

[转自] http://hi.baidu.com/zonesky/blog/item/d8b89e1b66329ed3ac6e7517.html

利用 webBrowser 获取页面比较简单,MSDN下有示例,在这里不必多说。
可是一些 HTML 文档由“框架”构成,或可以存放它们自己独特 HTML 文档的窗口。使用框架可以轻松地创建 HTML 页面,其中一页或多页在其他框架持续更改它们内容的同时保持静态,例如导航栏。

HTML 作者可以采用以下两种方法之一创建框架:

  • 使用 FRAMESET FRAME 标记,创建固定窗口。

- 或 -

  • 使用 IFRAME 标记,创建可以在运行时重新放置的浮动窗口。

  1. 因为框架包含 HTML 文档,它们在文档对象模型 (DOM) 中表示为窗口元素和框架元素。

  2. 当通过使用 HtmlWindow 的框架集合访问 FRAME IFRAME 标记时,也就是检索对应于此框架的窗口元素。这里指框架的所有动态属性,例如它的当前 URL、文档和大小。

  3. 使用 HtmlWindow Children 集合或 GetElementsByName GetElementById 等方法的 WindowFrameElement 属性访问 FRAME IFRAME 标记时,也就是在检索框架元素。这里指框架的静态属性,包括原始 HTML 文件中指定的 URL。

框架和安全

对框架的访问因为托管 HTML DOM 实施称为“跨框架脚本撰写安全”的安全措施的事实而比较复杂。如果文档包含的 FRAMESET 中的两个或多个 FRAME 在不同域中,这些 FRAME 互相之间不能交互。换言之,显示网站内容的 FRAME 无法访问承载第三方站点(例如 http://www.adatum.com/)的 FRAME 中的信息。在 HtmlWindow 类级别实现这种安全。可以获取关于承载另一个网站的 FRAME 的一般信息(例如它的 URL),但无法访问它的 Document 或更改它的宿主 FRAME IFRAME 的大小或位置。

此规则也适用于使用 Open OpenNew 方法打开的窗口。如果您打开的窗口所在域不同于在 WebBrowser 控件中承载的页面的域,您将无法移动该窗口或检查它的内容。当您使用 WebBrowser 控件显示一个与部署基于 Windows 窗体的应用程序所用网站不同的网站时,也将强制执行这些限制。如果使用 ClickOnce 部署技术从网站 A 安装应用程序,而使用 WebBrowser 显示网站 B,您将无法访问网站 B 的数据。

有关跨站点脚本撰写的更多信息,请参见 About Cross- Frame Scripting and Security(关于跨框架脚本撰写和安全) (http://msdn.microsoft.com/library/default.asp?url=/workshop/author/om/xframe_scripting_security.asp)。

请参见

其他资源
使用托管 HTML 文档对象模型
FRAME 元素 | frame 对象

1.获取 frame 的源文件

MessageBox.Show( webBrowser 1.Document.Window.Frames["main"].Document.Body.InnerHtml);

2.获取 frame 的HTMLDocument接口

HTMLDocument doc = (HTMLDocument) webBrowser 1.Document.DomDocument;
object j;
for (int i = 0; i < doc.parentWindow.frames.length; i++)
{
       j = i;
       HTMLWindow2Class frame = doc.parentWindow.frames.item(ref j) as HTMLWindow2Class;
       if ( frame .name == "main")
        {                   
              MessageBox.Show( frame .document.title);                    
        }
}     

3.获取 frame 的IHTMLDocument2接口

IHTMLDocument2 doc = (IHTMLDocument2) webBrowser 1.Document.Window.Frames["main"].Document.DomDocument;

4.取得 frame 中被点击的连接

private void webBrowser 1_Navigating(object sender, WebBrowserNavigatingEventArgs e)
{
      string url = webBrowser 1.Document.Window.Frames["main"].Document.ActiveElement.GetAttribute("src");

利用webBrowser获取框架内Html页面内容


更多文章、技术交流、商务合作、联系博主

微信扫码或搜索:z360901061

微信扫一扫加我为好友

QQ号联系: 360901061

您的支持是博主写作最大的动力,如果您喜欢我的文章,感觉我的文章对您有帮助,请用微信扫描下面二维码支持博主2元、5元、10元、20元等您想捐的金额吧,狠狠点击下面给点支持吧,站长非常感激您!手机微信长按不能支付解决办法:请将微信支付二维码保存到相册,切换到微信,然后点击微信右上角扫一扫功能,选择支付二维码完成支付。

【本文对您有帮助就好】

您的支持是博主写作最大的动力,如果您喜欢我的文章,感觉我的文章对您有帮助,请用微信扫描上面二维码支持博主2元、5元、10元、自定义金额等您想捐的金额吧,站长会非常 感谢您的哦!!!

发表我的评论
最新评论 总共0条评论