C#提取PPT文本和图片-创新互联

在图文混排的文档中,我们可以根据需要将文档中的文字信息或者图片提取出来,通过C#代码可以提取Word和PDF文件中的文本和图片,那么同样的,我们也可以提取PPT幻灯片当中的文本和图片。本篇文档将讲述如何使用C#来实现提取PPT文本和图片的操作。首先也是需要安装组件Spire.Presentation,然后添加引用dll文件到项目中。下面是主要的代码步骤。

创新互联公司是一家集网站建设,南海企业网站建设,南海品牌网站建设,网站定制,南海网站建设报价,网络营销,网络优化,南海网站推广为一体的创新建站企业,帮助传统企业提升企业形象加强企业竞争力。可充分满足这一群体相比中小企业更为丰富、高端、多元的互联网需求。同时我们时刻保持专业、时尚、前沿,时刻以成就客户成长自我,坚持不断学习、思考、沉淀、净化自己,让我们为更多的企业打造出实用型网站。

原文档:

C# 提取PPT文本和图片

1. 提取文本

步骤一:创建一个Presentation实例并加载文档

Presentation presentation = newPresentation(@"C:\Users\Administrator\Desktop\sample.pptx", FileFormat.Pptx2010);

步骤二:创建一个StringBuilder对象

StringBuilder sb = newStringBuilder();

步骤三:遍历幻灯片及幻灯片中的图形,提取文本内容

 foreach (ISlide slide in presentation.Slides)
            {
                foreach (IShape shape in slide.Shapes)
                {
                    if (shape isIAutoShape)
                    {
                        foreach (TextParagraph tp in (shape asIAutoShape).TextFrame.Paragraphs)
                        {
                            sb.Append(tp.Text +Environment.NewLine);
                        }
                    }
                }
            }

步骤四:写入Txt文档

File.WriteAllText("target.txt", sb.ToString());
Process.Start("target.txt");

C# 提取PPT文本和图片

2. 提取图片

这里提取图片有两种情况,一种是提取整个文档中的所有图片,另外一种是只提取文档中某一特定幻灯片中的图片。

 2.1提取所有图片

步骤一:初始化一个Presentation类实例,并加载文档

Presentation ppt = newPresentation();
ppt.LoadFromFile(@"C:\Users\Administrator\Desktop\sample.pptx");

步骤二:遍历文档中图片,提取图片并保存

for (int i = 0; i 

提取的图片已保存到项目文件夹下

C# 提取PPT文本和图片

 2.2.提取特定幻灯片中的图片

步骤一:创建一个Presentation类实例,并加载文档

Presentation PPT = newPresentation();
PPT.LoadFromFile(@"C:\Users\Administrator\Desktop\sample.pptx");

步骤二:获取第三张幻灯片,提取并保存图片

int i = 0;
foreach (IShape s inPPT.Slides[2].Shapes)
{
    if (s isSlidePicture)
    {
        SlidePicture ps = s asSlidePicture;
       ps.PictureFill.Picture.EmbedImage.Image.Save(string.Format("{0}.png", i));
        i++;
    }
    if (s isPictureShape)
    {
        PictureShape ps = s asPictureShape;
        ps.EmbedImage.Image.Save(string.Format("{0}.png", i));
        i++;
    }
}

提取的第三张幻灯片中的图片已保存至指定位置

C# 提取PPT文本和图片

上文演示了如何提取文本和图片,步骤比较简单实用,希望对你有所帮助,感谢阅读!

(如需转载,请注明出处和作者)

另外有需要云服务器可以了解下创新互联scvps.cn,海内外云服务器15元起步,三天无理由+7*72小时售后在线,公司持有idc许可证,提供“云服务器、裸金属服务器、高防服务器、香港服务器、美国服务器、虚拟主机、免备案服务器”等云主机租用服务以及企业上云的综合解决方案,具有“安全稳定、简单易用、服务可用性高、性价比高”等特点与优势,专为企业上云打造定制,能够满足用户丰富、多元化的应用场景需求。


名称栏目:C#提取PPT文本和图片-创新互联
网页URL:http://pwwzsj.com/article/cejddd.html