前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >Apache-Tika解析JPEG文档

Apache-Tika解析JPEG文档

作者头像
Dlimeng
发布2023-06-29 14:13:02
1570
发布2023-06-29 14:13:02
举报
文章被收录于专栏:开源心路开源心路
代码语言:javascript
复制
package com.mengyao.tika.app;

import java.io.File;
import java.io.FileInputStream;

import org.apache.tika.metadata.Metadata;
import org.apache.tika.parser.ParseContext;
import org.apache.tika.parser.jpeg.JpegParser;
import org.apache.tika.sax.BodyContentHandler;

public class JpegApp {

    public static void main(final String[] args) throws Exception {
        // Tika默认是10*1024*1024,这里防止文件过大导致Tika报错
        BodyContentHandler handler = new BodyContentHandler(1024 * 1024 * 10);
        Metadata metadata = new Metadata();
        FileInputStream inputstream = new FileInputStream(new File("D:/无标题.jpg"));
        ParseContext pcontext = new ParseContext();

        // 解析JPEG文件时应由超类AbstractParser的派生类JpegParser实现
        JpegParser msofficeparser = new JpegParser();
        msofficeparser.parse(inputstream, handler, metadata, pcontext);
        // 获取JPEG文件的内容
        System.out.println("JPEG文件内容:" + handler.toString());

        // 获取JPEG文件的元数据
        System.out.println("JPEG文件元数据:");
        String[] metadataNames = metadata.names();

        for (String name : metadataNames) {
            System.out.println(name + " : " + metadata.get(name));
        }
    }

}

代码语言:javascript
复制
方法2:
代码语言:javascript
复制
public String tikaTool(File f){  
        Tika tika=new Tika();  
        try  
        {  
            return tika.parseToString(f);  
        }  
        catch (IOException e)  
        {  
              
            e.printStackTrace();  
        }  
        catch (TikaException e)  
        {  
              
            e.printStackTrace();  
        }  
        return null;  
    }  
本文参与 腾讯云自媒体分享计划,分享自作者个人站点/博客。
原始发表:2017-06-16,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体分享计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档