edu.umd.cloud9.collection.trec
Class TrecDocumentInputFormat
java.lang.Object
org.apache.hadoop.mapreduce.InputFormat<K,V>
org.apache.hadoop.mapreduce.lib.input.FileInputFormat<K,V>
edu.umd.cloud9.collection.IndexableFileInputFormat<LongWritable,WebDocument>
edu.umd.cloud9.collection.trec.TrecDocumentInputFormat
public class TrecDocumentInputFormat
- extends IndexableFileInputFormat<LongWritable,WebDocument>
| Methods inherited from class org.apache.hadoop.mapreduce.lib.input.FileInputFormat |
addInputPath, addInputPaths, getInputPathFilter, getInputPaths, getMaxSplitSize, getMinSplitSize, getSplits, setInputPathFilter, setInputPaths, setInputPaths, setMaxInputSplitSize, setMinInputSplitSize |
TrecDocumentInputFormat
public TrecDocumentInputFormat()
createRecordReader
public RecordReader<LongWritable,WebDocument> createRecordReader(InputSplit split,
TaskAttemptContext context)
throws IOException,
InterruptedException
- Specified by:
createRecordReader in class InputFormat<LongWritable,WebDocument>
- Throws:
IOException
InterruptedException