# Indexing pdf in elastic search using spark scala

**URL:** https://discuss.elastic.co/t/indexing-pdf-in-elastic-search-using-spark-scala/79734
**Category:** Elasticsearch
**Created:** [March 23, 2017, 11:18am UTC](https://discuss.elastic.co/t/indexing-pdf-in-elastic-search-using-spark-scala/79734 "2017-03-23T11:18:14Z")
**Posts on this page:** 2
**Page:** 1

<div class="post-metadata">

### Author: ![Akshay\_Parab](https://avatars.discourse-cdn.com/v4/letter/a/ecccb3/32.png) [@Akshay\_Parab](https://discuss.elastic.co/u/Akshay_Parab)
#### Post date: [March 23, 2017, 11:18am UTC](https://discuss.elastic.co/t/indexing-pdf-in-elastic-search-using-spark-scala/79734/1 "2017-03-23T11:18:14Z")

</div>

I was trying to index pdf in scala  
i have converted text in base64 encoding  
also created RDD and we want to indexing in elastic search using this RDD  
Is their any other solution to solve this

Getting this error:  
Caused by: org.elasticsearch.hadoop.serialization.EsHadoopSerializationException: Cannot handle type [class java.lang.Character], instance [D] using writer [org.elasticsearch.spark.serialization.ScalaValueWriter@5f0eac1c]  
at org.elasticsearch.hadoop.serialization.builder.ContentBuilder.value(ContentBuilder.java:63)  
at org.elasticsearch.hadoop.serialization.bulk.TemplatedBulk.doWriteObject(TemplatedBulk.java:71)  
at org.elasticsearch.hadoop.serialization.bulk.TemplatedBulk.write(TemplatedBulk.java:58)  
at org.elasticsearch.hadoop.rest.RestRepository.writeToIndex(RestRepository.java:159)  
at org.elasticsearch.spark.rdd.EsRDDWriter.write(EsRDDWriter.scala:67)  
at org.elasticsearch.spark.rdd.EsSpark$$anonfun$doSaveToEs$1.apply(EsSpark.scala:102)  
at org.elasticsearch.spark.rdd.EsSpark$$anonfun$doSaveToEs$1.apply(EsSpark.scala:102)  
at org.apache.spark.scheduler.ResultTask.runTask(ResultTask.scala:70)  
at org.apache.spark.scheduler.Task.run(Task.scala:86)  
at org.apache.spark.executor.Executor$TaskRunner.run(Executor.scala:274)  
at java.util.concurrent.ThreadPoolExecutor.runWorker(Unknown Source)  
at java.util.concurrent.ThreadPoolExecutor$Worker.run(Unknown Source)  
at java.lang.Thread.run(Unknown Source)

---

<div class="post-metadata">

### Author: ![system](https://us1.discourse-cdn.com/elastic/original/3X/1/a/1ac57faf039f6b580b3f104ef42a2a89e41014de.png) [@system](https://discuss.elastic.co/u/system)
#### Post date: [April 20, 2017, 11:18am UTC](https://discuss.elastic.co/t/indexing-pdf-in-elastic-search-using-spark-scala/79734/2 "2017-04-20T11:18:23Z")

</div>

This topic was automatically closed 28 days after the last reply. New replies are no longer allowed.
