diff --git a/2017-big-data.iml b/2017-big-data.iml
new file mode 100644
index 0000000..ce21085
--- /dev/null
+++ b/2017-big-data.iml
@@ -0,0 +1,79 @@
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
+
\ No newline at end of file
diff --git a/README.md b/README.md
index 997652b..8caead4 100644
--- a/README.md
+++ b/README.md
@@ -1,27 +1,7 @@
# 2017-big-data
Репозиторий для практических домашних заданий 2017 года курса "Введение в машинное обучение для java-разработчиков" в [Технополис](https://polis.mail.ru).
-### Fork
-[Форкните проект](https://help.github.com/articles/fork-a-repo/), склонируйте и добавьте `upstream`:
-```
-$ git clone git@github.com:/2017-big-data.git
-Cloning into '2017-big-data'...
-remote: Counting objects: 3, done.
-remote: Compressing objects: 100% (2/2), done.
-remote: Total 3 (delta 2), reused 3 (delta 2), pack-reused 0
-Receiving objects: 100% (3/3), 10.1 KiB | 4.5 MiB/s, done.
-Resolving deltas: 100% (2/2), done.
-$ git remote add upstream git@github.com:polis-mail-ru/2017-big-data.git
-$ git fetch upstream
-From github.com:polis-mail-ru/2017-big-data
- * [new branch] master -> upstream/master
-```
+### Job run time
-### Develop
-Откройте в IDE -- [IntelliJ IDEA Community Edition](https://www.jetbrains.com/idea/)
-через File->Open, выбрав pom.xml
-
-Пример конфигурация для запуска таски из idea можно посмотреть в файле config.png
-
-В своём Java package `` выполните все задания.
+Время работы job WordCount без combiner составило 47m 38.473s. С использованием combiner, после добавления combiner время работы составило 31m 38.491s.
diff --git a/pom.xml b/pom.xml
index 16acaa5..68016de 100644
--- a/pom.xml
+++ b/pom.xml
@@ -29,7 +29,7 @@
- pritykovskaya.WordCount
+ kubrin.WordCount
@@ -38,8 +38,8 @@
org.apache.maven.plugins
maven-compiler-plugin
- 1.6
- 1.6
+ 1.8
+ 1.8
diff --git a/runtime.txt b/runtime.txt
new file mode 100644
index 0000000..31f7b1d
--- /dev/null
+++ b/runtime.txt
@@ -0,0 +1,18 @@
+WordCount without combiner
+real 47m38.473s
+user 44m32.444s
+sys 1m5.972s
+
+
+WordCount with combiner
+real 31m38.491s
+user 33m37.704s
+sys 0m19.676s
+
+WordsSort
+real 0m23.659s
+user 0m25.428s
+sys 0m1.880s
+
+
+
diff --git a/src/main/java/META-INF/MANIFEST.MF b/src/main/java/META-INF/MANIFEST.MF
new file mode 100644
index 0000000..3a5a4aa
--- /dev/null
+++ b/src/main/java/META-INF/MANIFEST.MF
@@ -0,0 +1,3 @@
+Manifest-Version: 1.0
+Main-Class: kubrin.SortWords
+
diff --git a/src/main/java/kubrin/GetRow.java b/src/main/java/kubrin/GetRow.java
new file mode 100644
index 0000000..0a986de
--- /dev/null
+++ b/src/main/java/kubrin/GetRow.java
@@ -0,0 +1,118 @@
+package kubrin;
+// based on implementation of a-filippo (https://github.com/a-filippo/2017-big-data)
+
+import java.io.IOException;
+import java.util.SortedSet;
+import java.util.TreeSet;
+
+import org.apache.hadoop.conf.Configuration;
+import org.apache.hadoop.conf.Configured;
+import org.apache.hadoop.fs.Path;
+import org.apache.hadoop.io.IntWritable;
+import org.apache.hadoop.io.Text;
+import org.apache.hadoop.mapreduce.Job;
+import org.apache.hadoop.mapreduce.Mapper;
+import org.apache.hadoop.mapreduce.Reducer;
+import org.apache.hadoop.mapreduce.lib.input.FileInputFormat;
+import org.apache.hadoop.mapreduce.lib.input.TextInputFormat;
+import org.apache.hadoop.mapreduce.lib.output.FileOutputFormat;
+import org.apache.hadoop.mapreduce.lib.output.TextOutputFormat;
+import org.apache.hadoop.util.Tool;
+import org.apache.hadoop.util.ToolRunner;
+
+public class GetRow extends Configured implements Tool {
+ private static int valueNumber;
+ private static IntWritable ONE = new IntWritable(1);
+
+ static class MyMapper extends Mapper