Запись данных из датафрейма pyspark в другую таблицу cassandra по id

Такой вопрос, предположим есть таблица в cassandra test:

+----+---------+---------+
| id | country | counter |
+====+=========+=========+
|  A |      RU |       1 |
+----+---------+---------+
|  B |      EN |       2 |
+----+---------+---------+
|  C |      IQ |       1 |
+----+---------+---------+
|  D |      RU |       3 |
+----+---------+---------+

Так же есть таблица в том же пространстве main в которой пару десятков столбцов и есть столбец аналогичный country, назовем его country_main и аналогичный id - main_id.

В столбце main_id есть как айдишники из таблицы test, так и уникальные айдишники. В столбце country есть пустые ячейки. Примерно так:

+---------+--------------+---------+
| main_id | country_main |      ...|
+=========+==============+=========+
|  A      |              |      ...|
+---------+--------------+---------+
|  B      |      EN      |      ...|
+---------+--------------+---------+
|  Y      |      IQ      |      ...|
+---------+--------------+---------+
|  Z      |      RU      |      ...|
+---------+--------------+---------+

Каким образом средствами pyspark сделать инсерт данных из таблицы test в main, что бы заполнить пустые ячейки таблицы main согласно айдишникам из теста?


Ответы (0 шт):