Hive – це підпроект Apache Hadoop. Hive використовує HDFS як систему зберігання файлів.
SQL Запити Hive створюються мовою запитів HiveQL, що базується на мові SQL, але не має повної підтримки стандарту SQL-92.');})();(function(){window.jsl.dh('9LlqZ8uKIaPcwN4P0Nq1gQ0__20','
Розроблений на Java в рамках обчислювальної парадигми MapReduce, згідно з якою додаток поділяється на велику кількість однакових елементарних завдань, що здійснюються на вузлах кластера і природно зводяться в кінцевий результат. hadoop.apache.org (англ.)
Hive перетворює запити HiveQL на завдання MapReduce або Tez, які виконуються на розподіленій платформі планування завдань Apache Hadoop , Yet Another Resource Negotiator (YARN) Він запитує дані, що зберігаються у розподіленому рішенні для зберігання даних, наприклад, у розподіленій файловій системі Hadoop (HDFS) або Amazon S3.
Двигун включає такі компоненти, як Parser (розбирає вхідні SQL-запрсои), Optimimer (оптимізує запит для досягнення більшої ефективності), Planner (планує завдання на виконання) Executor (запускає завдання на фреймворку MapReduce. Для роботи hive також необхідне сховище метаданих.
Hive дозволяє користувачам читати, записувати та керувати петабайтами даних за допомогою SQL.
Запити Hive пишуться мовою HiveQL який схожий на SQL.
SQL — це мова програмування, яка дуже нагадує англійську, але призначена для програм управління базами даних. SQL використовується у кожному запиті в Access.
Школа Великих Даних
SerDe-бібліотека Apache Hive: робота з даними у HDFS
Вікіпедія
Hive – Вікіпедія
Школа Великих Даних
Що таке Apache Hive: призначення, склад, архітектура, можливості
Habr
Apache Hive: від моделі розподілених обчислень MapReduce компанії Google до Big Data – сховища великих даних / Хабр
Школа Великих Даних
Як влаштовані матеріалізовані уявлення Apache Hive