Мы используем файлы cookie для улучшения вашего опыта использования сайта. Это позволяет нам анализировать, как посетители взаимодействуют с сайтом, и делать его лучше. Продолжая использовать сайт, вы соглашаетесь на использование файлов cookie. Подробную информацию вы найдете в политике обработки персональных данных.

Apache Kafka для инженеров данных

Apache Kafka: обучение для разработчиков

Вендор:
Open-source, Авторский курс, BDS
Направление:
Big Data
Продукт:
Apache Kafka
Код курса:
DEVKI
Длительность:
5 дней | 24 ак. часа
Цена:

3780 BYN с НДС 20%

В мире, где данные генерируются каждую миллисекунду, умение работать с потоками информации в реальном времени — это не просто навык, а ключевое преимущество. Apache Kafka стала золотым стандартом для построения высокопроизводительных и отказоустойчивых систем, способных обрабатывать миллионы событий в секунду. Если вы готовы перейти на новый уровень в инженерии данных и создавать сложные, масштабируемые решения, наш углубленный курс Apache Kafka — это ваш прямой путь к цели.

Этот 5-дневный практический интенсив предназначен для разработчиков и инженеров, которые хотят не просто изучить теорию, а получить реальные навыки программирования для распределенной обработки потоков событий (Event Stream Processing). Вы научитесь писать код для работы с распределенным журналом Kafka, использовать его в парадигмах Publish/Subscribe и Message Queue, а также освоите лучшие практики обработки потоковых данных. Наше Apache Kafka обучение построено на реальных кейсах, что позволит вам сразу после курса применять знания в рабочих проектах.

Чему вы научитесь на практике после обучения Apache Kafka?

Теория важна, но реальные навыки приобретаются только в бою. Наш курс, Apache Kafka для разработчиков, делает акцент на практических задачах, которые вы будете решать на протяжении всего обучения.

  • Разработка Producer и Consumer приложений: Вы напишете с нуля собственные приложения на Java для отправки и чтения сообщений из Kafka. На практике разберетесь с механизмами сериализации/десериализации, обработкой ошибок и гарантией доставки сообщений (at-least-once, at-most-once, exactly-once).
  • Построение систем потоковой обработки данных: Используя Kafka Streams API, вы создадите приложение, которое в реальном времени будет обогащать и агрегировать данные. Например, разработаете систему для анализа логов или обработки финансовых транзакций.
  • Интеграция с внешними системами: С помощью Kafka Connect вы научитесь настраивать коннекторы для передачи данных из реляционных баз данных (например, PostgreSQL) в Kafka и обратно без написания единой строчки кода.
  • Оптимизация и мониторинг: Вы научитесь настраивать производительность продюсеров и консьюмеров, работать с партициями для масштабирования нагрузки и использовать инструменты для мониторинга состояния кластера.
  • Работа с различными форматами данных: Вы освоите работу с Avro и Schema Registry для обеспечения совместимости данных и управления схемами в распределенной системе.
  • Проектирование событийно-ориентированной архитектуры: На примере реальных бизнес-кейсов вы научитесь проектировать микросервисные системы, где Kafka выступает в роли центральной нервной системы, обеспечивая надежный обмен данными.

Целевая аудитория

  • Developer Java, Python, Scala
  • DevOps инженер
  • Дата Инженер
  • Архитекторы

Практический курс по Apache Kafka и интеграции ее с другими системами ориентирован на программистов, разработчиков Big Data и специалистов, которые хотят:

  • изучить базовые методы программного взаимодействия с Kafka (Producer и Consumer API)
  • научиться использовать Kafka Streams API (как низкоуровневое Processor API, так и декларативный Stream DSL);
  • понять методы интеграции Apache Kafka с внешними системами
  • освоить лучшие практики (best practices) по реализации процессов автоматического обмена данными между Apache Kafka и внешними системами

Предварительная подготовка

  • Начальный опыт работы в Unix
  • Начальный опыт программирования на Java
  • Опыт работы с Hadoop Distributed File System (желательно)

Программа курса

Модуль 1. Введение в Apache Kafka: Ключевые концепции и архитектура

Введение в Apache Kafka:

  • Архитектура и история возникновения Kafka.
  • Основные компоненты: брокеры, Zookeeper, KRAFT mode.
  • Основные API Apache Kafka и принципы их взаимодействия и killer features.

Topic, partition и offset в Apache Kafka:

  •  Управление топиками.
  • Отслеживание последнего прочитанного сообщения.
  • Семантика доставки сообщений (at least once, at most once, exactly once)

Комплексная практика:

  • Работа из командной строки: Управление топиками и обмен сообщениями через консольные утилиты Kafka.

Модуль 2. Взаимодействие с Kafka: Producer и Consumer API

Producer API:

  • Настройка и использование Producer API для публикации сообщений.

Consumer API:

  • Принципы работы Consumer API
  • Consumer Group для параллельной обработки.
  • Сериализация данных.

Комплексная практика:

  • Разработка Producer/Consumer: Создание базового приложения для отправки и чтения данных на Java и Python.

Модуль 3. Потоковая обработка: Kafka Streams DSL

Потоковая обработка:

  • Архитектура Kafka Streams.
  • Основные абстракции Kafka Streams
  • Изучение декларативного DSL для описания трансформаций.
  • Обзор stateless и stateful операций (фильтрация, агрегация, оконные функции).

Комплексная практика:

  • Конвейер обработки на Kafka Streams DSL: Построение потокового приложения для трансформации данных в реальном времени.
  • Сериализация Avro: Пример типизированной сериализации данных с использованием Schema Registry и Avro.
  • ksqlDB: Интерактивные запросы к потокам данных в Kafka с помощью ksqlDB.

Модуль 4. Продвинутая обработка: Processor API

Processor API:

  • Изучение низкоуровневого Processor API для создания кастомных топологий.
  • Работа с State Store и использование Punctuator для задач по расписанию.

Комплексная практика:

  • Кастомная логика на Processor API: Реализация сложной логики обработки с помощью низкоуровневого API.

Модуль 5. Интеграция с экосистемой: Kafka Connect

Kafka Connect:

  • Архитектура Kafka Connect.
  • Обзор доступных коннекторов и их режимов работы (standalone и distributed).

Комплексная практика :

  • Интеграция через Kafka Connect: Настройка готовых коннекторов для интеграции Kafka с файловой системой.
Онлайн формат обучения

Онлайн обучение - это курс, который проходит в режиме реального времени под руководством преподавателя по такому же графику как и очное обучение. Наш учебный центр может организовывать курсы только в онлайн формате или в смешанном, когда часть слушателей находится в классе очно, а часть подключается онлайн.

Занятия на большинстве наших курсов занимают 8 академических часов в день (с 10:00 до 17:00), также есть отдельные программы вечернего онлайн обучения. Чтобы наши студенты не уставали в процессе учебы, мы делаем небольшие перерывы на чай/кофе, при полнодневном обучении также есть время на полноценный обеденный перерыв.

В процессе обучения вы сможете задавать вопросы и общаться с преподавателем и остальными участниками как с помощью чата, так и голосом при наличии микрофона.

В зависимости от выбранной программы обучения, каждому участнику будет предоставлен доступ к заренее настроенной виртуальной машине с лабораторными заданиями. Для удобства мы рекомендуем слушателям подключить 2 монитора, на одном из которых будет учебный материал/трансляция преподавателя, а на другом открыт стенд для выполнения практических заданий. На части из курсов (не всех) предусмотрена запись тренинга, которую слушатели могут просмотреть, если по какой-то причине пропустили часть занятия.

Документы об окончании курса

  • Сертификат Учебного центра iqData
  • Cертификат об обучении установленного образцая

сертификат iqData об обучении на курсеСертификат установленного образца

Учились на этом курсе?

Другие курсы Apache Kafka

Ближайшие даты
12-16 октября
Онлайн