Как превратить LLM‑разметку в универсальный Spark‑пайплайн +8 27.08.2026 09:59 d_a_ivanov 1 Блог компании Lamoda Tech Data Engineering Big Data Искусственный интеллект Машинное обучение
Как ИИ меняет работу с корпоративными данными — итоги седьмого митапа MWS +3 19.08.2026 13:52 IvanSayHi 0 Блог компании МТС Искусственный интеллект Конференции Data Engineering Карьера в IT-индустрии
Всё что нужно знать про DuckLake +11 31.07.2026 06:00 k0rsakov 0 Big Data Data Engineering IT-инфраструктура Базы данных Хранение данных
От ANN к честному KNN на GPU: как мы пересобрали отбор кандидатов в рекомендациях Ozon +17 28.07.2026 09:00 osinovskov 1 Блог компании Ozon Tech Машинное обучение Поисковые технологии Big Data
Работа с AI/ML-нагрузками в Kubernetes: плагин Headlamp для Kubeflow +3 27.07.2026 07:19 levashove 2 Блог компании VK Tech Kubernetes DevOps Машинное обучение Облачные вычисления
CI/CD для данных и моделей на Airflow: как мы деплоим прогноз спроса в «Магните» +12 21.07.2026 14:50 IlyaEvstifeev 2 Блог компании Magnit tech Data Engineering DevOps Машинное обучение Хранение данных
TPC-DS в 07.2026. Lakehouse: Spark, Trino, StarRocks, Impala и Doris. Greenplum & Cloudberry vs StarRocks как MPP +15 01.07.2026 08:57 EvgenyVilkov 2 Блог компании Data Sapience Высоконагруженные системы Big Data Базы данных Data Engineering
Только Сигма выбирают Delta Lake +7 03.06.2026 10:33 dishkakrauch 0 Блог компании Magnit tech Машинное обучение Хранение данных Базы данных Управление разработкой
Последовательное иерархическое распределение сумм между получателями. Постановка задачи. Выбор технологий 17.05.2026 22:12 VOrlyanskiy 0 Проектирование и рефакторинг Занимательные задачки
Когда автоматизация становится умнее: как трансформеры изменили AutoDL в Альфа-Банке +8 05.05.2026 07:00 123-39 0 Блог компании Альфа-Банк Машинное обучение Big Data
Архитектура Apache Iceberg: модель метаданных, на которой всё держится +1 17.04.2026 08:09 FaryaRos 0 Apache Data Engineering Хранение данных Big Data Восстановление данных
Volga: движок обработки real-time данных для AI/ML — аналог Spark и Flink на Rust (Arrow + DataFusion) +5 09.04.2026 09:26 dirty_valera 0 Rust Машинное обучение Высоконагруженные системы Облачные вычисления Хранение данных
Spark SQL Scripting. Новые возможности для инженеров данных +10 09.04.2026 08:08 andreyVarlamov 0 Блог компании Data Sapience Big Data Data Engineering Высоконагруженные системы Базы данных
ORC in Hive/Spark — «анатомия» файла, индексация и фильтр Блума +5 01.04.2026 14:00 Vjatcheslav_S 0 Блог компании АО «ГНИВЦ» Hadoop Big Data Data Engineering
CSV в Spark: Искусство правильной загрузки данных +2 25.03.2026 16:10 Andrey_Biryukov 0 Блог компании OTUS Big Data Data Engineering