Category

Apache Ecosystem

Apache Kafka, Apache Spark, Apache Flink, Apache Iceberg, Apache Airflow, Apache Superset, Apache Hadoop, Apache Hive, Apache HBase, Apache Cassandra, Apache Druid, Apache Pinot, Apache Beam, Apache NiFi, Apache Camel, Apache Camel K, Apache Tomcat, Apache HTTP Server, Apache Maven, Apache Ant, Apache Gradle plugins, Apache ActiveMQ, Apache Pulsar, Apache ZooKeeper, Apache Lucene, Apache Solr, Apache Tika, Apache Avro, Apache Parquet, Apache Arrow, Apache ORC, Apache Calcite, Apache Calcite Avatica, Apache ShardingSphere, Apache Dubbo, Apache Ignite, Apache Geode, Apache Storm, Apache Samza, Apache Kylin, Apache Knox, Apache Ranger, Apache Atlas, Apache Oozie, Apache DolphinScheduler, Apache Livy, Apache Phoenix, Apache Drill, Apache Impala, Apache Sqoop, Apache Tez, Apache Mahout, Apache OpenNLP, Apache MXNet, Apache JMeter, Apache Log4j, Apache Commons, Apache CXF, Apache Axis2, Apache Shiro, Apache Wicket, Apache Struts, Apache OFBiz, Apache Cordova, Apache PDFBox, Apache POI, Apache FOP, Apache Tapestry, Apache MINA, Apache Thrift, Apache Directory Server, Apache Guacamole

28 posts

الگوهای امنیت چندمستأجری: پیاده‌سازی سیاست‌های Apache Ranger برای دریاچه‌های داده Apache Iceberg

در عصر تکثیر گسترده داده‌ها، ساخت یک معماری Data Lakehouse مستحکم دیگر تنها درباره ظرفیت ذخیره‌سازی نیست؛ بلکه اساساً درباره حاکمیت و امنیت است. با پذیرش Apache Iceberg توسط سازمان‌ها به دلیل قابلیت‌های فرمت جدول با عملکرد بالا، آن‌ها اغلب با یک چالش حیاتی مواجه می‌شوند: چگونه مرزهای امنیتی چندمستأجری سخت‌گیرانه را بدون قربانی کردن انعطاف‌پذیری کوئری اعمال کنند.

آپاچی رنجر: دسترسی امن به داده‌های بزرگ

در منظره داده‌های سازمانی مدرن، امنیت یک موضوع ثانویه نیست؛ بلکه یک نیاز اساسی است. با مهاجرت سازمان‌ها به سیستم‌های توزیع‌شده مانند هادوپ، اسپارک و کافکا، مدل امنیتی مبتنی بر محیط پیرامونی قدیمی می‌شود. اینجاست که آپاچی رنجر درخشش می‌کند. این ابزار یک پلتفرم متمرکز برای مدیریت، نظارت و اعمال امنیت جامع در سراسر اکوسیستم هادوپ ارائه می‌دهد.

تقویت CDC: بهینه‌سازی کانکتورهای Kafka با استفاده از Debezium و SMTها

تغییر داده‌ها را ثبت کنید (CDC) به ستون فقرات معماری‌های داده مدرن تبدیل شده است، اما با افزایش حجم داده‌ها، پیکربندی‌های پیش‌فرض Apache Kafka Connect اغلب به گلوگاه تبدیل می‌شوند. امروز، ما بررسی خواهیم کرد که چگونه با بهره‌گیری از تبدیل‌های پیام تکی (SMTs) و تنظیم دقیق کانکتورهای Debezium، حداکثر عملکرد را از پایپ‌لاین‌های CDC خود استخراج کنید.

تسلط بر جستجوی سازمانی: نگاهی عمیق به Apache Lucene و Solr

در فضای داده‌های مدرن، یافتن اطلاعات به اندازه ذخیره‌سازی آن‌ها حیاتی است. برای توسعه‌دهندگانی که برنامه‌های قدرتمندی می‌سازند، کوئری‌های استاندارد SQL LIKE اغلب ناکافی هستند. اینجاست که غول‌های اکوسیستم آپاچی، Apache Lucene و Apache Solr وارد میدان می‌شوند. در حالی که Lucene ک...

تسلط بر Apache Flink: ستون فقرات پایپ‌لاین‌های داده در زمان واقعی

در منظره داده‌های مدرن، پردازش دسته‌ای دیگر کافی نیست. سازمان‌ها به بینش‌های فوری نیاز دارند و سیستم‌هایی را می‌طلبند که رویدادها را همان‌طور که رخ می‌دهند پردازش کنند. Apache Flink به عنوان استاندارد غیررسمی برای این نیاز ظهور کرده است و یک موتور قدرتمند و با عملکرد بالا برای محاسبات حالت‌دار ارائه می‌دهد...

تسلط بر میزبانی برنامه‌های جاوا: پیکربندی آپاچی تومکت و سرور HTTP

در دنیای توسعه جاوای سازمانی، آپاچی تومکت به عنوان یک پیاده‌سازی قدرتمند و متن‌باز از فناوری‌های جاکارتا سرولت، جاکارتا سرور پیجز، جاکارتا اکسپرشن لنگویج و جاکارتا وب‌اساکت شناخته می‌شود. با این حال، اجرای مستقیم تومکت روی پورت 80 یا 443 معمولاً یک بهترین شیوه برای محیط‌های تولید نیست...