ShardingSphere技术解析

我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。

拥有多年一线研发和团队管理经验，研究过主流框架的底层源码(Spring、SpringBoot、SpringMVC、SpringCloud、Mybatis、Dubbo、Zookeeper)，消息中间件底层架构原理(RabbitMQ、RocketMQ、Kafka)、Redis缓存、MySQL关系型数据库、 ElasticSearch全文搜索、MongoDB非关系型数据库、Apache ShardingSphere分库分表读写分离、设计模式、领域驱动DDD、Kubernetes容器编排等。不定期分享高并发、高可用、高性能、微服务、分布式、海量数据、性能调优、云原生、项目管理、产品思维、技术选型、架构设计、求职面试、副业思维、个人成长等内容。

阅读前，快速浏览目录和章节概览可帮助了解文章结构、内容和作者的重点。了解自己希望从中获得什么样的知识或经验是非常重要的。建议在阅读时做笔记、思考问题、自我提问，以加深理解和吸收知识。阅读结束后，反思和总结所学内容，并尝试应用到现实中，有助于深化理解和应用知识。与朋友或同事分享所读内容，讨论细节并获得反馈，也有助于加深对知识的理解和吸收。在这个美好的时刻，笔者不再啰嗦废话，现在毫不拖延地进入文章所要讨论的主题。接下来，我将为大家呈现正文内容。

一、核心分片机制

在分布式数据库系统中，ShardingSphere的核心分片机制是其架构的核心，它通过以下技术实现细节确保数据的均匀分布和系统的扩展性：

分片策略

精确分片算法：该算法基于哈希函数将分片键的值映射到特定的分片上。例如，可以使用MurmurHash算法进行哈希计算，确保数据分布的均匀性。
范围分片算法：通过定义分片键的值范围，将数据分配到不同的分片。这种策略适用于有序的分片键，如日期或ID。
复合分片算法：结合多种分片策略，例如，先按年份范围分片，再按月份精确分片，以实现更细粒度的数据管理。

强制路由策略

强制路由策略通过SQL解析器实现，当检测到特定的路由标识时，将请求直接路由到指定的数据库节点。例如，可以通过在SQL语句中添加特定的Hint来实现强制路由。

分布式事务

XA事务实现：ShardingSphere通过集成JTA（Java Transaction API）来实现XA事务。它支持两阶段提交，确保跨多个数据库节点的事务一致性。
SeGA事务模型：SeGA（ShardingSphere Global Transaction）是ShardingSphere自研的分布式事务模型，通过简化两阶段提交的复杂性，提高了事务的执行效率。

柔性事务补偿

补偿事务：通过编写额外的业务逻辑来补偿事务失败的影响。例如，如果订单创建失败，可以自动回滚库存操作。
存储补偿数据：将补偿信息存储在特定的数据表中，通过定时任务或触发器来执行补偿操作。

二、读写分离体系

读写分离体系通过以下技术细节来提升数据库性能和扩展性：

负载均衡

权重分配策略：根据数据库节点的性能或负载情况，动态调整每个节点的权重。例如，可以使用轮询或最少连接数策略。
故障自动剔除：通过心跳机制检测数据库节点的健康状况，当节点故障时，自动将其从负载均衡策略中剔除。

连接池管理

连接池大小：根据系统的负载情况和数据库的连接限制来设置连接池大小。例如，可以使用最小和最大连接数来限制连接池的规模。
连接池维护：通过连接池的监控和自动重连机制来确保连接池的稳定运行。

数据一致性

主从延迟检测：通过监控主从数据库的延迟情况，确保数据同步的及时性。
强制主库路由：在读取数据时，强制访问主库，以避免读取到可能未同步的数据。

读写分离+分片组合

主库读写分离：通过配置分片规则，实现主库负责写操作，从库负责读操作，同时保证数据按照分片策略分布。
主从读写分离：在主从复制的基础上，结合分片策略，实现更复杂的读写分离架构。

三、分布式治理

分布式数据库系统的治理需要以下技术细节来确保系统的稳定运行：

弹性伸缩

在线分片变更：通过动态调整分片规则，实现分片策略的在线变更，而无需停机。
数据再平衡：根据数据访问模式，动态调整数据分布，以优化系统性能。

资源隔离策略

配置中心集成：通过配置中心集中管理数据库配置，实现不同业务或用户之间的资源隔离。
分布式锁实现：使用分布式锁来防止多个业务同时访问同一资源，确保数据的一致性。

集群管控

节点状态探活：通过心跳机制定期检查数据库节点的状态，确保集群的健康和稳定。

四、数据迁移方案

数据迁移是分布式数据库系统建设中的重要环节，以下技术细节确保数据迁移的顺利进行：

全量迁移

一致性校验：通过比对源数据库和目标数据库的数据，确保迁移后的数据一致性。
断点续传：在数据传输过程中，记录已传输的数据，当传输中断后，从上次中断的位置继续传输。
存量数据切割：根据分片策略将存量数据切割成多个部分，并行迁移以提高效率。

增量同步

Binlog解析：解析源数据库的Binlog，获取数据变更信息，并同步到目标数据库。
双写一致性：在源数据库和目标数据库同时写入数据，确保数据的一致性。
灰度切换验证：在数据迁移过程中，逐步切换业务到目标数据库，验证数据的一致性。

五、生态扩展组件

ShardingSphere的生态扩展组件通过以下技术细节增强了其功能：

ShardingSphere-Proxy

协议适配层：通过适配不同的数据库协议，如MySQL、PostgreSQL等，实现与各种数据库的兼容性。
流量治理：根据分片策略和负载均衡策略，智能路由流量，优化系统性能。
多租户支持：通过租户标识实现多租户环境下的资源隔离。

ShardingSphere-JDBC

连接模式优化：通过连接池和连接复用机制，优化连接模式，提高性能。
多数据源聚合：支持连接多个数据源，实现数据聚合，满足复杂的业务需求。
Hint管理器：通过SQL Hint指令，控制数据访问路径，实现更精细的数据访问控制。

通过上述技术细节的补充，我们可以更深入地理解ShardingSphere在分布式数据库系统中的应用，以及其如何通过这些技术实现高性能、可扩展和稳定的系统架构。

博主的人生感悟和目标

希望各位读者大大多多支持用心写文章的博主，现在时代变了，信息爆炸，酒香也怕巷子深，博主真的需要大家的帮助才能在这片海洋中继续发光发热，所以，赶紧动动你的小手，点波关注❤️，点波赞，点波收藏⭐，甚至点波评论✍️，都是对博主最好的支持和鼓励！

- 博客主页： Java程序员廖志伟
- 开源项目： Java程序员廖志伟
- 哔哩哔哩： Java程序员廖志伟
- 个人社区： Java程序员廖志伟
- 个人微信号： SeniorRD

经过多年在CSDN创作上千篇文章的经验积累，我已经拥有了不错的写作技巧。同时，我还与清华大学出版社签下了四本书籍的合约，并将陆续出版。这些书籍包括了基础篇、进阶篇、架构篇的《Java项目实战—深入理解大型互联网企业通用技术》，以及《解密程序员的思维密码--沟通、演讲、思考的实践》。具体出版计划会根据实际情况进行调整，希望各位读者朋友能够多多支持！

如果您需要转载或者搬运这篇文章的话，非常欢迎您私信我哦~

你可能感兴趣的:(ShardingSphere技术解析)

高铁站违规撑伞识别误检率↓79%：陌讯多模态融合算法实战解析 2501_92722744 算法人工智能目标检测计算机视觉目标跟踪
原创声明本文为原创技术解析，核心技术参数与架构参考自《陌讯技术白皮书》，禁止未经授权的转载与改编。一、行业痛点：密集场景下的违规撑伞识别难题在高铁站、地铁站等交通枢纽，违规撑伞（如非雨天在站台、通道内持伞）可能引发客流拥堵、设备刮擦等安全隐患。然而，传统视觉识别方案面临三大核心挑战：环境干扰大：进出站口光线突变（正午强光/夜间弱光）导致伞面特征提取不稳定，某枢纽站点实测数据显示，阴雨天违规撑伞识别
建筑施工场景下漏检率↓76%！陌讯多模态融合算法在工程安全监控的落地实践 2501_92722744 大数据算法目标跟踪人工智能计算机视觉目标检测
原创声明本文为原创技术解析，核心技术参数与架构设计引用自《陌讯技术白皮书》，转载请注明来源。一、行业痛点：建筑施工监控的技术瓶颈建筑施工场景的安全监控长期面临多重技术挑战：数据支撑：据《2023建筑施工安全自动化监控报告》显示，传统监控系统对“未佩戴安全帽”“高空抛物”等危险行为的漏检率超35%，误报率高达42%，导致安全事故响应滞后[7]。场景难点：工地存在强光直射（正午阳光）、动态遮挡（塔吊/
深入理解 UDP 协议：从原理到实战的技术解析
UDP（UserDatagramProtocol，用户数据报协议）作为TCP的"轻量型伙伴"，在实时通信、流媒体传输等场景中发挥着不可替代的作用。与TCP的可靠传输不同，UDP以"简单、快速、无连接"为设计理念，为对延迟敏感的应用提供了高效传输方案。本文将从技术底层出发，系统解析UDP的核心机制、应用场景及实战实现，帮助读者构建对UDP协议的完整认知。一、UDP协议的核心定位与特性1.1协议栈中的
Coze开源实战指南：构建企业级AI应用的全链路技术解析（含Kubernetes+服务网格深度实践）
一、Coze技术架构深度解析1.1核心组件与五层异构架构Coze采用五层异构架构（感知层→执行层→决策层→监控层→进化层），实现亚毫秒级实时响应与动态弹性扩展。其核心模块包括：架构亮点支持横向扩展的微服务集群基于Kubernetes的自动扩缩容机制服务网格（Istio）实现流量治理核心组件对比表组件功能特性典型性能指标CozeStudio30+节点类型/多模式编排响应速度提升300%CozeLoo
八大国产 AI 模型全景对比：阿里 Qwen、百度文心、腾讯混元、字节豆包、华为盘古、DeepSeek、Kimi、MiniMax 的技术解析与选型指南 charles666666 人工智能百度交互语言模型 transformer 产品经理
“在国产AI模型百花齐放的今天，企业技术决策者稍有不慎，就可能陷入性能与成本的双重困境。如何穿越技术迷雾，找到真正适配业务场景的那把钥匙？”一、开篇引言当技术选型决定企业AI落地成败，你还在凭感觉决策吗？当前国产AI模型市场，模型同质化现象严重，各厂商宣传资料中充满夸张的性能指标，但真正落地到企业实际业务场景中，却常常出现适配性不佳、部署成本不可控等问题。企业急需一份基于真实数据与场景验证的深度解
Spring框架核心技术解析
我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）、《解密程序员的思维密码——沟通、演讲、思考的实践》作者、清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。拥有多年一线研发和团队
ShardingSphere核心技术解析 AIHacksCash Java场景面试宝典 ShardingSphere Distributed Database Database Sharding
我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。拥有多年一线研发和团队管理经验，研究过主流框架的底层源码(Spring、Spri
ShardingSphere架构解析 AIHacksCash Java场景面试宝典 ShardingSphere Distributed Database Database Sharding
我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。拥有多年一线研发和团队管理经验，研究过主流框架的底层源码(Spring、Spri
【速通RAG实战：进阶】16、AI生成思维导图全技术解析无心水速通 RAG 实战！解锁 AI 2.0 高薪密码人工智能 AI思维导图知识图谱 markmap-js Qwen-long模型 CSDN技术干货
一、AI生成思维导图的底层技术逻辑（一）知识结构化的核心流程AI生成思维导图的本质是非结构化文本到结构化知识图谱的转化，其技术流程可拆解为五大核心环节：1.语义解析与实体抽取多模态输入处理：支持文本（Markdown/Word/PDF）、语音（会议录音）、手写笔记（图片OCR）等多形式输入，通过TesseractOCR识别图片文字，Whisper处理语音流。实体识别技术栈：#中英文混合实体识别示例
AI 绘画 + 编程：10 分钟生成个性化艺术作品大力出奇迹985 人工智能
本文围绕Python+OpenCV实现自动人脸识别门禁系统展开，先概述系统的基本构成与作用，再从系统核心技术、开发实现步骤、功能扩展方向、实际应用场景及优化改进策略五个方面详细阐述，最后总结系统的价值与发展前景，为相关开发和应用提供全面参考。一、系统核心技术解析人脸识别技术是门禁系统的核心，其关键在于对人脸特征的精准提取与匹配。OpenCV作为开源计算机视觉库，提供了丰富的人脸检测算法，如Haar
Unity Catalog技术解析：数据与AI的统一元数据管理平台包幸慈Ferris
UnityCatalog技术解析：数据与AI的统一元数据管理平台什么是UnityCatalogUnityCatalog是一个开创性的开源元数据管理系统，专为现代数据与AI环境设计。作为业界首个真正通用的数据与AI资产目录，它解决了企业在多引擎、多格式环境下的元数据管理难题。核心特性解析1.多模态支持架构UnityCatalog的架构设计突破了传统元数据管理的局限：格式无关性：原生支持DeltaLa
Python,C++,go语言开发人类100年后1000种技术解析与实操APP Geeker-2025 python c++golang
以下是为"人类100年后1000种技术解析与实操APP"设计的全栈技术方案，融合跨学科技术预测、虚拟仿真与增强现实技术，构建面向未来的技术探索平台：---###一、三维混合架构```mermaidgraphTDA[Python-认知引擎]-->|gRPC|B[Go-协调中枢]B-->|FFI|C[C++-物理核心]C-->|光子总线|D{技术沙盒}D-->E[量子计算接口]D-->F[生物工程模拟
Java Web开发核心技术解析与实践指南 2301_81709812 java 前端开发语言
目录一、JavaWeb开发基础1.1核心概念解析1.2开发环境搭建二、Servlet与JSP核心技术2.1Servlet编程深度解析生命周期管理（关键代码示例）：核心对象关系：2.2JSP进阶开发技巧动态页面模板示例：三、Spring框架整合开发3.1SpringMVC核心原理3.2现代开发方案对比四、项目实战：图书管理系统4.1系统架构设计4.2性能优化策略五、学习路线建议一、JavaWeb开发
微服务架构核心技术解析我是廖志伟 Java场景面试宝典 Spring Cloud Microservices Service Governance
我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）、《解密程序员的思维密码——沟通、演讲、思考的实践》作者、清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。拥有多年一线研发和团队
Spring框架核心技术解析我是廖志伟 Java场景面试宝典 Spring Framework Dependency Injection AOP
我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）、《解密程序员的思维密码——沟通、演讲、思考的实践》作者、清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。拥有多年一线研发和团队
ShardingSphere数据库中间件我是廖志伟 Java场景面试宝典 Database Sharding Distributed Systems Middleware
我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）、《解密程序员的思维密码——沟通、演讲、思考的实践》作者、清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。拥有多年一线研发和团队
Spring框架核心技术解析我是廖志伟 Java场景面试宝典 Spring Framework Dependency Injection AOP
我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）、《解密程序员的思维密码——沟通、演讲、思考的实践》作者、清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。拥有多年一线研发和团队
ShardingSphere核心机制解析我是廖志伟 Java场景面试宝典 ShardingSphere Distributed Database Data Sharding
我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）、《解密程序员的思维密码——沟通、演讲、思考的实践》作者、清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。拥有多年一线研发和团队
Spring MVC核心技术解析
我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）、《解密程序员的思维密码——沟通、演讲、思考的实践》作者、清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。拥有多年一线研发和团队
OneCode 3.0 VFS客户端驱动(SDK)技术解析：从架构到实战低代码老李 OneCode实战低代码软件行业架构云原生低代码
引言在分布式系统架构中，高效的文件管理一直是开发者面临的核心挑战。OneCode3.0作为新一代微内核引擎，其VFS（虚拟文件系统）模块通过客户端驱动(SDK)提供了统一的文件操作抽象，屏蔽了底层存储细节，为开发者带来了极大便利。本文将深入剖析VFS客户端驱动的架构设计、核心API及实战应用，帮助开发者快速掌握其使用方法。一、VFS客户端驱动架构概览1.1架构定位VFS客户端驱动是OneCode3
睡岗识别漏检率 3%？陌讯动态检测技术解密 2501_92487762 视觉检测计算机视觉算法
在工业生产与安防监控领域，睡岗行为检测一直是保障作业安全的关键环节。传统监控系统依赖人工巡检，不仅人力成本高昂，还存在80%以上的漏检风险；而普通视觉算法则常因光照变化、姿态遮挡等问题，出现高达30%的误报率，严重干扰监控效率[实测数据来源：某能源企业2024年运维报告]。这些痛点直接导致生产事故隐患增加，据统计，制造业因睡岗引发的安全事故占比达17%，单次事故平均损失超50万元。技术解析：从传统
打电话识别误报率↓82%：陌讯轻量化部署算法实战解析 2501_92474790 人工智能算法智慧城市计算机视觉目标检测目标跟踪
原创声明：本文内容基于独立技术解析，部分数据引用自“陌讯技术白皮书”，严禁未经授权转载。摘要：针对边缘计算优化和复杂场景鲁棒性挑战，本文解析陌讯视觉算法在打电话识别中的轻量化部署方案。实测显示，该方案在误报率指标上较基线提升显著，适用于安防监控等场景。一、行业痛点打电话识别在安防监控中面临严峻挑战。行业报告显示，公共场所有效行为识别误报率超35%（来源：2024年《智能安防白皮书》）。具体难点包括
电线杆鸟巢识别误报率↓72%：陌讯多模态融合算法实战解析 2501_92474779 算法人工智能目标跟踪计算机视觉机器学习
原创声明本文为原创技术解析文章，核心技术参数与架构描述参考自《陌讯技术白皮书》，转载请注明来源。一、行业痛点：电线杆鸟巢识别的现实挑战电力巡检领域中，电线杆鸟巢被列为重要安全隐患之一。据电力行业运维报告显示，传统机器视觉系统在该场景下存在三大核心问题：复杂背景干扰：鸟巢与枯枝、塑料杂物的视觉特征高度相似，导致误报率超35%环境适应性差：逆光、阴雨等天气下识别准确率骤降40%以上边缘部署瓶颈：变电站
驾乘场景下漏检率↓76%！陌讯动态特征融合算法在安全带穿戴识别中的实战优化 2501_92474779 人工智能目标跟踪计算机视觉算法目标检测
原创声明本文为原创技术解析，核心技术参数与架构设计引用自《陌讯技术白皮书》，禁止未经授权的转载与篡改。一、行业痛点：安全带穿戴识别的现实挑战据交通部2023年道路运输安全报告显示，货运车辆与网约车的安全带穿戴识别场景中，传统算法存在三大核心问题：复杂光照干扰：逆光场景下（如清晨/傍晚行车），安全带特征被强光淹没，误报率高达52%；动态遮挡难题：驾驶员衣物（如外套、背包）覆盖安全带时，漏检率常超35
棉田霉斑病难识别？陌讯跨季节检测方案误判率直降58%！ 2501_92474779 人工智能算法目标跟踪计算机视觉机器学习
开篇痛点在农业病虫害识别场景中，传统算法常面临三大挑战：叶片遮挡导致的特征丢失（约32%误检）、跨季节形态变异（冬夏病虫害差异超60%）、复杂光照干扰（田间正午强光下mAP暴跌28%）。这些痛点使得许多农企不得不依赖人工筛查，每千亩农田质检成本高达￥5600。技术解析：多模态融合与自蒸馏架构陌讯视觉算法创新性地采用双流特征金字塔+自蒸馏机制解决上述问题：#核心代码片段（特征融合模块）classMu
电表箱识别漏检率高？陌讯算法实测降 90%
在电力巡检领域，电表箱状态识别一直是计算机视觉技术落地的难点。传统人工巡检模式下，一个台区的200个电表箱需2名巡检员耗时1天完成，且受光线、天气影响，误判率常超过15%。而采用普通开源算法部署的自动识别系统，又面临箱体污渍遮挡、表计型号混杂、边缘计算设备算力有限等多重挑战，实际商用时mAP（平均精度）往往跌破70%，难以满足电力行业的可靠性要求技术解析：从传统方法到陌讯创新架构传统电表箱识别多采
夜间监控模糊不清？陌讯低光目标检测方案解读 2501_92474779 目标跟踪人工智能计算机视觉算法目标检测
开篇痛点：安防监控的检测困局在智慧城市建设浪潮下，安防监控面临核心矛盾：复杂场景中传统算法的泛化性短板日益凸显。某市级公安部门数据显示，夜间监控的误报率高达34%，雨雾天气下漏检率超40%。更严峻的是，密集人流场景中YOLOv5的ID丢失率达28%，实时预警几乎瘫痪——这恰是陌讯视觉算法v3.2的破局切入点。技术解析：三阶时空融合架构传统单帧检测在遮挡场景易失效，陌讯的创新在于时空联合建模：#陌讯
岸边垃圾识别准确率↑32%：陌讯多模态融合算法实战解析 2501_92474745 深度学习人工智能算法目标检测计算机视觉视觉检测
原创声明本文为原创技术解析，核心技术参数与架构设计引用自《陌讯技术白皮书》，转载请注明来源。一、行业痛点：岸边垃圾识别的三大技术瓶颈岸边垃圾监测是水环境治理的重要环节，但传统视觉方案始终面临难以突破的技术壁垒：复杂背景干扰：岸边植被、岩石、水面反光等与垃圾目标特征高度相似，某环保机构报告显示，传统模型误将水草识别为塑料袋的概率超35%；动态环境鲁棒性不足：早晚光照差异（逆光场景亮度差可达2000l
ShardingSphere数据库分片解析
我是廖志伟，一名Java开发工程师、《Java项目实战——深入理解大型互联网企业通用技术》（基础篇）、（进阶篇）、（架构篇）、《解密程序员的思维密码——沟通、演讲、思考的实践》作者、清华大学出版社签约作家、Java领域优质创作者、CSDN博客专家、阿里云专家博主、51CTO专家博主、产品软文专业写手、技术文章评审老师、技术类问卷调查设计师、幕后大佬社区创始人、开源项目贡献者。拥有多年一线研发和团队
Python爬虫实战：使用Selenium与反反爬技术高效爬取大众点评餐厅数据 Python爬虫项目 2025年爬虫实战项目 python 爬虫 selenium okhttp scrapy 开发语言测试工具
摘要本文将详细介绍如何使用Python爬虫技术获取大众点评网站上的餐厅评分数据。我们将采用Selenium模拟浏览器行为，结合反反爬策略，实现高效、稳定的数据采集。文章包含完整的代码实现、技术解析以及数据处理方法，适合中高级Python开发者学习现代网页爬虫技术。1.引言在当今大数据时代，餐饮行业的数据分析变得越来越重要。大众点评作为中国领先的本地生活信息及交易平台，积累了海量餐厅评价数据。这些数
如何用ruby来写hadoop的mapreduce并生成jar包 wudixiaotie mapreduce
ruby来写hadoop的mapreduce，我用的方法是rubydoop。怎么配置环境呢： 1.安装rvm：不说了网上有 2.安装ruby：由于我以前是做ruby的，所以习惯性的先安装了ruby，起码调试起来比jruby快多了。 3.安装jruby： rvm install jruby然后等待安
java编程思想 -- 访问控制权限百合不是茶 java 访问控制权限单例模式
访问权限是java中一个比较中要的知识点,它规定者什么方法可以访问,什么不可以访问一:包访问权限; 自定义包: package com.wj.control; //包 public class Demo { //定义一个无参的方法 public void DemoPackage(){ System.out.println("调用
[生物与医学]请审慎食用小龙虾 comsci 生物
现在的餐馆里面出售的小龙虾,有一些是在野外捕捉的,这些小龙虾身体里面可能带有某些病毒和细菌,人食用以后可能会导致一些疾病,严重的甚至会死亡..... 所以,参加聚餐的时候,最好不要点小龙虾...就吃养殖的猪肉,牛肉,羊肉和鱼,等动物蛋白质
org.apache.jasper.JasperException: Unable to compile class for JSP: 商人shang maven 2.2 jdk1.8
环境： jdk1.8 maven tomcat7-maven-plugin 2.0 原因： tomcat7-maven-plugin 2.0 不知吃 jdk 1.8，换成 tomcat7-maven-plugin 2.2就行，即 <plugin>
你的垃圾你处理掉了吗?GC oloz GC
前序:本人菜鸟，此文研究学习来自网络，各位牛牛多指教　 1.垃圾收集算法的核心思想　　Java语言建立了垃圾收集机制，用以跟踪正在使用的对象和发现并回收不再使用(引用)的对象。该机制可以有效防范动态内存分配中可能发生的两个危险：因内存垃圾过多而引发的内存耗尽，以及不恰当的内存释放所造成的内存非法引用。　　垃圾收集算法的核心思想是：对虚拟机可用内存空间，即堆空间中的对象进行识别
shiro 和 SESSSION 杨白白 shiro
shiro 在web项目里默认使用的是web容器提供的session，也就是说shiro使用的session是web容器产生的，并不是自己产生的，在用于非web环境时可用其他来源代替。在web工程启动的时候它就和容器绑定在了一起，这是通过web.xml里面的shiroFilter实现的。通过session.getSession()方法会在浏览器cokkice产生JESSIONID，当关闭浏览器，此
移动互联网终端淘宝客如何实现盈利小桔子移動客戶端淘客淘寶App
2012年淘宝联盟平台为站长和淘宝客带来的分成收入突破30亿元，同比增长100%。而来自移动端的分成达1亿元，其中美丽说、蘑菇街、果库、口袋购物等App运营商分成近5000万元。可以看出，虽然目前阶段PC端对于淘客而言仍旧是盈利的大头，但移动端已经呈现出爆发之势。而且这个势头将随着智能终端(手机，平板)的加速普及而更加迅猛
wordpress小工具制作 aichenglong wordpress 小工具
wordpress 使用侧边栏的小工具，很方便调整页面结构小工具的制作过程 1 在自己的主题文件中新建一个文件夹(如widget)，在文件夹中创建一个php(AWP_posts-category.php) 小工具是一个类,想侧边栏一样，还得使用代码注册，他才可以再后台使用，基本的代码一层不变 <?php class AWP_Post_Category extends WP_Wi
JS微信分享 AILIKES js
// 所有功能必须包含在 WeixinApi.ready 中进行 WeixinApi.ready(function(Api) { // 微信分享的数据 var wxData = { &nb
封装探讨百合不是茶 JAVA面向对象封装
//封装属性方法将某些东西包装在一起，通过创建对象或使用静态的方法来调用，称为封装；封装其实就是有选择性地公开或隐藏某些信息，它解决了数据的安全性问题，增加代码的可读性和可维护性在 Aname类中申明三个属性，将其封装在一个类中：通过对象来调用例如 1： //属性将其设为私有姓名 name 可以公开
jquery radio/checkbox change事件不能触发的问题 bijian1013 JavaScript jquery
我想让radio来控制当前我选择的是机动车还是特种车，如下所示： <html> <head> <script src="http://ajax.googleapis.com/ajax/libs/jquery/1.7.1/jquery.min.js" type="text/javascript"><
AngularJS中安全性措施 bijian1013 JavaScript AngularJS 安全性 XSRF JSON漏洞
在使用web应用中，安全性是应该首要考虑的一个问题。AngularJS提供了一些辅助机制，用来防护来自两个常见攻击方向的网络攻击。一.JSON漏洞当使用一个GET请求获取JSON数组信息的时候（尤其是当这一信息非常敏感，
[Maven学习笔记九]Maven发布web项目 bit1129 maven
基于Maven的web项目的标准项目结构 user-project user-core user-service user-web src
【Hive七】Hive用户自定义聚合函数(UDAF) bit1129 hive
用户自定义聚合函数，用户提供的多个入参通过聚合计算(求和、求最大值、求最小值)得到一个聚合计算结果的函数。问题：UDF也可以提供输入多个参数然后输出一个结果的运算，比如加法运算add(3，5)，add这个UDF需要实现UDF的evaluate方法,那么UDF和UDAF的实质分别究竟是什么？ Double evaluate(Double a, Double b)
通过 nginx-lua 给 Nginx 增加 OAuth 支持 ronin47
前言：我们使用Nginx的Lua中间件建立了OAuth2认证和授权层。如果你也有此打算，阅读下面的文档，实现自动化并获得收益。SeatGeek 在过去几年中取得了发展，我们已经积累了不少针对各种任务的不同管理接口。我们通常为新的展示需求创建新模块，比如我们自己的博客、图表等。我们还定期开发内部工具来处理诸如部署、可视化操作及事件处理等事务。在处理这些事务中，我们使用了几个不同的接口来认证： &n
利用tomcat-redis-session-manager做session同步时自定义类对象属性保存不上的解决方法 bsr1983 session
在利用tomcat-redis-session-manager做session同步时，遇到了在session保存一个自定义对象时，修改该对象中的某个属性，session未进行序列化，属性没有被存储到redis中。在 tomcat-redis-session-manager的github上有如下说明： Session Change Tracking As noted in the &qu
《代码大全》表驱动法-Table Driven Approach-1 bylijinnan java 算法
关于Table Driven Approach的一篇非常好的文章： http://www.codeproject.com/Articles/42732/Table-driven-Approach package com.ljn.base; import java.util.Random; public class TableDriven { public
Sybase封锁原理 chicony Sybase
昨天在操作Sybase IQ12.7时意外操作造成了数据库表锁定，不能删除被锁定表数据也不能往其中写入数据。由于着急往该表抽入数据，因此立马着手解决该表的解锁问题。无奈此前没有接触过Sybase IQ12.7这套数据库产品，加之当时已属于下班时间无法求助于支持人员支持，因此只有借助搜索引擎强大的
java异常处理机制 CrazyMizzz java
java异常关键字有以下几个，分别为 try catch final throw throws 他们的定义分别为 try： Opening exception-handling statement. catch： Captures the exception. finally： Runs its code before terminating
hive 数据插入DML语法汇总 daizj hive DML 数据插入
Hive的数据插入DML语法汇总1、Loading files into tables语法：1) LOAD DATA [LOCAL] INPATH 'filepath' [OVERWRITE] INTO TABLE tablename [PARTITION (partcol1=val1, partcol2=val2 ...)]解释：1)、上面命令执行环境为hive客户端环境下： hive>l
工厂设计模式 dcj3sjt126com 设计模式
使用设计模式是促进最佳实践和良好设计的好办法。设计模式可以提供针对常见的编程问题的灵活的解决方案。工厂模式工厂模式（Factory）允许你在代码执行时实例化对象。它之所以被称为工厂模式是因为它负责“生产”对象。工厂方法的参数是你要生成的对象对应的类名称。 Example #1 调用工厂方法（带参数） <?phpclass Example{
mysql字符串查找函数 dcj3sjt126com mysql
FIND_IN_SET(str,strlist) 假如字符串str 在由N 子链组成的字符串列表strlist 中，则返回值的范围在1到 N 之间。一个字符串列表就是一个由一些被‘,’符号分开的自链组成的字符串。如果第一个参数是一个常数字符串，而第二个是type SET列，则 FIND_IN_SET() 函数被优化，使用比特计算。如果str不在strlist 或st
jvm内存管理 easterfly jvm
一、JVM堆内存的划分分为年轻代和年老代。年轻代又分为三部分：一个eden,两个survivor。工作过程是这样的：e区空间满了后，执行minor gc，存活下来的对象放入s0, 对s0仍会进行minor gc，存活下来的的对象放入s1中，对s1同样执行minor gc，依旧存活的对象就放入年老代中；年老代满了之后会执行major gc，这个是stop the word模式，执行
CentOS-6.3安装配置JDK-8 gengzg centos
JAVA_HOME=/usr/java/jdk1.8.0_45 JRE_HOME=/usr/java/jdk1.8.0_45/jre PATH=$PATH:$JAVA_HOME/bin:$JRE_HOME/bin CLASSPATH=.:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar:$JRE_HOME/lib export JAVA_HOME
【转】关于web路径的获取方法 huangyc1210 Web 路径
假定你的web application 名称为news,你在浏览器中输入请求路径： http://localhost:8080/news/main/list.jsp 则执行下面向行代码后打印出如下结果： 1、 System.out.println(request.getContextPath()); //可返回站点的根路径。也就是项
php里获取第一个中文首字母并排序远去的渡口数据结构 PHP
很久没来更新博客了，还是觉得工作需要多总结的好。今天来更新一个自己认为比较有成就的问题吧。最近在做储值结算，需求里结算首页需要按门店的首字母A-Z排序。我的数据结构原本是这样的： Array ( [0] => Array ( [sid] => 2885842 [recetcstoredpay] =&g
java内部类 hm4123660 java 内部类匿名内部类成员内部类方法内部类
　在Java中，可以将一个类定义在另一个类里面或者一个方法里面，这样的类称为内部类。内部类仍然是一个独立的类，在编译之后内部类会被编译成独立的.class文件，但是前面冠以外部类的类名和$符号。内部类可以间接解决多继承问题,可以使用内部类继承一个类，外部类继承一个类，实现多继承。 &nb
Caused by: java.lang.IncompatibleClassChangeError: class org.hibernate.cfg.Exten zhb8015
maven pom.xml关于hibernate的配置和异常信息如下，查了好多资料，问题还是没有解决。只知道是包冲突，就是不知道是哪个包....遇到这个问题的分享下是怎么解决的。。 maven pom: <dependency> <groupId>org.hibernate</groupId> <ar
Spark 性能相关参数配置详解－任务调度篇 Stark_Summer spark cache cpu 任务调度 yarn
随着Spark的逐渐成熟完善, 越来越多的可配置参数被添加到Spark中来, 本文试图通过阐述这其中部分参数的工作原理和配置思路, 和大家一起探讨一下如何根据实际场合对Spark进行配置优化。由于篇幅较长，所以在这里分篇组织，如果要看最新完整的网页版内容，可以戳这里：http://spark-config.readthedocs.org/，主要是便
css3滤镜 wangkeheng html css
经常看到一些网站的底部有一些灰色的图标，鼠标移入的时候会变亮，开始以为是js操作src或者bg呢，搜索了一下，发现了一个更好的方法：通过css3的滤镜方法。 html代码： <a href='' class='icon'><img src='utv.jpg' /></a> css代码： .icon{-webkit-filter: graysc

按字母分类： A B C D E F G H I J K L M N O P Q R S T U V W X Y Z 其他