自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

年轻即出发,

不努力,拿什么说明天

  • 博客(453)
  • 资源 (92)
  • 收藏
  • 关注

原创 机器学习支持向量机

为了求解$(α_2^{new})$ ,得先确定$(α_2^{new})$的取值范围。简而言之:如果不是用核技术,就会先计算线性映$ϕ(x_1)和ϕ(x_2)$,然后计算这它们的内积,使用了核技术之后,先把$ϕ(x_1)$和$ϕ(x_2)$的一般表达式$<ϕ(x_1),ϕ(x_2)>=k(<ϕ(x_1),ϕ(x_2) >)$计算出来,这里的$<·,·>$表示内积,$k(·,·)$就是对应的核函数,这个表达式往往非常简单,所以计算非常方便。我们要根据$ α$ 的取值范围,去更正b的值,使间隔最大化。

2026-08-14 20:50:21 142

原创 机器学习SVD

代码验证:np.allclose(A, u[:,:2]*s @ vt) 为 True,说明可重构回原矩阵。矩阵压缩、降噪、推荐系统(评分矩阵分解)、潜在语义分析(LSA)、求解病态线性方程等。把 test.jpg 读成数组,形状一般为 (高, 宽, 3)(RGB 三通道)。个奇异值逐步重构,生成 svd_1.jpg …是把任意矩阵拆成三个特殊矩阵乘积的工具,常用于降维、压缩、推荐等。大奇异值对应主要结构,截断后可近似原矩阵,实现压缩与降维。奇异值对角阵(非负,通常从大到小排)前50个奇异值重构的图,

2026-08-14 20:00:58 183

原创 机器学习随机森林

方法:用多棵决策树(本实现基于 CART/ClassificationTree)投票,降低单棵树的过拟合与方差。随机森林 = 多棵 CART 树 + Bootstrap 行抽样 + 特征列抽样 + 多数投票。fit 里 choice(n_features, max_features)树与树不完全相同 → 错误不易同时犯 → 整体更稳、更准。再随机选 max_features 个特征(默认约。单棵决策树容易过拟合、不稳定。进一步增加树的多样性,削弱强特征垄断。相对单棵树:偏差通常相近,降低方差,抑制过拟合。

2026-08-14 19:26:54 131

原创 机器学习PCA

高维数据里,很多方向变化很小(冗余)。PCA = 对协方差矩阵做特征分解,用方差最大的几个方向做投影,实现降维。方法:在尽量保留方差(信息)的前提下,把数据投影到更低维空间。argsort()[::-1],取前 n_components。个主成分近似原数据 → 降维、去相关、便于可视化。calc_cov 里对。大 → 该方向信息多。1. 中心化/标准化。去均值,消除量纲影响。刻画特征间相关与方差。分类相关的有监督降维。

2026-08-14 19:11:00 158

原创 机器学习感知机、神经网络

是最基础的线性二分类模型,也是神经网络的“最小单元”。它学习一个超平面,把正负样本分开。可分时存在无穷多个分隔超平面;感知机找到其中一个,不一定是最大间隔。直到训练集上没有误分类点(或达到迭代上限)。若训练集线性可分,算法有限步内收敛(感知机收敛定理)直觉:分错就把超平面往“纠正该点”的方向推一把。简单、可解释,是理解线性分类与神经网络的起点。,可用 Gram 矩阵加速,并为核方法埋伏笔。SVM 找最大间隔;感知机只求“分对即可”不会稳定收敛,可能在边界附近震荡。感知机perceptron。

2026-08-14 17:55:59 193

原创 机器学习最大熵模型max_entropy_model

MaxEnt 更强调特征函数与最大熵约束,易扩展到多分类/NLP 特征。仍是理解判别式模型与特征工程的经典方法,在特征明确、需可解释概率输出的场景仍可用。在已知一些约束(特征在训练数据上的期望)时,在所有满足约束的分布里,选。即在符合已知事实的前提下,对未知部分保持最大不确定性(不过度假设)。多分类、特征可灵活设计的结构化预测(与 CRF 等结合)这是最大熵约束的「数据侧」:模型期望要对齐到这个值。直观:某特征在数据里出现多、模型里偏少 →。(这里用 Px)估计特征在模型下的期望。

2026-08-14 09:59:14 293

原创 机器学习MCMC

核心想法是:不直接算难积的积分或难采样的分布,而是构造一条马尔可夫链,让它的平稳分布等于你想要的目标分布,然后用链上的样本做蒙特卡洛估计。归一化常数(边缘似然)往往算不出来,直接采样也困难。,从而在复杂、高维、只知道未归一化密度的情况下做推断与期望估计。隐变量推断(如主题模型 LDA 的部分采样、部分贝叶斯网络)高维积分、稀有事件概率估计(蒙特卡洛的难采样版)玻尔兹曼分布、伊辛模型等配分函数相关采样。图像复原、立体匹配等能量模型的近似采样。随机波动、风险模型中的后验与积分估计。,长期就堆成目标分布。

2026-08-13 18:25:48 226

原创 机器学习逻辑回归

按行并行的LR解决了样本数量的问题,但是实际情况中会存在针对高维特征向量进行逻辑回归的场景(如广告系统中的特征维度高达上亿),仅仅按行进行并行处理,无法满足这类场景的需求,因此还需要按列将高维的特征向量拆分成若干小的向量进行求解。这个值表达的是,是我想要的分类的概率,也就是该对象是分类0的概率。比如 有m行x,每一个x有n个属性,然后每个x有一个分类,也就有m行y,每个y可以被分成k个元素的向量,我需要先把m行y变成一个m行k列的矩阵,最后计算出一个(j+1)*k列的w矩阵。输出值h也是n维的。

2026-08-13 17:27:36 150

原创 机器学习线性回归

w_k$为迭代第k次产生的权重列向量w,当对新的一行对象进行预测时,总是使用最新的w。如果预测的结果为一维的,即Y为一个数值,则Y=WX,其中W为[b1,w11,w12,w13]的行向量,X为[1,x1,x2,x3]列向量,公式展开便可以写成如下线性组合的样式,这也就是最简单的线性回归模型。梯度下降法:优化目标在w的n个坐标轴上(或者说向量的方向上)对损失函数做迭代的下降,当所有的坐标轴上的$w_i$(i = 1,2,...n)都达到收敛时,我们的损失函数最小,此时的w即为我们要求的结果。

2026-08-13 15:02:04 157

原创 机器学习LightGBM

但不加区分的对待同一层的叶子,带来了很多没必要的开销。但实际上Level-wise是一种低效算法,因为它不加区分的对待同一层的叶子,带来了很多没必要的开销,因为实际上很多叶子的分裂增益较低,没必要进行搜索和分裂。这样的算法需要保存数据的特征值,还保存了特征排序的结果(例如排序后的索引,为了后续快速的计算分割点),这里需要消耗训练数据两倍的内存。遍历数据时,根据离散化后的值作为索引在直方图中累积统计量,当遍历一次数据后,直方图累积了需要的统计量,然后根据直方图的离散值,遍历寻找最优的分割点。

2026-08-12 20:18:21 187

原创 机器学习LDA

鸢尾花测试集是 4 维,没法直接画,所以函数里先用 PCA 压到 2 维,再按 LDA 的预测标签 y_pred 上色画散点。样本在 PCA 二维平面上的坐标(不是 LDA 投影轴)把有标签样本拆成两类,后面分别算“类内”与“类间”信息。实际是 PCA 的第 1、2 主成分(命名容易误解)指向两类中心连线,是“该把两类拉开”的方向。按类内形状加权,避免往“本来就很散”的方向猛投。这次自实现 LDA 的准确率(约 85%)校正类内形状(方差大的方向少用力)LDA 预测 的类别(0 / 1)

2026-08-12 19:35:01 191

原创 机器学习KNN

对深度为$j$的结点,选择$x^{(l)}$为切分的坐标轴,$l=j%k+1$,以该结点的区域中所有实例的$x^{(l)}$坐标的中位数为切分点,将该结点对应的超矩形区域切分为两个子区域。在计算样本距离时,取值范围大的属性的变化会严重影响取值范围小的属性的变化,以至于结果会忽略取值范围小的属性。根结点对应包含数据集$T$的矩形,选择$x^{(1)}$轴,6个数据点的$x^{(1)}$坐标中位数是6,这里选最接近的(7,2)点,以平面$x^{(1)}$=7将空间分为左、右两个子矩形(子结点);

2026-08-12 12:02:18 219

原创 机器学习HMM

不枚举所有隐状态路径(那是 O(N^T )),而是按时间一步步把概率“向前推”:每一步只做 N×N 的转移累加,复杂度 O(TN^2 )。最后从终点顺着指针往回走,得到全局最优路径(在马尔可夫假设下)。对例子 O=[1,0,1,0,0],输出约 0.01983,就是这条观测在当前 π,A,B 下的似然。对例子 O=[1,0,1,1,0],输出 [0,1,2,3,3],就是该观测下最可能的隐状态序列。对最后一步所有状态的 α_T (i) 求和,得到整条观测序列的概率。→ 最优路径 [0,1,2,3,3]。

2026-08-11 15:45:42 248

原创 机器学习GBDT

在GBDT的迭代中,假设我们前一轮迭代得到的强学习器是$f_{t−1}(x)$, 损失函数是$L(y,f_{t−1}(x))$, 我们本轮迭代的目标是找到一个CART回归树模型的弱学习器$h_t(x)$,让本轮的损失损失$L(y,f_t(x))=L(y,f_{t−1}(x)+h_t(x))$最小。GBDT的思想可以用一个通俗的例子解释,假如有个人30岁,我们首先用20岁去拟合,发现损失有10岁,这时我们用6岁去拟合剩下的损失,发现差距还有4岁,第三轮我们用3岁拟合剩下的差距,差距就只有一岁了。

2026-08-10 18:37:35 212

原创 机器学习FM、FFM

由于 $ \sum_{j=1}^n v_{j, f} x_j $ 只与 $ f $ 有关,而与 $ i $ 无关,在每次迭代过程中,只需计算一次所有 $ f $ 的 $ \sum_{j=1}^n v_{j, f} x_j $,就能够方便地得到所有 $ v_{i, f} $ 的梯度。其中,$f_j$ 是第 $j$ 个特征所属的field。在多项式模型中,特征 $x_i$ 和 $x_j$ 的组合采用 $x_ix_j$表示,即 $x_i$ 和 $x_j$ 都非零时,组合特征 $x_ix_j$ 才有意义。

2026-08-10 17:37:41 344

原创 机器学习decision_tree

对于类的重要性的衡量标准有很多,比如类的普遍性、误分类代价等。$$g(t) =\frac{C(t)-C(T_t)}{|T_t|-1} $$ 其中$T_t$为以t为根节点的子树,$C(t)$为t为单节点树时的预测误差,$C(T_t)$为树$T_t$的预测误差,$|T_t|$为树$T_t$的叶子节点个数。在整体树$T_0$中剪去$g(t) $最小的$T_t$得到子树$T_1$,在从$T_1$中剪去$g(t) $最小的$T_t$得到子树$T_2$,如此递归,直到只有根节点,这样就按找到了一个按顺序的子树序列。

2026-08-10 16:44:12 171

原创 机器学习crf

对齐关系:同一位置 i 上,features[i]、labels[i]、tokens[i] 都对应同一个词。难点是:相邻标签有依赖(如 I-PER 前面通常是 B-PER),不能把每个词当成完全独立分类。'+1:word.lower()': '(', # 后一词。'-1:word.lower()': 'melbourne', # 前一词。,CRF 用很多这样的句子学习“看到什么词/词性/上下文时,该打什么实体标签”。标签用 IOB:B-实体类型 / I-实体类型 / O。

2026-08-10 11:29:25 194

原创 机器学习catboost

教学 demo 还能接受;真实大模型/大数据里通常会改用随机搜索、贝叶斯优化,或先小数据粗调再全量精调。候选太多会很慢(CatBoost × 12 组 × 3 折 = 要训很多遍)。普通 GBDT 里,某样本可能既参与建树又被同一批信息编码,容易偏乐观。:编码/梯度估计时尽量只用“排在前面”的样本信息,降低这种偏差。参数组合1 ──► 折1/折2/折3 AUC ──► 平均分。参数组合2 ──► 折1/折2/折3 AUC ──► 平均分。组合数 = 2 × 2 × 3 × 1 = 12 组参数。

2026-08-07 10:58:02 207

原创 机器学习Bayesian

代码里 BayesianModel([...]) 建结构,TabularCPD(...) 填各节点局部概率,add_cpds 把它们装进网络。边 ('I','G')、('D','G') 表示:成绩由天赋和难度共同决定;前面手写的 nb_fit / predict,和后面的 GaussianNB,都在算这件事。结构:成绩由难度和天赋共同决定,推荐信只看成绩,SAT 只看天赋。这正是代码里 prior[('x2','S',-1)] 等值的来源。为什么其中编号1和编号4的数据,x1,x2一样,y却不一样呢?

2026-08-07 09:22:19 243

原创 机器学习adaboost算法

代码里是: 0.5 * log((1 - min_error) / (min_error + 1e-9))误差越小,α 越大,该树桩在最终投票中越重要。1e-9 防止 error=0 时除零。预测负类的条件写成: label * x < label * threshold。也就是:在当前权重分布下,找“加权错误率最低”的一条水平/竖直分割。fit 负责学出每个 h_m(树桩参数)和对应的 α_m。然后归一化 w /= sum(w)。下一轮会更关注上一轮分错的样本。

2026-08-06 19:55:04 195

原创 Paraformer 论文完整详细总结

,标题《Paraformer: Fast and Accurate Parallel Transformer for Non-autoregressive End-to-End Speech Recognition》,面向端到端语音识别(ASR) 提出单步非自回归(NAR)并行 Transformer 模型 Paraformer,解决传统自回归(AR)解码慢、原生单步 NAR 识别精度差的痛点,模型开源于 FunASR 工具包。将声学特征X映射为全局隐表征H,同时供给预测器与解码器。

2026-07-02 18:32:19 195

原创 第33章 轻舟已过万重山

备考的日子里,每一天都在地铁上开战:清晨,车厢摇晃,手指划过屏幕,每日练兵从不间断;夜晚,返程的灯火里,笔记一页页翻过,像把零散的知识重新缝进脑子里。也曾有过深夜与焦虑对峙的时候:书山有路,学海无涯,前方是未知,迎面是海风。那时最需要的,不是豪言壮语,而是那种朴素——不知道该做什么时,就把手边每件小事做好;二载寒窗,今朝试锋芒——这句话听起来像别人的故事,直到你真正坐在考场里,才发现它早已写进了自己的履历里。也愿此刻仍在备考路上的每一位同行者:以行动为笔,以汗水为墨,终能提笔战四方,逢考必定过。

2026-07-01 19:00:53 212

原创 使用上下文感知掩码的快速高效声纹识别网络cam++

本文提出 CAM++ 轻量化高效声纹嵌入网络,通过改进 D-TDNN 骨干、多粒度池化上下文掩码、2D 时频卷积前端三大创新模块,在 VoxCeleb、CN-Celeb 标准说话人确认测试集上取得最优识别性能;相比 ECAPA-TDNN、ResNet34 等主流高精度模型,参数量、浮点运算量大幅降低,推理速度提升 2 倍以上,可广泛部署于资源受限、高实时性要求的语音业务场景,相关代码已开源。基线模型:TDNN、ECAPA-TDNN、ResNet34、原始 D-TDNN、加深无掩码 D-TDNN-L。

2026-06-30 15:39:51 338

原创 BitsAndBytes详解:大模型量化与低显存训练的核心利器

是 BitsAndBytes 能力核心,封装六大标志性量化模块 ——8-bit 优化器、LLM.int8 () 混合精度 8bit 推理、基础 4bit 量化、适配权重正态分布的 NF4 格式、进一步压缩显存的双重量化、可实现超大模型微调的 QLoRA,分别针对性解决优化器内存冗余、8bit 量化精度丢失、4bit 极致显存压缩、权重分布适配、缩放因子二次存储优化、低显存微调等行业痛点;在大模型(LLM)时代,模型参数规模已经从数十亿(7B、13B)发展到数千亿(175B、405B)。

2026-06-18 10:23:01 399

原创 MCP 协议与 Skill 开发架构培训文档

它允许开发人员构建一套标准服务(MCP Server),该服务无需关心最终对接的是 Claude、GPT 还是企业自研的垂直领域大模型,只要客户端适配了 MCP 协议,就能以结构化、安全可控的方式读取服务器提供的文件、执行特定的数据库命令或调用受保护的内部 API。Client 负责维护与 MCP Server 的进程级或网络级连接,向 Server 获取可用的工具和资源清单(Schema),并在接收到 LLM 的指令时中转调度请求,最后组装上下文再次反馈给 LLM。它能降低用户与 AI 交互的门槛。

2026-06-12 19:41:58 232

原创 PagedAttention论文深度解析

总结:Orca 优化 “调度并发”,vLLM 优化 “内存利用率”,二者是当前高吞吐 LLM 服务的黄金组合;的行业痛点,在不修改模型结构、不损失推理精度的前提下,大幅提升 LLM 服务的批处理能力与整体吞吐量,缓解 GPU 内存墙瓶颈。例如束搜索场景下,传统系统会反复拷贝 KV Cache,带来双重的内存与算力损耗。,逻辑上连续的 KV 缓存可映射到物理上离散的 GPU 内存块,从根源解决碎片与共享问题。最终,内存利用率提升带来的批处理增益,完全覆盖单算子的轻微开销,端到端性能大幅领先基线。

2026-06-12 19:23:17 463

原创 YOLO-World 论文解析

在COCO和LVIS-base带分割标注的数据上分别微调后,表8结果显示:在仅微调分割头的情况下,YOLO-World-L在LVIS上仍保留了较强的零样本能力(APb=25.3,开放分割AP=18.0),而微调全部模块则进一步提升了AP,但轻微降低了零样本性能。YOLO-World的RepVL-PAN针对YOLO的特征金字塔(PAN)进行了定制化改造,引入了轻量的文本指导层(T-CSPLayer)和图像池化注意力(I-Pooling Attention),在融合图文信息的同时尽量保持模型轻量化。

2026-06-10 09:56:40 344

原创 LocateAnything解读

由 NVIDIA 联合香港理工大学、普林斯顿大学、南京大学等多所高校与企业研究者共同完成,核心作者包含 Shihao Wang、Shilong Liu、Zhiding Yu 等,是视觉语言模型(VLM)领域顶尖联合团队。,基于现有主流 VLM 架构轻量化改造,核心仅替换解码层为并行框解码(PBD),兼容现有视觉编码器、跨模态融合模块,迁移成本极低。系统性应用于视觉定位与检测任务。两类简单几何单元,尚未针对语义分割、实例分割、3D 视觉框等复杂几何结构做适配,向分割、3D 视觉领域拓展的有效性仍需验证。

2026-06-09 14:45:55 614

原创 Data-Juicer 整体代码解析

在大模型研发过程中,数据质量往往直接决定模型能力的上限,因此 Data-Juicer 的核心目标是建立一套标准化、自动化、可扩展的数据治理体系,将来自互联网、知识库、数据库、多模态资源等不同来源的原始数据,经过分析、清洗、过滤、去重、增强、评分、合成等多个阶段的处理后,最终生成适用于预训练、监督微调(SFT)、偏好对齐(DPO)、强化学习(RLHF)以及 RAG 检索增强生成等场景的高质量数据集。在执行过程中,数据会依次经过过滤、清洗、去重、评分、增强等处理环节;支持单机多进程到 Ray 千节点集群。

2026-06-08 17:35:44 485

原创 检索增强生成(RAG)原理与实战培训文档

RAG 已成为企业级大模型应用的重要架构。本培训文档系统讲解 RAG(Retrieval-Augmented Generation,检索增强生成)技术的原理、架构、核心组件与工程实践,重点覆盖向量数据库、文档切分、Embedding 嵌入模型、检索增强生成流程以及本地知识库问答系统的构建。它通过从外部知识库中检索相关内容,再将结果作为上下文输入大模型,从而解决模型知识过期、幻觉、私有知识缺失等问题。企业知识库、技术文档、合同论文、长培训文档等对回答完整性、准确性要求高的 RAG 问答。

2026-05-28 20:14:02 573

原创 AI全景与大模型基础 —— 提示工程入门培训文档

AI、大模型与智能Agent的广泛应用,AI系统在提升效率的同时,也带来了数据安全、算法公平、内容真实性等方面的挑战。"AI 幻觉"(Hallucination)指大型语言模型生成看似合理但实际上不准确、甚至完全错误的内容——可能是虚构的事实、不存在的引用、错误的数据,甚至凭空捏造的人物或事件。记住:提示越精准,模型的"猜测空间"越小,输出越可控。与传统编程不同,提示工程不需要修改模型权重,而是通过自然语言"编程",将任务意图、上下文信息、输出要求融合在一段文本中,让模型理解并执行。让模型“逐步思考”。

2026-05-26 17:21:50 400

原创 万字长文解读Qwen进化史:27篇论文深度复盘Qwen模型家族

自2023年生成式人工智能迎来爆发以来,LLM技术的发展已从单纯的堆训练数据、堆参数量,转向了架构效率、模态融合以及长上下文推理能力的深水区。在这场全球性的技术角逐中,阿里巴巴通义实验室推出的 Qwen(通义千问)系列模型,凭借其极其密集且高质量的开源迭代节奏,构建了一个庞大生态系统,覆盖了从端侧微型模型到云端巨型旗舰、从纯文本处理到全模态实时交互。

2026-04-07 16:50:22 772

原创 第32章 其他

是开发整体程序结构时使用的法则,即将每个程序的成分隐蔽或封装在一个单一的设计模块中,定义每一个模块时尽可能少地显露其内部的处理。在设计时首先列出一些可能发生变化的因素,在划分模块时将一个可能发生变化的因素隐蔽在某个模块的内部,使其他模块与这个因素无关。环境信息库是软件开发环境的核心,用以存储与系统开发有关的信息,并支持信息的交流与共享。统一的、具有一致性的用户界面是软件开发环境的重要特征,是充分发挥环境的优越性、高效地使用工具并减轻用户的学习负担的保证。PUT和PATCH请求是最常见的两种更新资源的方法。

2026-04-05 10:29:00 321

原创 第31章 2025真题作文

目录题目2025.5-论负载均衡设计题目2025.5-论软件测试题目2025.5-论事件驱动的架构题目2025.5-论多模型数据源题目2025.11-Serverless 架构模式题目2025.11-论基于云原生数据库的企业信息系统架构设计题目2025.11-性能测试题目2025.11-论秒杀场景及其技术解决方案负载均衡设计是构建高可用、可扩展和高性能分布式系统的核心要素。其核心目标是将网络流量或计算任务智能地分发到多个后端服务器(或资源)上,避免单点过载,最大化资源利用率,提升用户体验和系统容错能力。请围

2026-04-05 10:27:10 519

原创 第30章 2024真题作文

本文结合该项目实践,先明确个人核心职责,构建 CloudOps 四维衡量指标体系,再深入拆解 “基础设施即代码 + GitOps + 智能监控 + 费用治理” 四大子体系的落地路径,最终实现版本交付周期从数周压缩至 2 小时、故障平均恢复时间(MTTR)从 1 小时降至 5 分钟的显著成效,且一次性通过等保 3.0 与商用密码测评,为省级政务云自动化运维提供可复用范式。在项目的初始阶段,我与业务分析师合作,通过访谈、研讨会等方式,深入了解再保险的业务流程,包括合约签订、分保、理赔、结算等环节。

2026-04-05 10:25:40 398

原创 第29章 2023真题作文

通过上述设计与实现,智慧园区管理平台成功集成了 12 类核心数据源,包括 3 类结构化数据(企业管理数据、设备台账数据、缴费数据)、4 类半结构化数据(设备运行日志、传感器数据、OA 流程数据、告警数据)、2 类非结构化数据(监控视频、电子文档)、3 类第三方接口数据(气象数据、消防预警数据、政务服务数据)。作为项目负责人与技术架构师,我的核心职责包括:1)需求调研与分析,梳理园区管理方、入驻企业、运维团队等多方数据需求,明确数据集成的核心目标;在如今信息爆炸的时代,企业、组织和个人面临着大量的数据。

2026-04-05 10:22:55 420

原创 第28章 2022真题作文

湖仓一体是一种新型的开放式架构,打通了数据仓库和数据湖,将数据仓库的高性能及管理能力与数据湖的灵活性融合了起来,底层支持多种数据类型并存,能实现数据间的相互共享,上层可以通过统一封装的接口进行访问,可同时支持实时查询和分析,为企业进行数据治理带来了更多的便利性。从网络层面来讲,区块链是一个对等网络(Peer toPeer,P2P),网络中的节点地位对等,每个节点都保存完整的账本数据,系统的运行不依赖中心化节点,因此避免了中心化带来的单点故障问题。在维护的过程中,也需要对软件的可维护性进行度量。

2026-04-04 21:37:10 674

原创 第27章 2021真题作文

企业集成平台能够根据业务模型的变化快速地进行信息系统的配置和调整,保证不同系统、应用、服务或操作人员之同顺畅地相互操作,进而提高企业适应市场变化的能力,使企业能够在复杂多变的市场环境中生存。信息系统的安全保障是以风险和策略为基础,在信息系统的整个生命周期中提供包括技术、管理、人员和工程过程的整体安全,以保障信息的安全特征,为应用提供透明的信息访问服务,通过实现异种数据库系统之间数据的交换、互操作、分布数据管理和共享信息模型定义(或共享信息数据库的建立),使集成平台上运行的应用、服。

2026-04-04 21:35:57 162

原创 第26章 2020真题作文

然后将数据子集分布到不同的节点上,通过设计合理的数据分片规则,可将系统中的数据分布在不同的物理数据库中,达到提升应用系统数据处理速度的目的。上,存储节点可以根据IP地址进行哈希,数据通常通过顺时针方向寻找的方式,来确定自己所属的存储节点,即从数据映射在环上的位置开始,顺时针方向找到的第一个存储节点。务,而且这些事务都需要实时响应的情况(主要指B2C的环境)。数据级集成是通过ETL(抽取、转换、加载)工具或数据库同步机制,将不同系统的数据整合到统一的数据仓库或数据湖中,实现数据的集中管理与分析。

2026-04-04 21:33:50 178

原创 第25章 2019真题作文

在结构化设计中,模块和模块之间的关系局限于信息流,限制了对模块之间众多关系的表达,也无法体现模块和模块之间其他的众多关系,包含各种各样的结构、行为、依赖、包含(在结构化设计中这种关系隐含在分层中)、继承、关联关系等等。1)基于调查问卷或检查表的方式:该方式的关键是要设计好问卷或检查表,它充分利用系统相关人员的经验和知识,获得对架构的评估。净室方法是一种严格的软件工程方法,它是一种强调正确性的数学验证和软件可靠性认证的软件过程模型,其目标和结果是非常低的出错率,这是使用非形式化方法难于或不可能达到的。

2026-04-04 21:32:35 205

tsinghua严版教材讲义.ppt

清华大学严蔚敏数据结构ppt

2016-12-30

( cvpr-torch.pdf )

torch7官方文档

2017-08-14

UCF_CC_50

UCF_CC_50数据集,包含图片,json,mat

2017-03-31

( SEDIM.zip )

基于SEDMI方法实现的视频摘要,video synopsis。

2017-05-12

lenet_test.zip

基于c++实现的LeNet,可以基于自己鼠标手写的字符进行识别,效果很好,原验证集99%的识别率

2017-02-07

open_nsfw.zip

基于c++和caffe实现了色情识别,使用了resnet50,效果很赞

2017-02-10

CarFace-Detection-Adaboost.zip

基于opencv训练的cascade的车脸检测,带2个模型,vs2013下可以直接运行,对卡口车脸具有较好的识别效果,相应速度快。

2017-09-13

deepCrowd.zip

deepCrowdNet自己训练的caffemodel和deploy

2017-04-07

proto.zip

lightcnn 训练的proto

2017-03-22

( caffe-windows.zip )

windows版本的caffe,早期版本,里面有windows文件夹

2017-08-10

visualize.zip

将模型的weights和featuremap的可视化,c++实现

2017-07-11

ESR.zip

ESR人脸对齐,c++代码,包含了论文,29个点的Model,COFW数据集,训练和测试的代码都封装进去,运行环境vs2010,opencv。

2017-01-05

testLFW.zip

基于matlab的对LFW识别率的测试,可以直接运行,附全部数据,包含caffe-face的特征矩阵

2016-12-26

( libboost.zip )

caffe中缺少的libboost库文件,libboost_date_time-vc140-mt-1_61.lib,libboost_filesystem-vc140-mt-1_61.lib

2017-09-03

dlib_face.zip

基于dlib实现的人脸检测和对齐,VS2013可以直接运行。

2016-12-21

dlib-18.17.tar.bz2

dlib18.17库,支持vs2013,

2016-12-21

算法导论_原书第3版_CHS.pdf

算法导论,第三版,完整版本,带目录,高清,可编辑

2017-03-03

( convert_imageset.cpp )

将caffe转化为支持多标签

2017-06-08

2014facebookDeepLearningforVision:TricksoftheTrade.pdf

2014 cvpr上,face book Deep Learning for Vision:Tricks of theTrade,贾杨清推荐

2017-03-02

数据结构.zip (ppt)

数据结构ppt

2016-12-30

时间序列分析+目标检测

时间序列分析+目标检测等多个项目的分享

2025-03-06

时间序列预测实操的代码,可以直接运行

基于python的时间序列预测实操

2025-03-06

时间序列预测实操(从0到1)

时间序列预测实操(从0到1)的代码和数据集

2025-03-06

诗词助手的文件包括全部内容

里面包含了4张数据库表,dify的DSL,http post数据库请求。

2025-03-14

基于qt开发的手语识别系统平台

基于qt和python开发,支持图片、网络视频、本地视频的实时识别

2025-03-03

手工标注睡岗检测数据集

睡岗检测数据集,1407张,支持yolov7训练

2024-09-20

基于模板的文字识别结果结构化处理技术

基于模板的文字识别结果结构化处理技术,基于模板的文字识别结果结构化处理技术

2019-05-04

track.7z跟踪的顶顶顶顶goturn模型

跟踪goturn模型,opencv自带,可以实现自适应的跟踪。

2019-06-15

( mnist_tfrecords.rar )

使用tfrecords格式数据训练mnist神经网络,使用tensorflow实现

2018-01-10

( caf_face_detection.7z )

基于深度学习的人脸检测,c++,带模型,自动更新学习模型,。。。。。。。。。。。。。。。。。。。。。。。。。

2017-09-18

OpenCVDemo.zip

基于android studio 3.6的opencv的第二种调用方式

2020-03-16

CNN_book_weixs魏秀参.rar

cnn 总结,写的很棒,值得学习推荐。 解析卷积神经网络 ——深度学习实践手册

2018-05-18

OPENPOSE.zip

openpose的模型文件,包含body25,body19,coco,mpi,还有训练文件,

2019-08-27

FTPServer.zip

ftp 搭建工具,可以简单的部署windows下的ftp server...

2018-12-12

op.zip

基于opencv的java api方式的调用

2020-03-26

( face-py-faster-rcnn.zip )

基于faster rcnn 的人脸检测,带训练好模型。以及训练程序和测试程序

2018-02-11

mtcnn.zip

基于andorid studio 3.6的ncnn版本的mtcnn人脸检测

2020-03-17

OpenCVDemo.zip

基于android studio 3.6,ndk14b的opencv代码。demo级别的参考。。。。。。。。。。

2020-03-14

( caffe-facebox-vs2013.7z )

facebox人脸检测c++实现,修改的ssd,效果一般,仅供学习

2018-01-21

Xmanager.zip

Xmanager.Enterprise.5.0815.rar,破解版本,欢迎使用

2019-04-28

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除