自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

Python学习与数据挖掘

微信公众号:Python学习与数据挖掘,让分享成为一种习惯!

  • 博客(681)
  • 资源 (1)
  • 收藏
  • 关注

原创 《算法岗面试宝典》重磅发布!

薪资真香、技术难度真大、要求真的很全面,但不是没有方法可循、可借鉴的。业务知识 + 专业知识 + 编程基础能力+刷题(LeetCode/剑指Offer) + 项目 + 实习 + 竞赛 +顶会/顶刊+学校针对岗位要求,我在知识星球和《算法面试宝典》中详细给大家介绍。让加入的朋友了解最前沿的知识点,有问题给予专业指导,少栽跟头。这份《算法面试宝典》,文档字数 30w+,我们也在一直更新,涵盖算法岗的方方面面,相信你读完并思考实践后,你一定能有所收获。

2024-10-02 14:20:43 745

原创 3.5万字,图解 Pandas

大家好,在 Python 各个工具包中,最频繁使用的应该就是 Pandas 了。今天我以图解的方式给大家介绍 Pandas 中各种常用的操作,内容有点长,

2023-03-31 10:16:01 1403 2

原创 终于盼到了,Python 数据科学速查表中文版来了

近几年以来,Python 的应用场景越来越多,几乎可以应用于自然科学、工程技术、金融、通信和商业等各种领域。究其原因在于 Python 的简单易学、功能强大。想系统地学点东西,发现很多不错的技术文档都是英文资料,发现英文竟然成为了学习的拦路虎。非常幸运的是,DataCamp 推出的 Python 数据科学速查表,已经翻译成中文啦!高清资料已打包。喜欢点赞支持、欢迎收藏学习。领取方式:资料已打包,获取方法有两种:方式一、发送如下图片至微信,长按识别,回复:资料;方式二、微信搜索公众号:Python

2021-11-30 09:04:15 3400 3

原创 爱了爱了,20个好用到爆的Python函数

大家好,今天分享20个日常工作中必不可少的Python函数,这些函数平时看到的不多,但是它们使用起来倒是非常的方便,它们可以大幅度地提高工作效率。内容较长,欢迎收藏学习,喜欢点赞支持,文末有技术交流群,欢迎加入。isin()方法isin()方法主要是用来确认数据集当中的数值是否被包含在给定的列表当中df = pd.DataFrame(np.array(([1, 2, 3], [4, 5, 6], [7, 8, 9], [10, 11, 12])), index=['

2021-11-25 19:30:38 21790 13

原创 这次不迷路了!最全 Python 学习路线图+14张思维导图真香啊!

导图作者 | ZOE@数林觅风ZOE是一名医学生,在自己博客分享了很多高质量的思维导图。本文中所列的14张思维导图,是17年作者开始学习Python时所记录的,希望对大家有所帮助。原文:https://woaielf.github.io/2017/06/13/python3-all/呕心沥血用14张思维导图将 Python 编程的核心知识总结出来,现分享给大家。按顺序依次展示了以下内容的一系列思维导图:基础知识,数据类型(数字,字符串,列表,元组,字典,集合),条件&

2021-10-19 17:11:02 3421 2

转载 实战案例!用 Python 绘制全国鸿星尔克门店分布图,最多的是你所在城市吗?

最近的鸿星尔克,频频上热搜!咱们今天就以某度地图 用Python爬虫看一下全国到底有多少家鸿星尔克门店?又到秋冬换季买衣服的时候了,可以考虑支持一波。喜欢本文点赞支持,文末提供技术交流群。需求分析首先我们打开地图搜索“鸿星尔克”:F12打开浏览器开发者模式,找到如下链接。复制该链接到浏览器,发现这是一个json格式的数据集。我们所需要的省份和对应数量还有各个城市对应的数量都在其中。发送请求我们首先模拟浏览器来发送请求获取到这个json数据集,然后获取各个城市鸿星尔克门店及其对应数量

2021-10-16 22:00:17 6149 5

原创 【视频+PPT】2021年李宏毅版40节机器学习课程已更新完毕,推荐收藏!

提起李宏毅老师,熟悉机器学习的读者朋友一定不会陌生。最典型的就是开局一言不合就“宝可梦”。李宏毅老师幽默风趣的教学风格也吸引力很多机器学习爱好者。李宏毅老师,是宝岛台湾大学电机工程系教授,他分别于2010年和2012年获得硕士和博士学位,主要研究机器学习尤其是深度学习、语言理解和语音识别。李宏毅老师的机器学习课程可以说是最具代表性的中文公开课之一,已经成为大量国内初学者的首选。截至目前,2021年版的机器学习40节课程已经全部更新完毕,全程中文讲解,覆盖的内容也非常丰富,视频均长约40分钟,内容较多,喜

2021-10-05 06:26:12 1540 1

原创 李航老师《统计学习方法(第二版)》课件 & 算法代码全公开了!

李航老师的《统计学习方法》第二版的代码实现更新完毕,本文提供下载。李航老师编写的《统计学习方法》全面系统地介绍了统计学习的主要方法,特别是监督学习方法,包括感知机、k近邻法、朴素贝叶斯法、决策树、逻辑斯谛回归与支持向量机、提升方法、em算法、隐马尔可夫模型和条件随机场等。叙述从具体问题或实例入手,由浅入深,阐明思路,给出必要的数学推导,便于读者掌握统计学习方法的实质,学会运用。《统计学习方法》可以说是机器学习的入门宝典,许多机器学习培训班、互联网企业的面试、笔试题目,很多都参考这本书。我们将.

2021-03-14 21:33:39 3751

原创 Mac python matplotlib Glyph xxxxx missing from current font的解决方案

最近想使用matplotlib画图,发现plot出来的图无法显示中文,都是如下图的小方格,查找了很多资料,基本都是这样处理,其实这样处理基本上都是无用的(mac版本的),解决方案我在下面给出,如果你遇到相似的问题,请继续阅读。from matplotlib import font_manager as fm, rcParamsimport matplotlib as pltplt.rcParams['font.sans-serif']=['SimHei'] #显示中文标签plt.rcParams['

2020-07-04 18:18:41 9808 9

原创 minmax 算法岗薪资福利,果然很体面!!!

月薪(base)应届/初级(1–2年):35K–50K / 月中级(3–5年,有大模型项目):45K–70K / 月高级/资深(5年+,主导过百亿/千亿参数训练):60K–80K+ / 月技术负责人/专家:80K–120K+ / 月年薪构成现金部分:base × 16(12个月工资 + 4个月年终奖)股权激励:兑现:4年成熟期,1年 cliffs福利体系:六险二金、住房补贴、餐补、通讯补贴等。

2026-04-04 11:19:13 627

原创 用这个 Skill,直接一句话生成手绘架构图,省时省力~

安装完这个 skill 后,我们可用 Claude Code 等工具,只需要输入一句话,它就会直接生成一个。

2026-04-04 11:14:56 703

原创 还得是拼多多,算法岗薪资给的真多啊

最近春招开始了,不过时间还是太短了。节前,我们邀请了一些互联网大厂朋友、今年参加社招和校招面试的同学。针对新人如何快速入门算法岗、如何准备面试攻略、面试常考点、大模型项目落地经验分享等热门话题进行了深入的讨论。在做出最终选择前,我也认真了解过公司的工作节奏,清楚这里业务压力大、强度高,对于加班和高强度工作,我确实有过担心和犹豫。但经过慎重考虑,我还是坚定地选择加入。一方面,拼多多给出的薪资待遇对我而言非常有吸引力;另一方面,我非常看重公司务实的业务氛围和硬核的技术场景。

2026-03-18 14:14:08 584

原创 Openclaw一周烧掉我14亿Token后,我总结了这10条血泪教训

你不是不擅长这个。这事儿现在就是很难。那些发"我的agent一晚上做了个完整应用"的人,已经调了几周了。他们烧了token,写了几十页规则,调试了你正在经历的同样卡顿。对我有帮助的是:接受这个事实——配置本身就是工作。写**就是产品工作。调整模型路由是基础设施工作。定时任务是运维工作。你不是在用一个工具,你是在搭建一个系统。14亿token之后,agent在我睡觉的时候真的在产出成果。配置就是护城河。大部分人在到达这里之前就放弃了。存好这篇。发给你的bot。等它在晚上自动产出成果的时候再回来看看。

2026-03-18 14:10:27 608

原创 OpenClaw避坑指南:先装这10个Skills,再谈生产力

写这篇文章,不是为了给你一份"必装清单",而是想帮助你理解OpenClaw的能力边界。OpenClaw的价值,在于把"理解意图"转化为"执行任务"。Skills就是执行任务的具体工具。这10个Skills,覆盖了安全、信息、进化、记忆、扩展五个维度,构成了一个相对完整的能力闭环。有人喜欢查资料,有人喜欢写代码,有人喜欢管理日程——都没问题。关键是理解它的工作原理,知道它擅长什么、不擅长什么,然后找到适合你的使用方式。如果你也在玩OpenClaw,欢迎在评论区分享你的经验和踩过的坑。

2026-03-18 14:01:32 1462

原创 上海人工智能实验室大模型算法岗,竞争太激烈了。。。

最近春招和日常实习已开启。不同以往的是,当前职场已不再是那个双向奔赴时代了。求职者在变多,HC 在变少,岗位要求还更高了。最近,我们又陆续整理了很多大厂的面试题,帮助一些球友解惑答疑,分享技术面试中的那些弯弯绕绕。万万没想到啊,上海人工智能实验室实习岗居然都这么卷,HR反馈当前岗位投递人较多,让耐心等待结果,竞争真的太激烈。所以说啊,无论是实习还是找工作,还是要提前做准备,越早越好啊,希望助力大家都能拿到心仪的offer!

2026-03-03 09:13:21 800

原创 所有付出都值得,感谢淘天大模型算法岗Offer!

节前,我们邀请了一些互联网大厂朋友、今年参加社招和校招面试的同学。针对新人如何快速入门算法岗、如何准备面试攻略、面试常考点、大模型项目落地经验分享等热门话题进行了深入的讨论。受星主邀约,分享26届秋招淘天算法工程师-大模型应用面经,欢迎与我沟通交流。

2026-03-03 09:05:05 303

原创 《大模型面试宝典》(2026版) 正式发布!

2025年12月11日,OpenAI发布GPT-5.2,这次升级确实挺猛的,核心亮点就是‌更专业、更高效、更可靠‌,直接瞄准了办公、开发这些实际场景。同样国内模型应用加速迭代落地。12月1日,豆包手机助手首个OS级合作落地,实现AI像人一样操作手机,这种深度参与将催生更多创新应用场景。同时,DeepSeek-V3.2正式发布,强化Agent能力、融入思考推理。经历这两年的你追我赶,大模型已进入深耕细作阶段,重心从试点转向系统化落地。

2026-01-20 22:02:55 269

原创 程序员必备!Prompt三大进阶技巧和实用模板

1 基础优化技巧2 中级技巧3 高级技巧4 实用模板5 最佳实践在与AI结对编程的过程中,优秀的 Prompt 设计是充分发挥 AI 能力的关键。本文将分享一些开发中实用的 Prompt 优化技巧,帮助开发者更高效地与 AI 协作。

2025-12-15 19:19:09 449

原创 从携程到虾皮:两个月十余家大厂算法岗面试复盘

自我介绍是对背景和工作经历的概述,所以尽可能突出你自己做的比较好且有把握的项目,这样面试官在提问的时候也会因为你自己提到的内容而往这方面走。不过有一些面试官就是会找简历上和自己业务相关或者感兴趣的项目来进行提问,所以你在简历上提到的项目都需要非常熟悉。

2025-12-15 19:11:39 1057

原创 一文带你彻底理解AIGC、Agent、MCP的概念和关系

Function Calling(函数调用)是大型语言模型的关键技术。前面有提到过RAG技术是为了解决模型无法和外接数据交互的问题,但是RAG的局限在于只赋予了模型检索数据的能力,而允许模型理解用户请求中的潜在意图,并自动生成结构化参数来调用外部任何函数/工具,从而突破纯文本生成的限制,实现与真实世界的交互,比如可以调用查天气、发邮件、数学计算等工具。

2025-12-10 22:59:48 1059

原创 字节算法岗 offer 到手,有点小激动。。。

摘要:本文分享了26届秋招字节大模型算法岗的三轮面试经历,涵盖算法岗面试的核心要点。一面考察基础知识和代码能力,涉及Transformer结构、BERT预训练、LLM Agent设计等;二面深入项目细节,聚焦Qwen模型、MoE结构、RLHF流程等技术难点;三面侧重工程实践,讨论硬件优化、训练监控、数据配比等实际问题。文章为算法岗求职者提供了全面的面试准备参考,特别强调对大模型技术细节和工程落地的深入理解。

2025-12-10 09:14:52 786

原创 图解AI核心技术:RAG、大模型、智能体

维度传统RAG检索方式单次、静态多轮、动态优化推理能力单跳,依赖人工设计多跳,自主分解任务上下文管理固定拼接动态筛选与精炼错误处理无自检机制结果验证与修正适用场景简单问答、文档摘要复杂推理、实时交互、工具调用演进本质:Agentic RAG将RAG从“管道流程”升级为“自主决策系统”,更贴近人类问题解决模式。策略核心逻辑优势局限性Fixed-size固定长度切割高效、通用语义断裂风险Semantic语义边界检测保留上下文计算复杂度高。

2025-10-20 10:37:43 805

原创 被百度大模型算法岗狠狠的毒打了

摘要:近期互联网大厂秋招如火如荼,某算法岗面试经历引发关注。面试内容涵盖自我介绍、项目深挖、技术八股(包括DeepSeek、注意力机制、DeepSpeed等)、微调技术细节(LoRA显存计算)、大模型推理参数(温度/topk/topp执行顺序)以及业务场景题。面试采用压力面形式,面试官未开摄像头但质疑候选人简历内容,最终候选人反馈体验较差。该案例反映出算法岗面试的高专业要求和高压特点,建议求职者扎实准备技术细节。(149字)

2025-10-20 10:23:55 663

原创 一文搞懂大模型的向量化(Embedding)

今天来聊一聊BERT和GPT的向量化,从而了解大模型的第二步:Embedding。Embedding(嵌入)是大语言模型(如 BERT 和 GPT)的核心组件,其作用是将人类语言转换为机器能理解的数值向量。这一过程类似于为每个词、子词或符号赋予一个“数字身份证”,使得模型能够捕捉语义信息,让相似的词(如“快乐”和“高兴”)在向量空间中距离更近。

2025-05-24 18:53:18 1277

原创 一文搞懂大模型的分词器(Tokenizer)

今天来聊一聊BERT和GPT的分词器,了解大模型的第一步:Tokenizer。Tokenizer(分词器)是大语言模型(如BERT和GPT)预处理文本的核心组件,其作用是将原始文本拆解为子词、单词或字符,同时保留语义和结构信息。

2025-05-24 18:46:27 724

原创 一文搞懂混合专家(MoE)模型

在探索最新的大语言模型(LLM)时,“MoE”这一术语频繁出现在各种标题之中。DeepSeek-V3便是一个实力强劲的混合专家(MoE)模型,其总参数量高达6710亿,且在处理每个标记(token)时,能够智能地激活约370亿的参数,实现高效计算。同样引人注目的还有Qwen2.5-Max,这一大规模MoE模型通过精心设计的监督微调(SFT)流程以及基于人类反馈的强化学习(RLHF)方法进行了后训练,大大提升了其性能与实用性。这个“ MoE ”代表什么?为什么这么多大语言模型(LLM)都在使用它?

2025-05-10 16:59:51 1108

原创 Qwen3正式发布并全部开源8款混合推理模型

Qwen3正式发布并全部开源8款「混合推理模型」。

2025-05-10 16:53:29 2120

原创 一文搞懂大模型提示工程(Text2SQL、Text2API)

大模型的提示工程(Prompt Engineering) 是通过精心设计输入文本(Prompt),引导大语言模型(LLM)生成符合预期输出的技术。在Text2SQL(自然语言转SQL)和Text2API(自然语言调接口)场景中,提示工程的核心目标是将自然语言问题转化为准确的 SQL 查询和具体的 API 调用参数。

2025-04-12 16:29:05 935

原创 一文搞懂大模型部署框架Ollama和vLLM

Ollama是一款专注于简化大型语言模型本地部署和运行的开源框架,基于Go语言实现,支持跨平台运行,并以“开箱即用”为核心理念,适合个人开发者和轻量化场景。而vLLM是一个高效的大模型推理与服务引擎,基于PyTorch构建,创新性地引入了PagedAttention技术,旨在解决大模型服务中的显存效率与吞吐量瓶颈,支持张量并行和流水线并行,可横向扩展至多机多卡集群。节前,我们邀请了一些互联网大厂朋友、今年参加社招和校招面试的同学。

2025-04-12 16:24:17 1335

原创 《算法岗面试宝典》重磅发布!

薪资真香、技术难度真大、要求真的很全面,但不是没有方法可循、可借鉴的。业务知识 + 专业知识 + 编程基础能力+刷题(LeetCode/剑指Offer) + 项目 + 实习 + 竞赛 +顶会/顶刊+学校针对岗位要求,我在知识星球和《算法面试宝典》中详细给大家介绍。让加入的朋友了解最前沿的知识点,有问题给予专业指导,少栽跟头。这份《算法面试宝典》,文档字数 30w+,我们也在一直更新,涵盖算法岗的方方面面,相信你读完并思考实践后,你一定能有所收获。

2025-03-29 22:48:19 435

原创 图解 Attention,从MHA到DeepSeek MLA,非常详细!

对于一个输入序列中的某个词,都会与序列中的所有词计算相关性。假设有一个输入序列:对于每个词 ,我们计算它与所有其他词的相关性,并赋予不同的权重,然后将这些信息进行加权求和,得到新的表示。当前这里的每个词都要在经过Embedding之后,再做权重转换。

2025-03-29 22:40:13 1361

原创 北大DeepSeek使用手册来了,清北是在“神仙打架”吗?

清华之前出了 5 份 DeepSeek 的相关教程,北大近期了也出了两个,做个整理。。。

2025-03-03 22:23:24 404

原创 DeepSeek杀死了Excel!感觉我要失业了!

节前,我们邀请了一些互联网大厂朋友、今年参加社招和校招面试的同学。针对新人如何快速入门算法岗、如何准备面试攻略、面试常考点、大模型项目落地经验分享等热门话题进行了深入的讨论。2025开年相信大家都被DeepSeek刷屏了,DeepSeek以极地训练成本这么低,就获取了跟ChatGPT相近的性能,给美国科技圈一记暴击。有不少粉丝都问道DeepSeek应该怎么使用?只要你会将文字输入到AI对话框里,就能使用AI工具提高工作效率,下面就有把手教你如何使用DeepSeek解决Excel问题。

2025-02-12 21:14:16 658

原创 清华大学DeepSeek使用手册,长达104页!(附PPT下载)

从避免AI幻觉的小窍门,到设计出色提示语的秘籍,每一页都凝聚着干货知识,让用户能够直接上手操作,快速掌握DeepSeek的精髓。这份文档不仅为用户提供了关于DeepSeek的全面知识,还体现了中国科技在人工智能领域的快速发展。《DeepSeek:从入门到精通》以通俗易懂的方式,全面介绍了DeepSeek的使用方法,为用户提供了极具价值的指导。这份文档内容丰富,篇幅长达104页,涵盖了众多实用技巧。

2025-02-12 21:12:00 658 1

原创 完整的671B DeepSeek R1本地部署,详尽教程来了!

节前,我们邀请了一些互联网大厂朋友、今年参加社招和校招面试的同学。针对新人如何快速入门算法岗、如何准备面试攻略、面试常考点、大模型项目落地经验分享等热门话题进行了深入的讨论。过年这几天,DeepSeek 算是彻底破圈了,火遍大江南北,火到人尽皆知。虽然网络版和 APP 版已经足够好用,但把模型部署到本地,才能真正实现独家定制,让 DeepSeek R1 的深度思考「以你为主,为你所用」。

2025-02-06 21:50:31 5539 1

原创 《大模型面试宝典》(2025版) 发布了

基于去年我们写的《大模型面试宝典》(2024版)的基础上,我根据自己实践经验和星球小伙伴的面经分享总结推出《大模型面试宝典》(2025版),共计52w+字。与去年相比,内容增加了星球成员面试真题分享、大模型最新考试要点总结、DeepSeek 项目实战、业内同行大模型实战项目总结,同时删除了一些老旧内容。相信读完后,无论你是学生还是在职人员,在求职面试和工程实践方面一定能会有所收获。

2025-02-06 21:40:59 911 1

原创 把 DeepSeek 部署在你的电脑上(保姆级教程)

如果是32b参数的,就需要32G显存啦,可以根据自己的电脑性能选择。最近做的一个视频,讲了DeepSeek的本地部署,在全网取得了600万+的播放量,大家对DeepSeek的本地部署很热情。如果安装半天没完成,容易打击到学习AI的热情,这也是为什么我做的视频里,没有讲Open-WebUI安装步骤的原因。Open-WebUI这部分的安装过程比较简略,如果出现报错,需要具备通过浏览器搜索问题原因,并修复的能力。本地部署首先要安装ollama,你可以把它理解为,一个装AI的盒子,把AI装在盒子里,方便管理。

2025-02-03 23:49:39 2693 3

原创 双非本 985 硕士,秋招上岸字节算法岗!

最近已有不少大厂都在秋招宣讲了,也有一些在 Offer 发放阶段。节前,我们邀请了一些互联网大厂朋友、今年参加社招和校招面试的同学。针对新人如何快速入门算法岗、如何准备面试攻略、面试常考点、大模型项目落地经验分享等热门话题进行了深入的讨论。背景:电子科技大学 985硕士 字节算法岗Offer我最近已有几次大厂面试经历,目前还在刷面经和复盘,想想面试的时候,什么地方回答的不好(主要是项目经历的部分)总结整个面试下来,基础题偏多,算法原理的内容也不少,工程方面偏向于工程落地实现。

2024-10-02 14:25:36 894

原创 Pandas AI:最棒的大模型数据分析神器!

暑期实习基本结束了,校招即将开启。不同以往的是,当前职场环境已不再是那个双向奔赴时代了。求职者在变多,HC 在变少,岗位要求还更高了。最近,我们又陆续整理了很多大厂的面试题,帮助一些球友解惑答疑,分享技术面试中的那些弯弯绕绕。想象一下,能够像和最好的朋友交谈一样与你的数据对话,这就是 Pandas AI 的功能!这个 Python 库具有生成式人工智能能力,可以将你的数据框变成会话者。它像一个超级英雄的助手,会帮助你解决问题,让你的生活更轻松。

2024-06-15 09:05:48 1806

原创 PyGWalker:Python 中最好的数据分析库

节前,我们星球组织了一场算法岗技术&面试讨论会,邀请了一些互联网大厂朋友、参加社招和校招面试的同学。针对数据分析、数据挖掘、算法,新手该如何快手入门、该如何准备面试、面试常考点分享等热门话题进行了深入的讨论。你在 Jupyter Notebook 中有一堆数据需要分析和可视化。PyGWalker 就像一个神奇的工具,使这一过程变得超级简单。它将你的数据转换成一种特殊的表格,你可以像使用 Tableau 一样与之交互。你也可以直观地探索数据,随意操作,发现模式和见解,而不会迷失在复杂的代码中。

2024-06-01 16:28:35 1088 1

mac版SimHei(黑体)

最近想使用matplotlib画图,发现plot出来的图无法显示中文,都是如下图的小方格,查找了很多资料,基本都是这样处理,其实这样处理基本上都是无用的(mac版本的),解决方案我在下面给出,如果你遇到相似的问题,请继续阅读。

2020-07-04

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除