- 博客(38)
- 收藏
- 关注
原创 稀疏注意力 / DSA:用白话讲清在优化什么
稀疏注意力(sparse attention)指:计算注意力时,不让每个位置都与序列里所有位置两两交互,只连接一部分位置。长上下文越来越常见,全量注意力的代价也越来越显眼。资料里又出现 DSA、各种稀疏模式缩写。先抓住它在优化什么,再记名字。指让模型按约定形态返回数据,常见是 JSON,便于程序直接解析。JSON Mode / schema 约束是各厂商实现这一目标的手段。聊天可以是散文;自动化要把结果喂给代码。这时「大概是个 JSON」不够,缺字段或尾随逗号都会让流水线断掉。是你给模型的任务说明。写得含糊,输出就漂;写得可检查,输出才容易收敛。很多人习惯堆形容词:「写得优雅、专业、全面、生产级」。这些词对人有感觉,对模型几乎没有可执行标准。更有效的写法是:**约束(不要做什么)+ 验收(怎样算完成)**。、搜索进入、关注(粉丝净增)。同一周里,阅读暴涨不一定等于搜索变好,也不等于粉丝留下。把三个指标当成同一回事,会做出错误选题决策。## 一、
2026-09-01 20:00:00
207
原创 简历头像、微信头像一次裁方/裁圆(含常见尺寸)
投简历、换微信头像、填报名系统,上传框往往写着:**「请上传正方形照片」「尺寸 295×413」「文件小于 2MB」**。手机相册里大多是竖构图全身或半身,比例不对直接被拒。其实不需要开 PS。浏览器里 **裁方 → 裁圆 → 按像素导出**,几分钟搞定。
投简历、换微信头像、填报名系统,上传框往往写着:**「请上传正方形照片」「尺寸 295×413」「文件小于 2MB」**。手机相册里大多是竖构图全身或半身,比例不对直接被拒。其实不需要开 PS。浏览器里 **裁方 → 裁圆 → 按像素导出**,几分钟搞定。
2026-08-28 13:00:00
923
原创 Agent 工程笔记①:工具调用失败时,先查哪三层
专栏「Agent 工程笔记」第一篇:工具调用失败时按模型决策、协议与参数、执行环境三层排查,避免只盯着报错原文空转。
2026-08-27 20:15:00
419
原创 理解 MCP:模型如何接上外部工具
用白话说明 Model Context Protocol(MCP):宿主如何通过统一协议把文件系统、数据库等工具接到模型,以及工具循环怎么转
2026-08-27 12:00:00
971
原创 理解流式输出:SSE 在聊天里干什么
说明聊天产品里的流式输出常见实现 SSE:服务器按事件推送文本碎片,前端边收边渲染,以及它解决什么、不替代什么
2026-08-26 20:30:00
300
原创 理解 WebAssembly:它解决什么问题
说明 WebAssembly(Wasm)要解决的问题:把紧循环与算力密集逻辑以近原生性能跑在浏览器或边缘环境,并与 JavaScript 分工协作
2026-08-25 20:00:00
359
原创 理解 JWT:三段分别是什么
拆开 JSON Web Token 的三段结构:Header、Payload、Signature 各自做什么,以及 JWT 不能解决什么问题
2026-08-24 19:30:00
349
原创 浏览器里的图形②:ImageData——像素级处理入门
专栏「浏览器里的图形」第二篇:用 getImageData / putImageData 读写像素,理解 RGBA 排列,并完成一个最小灰度处理
2026-08-21 11:45:00
729
原创 本地跑开源模型前要问的 5 个问题
在本机或局域网部署开源大模型前,先问清许可证、显存、量化、推理框架与用途上下文,避免下完权重才发现跑不动或不能商用。
2026-08-20 21:09:09
1446
原创 fetch:超时、重试与 AbortController
说明用 fetch 时如何做超时取消、可重试错误判断与退避重试,核心是 AbortController 与清晰的失败分类。
2026-08-19 12:45:00
380
原创 重排与重绘:前端性能的两个词
用白话区分浏览器重排(layout/reflow)与重绘(paint):几何变化常触发重排,外观颜色变化可能只重绘,并给出少踩坑的写法直觉。
2026-08-19 08:23:40
319
原创 Git:merge 与 rebase 分别解决什么问题
说明 Git merge 与 rebase 各自解决什么问题:保留分叉历史,还是把提交变直;以及何时不该 rebase 公共分支
2026-08-18 12:30:00
523
原创 浏览器里的图形①:Canvas 最小路径——从画布到第一根线
专栏「浏览器里的图形」第一篇:用最小步骤在 Canvas 上画出第一根线,并弄清坐标系与路径 API 的基本节奏
2026-08-17 12:15:00
685
原创 当周快评:DeepSeek 涨价,你换了吗
梳理 DeepSeek 2026 年 8 月 API 涨价预告前后时间线,并给出开发者判断「换不换模型」的三个检查项:缓存、时段、任务可迁移性。
2026-08-15 08:30:00
818
原创 前端里 SVG 三种用法:img、内联、组件
对比前端使用 SVG 的三种常见方式:当作图片引用、内联进 DOM、封装成组件,并说明各自适合什么场景
2026-08-14 12:30:00
381
原创 img2threejs:一张图如何变成 Three.js 模型
明开源技能 img2threejs 如何把参考图重建成可 diff、可动画的程序化 Three.js 工厂函数,以及它与 mesh 导出路线的差别
2026-08-14 00:01:15
861
原创 HTTP 状态码:只记你真正用得到的那些
不背完整状态码表,只记住前后端日常会碰到的 2xx / 3xx / 4xx / 5xx 常用项,以及各自该谁处理
2026-08-11 20:00:00
406
原创 Cursor 入门:Tab、行内编辑与 Agent 怎么选
把 Cursor 里最常用的三种介入方式拆开:Tab 补全、行内编辑、Agent,并说明各自适合什么改动、什么时候不该用
2026-08-10 13:28:34
308
原创 Claude Opus 5 来了,开发者先看这三件事
Anthropic 在 2026 年 7 月 24 日发布了 Claude Opus 5。官方把它定位成更适合日常使用的旗舰档:编码与知识工作评测上更强,价格与上一代 Opus 4.8 同档。
2026-08-10 12:00:00
646
原创 理解 MoE:总参数很大,为何还能跑
用白话说明 Mixture of Experts:总参数可以很大,但每次推理只激活少数专家,所以算力与显存压力不等于「全员同时上场」
2026-08-09 11:21:21
301
原创 理解上下文窗口:token 到底在限制什么
用白话说明上下文窗口与 token:它们限制的是一次请求里模型能「同时看见」多少内容,以及输入、历史与输出如何抢同一块预算
2026-08-06 23:24:44
2486
原创 AI 帮我写完功能后,我把 Code Review 的第一问换了
AI 写页面、补测试、拆函数已经很顺手了。问题是,它最擅长交付“看起来完成”的代码,而线上事故往往躲在“需求其实没说清”的地方。我后来不再先问“这段代码有没有问题”,而是先问:**这个需求能不能写成三个能跑的验收样例?** 这一步看似慢一点,却能明显减少 AI 生成代码进入项目后的返工。
2026-08-03 23:25:09
313
原创 别再问 Cursor 和 Claude Code 谁更强了,真正拉开差距的是工作流
这篇文章探讨了如何有效利用AI编程工具(如Cursor、Claude Code、Copilot等)提升开发效率,核心观点如下: 工具选择取决于任务类型:不同AI工具适合不同场景,如编辑器型适合局部修改,终端Agent适合跨文件重构,GitHub型适合issue修复。 工作流比工具本身更重要:关键在于将开发任务拆解为AI可完成、开发者可验收的明确步骤,提供清晰的目标、范围、约束和验收标准。 测试和人工review不可替代:随着AI代码质量提升,测试成为验证有效性的关键,技术判断仍需开发者把关。 实用建议: 小
2026-07-30 08:17:15
411
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅