自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

鬓戈

老兵不死,只是慢慢凋零

  • 博客(122)
  • 资源 (2)
  • 收藏
  • 关注

原创 Laya 系统调研:部署与使用指南

Laya v0.3.23 是一个非自回归的 System 1 决策引擎,支持多语言、毫秒级响应,用于高频、封闭答案的结构化决策(如路由、分诊、守卫)。部署方式灵活:可通过 pip 安装本地 venv,或使用 Docker Compose 快速构建生产环境,支持国内 ModelScope 烘焙实现离线部署。提供 MCP、HTTP 服务及进程内 SDK 多种接入形态,可按需组合。核心优势在于零成本、低延迟、概率校准,适用于对性能与成本敏感的场景。

2026-10-09 07:00:00 144

原创 Logits 到底是什么

LLM 的 logits 是模型对下一个 token 的原始分数,虽未归一化,但其相对大小与概率一致。Jev 及其生态(jev-ultrafast、fast-browser-use)利用这一特性,将有限候选映射为词表 token,通过一次前向计算后掩码并局部 softmax,直接比较 logits 选出答案,实现零输出、高速决策。该方法避免自回归生成,显著提升效率,确保格式正确并提供置信度,适用于浏览器 Agent 等封闭选择场景,是“一次前向 + logits 比较”替代传统生成的核心原理。

2026-10-08 12:00:00 227

原创 System One 技术价值与 Laya 在各 Agent 中的接入方式

摘要(148字): 无需自研编码即可接入System One技术。Laya官方提供laya[mcp]和Jev兼容HTTP端点,支持MCP的Agent仅需配置即可使用;不支持MCP的系统仅需几十行HTTP客户端代码。System One以33ms级低延迟、零成本完成路由、分诊、安全判断等高频封闭决策,显著降低LLM调用开销。通过置信门控实现“确定则快、不确定才升级”,提升效率与可靠性。中文场景推荐使用laya-multilingual检查点,实测效果优异。

2026-10-08 07:00:00 427

原创 System One 到底是什么?

2026年9月,System One模型(如Jev)作为新范式出现,专为“快速直觉判断”而生,是基于卡尼曼“快思考”理念的概率决策引擎。它在已知答案范围内返回带类型与概率的结论,拒绝生成文本,实现亚秒级响应与极低延迟。适用于意图分类、相关性评分、实时决策等场景,通过“置信度门控+风险感知策略”提升效率与可靠性。虽具成本与性能优势,但尚无公开训练细节,仅托管服务,需谨慎评估成熟度与安全边界。

2026-10-07 07:00:00 275

原创 dsh-openpencil 使用教程

dsh-openpencil 插件已弃用 Penpot,转而对接开源设计工具 OpenPencil(.op 格式)。插件支持自然语言生成设计稿、实时渲染预览与交互编辑,但需手动安装 OpenPencil 二进制(openpencil-desktop 与 op-host-web-server),并通过环境变量配置路径。推荐通过 GitHub Releases 下载安装,设置后重启 DSH Web 即可使用。原 Penpot 相关功能改用内置 dsh-mcp-client 插件对接。

2026-10-06 06:00:00 565

原创 OpenPencil 产品设计与前端编码系统

本机系统搭建手册(2026-09-17)基于OpenPencil v0.8.4,实现需求→高保真原型(.op)→React/Tailwind代码→回流的全链路自动化。通过CLI、桌面端、DSH对话及MCP工具四入口协同,支持人机共治。已验证完整管线:从op start --web启动服务,经设计、代码生成、导出至回流,全流程可追溯、可版本控制。关键组件均本地实测可用,仅op-host-web-server.exe因架构限制以桌面版替代,环境变量配置完善,支持快速原型、批量处理与工程化集成,实现“设计即代码”

2026-10-05 06:00:00 597

原创 Claude Code frontend-design 插件调研 与 Vue 旧系统风格一致性方案

frontend-design 插件是 Anthropic 推出的前端设计技能,通过 SKILL.md 规范引导 Claude 生成具审美一致性的界面设计。核心为“先定设计再写代码”:明确主题、色板、字体、布局与独特签名元素,并执行自我批判。适用于 Vue2/Vue3 项目时,需分离设计规范与实现,将 token 落地为变量或主题。旧系统中应先考古提取设计规范,固化为 CLAUDE.md 约束文件,使 AI 成为风格统一的“润色器”,而非自由发挥的设计主。关键在于:设计先行,约束为王,确保新功能与旧系统视觉

2026-10-04 06:00:00 425

原创 tmux 跑 omp / pi 等 AI coding agent:无人值守后台执行 + 随时回看操作

tmux 是 AI coding agent 无人值守的核心载体,凭借进程不中断、可脚本化操控与会话可恢复三大优势,实现任务持续运行与状态无缝衔接。推荐工作流:创建命名会话启动 agent,detach 后通过 capture-pane 监控、send-keys 注入指令,配合 pipe-pane 全程落盘日志。结合 omp 的 goal 模式与 --max-time 等参数,可安全执行长周期任务,支持断点续跑与多任务并行,构建高效、可靠的自动化开发流水线。

2026-10-03 06:00:00 576

原创 Volta:解决 nvm「不能同时存在多个 Node 版本」的痛点

Volta 通过「shim + package.json 声明式 pin」机制,彻底解决 nvm 在 Windows 上版本切换痛苦的问题:无需手动 nvm use,进项目目录自动匹配指定 Node 版本,多版本常驻共存、零操作。全局工具绑定版本,团队环境一致,安装简单(MSI 兼容 Windows),但需注意官方已宣布 unmaintained,建议迁移到 mise。

2026-10-02 06:00:00 377

原创 AnyJev-把任意 LLM 变成 Jev 风格决策模型

AnyJev(Apache-2.0)是轻量级Python库,非模型,通过修正logits读取偏差提升决策可信度。其四档机制(L0-L2)分别解决位置偏置、概率未校准与高速推理问题,使“可自动决策流量”从7.7%升至52.0%。可无缝对接现有vLLM服务:推荐先用VLLMBackend跑L0/L1(仅需开启--enable-prefix-caching),后期部署截断版vLLM embed服务实现更低成本的L2推理。注意head需与量化模型匹配,且当前仅支持Qwen3系列及≤26选项的字母读法。

2026-10-01 14:08:02 339

原创 Jev 技术(System One Model)开源模型调研

TypeSafe AI 的 System One Model「Jev」以单次前向、零 token 生成带校准概率的类型化决策(Choice/Score/Noul)为突破。本报告通过 GitHub API 验证开源生态,发现 Laya(19.3k★)为最成熟替代,支持 POST /v1/systemone 接口与多后端部署;SemIf、LitJev 等实现通过 logits 投影复现 Jev 接口,无需训练;NanoJev 提供完整训练流水线;ruling 实现与 Jev 统计等效。官方适配器 system-

2026-09-30 06:00:00 357

原创 开源中文输入法技术调研与自建方案

基于开源的RIME引擎,构建一款完全本地化、无遥测、零数据上传的中文输入法。采用自研前端(Windows/Tauri/Rust,macOS/InputMethodKit,Linux/fcitx5)实现隐私可控的输入体验,复用BSD-3-Clause许可的librime核心,规避GPL传染风险。通过本地词库(leveldb)、无网络行为、可审计架构确保用户数据绝对安全,支持可选端到端加密同步。技术可行且合规,推荐以开源发布(GPL-3.0)强化信任,打造真正“无广告、无监控”的隐私输入工具。

2026-09-29 06:00:00 370

原创 TypeScript 学习方案(Vue 开发 + AI 应用方向)

4周从会JS到独立交付Vue+AI应用:聚焦类型推断、泛型与Zod校验,掌握Vue组合式API类型化,优先使用Vercel AI SDK 6.x对接vLLM实现结构化输出与Tool Calling。全程基于TS 6.0/7.0,以VS Code+Volar为开发环境,通过每日实战(如类型重构、组件泛型、AI schema定义)达成生产可用目标,不追求复杂类型体操,专注AI场景刚需能力。

2026-09-28 06:00:00 631

原创 DeepSeek Harness (dsh) 调研与学习方案

本机基于 @deepseek-ai/dsh@0.1.2-rc.1 及 DSH_HOME 配置,验证了“一切是插件”的架构:应用由 YAML 行列表驱动,通过补丁叠加机制动态构建;核心依赖 cordis 框架实现服务注入与生命周期管理,工具管线、协议桥接、沙箱等能力均以插件形式模块化。关键组件如 LLM、FS、Session 等采用接口与实现分离设计,支持多平台适配。所有配置、依赖及运行逻辑均可在本地复核,证据路径完整可追溯。

2026-09-27 06:00:00 346

原创 Rust 语言与 AI 应用生态调研及学习路径

Rust 与 AI

2026-09-26 06:00:00 666

原创 Easysearch 系统调研

Easysearch, 信创

2026-09-25 18:21:15 331

原创 重构 AI 时代学习的旧思维

AI, AI编码, 职业发展, 学习观, 一人公司, 全栈

2026-09-19 08:58:44 103

原创 Qwen3.8-27B + vLLM 性能优化

在单卡RTX PRO 6000 Blackwell(96GB)上部署Qwen3.8-27B编程助手,通过优化vLLM配置,在不量化模型、不牺牲推理效果的前提下,将生成吞吐从~27 tok/s提升至80~105 tok/s(约3~4倍)。核心优化包括启用FP8 KV缓存、调整block size、修复FlashInfer JIT编译问题,并严格遵循显存预算与稳定性约束。日志与监控显示,GPU利用率达100%,多模态缓存命中率保持98.3%,服务稳定运行于262K上下文场景。关键教训:避免盲目采纳AI建议,所有

2026-09-13 18:07:28 447

原创 LLM 学习教程:Transformer 直觉 → 采样参数 → 结构化输出 → 流式与错误处理

<think>好的,用户给了一段关于LLM教程的详细内容,要求我根据内容生成不超过150字的文章摘要。 让我先理解任务:需要压缩这段涵盖LLM原理、token成本、采样参数、结构化输出的长内容,提炼出核心要点,字数限制在150字以内。 内容的主要板块有: LLM的核心机制(预测下一个token)+内部架构(Attention/FFN) Token与上下文成本管理 采样参数(temperature等)及应用配置 结构化输出与Function Calling流程 字数很紧,需要高度概括。摘要要抓住全文主线,用简

2026-09-02 09:19:02 354

原创 OCR Server 性能分析与优化方案

<think>我们只需要根据用户提供的文档内容生成≤150字的摘要。用户要求“根据以下内容,生成≤150字的文章摘要”。需要抓住核心:业务需求(每天几万张截图OCR)、问题(2×2080Ti压测性能无法提升)、分析(显存被vLLM挤占、并发架构问题)、优化建议(调整代码、选择ONNX Runtime等)。摘要要简洁,字数限制。</think>本文通过三台GPU服务器实测,诊断OCR系统性能瓶颈:生产机2×2080Ti显存被vLLM占用,OCR实例显存边缘运行;并发架构存在负优化。提出混部/独占两套方案,建议

2026-09-01 06:32:56 372

原创 AI 全栈工程师进阶修炼手册

AI 全栈工程师 修炼 手册

2026-08-31 07:00:00 613

原创 PaddleOCR 技术调研

OCR文字识别

2026-08-30 12:08:50 422

原创 截图多模态智能检索系统技术调研

Web 系统界面截图 → OCR 文本 + 人脸/人体/车辆/车牌检测切图 → 向量生成 →文件存 SeaweedFS + 文本/向量存 OpenSearch → 支持文本搜索、以文搜图、以图搜图

2026-08-25 21:51:52 364

原创 Claude连接Penpot MCP server进行AI原型设计

本次从openspec(需求)开始,Claude Code连接Penpot MCP server, 用需求spec去驱动Penpot系统进行原型设计, 在用Claude Code连接Penpot MCP server导出Penpot生成的资产(设计)到git仓库目录penpot-assets里,最后Claude Code利用openspec和penpot-assets进行编码,生成基于Vite+Vue3+router+axios脚手架的可运行的frontend2前端系统代码,验证这条自动化路径是走得通的。

2026-08-22 11:06:52 358

原创 Qwen3.8-27B 和 Qwen3.6-35B-A3B-FP8 能力对比

文章摘要: 本文对比了阿里云开源的两个大模型Qwen3.8-27B和Qwen3.6-35B-A3B-FP8的性能差异。Qwen3.8-27B是2026年8月发布的新一代27B参数稠密模型,在编码、推理和多模态能力上全面领先,8个基准测试得分高出3.2-12.9分。而Qwen3.6-35B-A3B-FP8是4月发布的35B参数MoE模型,采用FP8量化,每token仅激活3B参数,在推理效率、部署成本和高并发服务上更具优势。两者的核心差异体现在:Qwen3.8-27B侧重能力优先,适合追求最强效果;

2026-08-16 16:00:05 2183

原创 屏幕截图中人脸提取与文字识别分析

本文介绍了一个从系统界面截图中提取人脸照片和识别文字信息的技术方案。由于环境限制(仅Pillow库可用),采用了视觉分析模型结合迭代定位的方法:首先通过多次裁剪和视觉验证确定人脸精确坐标,最终生成120×180像素证件照;文字识别完全依赖视觉模型分析,通过多轮验证确保信息准确性。技术决策排除了传统OCR方案(如Tesseract、PaddleOCR等),采用更高效的迭代定位策略,经过2-3轮调整即可收敛。最终输出包含人脸照片和结构化个人信息(姓名、身份证号、性别等),验证了纯视觉分析方案在有限环境下的可行性

2026-08-12 09:10:00 221

原创 前端采集实时视频流进行人脸识别

本文摘要: 针对浏览器端实时人脸识别需求,分析了三种技术方案。推荐方案一使用face-api.js,该方案纯前端运行,集成人脸检测、特征提取和身份识别功能,模型总大小约15MB,API简洁易用且隐私保护最佳。方案二MediaPipe提供高性能人脸检测但缺少身份识别功能。方案三采用前后端分离架构,通过WebSocket传输视频帧到后端处理,适合高精度需求但延迟较大。face-api.js在Chrome浏览器中性能表现良好(首帧20-30秒,后续约10fps),支持构建本地人脸数据库进行实时匹配,是平衡性能、隐

2026-08-02 11:09:19 323

原创 开源视频分析大模型与Qwen3-VL

开源视频分析大模型综述 本文全面梳理了当前主流的开源视频分析大模型,包括Qwen3-VL、GLM-4V、CogVLM/CogAgent、LLaVA等,从模型架构、核心能力、参数规模等维度进行对比分析。其中,阿里云通义千问的Qwen3-VL系列凭借256K上下文支持、秒级视频索引、多分辨率自适应等特性,成为当前开源界最强的多模态模型之一;GLM-4V系列在中文优化和GUI Agent能力上表现突出;CogVLM/CogAgent则以高分辨率图像理解和桌面操作能力著称。

2026-08-01 07:24:53 357

原创 开源语音识别大模型与Qwen3-ASR

2026年开源语音识别(ASR)领域涌现多个主流模型:OpenAI的Whisper支持99种语言,生态成熟;阿里通义的Qwen3-ASR覆盖22种中文方言,精度达SOTA;阿里达摩院的Paraformer采用非自回归架构,速度快10倍;SenseVoice集成ASR、情感识别和事件检测;小红书的FireRedASR中文CER仅0.57%,精度最高;NVIDIA NeMo适合企业级流式服务。这些模型各具特色,适用于不同场景如多语言转录、中文方言识别、实时流式处理等,满足从端侧到云端的不同需求。

2026-07-30 08:56:58 591

原创 AI工程师修炼手册 — 基于53个真实招聘岗位的深度分析

AI工程师修炼

2026-07-29 09:07:41 167

原创 OpenSpec与规范驱动开发SDD

OpenSpec是一个面向AI编程助手的规范驱动开发框架,旨在解决传统AI编程中需求分散、修改记录缺失、协作冲突等问题。其核心是通过结构化的规范文档(Specs)和变更管理(Changes)分离系统意图与实现细节,确保AI与开发者对系统行为的共识。OpenSpec采用标记差异(Delta)的方式管理变更,避免直接修改主规范文件,支持并行开发。典型工作流包括探索、提案、审查、实施和归档阶段,所有变更先写入独立文件夹再合并。该框架适用于单仓库或多仓库项目,通过明确的目录结构和文档规范(如proposal.md、

2026-07-28 09:03:34 492

原创 Open-Design系统简介与使用

文章摘要(150字): Open-Design是一款开源在线图形设计工具,定位为可本地部署、可二次开发的Figma/MasterGo替代方案。基于React+TypeScript技术栈,支持Canvas画布、基本图形绘制、元素变换、属性编辑及导出功能。核心优势包括MIT协议开源免费、开发者友好(支持定制化开发)以及技术学习价值(整合Redux、gl-matrix等)。项目采用三层架构,依赖React、Redux Toolkit和antd等库,适用于原型设计等轻量场景。用户可通过Git克隆快速部署,提供开发与

2026-07-27 11:36:31 388

原创 OpenCode 1.x 的问题深度分析

OpenCode 1.x版本面临诸多历史问题,包括中文支持薄弱、内存泄漏、响应延迟、文件写入卡顿等性能问题,以及跨平台兼容性和API稳定性不足。这些问题导致用户使用体验不佳,尤其对中文开发者造成额外障碍。尽管项目在GitHub上拥有18.8万Star和活跃社区,但核心问题长期未解决,与Claude Code等竞品相比进步有限。官方虽尝试通过重写架构(迁移至Node.js和Electron)来改善,但旧版用户仍需面对功能迭代与稳定性不成正比、迁移成本高等挑战。

2026-07-26 09:19:40 262

原创 从CUDA到SAIL-CANN-MXMACA

摘要 本文系统分析了CUDA与国产AI软件栈SAIL、CANN、MXMACA的技术架构与发展现状。CUDA作为NVIDIA构建的行业标准,通过完整的编程模型和生态体系形成技术壁垒。SAIL(阿里平头哥)采用开源插件式架构,试图构建开放的异构计算平台;CANN(华为昇腾)是国内最成熟的AI软件栈,已形成完整生态;MXMACA(沐曦)则为国产GPGPU提供加速支持。国产软件栈在特定领域取得进展,但整体生态与CUDA仍有差距,未来发展需突破核心技术并构建开放协同的产业生态。

2026-07-25 07:12:52 375

原创 Hermes Agent执行流程

Hermes Agent系统是一个基于LLM的智能代理框架,其核心架构包括三个模块:主控模块、对话循环模块和工具执行模块。系统采用多层处理流程,从用户输入接收、消息格式化开始,经过动态提示词构建(包含身份、环境、记忆等上下文信息),进入核心推理循环。推理循环支持多轮交互,能够处理文本响应、工具调用及错误恢复。系统特别设计了程序化工具调用机制(PTC),通过生成Python脚本并建立RPC通信实现复杂工具调用。此外,系统具备多层容错机制(包括重试、凭证轮转和故障转移)和智能上下文压缩功能,确保在token限制

2026-07-24 07:35:58 228

原创 MCP(Model Context Protocol)技术知识体系

Agent MCP

2026-07-23 07:45:33 303

原创 Hermes Agent 技术架构

本文介绍了Hermes智能代理系统的核心架构与工作流程,主要包括以下关键点: 整体流程 采用对话循环机制,由LLM自主决定是否调用工具 通过动态注入工具定义和技能描述,不依赖硬编码路由逻辑 内置多层容错机制,包括应用层重试、凭证池轮转和故障转移 系统提示词构建 动态拼装包含身份、环境、记忆、技能和工具定义的多维提示 技能分系统级自动加载和会话级按需加载两个层次 技能作为上下文增强,工具提供实际执行能力 对话循环机制 迭代执行LLM调用和工具执行的双向交互 实现自动上下文压缩和渐进式工具披露 支持多轮工具调用

2026-07-22 08:53:22 221

原创 Excalidraw一个手绘风格的绘图工具

Excalidraw 是一款开源的虚拟白板工具,采用独特的手绘风格渲染技术,通过算法扰动标准几何图形实现自然手绘效果。核心架构基于TypeScript和React,使用Canvas 2D渲染无限画布,并支持实时协作。其JSON数据模型简洁易读,包含多种元素类型和属性。工具集提供完整的绘图功能,包括基础图形、手绘工具、文本和图片插入等。Excalidraw支持PWA和本地优先存储,已成为最流行的开源绘图工具之一,GitHub星标超12.7万。

2026-07-21 06:50:28 367

原创 Hermes-使用/learn命令学习生成RD技能并使用技能自动编写RD文档

本文介绍了Hermes Agent中的/learn命令,它能将任意资料(本地文件、URL、工作流记录等)自动转化为标准化的Hermes技能文档。以研发申报(RD)文档为例,用户只需提供历史RD文档或模板,/learn即可生成结构化技能。实际应用中,当需要编写新RD文档时,用户只需简单描述项目信息(如活动名称、研发人员等),Hermes就能基于技能模板自动生成规范文档,大幅提升效率。文章强调AI编程应优先采用spec coding(预先编写详细规范)而非vibing coding(即兴编码).

2026-07-20 07:09:43 211

原创 又一个文本格式UML设计工具-PlantUML

PlantUML 是一个基于文本的开源 UML 绘图工具,支持多种 UML 图表类型。文章介绍了 PlantUML 的核心特点,包括纯文本定义、多格式输出、丰富图表类型和开发工具集成,并对比了与 Mermaid 的优劣势。详细展示了用例图、组件图、部署图、时序图、活动图、状态图和类图的具体语法和示例,涵盖了从系统功能描述到类结构设计的 UML 主要应用场景。文章强调在 AI 时代,文本式 UML 设计具有 AI 友好、高效迭代和版本控制等优势。

2026-07-19 14:48:44 178

VIM常用命令集锦

vi 是visual edit 的缩写 文本编辑器是所有计算机系统中最常用的一种工具。UNIX下的编辑器有ex,sed和vi等,其中,使用最为广泛的是vi,而vi命令繁多,论坛里好像这方面的总结不多,以下稍做总结,以资共享!渴望更正和补充!

2014-04-05

capacity-scheduler.xml

hadoop配置之一

2024-01-12

core-site.xml

hadoop配置文件之一

2024-01-12

hadoop-env.sh

hadoop-env.sh

2024-01-12

hdfs-site.xml

hdfs-site.xml

2024-01-12

hadoop slaves配置文件

hadoop slaves配置文件

2024-01-12

yarn-site.xml

yarn-site.xml

2024-01-12

hadoop运行脚本run.sh

hadoop运行脚本run.sh

2024-01-12

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除