自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(40)
  • 收藏
  • 关注

原创 每晚23点到早9点,GLM-5.3-Flash免费用:普通人如何用好这波“夜间算力窗口“

智谱GLM Coding Plan推出夜间畅用活动:9月3日至20日每晚23:00-次日9:00,ZCode中调用GLM-5.3-Flash额度归零、其他Agent额度翻倍。本文不讲跑分,只做规则拆解和实操指南:三笔额度怎么分清、100万上下文的Flash适合什么任务、非程序员如何挂机跑批量文案与文档整理、新手避坑要点。

2026-09-07 10:55:17 580

原创 GLM-5.3-Flash深度解析:3200亿参数只卖Opus四十分之一,国产算力首次跑通前沿模型

智谱8月26日开源GLM-5.3-Flash:320B参数/18B激活,AA指数57分持平Claude Opus 4.8,价格仅为其1/40,全部流量由10万张国产芯片承载。本文从混合注意力架构、原生多模态视觉Coding、国产算力推理改造、Flash路线行业影响四维度深度解析。

2026-08-27 22:13:56 682

原创 AI视频别再死磕提示词了,3D白模预演才是正确姿势

AI视频生成中,文字提示词无法精确传递四维时空信息,导致运镜不准、场景失控、反复抽卡。3D白模预演(Previs)用几何锚点替代文字描述,updream预演台可在数分钟内从参考图生成3D白模,支持机位规划和走位录制,实测显著提升一镜到底、多机位切换和复杂运镜的可控性。

2026-08-20 09:07:08 281

原创 3D白模预演:AI视频从“抽卡“到“导演“的关键一步

AI视频生成的核心痛点不是提示词不够长,而是文字无法精确传递四维时空信息。3D白模预演(Previs)将空间约束从文字描述转为几何锚点,让创作者先搭场景、定机位、排走位,再交给视频模型渲染。本文基于updream预演台实测,解析白模预演的技术原理、四步工作流和三类高难度镜头对照,并探讨AI视频从"抽卡生成"走向"可控创作"的行业趋势。

2026-08-20 09:01:21 743

原创 Qwen3.8本地部署的真实门槛

Qwen3.8-27B开源12小时登顶HuggingFace,Apache 2.0可商用。但27B参数不是闹着玩的,本文用一张表说清不同显存能跑哪个量化版,避免白折腾。

2026-08-19 11:52:55 186

原创 Qwen3.8-27B开源实测:本地部署+Coze接入全流程,27B多模态模型16GB显卡可跑

阿里8月14日开源Qwen3.8-27B:27B稠密多模态模型,Apache 2.0协议,SWE-bench Pro 61.7超Claude Opus 4.6 Max,Q4KM量化约17GB,24GB显卡可跑。本文覆盖GGUF量化选型表、Ollama/llama.cpp部署实操、Coze自定义模型接入4步指南,附与GLM-5.3/Kimi K3/DeepSeek V4 Pro对比表格和7个FAQ。

2026-08-17 22:08:10 3859 7

原创 AI工具推荐:Agent Plugins 1.0.0统一标准实战与MCP适配指南

2026年8月,OpenAI等六家科技巨头联合发布AgentPlugins 1.0.0开放规范,统一AI智能体插件打包格式。该标准通过规范化的目录结构和清单文件,解决了跨客户端(如VSCode、Copilot等)插件适配的碎片化问题,实现"一次打包,多端运行"。规范将AgentSkills和MCP服务器配置打包为统一格式,同时MCP协议升级为完全无状态架构,显著降低部署门槛。GitHub Copilot率先实现全端支持,开发者可通过标准化流程快速适配。尽管生态快速扩展,但标准在权限管理、厂商锁定等层面仍存在

2026-08-17 21:58:22 534

原创 DeepSeek V4 Pro正式版实测:Agent能力暴涨近5倍,开发者该怎么用?

8月13日DeepSeek V4 Pro正式版上线,Agent能力暴涨近5倍,DeepSWE从12.8飙至62.7,逼近Claude Fable 5。百万Token仅3元/6元,支持OpenAI+Anthropic双协议。本文拆解核心参数、基准数据、定价策略与开发者接入建议。

2026-08-13 22:38:04 536

原创 英伟达Nemotron 3.5 Lightning开源模型实测解析与本地部署指南:AI工具推荐赛道的新选手

英伟达发布开源模型Nemotron 3.5 Lightning及路由库NeMo Switchyard。配套的Switchyard路由库可实现多模型智能调度,LangChain实测可降低74%API成本。模型提供Ollama/vLLM/llama.cpp等多种部署方案,在电气工程等领域可应用于设备巡检、文档处理等场景。

2026-08-12 23:23:24 1366

原创 Claude Code 5天后默认启用自动模式:实测表现与Anthropic“自掏腰包“的商业逻辑

Claude Code将于8月14日默认启用自动模式。本文实测分析Auto Mode表现,解读Anthropic承担额外Token费用的商业逻辑,以及对开发者工作流的影响。

2026-08-11 18:44:27 453

原创 OpenRouter全球调用量前五全是国产模型,出海逻辑拆解

OpenRouter周榜显示全球大模型调用量前五全为国产模型,中国总量28.13万亿Token远超美国4.38万亿。从稀疏激活架构和价格优势两个维度拆解国产模型出海逻辑,硅谷初创公司正悄悄换底座。

2026-08-10 14:38:40 276

原创 3秒音频攻破华尔街:AI语音克隆Vishing技术原理与防范

Point72、Citadel等对冲基金遭AI语音克隆攻击,3秒音频即可克隆声纹。用三步技术流程表格拆解Vishing原理(声纹提取→特征建模→语音合成),附5条普通人防范指南。

2026-08-10 14:33:10 228

原创 AI工具推荐:Agent Plugins 1.0.0统一标准实战解析与MCP适配指南

2026年8月6日六巨头联合发布Agent Plugins 1.0.0统一插件打包标准。本文解析其与MCP的三层架构关系、plugin.json清单格式、MCP 2026-07-28无状态协议变更要点,提供6步适配实战指南(含代码示例),附Agent Plugins vs MCP vs 传统API对比表格和7个FAQ。

2026-08-09 15:51:10 890

原创 DeepSeek预告大幅涨价:单日8万亿Token后的商业逻辑

8月6日DeepSeek预告整体大幅上调API定价。8月1日V4-Flash单日处理8万亿Token登顶全球调用量榜。本文拆解DeepSeek从"地板价"到涨价的商业逻辑:渗透定价→验证需求→回调价格,分析对开发者API调用成本的影响及"烧钱换规模"模式的可持续性。

2026-08-09 00:03:18 235

原创 GPT-5.6 Luna体验报告:从GPT-5.5切换后的实测对比

8月7日OpenAI将ChatGPT默认模型升级为GPT-5.6 Luna,免费用户开放无限文字对话并新增"Think"按钮。本文从开发者视角实测Think按钮效果,对比GPT-5.5在代码调试、电路计算等场景的差异,分析Luna的实际体验提升。Luna事实错误率较前代下降62%,API价格同步下调80%

2026-08-08 23:57:25 337

原创 AI工具推荐:Google Gemma 3 12B多模态开源模型实测与企业部署指南

Google Gemma 3 12B多模态开源模型实测与企业部署全指南。作为电气工程师,从PCB缺陷检测实战出发,深度解析Gemma 3架构创新(5:1局部/全局注意力、SigLIP视觉编码器),提供Ollama/Transformers/vLLM三套部署方案,含完整HowTo代码、量化版本选型建议、7个FAQ,附学术基准与真实场景实测数据。

2026-08-07 13:28:27 613

原创 苹果端侧AI部署实测:3.9GB轻量级模型Bonsai 27B的模型压缩技术与本地部署体验

PrismML发布的Bonsai 27B通过1-bit极限量化将27B大模型从54GB压缩至3.9GB,首次在iPhone上实现27B级推理。本文深度拆解其端到端低比特压缩原理,提供Mac/iPhone完整部署指南,对比M5 Max/Pro/iPhone 17 Pro Max实测性能,并给出端侧AI选型建议。

2026-08-06 10:07:09 451

原创 智谱GLM-4.5编程智能体深度实测:355B MoE架构如何重塑AI编程体验

智谱GLM-4.5编程智能体深度实测:355B MoE架构在12项国际基准评测全球第三、国产第一。本文从核心参数、编程基准对比(DeepSeek V4 Flash/Kimi K3/Claude)、智能体实测案例、API接入指南、主流AI编程工具横评等维度全面拆解,附FAQ解答与选型建议。

2026-08-06 08:48:43 530

原创 阿里Qwen3.8-Max技术深度解析:2.4T MoE架构与自主编程实战

阿里Qwen3.8-Max旗舰大模型技术深度解析:2.4万亿参数MoE架构,95B激活,原生多模态。16天自主编程破纪录,PaperBench 93.0全球新高,API国内12元/百万输入tokens。涵盖架构拆解、13项基准测试、API接入指南与竞品选型对比,为开发者AI工具推荐提供参考。

2026-08-04 13:53:24 849

原创 【开源速览】LMFlow:3090单卡5小时训练专属大模型,私有化部署门槛再降

LMFlow 的核心创新是 LISA 算法——通过分层重要性采样动态激活部分 Transformer 层进行训练,其余层冻结。

2026-08-03 21:16:03 409

原创 【实测对比】三大Agent框架Token消耗分析:Claude Code成本最高差30倍

研究表明,AI编程Agent框架(Harness)的选择对Token消耗和成本影响显著,甚至比模型本身更大。Composio实验显示,相同模型在不同框架下运行相同任务,Token消耗差距可达30倍,而任务成功率差异不大。

2026-08-01 23:37:30 1063

原创 OpenAI Codex开放第三方模型:开发者如何用Claude/Gemini驱动Codex

OpenAI发布gpt-oss-120b/20b开放权重模型,Codex正式支持接入第三方模型。本文详解--oss模式与model_providers配置方法、Responses API协议转换方案、Claude/Gemini接入实操步骤,并对比Cursor/Claude Code/Cline/OmniRoute,给出开发者迁移建议。

2026-07-30 21:00:23 478

原创 OmniRoute爆火3万Star:一个本地网关统一管理Codex/Claude Code/Cursor

OmniRoute是可本地部署的AI编程网关,统一管理Codex/Claude Code/Cursor等工具的模型调用,支持Combo链式降级和19种路由策略。3.25万Star,近一个月新增2万。本文速览核心能力、安装方法和三个易踩坑点。

2026-07-29 20:19:23 244

原创 MCP协议今日大改:无状态化核心变化速览

MCP协议2026-07-28版正式发布,取消session机制转向无状态化,新增MCP Apps和Tasks扩展,OAuth 2.1标准对齐。本文速览5个核心变化及开发者迁移建议。

2026-07-28 21:06:11 461

原创 电气工程师用AI处理工作的6个真实案例拆解

AI正重塑电气工程师工作模式,本文通过6个典型案例进行展示,核心价值在于将重复劳动压缩释放工程师专业判断力。

2026-07-28 00:10:35 535

原创 用工程师思维拆解“AI写作去AI化“——接单通过率从35%到72%

AI写作接单通过率从35%提升到72%的关键在于四个工程化模块:角色精准定义、禁用词清单、读者画像和格式参数化。

2026-07-27 11:18:33 284

原创 腾讯上线Agently Mail——AI Agent终于有了自己的“工位“

腾讯QQ邮箱推出AgentlyMail,AIAgent安全治理市场窗口已开启,率先实现可落地安全方案者将占据先机。

2026-07-27 11:15:16 160

原创 北京智能体新政技术深度拆解:驾驭层工程、AIP协议与Token经济的技术内核

2026年7月北京发布全国首个省级智能体专项政策,本文从技术架构视角深度拆解驾驭层工程六元组体系、AIP互联协议与MCP/A2A的分层互补关系、灵玑OS开源基础设施的技术定位、Token经济五项关键技术、技能市场对开发者工具链的影响,以及"以模治模"安全治理的技术实现路径。

2026-07-26 14:27:05 789

原创 从政策到实践:AI Agent工具链如何支撑一人公司运营

北京发布全国首个省级智能体专项政策,支持OPC一人公司创业新模式。本文跳过政策条文,直接从实操角度拆解:如何选Agent开发平台、用工具链替代团队角色、搭MCP工具集成、建安全基线,以及Token经济怎么算账和4个常见避坑指南。

2026-07-24 15:10:47 322

原创 【无标题】WAIC 2026复盘:AI Agent进入企业,真正的壁垒在哪里?

WAIC 2026复盘:AI竞争焦点从模型能力转向系统能力。智能体进入企业的真正壁垒是上下文工程——模型了解世界却不了解组织。本文拆解上下文工程、交付能力和安全治理三个关键条件,附百度/腾讯/阿里等企业落地案例和标准化进展。

2026-07-23 09:20:09 270

原创 AI Agent工作流怎么搭建?2026年Coze+n8n实操指南(含MCP工具调用)

AI Agent工作流搭建核心路径:Coze当大脑(对话推理决策),n8n当手脚(跨平台自动化),MCP做神经系统(工具标准化通信)。电气工程师从零实测,零基础3-5天跑通首个完整闭环。本文拆解每步操作、常见报错和FAQ。

2026-07-20 16:24:45 1136

原创 华为Atlas 950真机亮相:国产超节点规模是英伟达方案的56.8倍

WAIC 2026现场,华为展出全球最大规模超节点Atlas 950,单机柜集成64张昇腾计算卡,最高扩展至8192张芯片。国产算力竞争从单卡较量升级到集群较量。

2026-07-19 00:13:41 374

原创 镇馆之宝:阶跃星辰Step AOS,AI手机操作系统的分水岭

阶跃星辰STEPX Neo获WAIC镇馆之宝,搭载全球首个智能体原生操作系统Step AOS,通过L3级国家标准检测。AI手机正从"AI+OS"转向"Agentic OS"。

2026-07-18 23:14:59 394

原创 一个人就是一家公司:WAIC上22个“一人公司“已经赚到了钱

聚焦细分领域、利用AI自动化非核心环节、零融资启动验证盈利模式。专业领域+AI工具可快速实现商业化。

2026-07-18 23:10:37 536

原创 【WAIC前瞻】AI从会聊天到能干活:2026实干元年的3个信号

2026年被称为"AI实干元年"。本文从WAIC 2026前瞻视角,分析AI从"能对话"到"能办事"的三个关键信号:智能体操作系统Agent OS发布、OPC一人公司专区设立、AI终端设备规模化。附产业数据与行动建议。

2026-07-17 10:15:49 614

原创 AI Agent电商闭环:腾讯元宝×京东打通后,开发者的3个机会

京东AI Agent接入腾讯元宝。对话式电商进入交易入口时代。行业竞争焦点转向Agent生态密度与场景深耕能力。当前正是开发者抢占生态位的关键窗口期。

2026-07-16 19:38:46 228

原创 【WAIC前瞻】后天开幕的WAIC 2026,开发者该盯这5个技术点

WAIC 2026后天开幕,开发者视角盘点5个最值得关注的技术点:Agent OS、Atlas 950超节点、3D近存计算芯片、WAIC Academic学术大会、AI Coding论坛。

2026-07-15 09:54:07 199

原创 2026年AI工具链搭建实践:5款工具的技术选型与工作流整合经验

电气工程师实测5款AI工具,搭建一个人替代5个岗位

2026-07-13 20:26:10 438

原创 196B大模型塞进口袋:阶跃星辰AI智能体手机技术拆解

【摘要】阶跃星辰即将发布全球首款智能体手机,通过1960亿参数的Step3.7Flash大模型实现跨App自动操作,将AI从"问答工具"升级为"执行代理"。其核心技术包括MoE稀疏架构(仅激活5.6%参数)、端侧四模型协同(理解/语音/界面/生成)及开放的GUI-MCP协议。这场发布标志着移动互联网从App时代向Agent时代的跃迁,但面临用户习惯培养、超级App接口开放和供应链支持三大挑战。短期内建议观望实际闭环效果,关注WAIC2026行业动态及主流应用生态适配情

2026-07-13 19:36:21 486

原创 【实测】2026年AI填志愿工具横评:千问/百度/豆包/元宝,到底哪个靠谱?

用同一个640分江苏历史类考生案例,实测千问、百度、豆包、元宝四家AI填志愿工具。四家给出四套完全不同的答案——千问保守型、百度均衡型、元宝激进型、豆包发散型。本文拆解策略差异、三大盲区和正确使用方式,帮你少走弯路。

2026-07-12 13:35:01 331

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除