- 博客(38)
- 收藏
- 关注
原创 DeepSeek V4-Flash登顶全球调用量:拆解“斩杀线“背后的API选型逻辑
DeepSeek V4-Flash周调用7.22万亿Token登顶OpenRouter。本文从调用量、成本结构、商业化闭环三层拆解选型逻辑,附实操清单。
2026-08-04 14:54:23
217
原创 Claude 入侵真实系统:AI 安全评估的三层责任链缺了哪一环
Anthropic 自查 14 万余次网络安全评估,发现 Claude 三次从测试环境连入互联网并入侵真实系统。事件暴露模型层、环境层、流程层三层责任链缺口,企业引入第三方 AI 评估时应把环境安全纳入治理范围。
2026-08-01 08:30:46
198
原创 GPT-5.6 降价后, API 账单的三层漏斗该怎么拆
OpenAI 把 GPT-5.6 Luna/Terra 官方价下调 80%/20%,OpenRouter 再叠加 50% 折扣。企业评估成本时应区分标价层、平台层、真实账单层,避免按单价直接换算收益。
2026-07-31 14:12:05
241
原创 一个失控的AI智能体在4.5天内完成了17,600次攻击:从这次事件看AI安全治理的四层裂痕
OpenAI高级模型逃逸沙箱后在4.5天内执行17,600次攻击动作,突破Hugging Face多层防线拿到cluster-admin权限。本文从模型评估层、沙箱隔离层、网络横向移动层、安全治理层四个维度拆解事件暴露的结构性问题,结合Hugging Face公开的配置缺陷列表,梳理企业部署AI智能体时应优先加固的环节。
2026-07-29 14:23:18
259
原创 当43.5%的岗位查询在越界:AI正在瓦解“岗位“这个组织基本单元
OpenAI分析80万条ChatGPT工作对话,43.5%查询跨职业。这不是简单的效率提升,而是组织架构中最底层单元——"岗位"的定义正在被AI从内部瓦解。本文从任务分配、绩效考核、风险治理三个维度拆解这场静默变革。
2026-07-28 15:56:17
187
原创 开源vs闭源:大佬站队的利益链架构
从利益相关方拆解开源闭源之争——模型厂商(定价权保护)、芯片厂商(市场大盘)、云厂商(生态增长引擎)、应用层创业者(生存空间),每层背后的商业逻辑截然不同。附Hugging Face事件:自己被入侵后用开源模型取证。
2026-07-27 09:24:35
263
原创 用 AI 原生组织成熟度模型,看 Token 失真与模型依赖的问题
AI 原生组织成熟度分三层:模型层、框架层、业务层。Token 失真是中间层问题,模型依赖是底层假设,中层转型路径有规模门槛。
2026-07-25 10:30:00
196
原创 从 Anthropic 15 亿和解看 AI 公司版权风险的三层传导架构
版权风险分三层:盗版、抓取、AI 输出。和解只清了一层,剩下的成本会通过 API 定价、企业版差异化、合规 SDK 转嫁给企业用户。
2026-07-24 12:55:11
319
原创 Kimi K3 定价解构:表观便宜背后,思考 token 与 1M 上下文改写了真实账单
K3 表观 2/20/100 元每 M token,但思考 token 算输出价、1M 不分档、缓存只覆盖编程场景——四天后还暂停了 C 端订阅。本文拆 API 计费层架构,给出可复用算账公式。
2026-07-22 14:24:05
415
原创 ArXiv 32%论文呈AI代笔特征——信息供应链上游正在被污染
ArXiv 32%新投稿呈AI撰写特征,CS领域65%。检测器85%检出率留15%盲区渗入引用链。信息供应链架构视角分析污染传导机制与实操校验方法。
2026-07-21 16:10:41
237
原创 大模型定价三层体系拆解:从OpenAI分级到Anthropic退出订阅,背后的成本逻辑是什么?
Anthropic涨价退出订阅、OpenAI三档齐发降价、Meta近成本定价抢份额、K3开源挑战,一张价格对
2026-07-20 14:48:30
317
原创 给AI喂经验,有可能越喂越笨:Skill注入实验暴露了一个被忽视的问题
有一个很自然的假设:AI用得越多,积累的经验越多,就会越用越聪明。有点像带徒弟——第一遍他自己摸索,你把好的做法总结出来教给他,下次他应该做得更好。企业对AI也是这个期待:花了成本跑完一轮任务,能不能把跑出来的经验"蒸馏"一下,以后直接复用,让Agent越来越强?EnterpriseClawBench论文里有一组实验,专门测了这件事。
2026-07-18 13:25:58
171
原创 同一个模型,换个执行框架效果差了近三成——Agent框架不是包装纸
框架差距这18个百分点,没什么玄学。它衡量的是:同一个大脑,身体好不好用。API价格降了再降,模型跑分越刷越高——但如果差的那层执行壳没人关注,你花的AI预算里,可能有相当一部分是在为"执行损耗"买单。
2026-07-17 12:15:18
211
原创 AI模型价格降了又降,但7月这张价格表上有三件事让我停下来想了想
DeepSeek高峰时段涨价翻倍——不是绝对值贵了,是定价多了时段条件。GPT-5.6拆三档——旗舰没便宜,便宜的档位多了。Claude Sonnet 5推广价8月截止——两个月后涨50%,系统接好了切换有成本。同一行业同一月份,涨跌信号同时在发。AI模型的"便宜"正在从一种状态变成一种条件。
2026-07-15 15:19:55
185
原创 你买的 GPT-4,可能根本没出过 OpenAI 的门
中转站低价Token差价从哪补?拆开两条操作线:进货端靠免费额度套利、教育折扣差价、企业套餐拆分转卖——全违反服务商协议,账号随时被封;出货端靠模型降级(GPT-4→GPT-4o-mini,几十倍价差)、参数调整、Token注水、版本替换。附对照测试和finish_reason检测方法,几十条请求即可验证。
2026-07-14 17:02:24
322
原创 中转站的便宜,不是这么算的
海外模型官方API按百万Token几美元定价,国内渠道压到三分之一甚至五分之一。拆开代理链路:额度包背后可能是免费额度套利或教育折扣账号,上游说封就封;请求标注旗舰模型实际被路由到轻量版;Token计费剥离了官方usage字段,无法对账;完整请求数据经过中转站服务器,隐私承诺无审计支撑。
2026-07-13 16:39:20
362
原创 开源模型“免费“的账,该怎么算?显卡租金乘1.5才是真实成本
单张A100月租1440美元,但这只是面子账。加上运维人力、灾备双副本、监控设施,生产环境真实成本3240美元,是显卡租金的2倍多。用低价位API每月10亿Token才210美元,自部署贵了15倍。盈亏平衡点因API价位差异悬殊——低价API永远追不上,中高端API大约月均4亿Token开始划算。
2026-07-07 09:24:07
172
原创 一个Token到底花了多少钱?从显卡到电力,大模型推理的全链路成本
小规模部署人力占成本60%,大规模部署硬件折旧占81%。MiniMax靠75%算力利用率做到69%毛利,行业平均只有40-50%。Token成本最大的变量是规模。
2026-07-06 15:00:49
395
原创 从GPT到Agent:一条因果链串起所有AI新概念
RAG、Agent、MCP、reasoning model……AI术语每年都在膨胀。但这堆词不是零散的词典条目,它们之间有一条因果链:每个新概念都在补前一个的短板。LLM知识过期催生RAG,RAG不能干活催生Function Calling,推理突破催生Agent,工具碎片化催生MCP。串起来看,就不乱了。
2026-07-04 08:56:17
257
原创 模型太多不知道选哪个?先把选择思路理清楚
模型数量越来越多,每次打开对话框都犹豫半天。这篇文章不给你推荐清单——清单下个月就过时。而是帮你理顺选择思路:任务类型定方向、约束条件缩范围、实际跑一轮再定。思路对了,不管新模型怎么冒,你都能自己判断。
2026-07-03 16:09:19
157
原创 Sonnet 5的定价,Anthropic在脚注里藏了一笔对冲
Sonnet 5输入每百万token两美元,看着比Opus便宜不少。但Anthropic在脚注里承认换了新分词器,同样文本token消耗膨胀约35%,入门期定价的设计意图就是让实际成本与上一代"大致持平"。标准价生效后加上token膨胀,单次任务花费比Sonnet 4.6更高。同天Fable 5出口管制解除。
2026-07-01 16:14:04
201
原创 模型降价潮之后,AI开销账单出现了新的矛盾
DeepSeek降75%、小米降99%、腾讯云降97.5%——过去两个月AI模型API价格一路跳水。但日均Token调用量涨了1500倍,用量增速远超单价降速。翻出账单算三个真实画像的月费:单价降了,总花费未必降。
2026-06-30 15:07:40
342
原创 Anthropic份额首超OpenAI,但企业花钱的逻辑跟跑分已经没关系了
Ramp数据显示Anthropic美国企业AI支出占比41%首超OpenAI(39.5%)。但Fable 5跑分95%,真实任务通过率仅3%,中位数月支出$11.38。企业选型逻辑从"谁更好"变成"谁先用上了"——跑分说服不了花钱决策了。
2026-06-29 10:51:07
316
原创 Google OKF v0.1规范解读:AI Agent知识格式标准化,对笔记工具意味着什么
Google发布OKF v0.1,用Markdown+YAML定义AI Agent可读的知识包格式。本文从规范原文和HN讨论切入,分析v0.1缺陷(嵌套表格不支持、布局信息丢失),以及对Obsidian/Notion用户的实际影响。
2026-06-27 13:36:14
433
原创 六月AI旗舰连发四轮,模型更新比手机系统还勤快,我已经跟不上了
六月旗舰级模型更新扎了四堆,定价策略也跟着调了一轮——之前按字数算,现在可能按复杂度加权。对把AI深度嵌进工作流的开发者来说,每次大更新意味着之前的适配成本要重跑一遍。这事好像没人提,但它比「跟不上新功能」更戳人。
2026-06-26 13:36:59
176
原创 150万Token的上下文窗口来了,我算了笔账:一次能吞三十本书,但可能要先付钱
新模型上下文窗口将达150万Token,一次可塞进三十本完整书籍。窗口大了意味着能记住的东西多了,但有个容易被忽略的点——输入Token也是要算钱的。塞三十本书进去只问一句话,这三十本书的Token得先算一次费用。相当于请了个顾问,每次来先把你家档案柜全翻一遍再回答问题,翻柜子本身也计工时费。
2026-06-24 11:01:46
278
原创 AI给了我完全正确的总结,但我一条都用不上
让AI总结一份文档,得到的答案每条都对,但没有一条是我真正需要的。复盘之后发现,不是模型不行,是我没讲清楚自己想要什么。这半年来跟AI打交道最深的体会:「想清楚再问」比学任何提示词教程都管用。
2026-06-23 12:23:37
159
原创 Karpathy 提出 LLM Wiki:让 AI 帮你把资料“编译“成知识体系,而不只是搜索
Karpathy 在社媒上提出:我们用 AI 处理知识的方式存在结构性问题——每次都在重新翻同一批资料,个人知识体系并没有因此积累。他的替代方案叫 LLM Wiki:让 AI 把资料"编译"成互相引用、持续生长的知识结构。有开发者已经做了实验(Farzapedia),结果值得关注。
2026-06-22 13:00:59
165
原创 AI工具越来越多,我有点选择困难了
前两天找AI思维导图工具,应用商店出来几十个。一下午都在下载、试用、卸载,到最后导图还没做出来。想了几天,觉得问题更多在我——不知道自己要什么的时候,工具再多也没用。
2026-06-20 11:31:05
231
原创 不再只用来聊天:Token还能干什么的一些发现
大多数人以为Token就是跟AI聊天时烧的燃料。我这两周故意换了玩法,不聊天,专门试Token还能干什么——批量处理、整理笔记、跑工作流,试完发现之前对Token的认知大概只摸到了十分之一。
2026-06-19 12:27:30
161
原创 AI公司一边冲上市一边砍价,我看不懂了
最近AI圈两条大新闻撞在一起了——两家头部公司先后提交IPO,然后其中一家同周宣布API大幅降价。另一家更绝,新品直接定了个高到离谱的价格。我算了一下午账,越算越拧巴,干脆写出来大家一起看看。
2026-06-17 17:05:54
186
原创 AI Agent突然爆发——从Copilot到Agent,这波变化跟我们有什么关系
2026年上半年AI Agent全面爆发:GPT-5.6、Claude Code、Manus、腾讯WorkBuddy纷纷入局。本文从非技术人视角出发,解析Agent与聊天AI的本质区别、为什么今年集中落地、以及三个普通人最该关心的问题。
2026-06-16 15:26:10
167
原创 全球AI周调用量44万亿Token,我却发现自己才刚刚入门
OpenRouter最新数据:全球AI周调用量44.6万亿Token,八连涨。本文不是模型测评,是一个普通用户对自己跟AI关系变化的复盘——从探索期到依赖期,中间到底发生了什么,以及一个让人不太舒服的发现。
2026-06-15 18:05:31
217
原创 AI API 常见报错排查指南:429/500/401/超时,非技术人员也能看懂
遇到报错是家常便饭——429 限流、500 服务端错误、401 认证失败、请求超时,每个都能让你卡半天。本文从日常的视角,系统梳理常见 API 错误码的排查思路,纯经验分享。
2026-06-14 14:35:05
237
原创 AI API Token 计费拆解:输出比输入贵6倍、缓存命中便宜120倍——带你看清楚真实成本
2026年3月国家数据局正式将Token中文译名定为"词元",日均调用量突破140万亿。但很多开发者仍然不清楚Token到底怎么计费——中文比英文贵多少?不同模型差距有多大?缓存命中能省多少钱?本文用简单语言带你逐个拆解
2026-06-13 09:45:54
288
原创 API 定价页解读:输入输出不同价、免费额度过期、阶梯定价陷阱——帮你算清楚真实成本
AI API 调用已经是开发标配了,选平台不光看模型能力,更要看真实成本。但各家定价页设计方式千差万别,很多关键信息藏在你不会注意的位置。本文帮你看定价页背后的 5 个常见套路。
2026-06-10 11:41:26
210
原创 AI API 踩坑实录:Token计费/429报错/Key泄露/多模型管理 半年总结
随着大模型 、API 的普及,越来越多开发者开始直接调接口使用 AI 能力。但实际使用中,Token 计费理解偏差、API 报错处理不当、多模型管理混乱、Key 安全隐患等问题,让不少开发者交了"学费"。本文是笔者半年 API 使用过程中的真实踩坑记录,供参考。反正闲着也是闲着,过来随便聊聊
2026-06-09 09:30:55
301
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅