<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[TokenLat的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/TokenLat</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; TokenLat]]></copyright><item><title><![CDATA[作为信通院「算力词元出海生态计划」首批成员，我们聊聊 AI 网关为什么关键]]></title><link>https://blog.csdn.net/TokenLat/article/details/165340270</link><guid>https://blog.csdn.net/TokenLat/article/details/165340270</guid><author>TokenLat</author><pubDate>Mon, 14 Sep 2026 17:51:46 +0800</pubDate><description><![CDATA[9月9日厦门投洽会上，中国信通院牵头的「算力词元出海生态计划」正式启航，首批成员覆盖算力基础设施、基础电信、AI 大模型、应用平台等全产业链。对我们技术团队来说，这件事的意义不在于"上榜"，而在于它把行业一个长期痛点摆到了台面：当 AI 能力要跨境交付，"怎么合规、怎么稳定、怎么不被单一模型绑定"才是真问题。中国日报：https://cnews.chinadaily.com.cn/a/202609/09/WS6aa11810e4b09a165c788f2e.html。]]></description><category></category></item><item><title><![CDATA[信通院牵头「算力词元出海生态计划」启航，聊聊 AI 网关到底解决了什么问题]]></title><link>https://blog.csdn.net/TokenLat/article/details/164848037</link><guid>https://blog.csdn.net/TokenLat/article/details/164848037</guid><author>TokenLat</author><pubDate>Thu, 10 Sep 2026 14:51:55 +0800</pubDate><description><![CDATA[9月8日，中国信通院牵头的「算力词元出海生态计划」在厦门投洽会正式启航，首批成员覆盖算力基础设施、AI 大模型、应用平台等全产业链。本文从开发者视角，拆解“算力词元出海”到底是什么，以及 AI 网关 / 模型聚合中间件为何会成为这一趋势里的关键基础设施。]]></description><category></category></item><item><title><![CDATA[Token 单价三个月降三成，为什么你的 AI 账单还是涨了？]]></title><link>https://blog.csdn.net/TokenLat/article/details/164119794</link><guid>https://blog.csdn.net/TokenLat/article/details/164119794</guid><author>TokenLat</author><pubDate>Thu, 27 Aug 2026 16:59:59 +0800</pubDate><description><![CDATA[CacheRouter 论文把工具列表拆成"固定核心工具（主模型永远看到）+ 独立路由通道（其余工具走子模型检索）"，让 token 级缓存命中率达到 90%+，输入成本压到无缓存基线的。当团队同时用 3+ 家模型时，自己写一个路由 + 计费 + 故障转移的中间层，很快会变成"第二个需要养的项目"。Agent 是"规划 → 调工具 → 看结果 → 再规划"的循环，每一步都可能是一次或多此模型调用。“Token 自由时代"没有消灭成本问题，只是把问题从"买不买得起模型"变成了"会不会用模型”。]]></description><category></category></item><item><title><![CDATA[DeepSeek 涨到 27 元/百万 token 后，Agent 开发者如何把成本压回来？]]></title><link>https://blog.csdn.net/TokenLat/article/details/164092861</link><guid>https://blog.csdn.net/TokenLat/article/details/164092861</guid><author>TokenLat</author><pubDate>Wed, 26 Aug 2026 17:19:13 +0800</pubDate><description><![CDATA[8 月 17 日起，DeepSeek V4 全系列启用，旗舰 V4-Pro 高峰时段输出价从 6 元涨到（涨幅 350%）；智谱、Kimi、MiniMax 等独立厂商年内也接连上调 API 价格。]]></description><category></category></item><item><title><![CDATA[《出海应用如何低成本用上国产大模型（含合规姿势）》]]></title><link>https://blog.csdn.net/TokenLat/article/details/164060360</link><guid>https://blog.csdn.net/TokenLat/article/details/164060360</guid><author>TokenLat</author><pubDate>Tue, 25 Aug 2026 16:43:43 +0800</pubDate><description><![CDATA[出海应用接大模型，痛点从来不是「模型够不够强」，而是「账单够不够吓人」+「合规够不够稳」。国产大模型（DeepSeek / 混元 / Qwen）在成本和中文/多语言场景上很有性价比；而合规的关键，不是选哪个模型，而是。这篇把「降本」和「合规」两套姿势一次讲清，附可直接抄的架构思路。注：合规部分讲工程侧能做的准备，具体以目标市场法规与法律意见为准。]]></description><category></category></item><item><title><![CDATA[国产大模型 API 横评：DeepSeek / 混元 / Qwen 怎么选]]></title><link>https://blog.csdn.net/TokenLat/article/details/164028005</link><guid>https://blog.csdn.net/TokenLat/article/details/164028005</guid><author>TokenLat</author><pubDate>Mon, 24 Aug 2026 17:18:32 +0800</pubDate><description><![CDATA[三家没有绝对的「谁更强」，只有「谁更对味」。DeepSeek 胜在推理+代码的性价比，混元长在腾讯生态与中文 Agent，Qwen 胜在模型矩阵最全、开源生态最大、长上下文与多语言。选模型的正确姿势，是先按场景分层，再决定每一层用谁——而不是 All in 某一个「最强模型」。下文所有价格均为。]]></description><category></category></item><item><title><![CDATA[《一文搞懂 OpenAI 兼容接口：为什么国产模型出海都该做兼容层》 之后，我重新算了一笔 AI 成本账]]></title><link>https://blog.csdn.net/TokenLat/article/details/163830257</link><guid>https://blog.csdn.net/TokenLat/article/details/163830257</guid><author>TokenLat</author><pubDate>Mon, 17 Aug 2026 17:49:46 +0800</pubDate><description><![CDATA[摘要：本文探讨国产AI模型出海时采用OpenAI兼容接口的必要性，指出其可封装模型差异、降低成本并提升稳定性。文章面向技术负责人和开发者，提出四步策略：需求对齐、接口兼容、模型路由和成本优化（如语义缓存）。通过TokenLat网关案例，展示如何实现多模型自动路由和30%以上的成本节省。适合关注AI生产环境部署及成本控制的团队参考。（149字）]]></description><category></category></item><item><title><![CDATA[自建 OneAPI 还是用网关 SaaS？一篇讲清取舍]]></title><link>https://blog.csdn.net/TokenLat/article/details/163569761</link><guid>https://blog.csdn.net/TokenLat/article/details/163569761</guid><author>TokenLat</author><pubDate>Fri, 07 Aug 2026 17:40:35 +0800</pubDate><description><![CDATA[本文系统对比了AI模型统一接入层的两种实现路径：自建One-API与使用托管网关SaaS。文章首先明确了统一接入层的核心目标，然后分别从做法、优点、代价和适用场景详细分析了两种方案，并通过对照表直观展示关键差异。最后给出务实建议：起步阶段优先使用托管网关快速验证，规模化或强合规场景再评估自建或混合方案，同时强调业务侧对接OpenAI兼容协议以降低未来切换成本。]]></description><category></category></item></channel></rss>