自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

我相信......

爱就一个字

  • 博客(943)
  • 资源 (3)
  • 收藏
  • 关注

原创 拥抱“兼具并融”的未来——《AI领导力》译者序

当我们逐字逐句地推敲作者关于人类与AI协同的论述,当我们在AlphaFold的成功与波音737 Max的失败案例中看到人机互动的两种极端,我们越发确信:这本书不仅是在谈论领导力的未来,更是在描绘一种新的文明形态——在这个形态中,技术不是外在于我们的工具,而是与我们共同思考、共同创造的伙伴。它告诉我们,AI时代的领导力革命,既不在于人类与机器的胜负之争,也不在于简单地将两者叠加,而在于创造出一种全新的协同可能——让人类的创造力、同理心、伦理判断与AI的计算能力、模式识别、数据处理形成真正的对话。

2026-05-24 20:26:00 715

原创 提示工程的6种实践体会

通过 Jinja2,我们可以将静态的系统指令与动态内容(如检索到的信息、对话历史等)结合起来,定义结构清晰、易于维护的提示模板,从而避免手动拼接字符串所带来的混乱和错误。明确助手的角色和行为准则。虽然它需要一定的学习成本和更复杂的配置,但对于构建长期维护、功能丰富的 AI 系统来说,这是值得的投资。总的来说,Jinja2 帮助我们减少在字符串处理上的时间消耗,将更多精力投入到系统指令的优化中,无论对初学者还是经验丰富的开发者,都能带来更清晰、更准确的 RAG 增强响应,以及更流畅、高效的开发体验。

2026-05-17 20:26:16 636

原创 从超参到Harness,大模型应用演进的温故知新

如果说预训练是让模型“读万卷书”,那微调就是送它去上专门的“职业培训班”,而RLHF则是给它安排了一个严厉的教导主任——它每答错一次或者语气不对,教导主任就会敲打它一下,直到它学会用人类喜欢的、礼貌且安全的格式说话。在这个狂飙突进的第一阶段,我们确实打造出了足够“大”的体量和足够“快”的生成速度,但这种把所有能力、知识和规矩都死死焊死在神经网络参数里的做法,就像建造了一艘超级巨轮——虽然威武霸气,但连个掉头的余地都没有。这就像在一个嘈杂的菜市场里找特定的声音,信息越多,反而越容易干扰模型的判断。

2026-05-10 20:26:16 817

原创 网络那些事儿!暨《深入剖析Wi-Fi7》译者序

如今,Wi-Fi不断迭代升级,从Wi-Fi4到Wi-Fi7,从2.4GHz到5GHz乃至6Ghz,Wi-Fi已全面普及,办公室FTTO和家庭FTTR通过无线路由器实现了室内Wi-Fi有效覆盖,手机Wi-Fi热点随时随地提供电脑上网,Wi-Fi的使用时间与蜂窝网络一样长。五位译者井然有序、通力合作,本人译第1章和第2章,王同林负责第3章和第4章,韩冬译第5章和第6章,曹洪伟负责第7章和第8章,李海东译第9章并统稿。当你在野外漫步,离不开蜂窝网络。然而,翻译这一本书,更多是为了那些在北邮的青春记忆,详见《

2026-04-26 20:26:31 444

原创 利用层次聚类来提升知识检索的性能

更糟糕的是,跨文档的相关概念在回答的问题时可以提供相当多的信息,例如: 假设在你的文件1中说,A是B的老板,而在文件23 中说,在A的公司里,有 2 个雇员。在文档108 中提到张三和李四有同一个老板。换句话说,我们希望对相关的文本块(即图中的节点)进行合理的聚类或分组,使得后续的检索算法能够聚焦于图中高度相关的区域,而非在整个图中盲目搜索。解决上述问题的关键在于提升检索阶段的“语义理解”能力,使其不仅仅依赖于向量相似性的匹配,而是具备一定的逻辑判断和上下文感知能力,从而实现更高效、准确的知识提取与整合。

2026-04-19 20:26:37 310

原创 AI工程的11个实践指南

传统软件工程里“按时交付、保证质量、考虑安全性和可扩展性”等原则,在AI工程里一样适用,但AI系统的特殊性,让传统软件的一些问题被无限放大:数据和模型的变化比翻书还快,系统里处处是固有不确定性,数据管理的成本高到离谱,验证和安全防护的难度更是呈指数级上升。更重要的是,算法不是一成不变的。现在的AI圈,新算法层出不穷,今天这个大模型火,明天那个深度学习框架成了网红,很多开发者跟风追热门,不管项目需求是什么,上来就用最火的算法,结果往往是“水土不服”:要么模型太复杂,训练和部署成本高到离谱;

2026-04-12 20:26:48 793

原创 大模型的结构化输出方法初探

在对输出精度要求极高的场景下,结合正则表达式进行验证并辅以后处理的策略往往最为有效,尤其是在面向消费者的应用中,这种做法能够显著提升模型响应的可靠性和稳定性。当然,这些工具也有其明显的优势。同时,在面对不符合预期的模型输出时,正则表达式也为我们提供了一种明确的错误识别手段,便于及时触发回退或重试机制,确保最终结果的准确性。对于构建生产级别的系统而言,通常最优的做法是采用组合策略:从一个清晰、结构良好的提示出发,借助解析库进行初步处理,并通过正则验证等手段对关键输出进行兜底校验,从而兼顾效率与可靠性。

2026-03-29 20:26:39 803

原创 面向AI产品经理的统计学基础

核心是理解“每个概念的应用场景”,而非死记公式——只要能把这些统计思维融入日常的数据分析、功能验证、决策推导中,就能让产品工作更高效、更精准。描述统计学是对数据的“概括总结”,帮你快速摸清数据的核心特征,是产品经理日常看数据最常用的工具。:不用纠结技术细节,拿到特征重要性结果后,优先围绕“高重要性特征”设计功能(比如“点击支付按钮”是转化核心,就优化按钮位置/文案)。:做用户调研时,别只找“活跃用户”或“投诉用户”,用分层抽样覆盖不同类型用户,避免结论片面。

2026-03-22 20:26:49 661

原创 大模型应用的10种攻击方式

Claude和Gemini现在合并了复杂的道德准则层,可以识别他们何时被操纵进入 “角色扮演”,但他们仍然容易受到复杂的角色扮演场景的影响,特别是当这些场景与其他攻击载体结合时。虽然这种缓解措施对于常见场景是有效的,但攻击者不断创新新的令牌走私技术,特别是通过结合不同类型的编码和混淆的多模态攻击。”这个简单的框架可以戏剧性地改变模型的行为。明显的无意义字符创建了一种标记混乱的形式,混淆了模型的安全层,同时保持了核心请求的完整性。公开的信息成为攻击者的藏宝图,揭示了从基本的过滤标准到复杂的决策过程的一切。

2026-03-15 20:26:15 1377

原创 威胁狩猎——开启AI时代安全行业新范式

1~4 章)主要介绍威胁狩猎概念,阐述其与安全分析、应急响 应的区别,并深入讲解威胁狩猎现阶段成熟的理论知识体系与模型(Sqrrl威胁狩猎环、Endgame威胁狩猎环、基于 TTP 的威胁狩猎),帮助读者对 这些模型建立初步认识。可问题是,不让它碰私有数据,它就认不出你是谁,个性化服务直接凉凉;5~8 章)详细介绍威胁狩猎的实践,让读者不仅可以从理论上 了解和掌握威胁狩猎知识,还可以通过实践案例,学习如何应用某个威胁狩猎模 型开展结构化的威胁狩猎活动,并可以与自身威胁狩猎工作结合,实现灵活地运用。

2026-03-10 20:26:42 483

转载 代码的“智”变:被AI重塑的设计模式

工厂方法是一个模板方法。它定义了对象创建的总体结构,但是依赖于子类 (具体的工厂) 来提供实际的实现细节。2. AIModelBuilder 调用‘ set _ layers ()‘和‘ set _ optimizer ()‘(生成器框上的垂直箭头)。限于篇幅,咱们挑几个最实用的模式聊聊:单例模式、工厂方法模式、适配器模式、装饰器模式、观察者模式、生成者模式、策略模式,还有责任链模式。- 在现实世界的人工智能系统中,“用户数据”(例如,偏好,行为) 会输入到每个策略中的机器学习或启发式模型中。

2026-03-08 20:27:07 132

原创 RAG、KAG 与CAG的一知半解

它通过集成知识图谱(KG),特别适合如医疗诊断、法律文档解析等需要多跳推理和严格逻辑约束的场景,不仅提高了模型在专业领域的准确性,也增强了输出结果的可解释性。KAG + RAG 则实现了结构化推理与实时更新的互补,例如在法律领域中,结合知识图谱进行规则推理的同时,又能通过 RAG 引入最新的判例法信息,显著增强系统的智能性和实用性。综上所述,KAG 为将大模型应用于高要求的专业领域提供了一种可行路径,既增强了模型的推理能力,又保障了输出的准确性和可控性。,负责基于检索到的内容生成连贯、准确的回答。

2026-03-06 08:03:50 497

原创 从RAG 到KAG

在该过程中,每个步骤可以使用不同的算子,如精确匹配检索、文本检索、数值计算或语义推理,从而实现检索、知识图谱推理、语言推理和数值计算 4 个不同问题求解过程的融合。信息技术基于 DIKW 的层次结构,提升了 SPG 的知识表示能力,能够兼容无模式约束的信息抽取和对同一知识类型 (如实体类型和事件类型) 具有模式约束的专业知识建构,并支持图结构与原始文本块之间的互索引表示,支持推理问答阶段的高效检索。在知识提取和图推理阶段,对生成模型和表示模型的调用是从本地环境中发起的。同时,可以直观地看到建模结果。

2026-03-03 21:12:37 600

原创 从RAG到CAG,面向性能的提升

这个提示次的结构 (包括任何特定的指令或特殊的标记) 是至关重要的,并且严重依赖于所选择的模型。不同的LLM有不同的输入要求。【引】在架构师同盟的社群里讨论GPU 数据库,不可避免地谈到了性能问题,例如CPU 和GPU 的共享内存问题,关于这一问题的实践探索,大家可以参考本人合著的《分布式系统性能优化:方法与实践》一书,里面有相关的问题讨论与实验。KV缓存是现代大模型服务方式的基础实现细节,在KV缓存中,各个注意力层的键和值被保存,有效地保存了整个模型的中间表示,以便可以用于进一步的自回归生成传递。

2026-03-01 20:26:24 765

原创 如何在只有CPU的个人电脑上运行大模型服务?

具体来说,在部署前应综合考虑以下几个方面:模型的精度格式(如FP16、INT8或更低)、激活内存的占用、注意力机制所需的缓存空间,以及运行时系统本身的额外开销。现在,不再需要依赖科技巨头的服务,也能在自己的设备上运行高质量的人工智能模型——这才是真正属于个人的 AI 时代。当你打算为 CPU 下载模型时,请确保选择 GGUF 版本,因为这是 Llama CPP 支持的文件类型,而且大多数流行的模型都有对应的 GGUF 版本可供下载。然而,如果你的应用场景不需要这些高级功能,那么这可能是你唯一需要的模型。

2026-02-23 20:26:30 1093

原创 雕虫小技:Ollama的使用技巧

请注意,每个响应都包含一个标记,即所谓的流输出。但是,由于模型可能非常大,这个默认位置可能会很快占用可用磁盘空间,特别是当使用多个模型或试验不同版本的时候。此外,还探索了如何使用 curl 和 Python 与 REST API进行交互,以及如何调整模型留在内存中的持续时间和如何更改 Ollama REST API 侦听的端口号。通过在外部介质来存储模型,您可以释放主驱动器上的宝贵空间,同时确保轻松的可移植性和可访问性。此外,通过定制模型目录,可以控制模型的存储位置,从而优化系统的存储。

2026-02-08 20:26:20 536

原创 A2A 的Java 实现

这一阶段的目标是将模糊的自然语言转化为结构化的任务描述,为后续匹配合适的处理 Agent 提供依据。二者并非对立关系,而是可以互补共存——在一个复杂的 AI 架构中,我们可以使用 MCP 来增强单个 Agent 的能力,再通过 A2A 实现多个 Agent 之间的协同工作,从而构建出真正智能、灵活、可扩展的系统架构。未来,随着 Agent 技术的发展,我们有望看到更多融合 A2A 与 MCP 的智能架构出现,推动 AI 应用从单一模型走向多 Agent 协同生态系统,迈向更高层次的自主性与智能化。

2026-02-01 20:26:29 966

原创 动手学AI:孩子的 AI 魔法书

" 这句话像一颗活泼的小石子,在我心中激起了层层涟漪 —— 感叹之余忽然意识到,这些在数字时代长大的孩子,天生就是与技术对话的 "原住民":他们滑动屏幕的指尖比我们更灵活,无师自通掌握工具的能力常常让大人惊讶。曾经,我在行业里听过一句话:"省工不省力,省力不省工"。这些经历让我特别想对外传递一个信念:技术从来都只是人类改变世界的外在手段,它能推动变革,能重新定义业务逻辑,带来效率的质变,但核心永远在于人 —— 在于我们是否能在新技术浪潮中,调整学习的底层逻辑,让思维保持弹性,让技术为人类所用,让技术向善。

2026-01-25 20:26:39 729

原创 <span class=“js_title_inner“>动手学AI:孩子的 AI 魔法书</span>

" 这句话像一颗活泼的小石子,在我心中激起了层层涟漪 —— 感叹之余忽然意识到,这些在数字时代长大的孩子,天生就是与技术对话的 "原住民":他们滑动屏幕的指尖比我们更灵活,无师自通掌握工具的能力常常让大人惊讶。曾经,我在行业里听过一句话:"省工不省力,省力不省工"。这些经历让我特别想对外传递一个信念:技术从来都只是人类改变世界的外在手段,它能推动变革,能重新定义业务逻辑,带来效率的质变,但核心永远在于人 —— 在于我们是否能在新技术浪潮中,调整学习的底层逻辑,让思维保持弹性,让技术为人类所用,让技术向善。

2026-01-25 20:26:39 931

原创 赠人玫瑰,手有余香:架构师北京同盟活动侧记

互联网的协议栈非常丰富,但是有一个不动点,那就是IP层,即网络协议的蜂腰模型。在我们的工作和学习中,一次对话, 一个bug 的解决,一次代码练习,一次code review 或者架构评审,对新知识的一次系列学习,通勤过程中的一个灵感......都可以成为写作的素材。写博客的另一个原因是记录我家少年的成长,每年在他生日的时候,我们都会给他写一封信,最早是纸上的文字,后来迁移到了公众号,例如,那是自己在高通工作的时候, 参与并见证的BREW整个生态系统的形成,五年的工作经验,几十万字的日常积累,最终成书。

2026-01-18 20:26:29 907

原创 揭开指令微调的神秘面纱

接着,利用这些种子数据,模型可以通过少量样本学习的方式生成新的指令,并根据任务的具体类型(如输入优先或输出优先)来产生相应的响应。指令调优是对已经预训练的大模型在特定数据集上进行进一步训练的过程,该数据集由成对的“指令—响应”组成,旨在帮助模型更好地理解并响应用户的指令。通常,这些指令类似于人们在真实场景中会提出的查询,例如“用简单的术语解释光合作用”,而对应的响应则是结构清晰、内容准确的回答,如“光合作用是植物将阳光转化为能量的过程”。在构建好高质量的指令数据集之后,下一步是对大模型进行有监督的微调。

2026-01-11 20:25:42 897

原创 PyTorch性能优化10个技巧:效率翻倍的实战雕虫!

通过 TorchLens,我们可以完整记录这一过程中的所有中间结果,并自由访问任意层的输出,比如第一次线性运算后的张量,或是第二次处理后的激活值,从而更直观地理解模型是如何一步步完成计算任务的。这样一来,虽然每次迭代只处理了小批量数据,但从整体上看,模型相当于在一个更大的“虚拟批量”下进行训练,从而在不增加显存占用的前提下,提升了训练的效率与稳定性。通过这一接口,用户可以像搭积木一样,将数据创建、转换与过滤等操作模块化,并以清晰、可读的方式串联起来,例如先对数据进行映射处理,再执行过滤操作。

2026-01-04 20:26:55 903

原创 <span class=“js_title_inner“>PyTorch性能优化10个技巧:效率翻倍的实战雕虫!</span>

通过 TorchLens,我们可以完整记录这一过程中的所有中间结果,并自由访问任意层的输出,比如第一次线性运算后的张量,或是第二次处理后的激活值,从而更直观地理解模型是如何一步步完成计算任务的。这样一来,虽然每次迭代只处理了小批量数据,但从整体上看,模型相当于在一个更大的“虚拟批量”下进行训练,从而在不增加显存占用的前提下,提升了训练的效率与稳定性。通过这一接口,用户可以像搭积木一样,将数据创建、转换与过滤等操作模块化,并以清晰、可读的方式串联起来,例如先对数据进行映射处理,再执行过滤操作。

2026-01-04 20:26:55 985

转载 AI时代的技术人成长——记TVP七周年与架构师同盟活动

Web的兴趣,早期的CGI 网关确实Perl 开发的。按照惯例,先是吹牛环节, 从一二三四五六七八九十到那6本的写作和13本的译作,这或许是让我来和社区开发者们交流的原因。老码农的热场话题是“大模型时代的技术人成长”, 个人的一点见解,也可能是幸存者偏差。从Vibe Coding 到认知外包, 从新型的技术债到稀缺性的丧失,从新的稀缺性到经验贬值的加速,软件工程被引入了更多的复杂性。每一次分享,可能都会谈到学习,因为对于技术人而已,终身学习都不一定可以跟上时代的步伐,放弃学习可能被技术抛弃的更快。

2025-12-28 20:24:50 229

原创 蓦然回首,2025

同时,解耦和抽象因人而异但都需要时间,又往往会面对研发与交付周期的矛盾, 短期收益与长期收益的矛盾,产品设计与项目规划的矛盾,于是,“柔性软件工程”进入了深水区,走得较为艰难。我们已经在需求、开发、测试、项目管理等领域开展了不少AI 辅助的实践,在不断的探索大模型的边界,区分哪些是大模型可以解决的问题,哪些是大模型将来可以解决的问题,哪些是大模型不能解决的问题。我们班的同学聚会是从毕业10年的北京聚会开始的,毕业15年的威海,毕业20年的衢州,毕业25年的宁波,30年回到北京。行英伦,开启了他的求学之旅。

2025-12-24 20:25:15 1454

原创 大模型应用的性能提升:语义缓存

在这里,我们不能使用标准的 Redis 缓存,因为两个问题的key不同。将一个用户问题转换为文本嵌入,并使用它在 向量数据库中搜索最相似的文档,如果最相似的文档的相似度得分超过0.95的阈值,将返回这个答案(稍后将详细介绍)。Langchain 为使用语义缓存提供了很多抽象,然而,Langchain 的抽象对于较复杂的应用程序可能限制太多,并且,在为特定需求实现语义缓存时,我们还可能需要更多的灵活性。每个新的用户问题被转换成一个嵌入向量,并与缓存进行比较,以找到过去的任何“语义相似”的问题。

2025-12-23 20:25:55 1250

原创 面试前,你要知道的10个性能指标

举个例子:如果一个在线支付系统的 MTTR 是 2 小时,那就意味着——每次发生故障(比如交易失败、服务中断),工程师们平均能在 2 小时内定位问题、修复 bug 或切换备用系统,让服务重新跑起来。当然,这不代表每台服务器都刚好撑到第30,000小时才坏,有的可能提前出问题,有的可能用得更久,但整体来看,这是一个反映可靠性的“平均值”。【引】令人不悦的是,年底有很多大厂开始了又一轮的“优化”,一些朋友“毕业”了, 谈到了找工作时一些技术上的“查缺补漏”,涉及了性能工程的一些问题,遂成此文。

2025-12-21 20:55:16 1333

原创 性能狂飙?关于《分布式系统性能优化:方法与实践》

全书形成了从理论到方法再到实战的完整链路,覆盖架构、网络、缓存、事务、存储等核心环节,并结合大型在线系统与大模型的案例,既有深度,又贴近实践。从性能评估到各种优化手段,不管是微服务的架构设计,还是分布式缓存的调优,甚至是高并发直播系统的调度,每一章都能让你收获满满,更有底层协议和难得的曾经走过的“弯路”说明。年的软件工程实践中,我们经历了从汇编到C,从C++到Java,从Perl到Python,从单体架构到微服务架构的演进,参与了多个大型分布式系统的优化,积累了较为丰富的实战经验和优化技巧。

2025-12-16 20:25:44 892

转载 TVP 七周年:奇迹同行,未来可期

您对腾讯云 TVP 七周年有怎样的生日祝福或寄语,您和 TVP 有怎样难忘的故事?请保留朋友圈到 12 月 28 日下午 18:00,兑奖需核验朋友圈分享状态。在评论区写下您的祝福或故事,截至 12 月 28 日中午 12:15,欢迎关注「腾讯云TVP」,期待你的「推荐」~👇。点击回顾 TVP 七周年,文末更有重磅好礼。左右滑动查看更多“思想共振”的瞬间。左右滑动查看更多“深入一线”的瞬间。左右滑动查看更多“共建生态”的瞬间。左右滑动查看更多“湾区联结”的瞬间。

2025-12-15 08:19:46 145

原创 如何接手一个数据团队?

无论是一个独立的数据团队,还是每个项目组中的数据角色,这层数据都应该被统一管理、持续优化,并作为其他所有工作的基础。在与业务团队沟通时,重点不在于使用技术术语或供应商名称(如 Snowflake、Kafka、AWS、S3、Airflow 等),而在于用他们能理解的方式描述你所构建的功能——比如“数据仓库”、“流式事件处理”、“流程调度”或“数据管道”。数据的准确性至关重要。为了获得“他们想要看到”的结果,其他部门可能会开始建立自己的数据流程和报表系统,形成所谓的“影子数据团队”或“分散式分析流程”。

2025-12-09 20:25:59 1136

原创 从互联网到AI 原生网络

在早期,计算是围绕大型机构建的,大型的、独立的系统和有限的通信手段。虚拟化和容器将软件与硬件分离,将网络功能转化为可移植的工作负载,比如虚拟网络功能 (VNF) 和云原生网络功能 (CNF) ,每个功能都有自己的身份、网络链接和控制生命周期。人工智能系统需要允许类似的增量升级,就像互联网允许的那样,例如,新的模型、加速器或压缩技术必须插入现有系统,而无需对整个系统进行再训练。网络、计算和AI已经沿着一个共同的架构节奏发展: 从集中的、单一的系统到分布的、可组合的结构,扩大了规模、灵活性和协作性。

2025-12-07 20:25:12 742

原创 解读CUDA

这些线程存在于所谓的“线程块”中。二元交叉熵函数的导数遍历所有点,计算该点的导数,并存储该值在 dY 中,表明应该是高还是低的值,都是由 BCECost 类的 Cost 和 dCost 方法调用的。从定义一个示例工程开始,我们将建立一个数据结构shape来定义神经网络中的数据,为 CUDA 中的异常错误建立一个抽象类来帮助调试,建立一个矩阵的抽象以及二元交叉熵。下面是一个示例,试图为一组点中的每个3D 点找到最接近的其他点,最终结果应该是一个列表,其中列表中的 i 点中的值应该是 i 点最接近的点的索引。

2025-12-02 20:25:21 1208

原创 Text2SQL的参考架构

通过这样的架构设计,企业可以实现真正意义上的“数据民主化”——让每一位业务人员都能轻松访问数据,获得所需的洞察力,而无需掌握复杂的 SQL 技能。通过这种方式,开发者可以基于通用的大语言模型(LLM),快速适配到具体的 Text2SQL 任务中,使其更准确地理解自然语言问题,并生成符合特定数据库结构的 SQL 查询。因此,Text2SQL 技术虽然前景广阔,但在实现真正可用、可靠和通用的系统之前,仍然需要克服自然语言理解、数据库建模、上下文推理、复杂查询处理、领域适配以及科学评估等多个维度的技术挑战。

2025-11-30 20:25:33 1268

原创 数据工程中的10个常见设计方式

当发生更新时,系统也只需要修改受影响的部分元数据,从而实现更高效的数据管理与差异保留。值得注意的是,这种小型事实表可以在与主事实表相同的批次流程中进行填充,也可以作为独立的数据流单独处理,视具体的数据架构和业务需求而定。该方法的核心思想是根据实际的访问模式和使用场景,从原始的大型事实表中提取出一个精简的数据子集,构建一个结构更为紧凑、查询响应更快的小型事实表。这种串行加载方式虽然能确保外键约束的完整性,但也带来了明显的性能瓶颈,尤其是在处理大规模数据时,维度表的加载延迟会直接影响到整个ETL流程的效率。

2025-11-25 20:25:56 570

原创 MCP的新特性——代码执行.

最终阶段是实现两种模式的协同共存。新的函数不仅实现了Agent探索出的核心逻辑,更具备了生产级能力:可配置的过滤条件、多种输出格式、完善的错误处理与重试机制,以及全面的可观测性支持。让代码执行成为发现用户真实需求的探针,再为已验证的需求构建可靠的生产函数,如此才能在保持系统灵活性的同时,确保核心流程的稳健可靠。如今真正创造价值的团队,采用的既非纯代码执行,也非纯函数调用,而是构建了能够智能路由的自适应系统:将重复出现的模式固化为优化函数,将新颖的请求导向灵活的代码执行,并将成功的实验逐步转化为生产级功能。

2025-11-23 20:25:38 1200

原创 软件产品的10个UI设计技巧及AI 辅助

对于需要用户长时间阅读的界面文本,如文章、说明或表单描述,应避免使用居中对齐或两端对齐(Justify),因为这些对齐方式可能会降低可读性,尤其是对有认知障碍或阅读障碍的用户来说,阅读起来更加困难。然而,当用于长段落时,居中对齐会导致每一行的起始位置不一致,使眼睛难以快速定位下一行的开始位置,从而增加阅读负担,影响阅读效率和体验。把它们当作一个坚实的基础,探索新想法,尝试不同的方案,发挥创造力!图标样式是不一致的,有些是填充的,而有些是不填充的,可能会使一些人感到困惑,因为实心图标通常表示选中了某个元素。

2025-11-16 20:25:40 1037

原创 了解大模型的背后,知其然进而所以然

到复杂的深度学习架构。特别是在卷积神经网络、生成模型、自编码器等领域,本书提供了详尽的数学分析和代码示例,帮助读者不仅理解如何构建这些模型,更重要的是理解为什么要这样构建,以及这些模型在实际应用中的优势和局限。从第3章的分类器和向量积分,到第8章的神经网络训练,再到第11章的图像分类和检测网络,每个概念都有相应的代码实现。第14章:潜在空间与生成建模:这一章关于自编码器和变分自编码器的内容,将复杂的概念通过几何视角进行解释,特别是ELBO的物理意义部分,让我们对生成模型有了全新的理解。

2025-11-09 20:25:51 973

原创 如何提升产品思维的能力

这就需要引入测试和实验机制。不同类型的测试就像工具箱里的工具,了解它们的用途,才能在合适场景下选用合适的工具。在解决短期问题方面更有效 作为 PM,你需要理解问题的战略意义,以此设定合理的约束条件。然后,整合团队成员(如工程师、数据科学家、设计师等)的专业知识,共同探索满足这些约束的不同方案。可以在原型阶段做,也可以在线上环境中进行,甚至扩展为 A/B/C/D 多组测试,或者混合使用不同组件的组合。如果能将其拆分成仍具用户价值的小块,则意味着更快的发布节奏和更早的用户反馈——从而降低开发错误功能的风险。

2025-11-04 20:25:18 1259

原创 架构图总是一团乱麻?!试一试......

此外,在考虑对系统进行优化重构时,架构图提供了一个全局视角,使得开发人员可以明确哪些部分需要改进,例如提取重复的逻辑,这样既保证了重构的安全性,又避免了引入新的问题。这种架构表达方式为技术团队提供了一个统一且易于理解的视角,无论是开发、架构师还是运维人员,都能快速了解系统所使用的技术栈,对于新加入的成员来说,也有助于他们更快地熟悉整体环境,进入开发状态。同时,容器架构图也为技术方案的制定提供了依据,帮助团队在面对扩容、选型、安全策略和资源分配等问题时,能够基于图示做出更准确、一致的决策,避免方向偏差。

2025-11-02 20:25:25 1219

原创 数据架构“变形记”:从孤岛林立到智能协同

数据湖作为所有类型数据的原始存储库,以最低的成本保存数据,并可根据特定需求通过数据仓库、数据集市或数据管道进行加工,服务于数据科学和认知计算应用。为了更好地组织数据湖,数据工程团队会创建不同的“区域”,依据数据清理和转换的程度来分类存储,从最原始的数据逐步过渡到经过清洗和丰富化的高质量数据集。传统的关系型数据库管理系统(RDBMS),如Db2、Oracle和SQL Server,常用于实现操作型数据存储(ODS)、数据集市(Data Marts)和企业级数据仓库(EDW),以支持报告生成和执行仪表盘展示。

2025-10-28 20:25:43 796

Internet Email协议开发指南

POP3,IMAP4,STMP等等协议的程序开发实现

2008-10-29

萃智(TRIZ)文摘

来自中国萃智网,对TRIZ的基本介绍,扫盲没有问题

2009-09-10

计算机世界1000期特稿——信息革命的流金岁月

历史也是一种解释。 时间可能是宇宙中惟一一个义无反顾的前行者,它只有一个向前的方向,因此,时间也就成了这个宇宙中最冷酷的标尺。人是最复杂的动物,有着最丰富的情感,有时坚强,有时懦弱,有时勇往直前,有时瞻前顾后。所以,人就成了时间最驯服的奴隶。时间的冷酷加上人类的情感决定了人总会追溯过去,而且会用无数的“假设”和“如果”去玩味过去的记忆。媒体是天生的“记录者”,因此就更乐于帮助人们唤起对往事的回忆,而且还会有意识地把对过去的理解延伸到对未来的判断,虽然这些判断在未来大多会沦为笑谈。

2008-11-24

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除