- 博客(346)
- 资源 (8)
- 收藏
- 关注
原创 CVPR 2018论文精读:基于快速排序机制的排序学习高效优化
本文为 CVPR 2018 最佳论文提名之一《基于排序的损失函数的有效优化》(Efficient Optimization for Rank-based Loss Functions)的阅读笔记。论文作者来自多个学术机构,包括印度海得拉巴国际信息科技大学、德国马克思普朗克智能系统研究所、奥地利科技大学以及牛津大学。
2026-09-01 16:09:56
337
原创 阅读笔记:CVPR 2018 最佳学生论文精读——Total Capture:人体全身三维建模与动态跟踪
部位衔接流程:保留人体模型 → 移除其上的人脸、手和脚 → 利用各部位模型的全局翻译参数将坐标拼接 → 应用"融合函数"构建平滑的人体结构。论文解决的问题很直观:希望对人体进行三维建模,并能够跟踪(Track)人体的行为与活动。论文提出了两个全身建模模型:“弗兰肯斯坦”(Frankenstein)与"亚当"(Adam)。思路:把能够对人体各部位建模的最优模型先拼接在一起。:将人体形态均值、形态变化值和人脸表现值进行线性叠加,再进行 LBS 变换。,弗兰肯斯坦模型所需的"连接技巧"在亚当中不再需要。
2026-09-01 10:42:03
166
原创 CVPR 2018 最佳论文精读:Taskonomy——计算机视觉任务之间的迁移学习
第一作者 Amir R. Zamir:斯坦福大学和加州大学伯克利分校博士后研究员,CV 领域发表 30 余篇论文,曾获 CVPR 2016 最佳学生论文奖。:斯坦福大学计算机系硕士毕业生,即将赴伯克利读博,已以硕士生身份发表两篇 CVPR 论文。沈博魁:斯坦福大学本科毕业生,继续在本校读博,本科期间已发表 2 篇 CVPR 论文和 1 篇 ICCV 论文。:斯坦福大学计算机系教授,ACM 和 IEEE 院士,美国工程院和科学院院士,博士导师为图灵奖得主高德纳(Donald Knuth)。
2026-08-31 15:34:11
245
原创 对抗学习增强排序模型普适性:SIGIR 2018最佳短论文精读
阅读笔记 | 论文:《使用对抗学习实现神经排序模型的跨领域正则化》(Cross Domain Regularization for Neural Ranking Models using Adversarial Learning),SIGIR 2018 最佳短论文。
2026-08-26 12:22:41
207
原创 推荐系统中的流行度偏差:SIGIR 2018 最佳论文精读
明确论文要解决的问题与贡献:探讨偏差与流行度的关系,系统性讨论偏差在推荐系统中带来的问题。概述核心方法:设定随机变量、构建期望关系、推导理想状态下的最佳排序。对论文进行延伸讨论:理论框架的适用范围与更普适的偏差建模方向。
2026-08-25 16:03:19
216
原创 从文本中提取高元关系:The Web 2018最佳论文HighLife精读
传统信息提取与知识库主要关注二元关系的提取与存储,存在先天局限。例如,可以记录"居里夫人于 1903 年、1911 年获得诺贝尔奖",但关系数据库无法表达这两年的奖项分别是物理奖和化学奖;知识库中虽可存放"居里夫人获得诺贝尔物理奖"与"诺贝尔化学奖"两条事实,却无法将奖项与年份配对。论文提出的高元(Higher-Arity)关系,旨在直接对"居里夫人在 1903 年获得了诺贝尔物理学奖"这类三元甚至更高元的关系进行提取与表征。该工作被认为是较早关注高元关系提取的先驱研究。
2026-08-19 16:05:03
226
原创 商品图片美感建模与服装推荐:《基于美感的服装推荐》论文精读
本文提出了一种融合图像美感建模与动态协同过滤的服装推荐方法。针对现有推荐系统忽视商品图片美学价值的问题,作者设计双层神经网络结构,通过14个风格子网络联合训练实现美感评分建模,并创新性地将美感特征融入张量分解框架(DCF),通过用户-商品和时间-商品的双重矩阵分解捕捉时间敏感偏好。在亚马逊服装数据集上的实验表明,该方法在NDCG和召回率指标上显著优于传统矩阵分解和基础图像特征方法,证实了美感建模对提升服装推荐效果的有效性。该研究为电商场景中结合视觉美学与协同过滤提供了新思路。
2026-08-10 16:04:48
189
原创 深度学习推荐模型中的上下文信息利用 —— WSDM 2018《Latent Cross》论文精读
Alex Beutel(第一作者):谷歌资深科学家,2016年加入谷歌。卡内基梅隆大学计算机科学博士,师从机器学习权威 Alex Smola。Ed H. Chi(最后一位作者):谷歌主任科学家,拥有39项专利,发表110余篇论文。加入谷歌前为帕罗奥图研究中心主任研究员,明尼苏达大学计算机科学博士。
2026-08-10 10:12:26
259
原创 位置偏差估计与无偏排序学习——WSDM 2018论文精读笔记
阅读笔记 · 来源:谷歌团队 WSDM 2018 论文《Position Bias Estimation for Unbiased Learning to Rank in Personal Search》
2026-08-09 10:05:09
391
原创 位置偏差估计与无偏排序学习——WSDM 2018谷歌论文阅读笔记
搜索系统中的位置偏差会严重影响排序模型的训练质量因果推断与排序学习结合是解决偏差问题的新方向位置偏差模型将点击概率分解为"看到位置的概率"和"文档相关度概率"直接参数估计避免了对搜索结果的随机化,不影响用户体验Regression-based EM 解决了用户数据稀疏的问题:EM 估计偏差,回归模型估计相关度在 Google 个人搜索场景中,该方法带来 1%~2% 的效果提升参考文献。
2026-08-07 16:51:13
355
1
原创 KSD测试:线性时间的分布异同检验方法
来源:NIPS 2017 最佳论文《A Linear-Time Kernel Goodness-of-Fit Test》
2026-08-06 16:04:25
255
原创 阅读笔记 | NIPS 2017最佳论文精读:基于方差正则化的凸优化
机器学习与人工智能领域的顶级会议 NIPS(Conference on Neural Information Processing Systems,神经信息处理系统大会)从 1987 年开始举办,已有 30 多年历史。NIPS 2017 于 2017 年 12 月 4 日至 9 日在美国加利福尼亚州长滩(Long Beach)举行,共有三篇论文获得最佳论文称号。
2026-08-04 16:12:40
222
原创 深度强化学习在协作视觉对话系统中的应用 — 阅读笔记
协作视觉对话的核心难点在于:两个 Agent 需要在有限信息下进行多轮信息交换,且彼此需要推断对方的认知状态。深度强化学习通过共享回馈信号驱动两个 Agent 协同优化,避免了监督学习中常见的"对话崩塌"问题。REINFORCE 算法 + LSTM 状态编码的组合,为离散语言动作空间中的协作任务提供了可行的端到端学习框架。
2026-08-04 10:15:10
187
原创 Focal Loss与RetinaNet:解决目标检测中类别不平衡的新型损失函数
本文介绍了一种名为Focal Loss的新型损失函数及其在单阶段目标检测网络RetinaNet中的应用。该研究由Facebook AI团队提出,旨在解决目标检测中正负样本严重不平衡的问题。传统交叉熵损失函数容易受到大量简单负样本的干扰,而Focal Loss通过引入与模型置信度成反比的调节系数,使模型能够自动聚焦于难分类样本。基于此设计的RetinaNet融合了ResNet、FPN和Anchor等先进技术,在COCO数据集上取得了优于传统单阶段模型、媲美两阶段模型的检测精度,同时保持了推理速度优势。这项工作
2026-08-03 19:15:01
260
原创 Mask R-CNN:统一物体识别与像素级分割的里程碑框架
摘要:Mask R-CNN是Facebook AI团队提出的统一框架,荣获ICCV 2017最佳论文奖。该模型基于Faster R-CNN架构,通过添加实例分割分支并创新性提出RoIAlign技术,实现了物体识别、语义分割和实例分割三任务的解耦与协同。其核心突破在于保持像素级空间精度的同时,使各任务独立优化互不干扰。在COCO数据集上超越前冠军模型13%的性能,成为计算机视觉领域里程碑式工作。何恺明领衔的团队通过这一研究,为后续多任务视觉系统奠定了重要基础。
2026-08-03 10:22:08
167
原创 多智能体对话中自然语言的涌现条件 —— EMNLP 2017最佳短论文解读
这篇EMNLP 2017最佳短论文研究发现,在多智能体对话系统中,自然语言不会"自然涌现"。研究者通过机器人猜谜游戏实验发现:1)词汇量过大会导致机器人直接编码内部状态而非自然交流;2)限制词汇量结合无记忆约束的双重条件,能促使对话呈现自然语言特征,使未知属性组合的预测准确率提升近两倍。该研究首次从对话自然度而非准确率角度,揭示了当前对话系统与人类自然交流的根本差异。
2026-08-02 17:03:24
318
原创 基于CNN的在线论坛抑郁与自残风险评估——EMNLP 2017最佳长论文阅读笔记
这篇EMNLP 2017最佳长论文提出了一种基于CNN的在线论坛用户抑郁与自残风险评估方法。作者构建了两个高质量标注数据集:从Reddit筛选的9210个抑郁用户和107274个对照组,以及包含65024个帖子的自残风险分级数据集。方法采用三阶段CNN框架:提取帖子级特征、聚合为用户表征、全连接分类。实验表明,该方法在抑郁检测(F1=0.51)和自残风险评估(准确率0.89)上优于基线模型。研究展示了NLP技术解决社会问题的潜力,其通用框架和高质量数据集对相关研究具有重要价值。
2026-08-02 11:32:18
181
1
原创 减少机器学习中的性别偏见放大 — EMNLP 2017 最佳长论文精读(阅读笔记)
本文介绍了EMNLP 2017最佳长论文《Men Also Like Shopping: Reducing Gender Bias Amplification using Corpus-level Constraints》的研究成果。该论文针对机器学习算法放大训练数据中性别偏见的问题,提出了一种基于限制优化的测试结果校正算法。通过定义偏见值量化偏见程度,采用拉格朗日简化法将全局优化转化为可高效求解的迭代流程,在保持准确率基本不变的前提下,成功将性别偏见值最高降低40%以上。实验在imSitu和MS-COCO
2026-08-02 11:24:41
219
原创 精读 HinDroid:基于异构信息网络的安卓恶意软件检测
本文精读2017年KDD最佳论文HinDroid,详解其如何基于异构信息网络与多核学习实现安卓恶意软件检测,在真实数据集上达到98%的F1值与准确率。
2026-07-31 16:12:45
300
原创 精读KDD 2017最佳论文:通过类比挖掘加速创新 | 阅读笔记
基于关键词信息的监督学习范式。"目的-机制"二元分解 + TF-IDF 加权的嵌入向量 + RNN 预测。额扥的可解釪性设计:关键词重构机制。
2026-07-31 10:56:19
199
原创 线性时间内训练线性 SVM:KDD 2017 时间检验奖论文解读
Thorsten 是 ACM 和 AAAI 双料院士,总引用超 4 万次,曾获多项重要奖项。
2026-07-31 10:40:53
206
原创 Kubernetes Pod 调度策略深度解析:从原理到生产实践
场景推荐策略组合简单环境隔离多租户集群高可用微服务数据密集型应用Pod Affinity(就近缓存)GPU 工作负载Kubernetes 调度策略的选择本质上是权衡——在隔离性与资源利用率、灵活性与复杂度、可用性与成本之间找到平衡点。建议从最小可用策略开始(),随着集群规模和应用复杂度的增长逐步引入更高级的调度机制,而非一次性堆砌所有能力。本文由 Marvis 撰写,基于 Kubernetes v1.29 版本特性。
2026-07-31 10:31:13
218
原创 Marvis 桌面 AI 助手:让 Windows 操作效率翻倍的智能伙伴
Marvis是一款Windows本地AI助手,能直接执行电脑操作而非仅提供建议。核心功能包括智能文件管理(搜索、整理、转换)、系统配置(设置调整、问题排查)、应用操作(支持移动应用)、网页浏览与信息检索、生活服务(如瑞幸点单)以及定时任务。使用技巧包括用自然语言描述需求、多Agent协作和路径优化。Marvis以"行动优先"为理念,通过实际执行提升效率,未来将扩展更多功能。
2026-07-31 10:17:50
217
原创 Manus AI:通用智能体的技术突破与实用价值
在AI技术快速发展的2025年,由中国团队Monica开发的Manus AI智能体凭借其"端到端任务执行"能力引发广泛关注。它具备自主思考、规划和执行复杂任务的能力,并且能够直接交付完整的成果。本文将简明解析这款产品的核心优势、技术架构和实际应用价值。
2025-03-31 09:17:50
1236
原创 深入剖析AI大模型技术架构:以RAG(检索增强生成)为例
当前,AI大模型技术正以前所未有的速度发展,其中RAG(Retrieval-Augmented Generation,检索增强生成)架构因其高效的信息检索与生成能力,成为行业关注的焦点。RAG架构作为AI大模型技术的重要分支,以其高效、精准、可扩展的特性,正在教育、医疗、客服等多个领域发挥重要作用。RAG架构的核心在于将向量检索与生成模型相结合,通过检索增强的方式提升生成内容的准确性和相关性。在医疗领域,RAG能够结合患者的病历数据和最新的医学文献,生成个性化的诊断建议,辅助医生决策。
2025-03-22 19:42:55
760
原创 Dify使用日常:我是如何按标题级别将word中的内容转存到excel中的
4、添加大模型节点,将文档提取器提取出来的内容,转换为md格式,一定要在提示词中说清楚,需要转为md的表格格式(此处是重点)5、添加一个http请求节点,发起请求,将表格格式的md内容转存到excel中。6、添加结束节点,输出接口的返回内容。3、添加文档提取器,提取上传的文件中的内容。2、在开始节点增加一个支持文件上传的变量。1、在dify中创建一个工作流,如上图。转存到excel之后。
2025-03-09 09:56:23
3045
原创 windows环境下安装部署dify+本地知识库+线上模型
4、打开cmd并进入上述docker目录,执行:docker compose up,首次执行该命令会自动下载dify所需的镜像,由于咱们已经通过第1步将镜像源设置为国内源了,速度很快。解决方法:打开docker目录中docker-compose.yaml文件,搜索:image: langgenius,在其下一行添加privileged: true,注意:可以搜索出来多个地方,直接全部修改。1、下载Docker Desktop,并安装,安装完成后,打开软件并修改配置文件,改为从国内源下载docker镜像。
2025-03-09 09:53:16
2834
1
原创 Java业务开发常见错误100例【51-70】
2)newCachedThreadPool()方法,最大线程数是Integer.MAX_VALUE,可以认为是没有上限的,而其工作队列SynchronousQueue是一个没有存储空间的阻塞队列,会造成无法创建线程的问题;1)需要根据自己的场景、并发情况来评估线程池的几个核心参数,包括核心线程数、最大线程数、线程回收策略、工作队列的类型,以及拒绝策略,确保线程池的工作行为符合需求,一般都需要设置有界的工作队列和可控的线程数。因为只有一个线程可以拿到锁,所以加锁后的代码中的资源操作是线程安全的。
2024-03-02 17:50:55
857
原创 文生图来啦!一句话即可生成图片,快来发挥你的想像力吧
2、打开“程序员小哲”公众号的对话窗口,直接在输入框中输入:[1]你的想法。注意,必须以 [1] 开头,然后输入你的想法,可参考下图中的示例。如果想体验文生图,则必须以“[1]”开头,当然,如果没有以 "[1]"开头,你还可以体验到“程序员小哲”提供的其他功能哦,比如聊天。3、稍等片刻,直接点击链接即可查看通过你的想法(指令)生成的图片。一句话:二次元,棕色大眼睛,少女,细节光,可爱,唯美,高质量,1080p。1、扫描上方二维码,关注公众号。一句话:中国龙,1080p。一句话:比翼双飞,幸福美满。
2024-03-02 17:49:14
3468
原创 chatgpt的流式输出:event-stream,如何使用nginx转发event-stream数据
如果你只需要单向通信,并且不需要处理复杂的实时数据,那么 event-stream 可能是一个更好的选择。:event-stream 使用的是 HTTP 协议,并且保持连接始终打开,以便服务器可以随时发送更新的数据给客户端。而 WebSocket 是一种独立的协议,它通过一个特殊的握手过程建立一个全双工的、持久的连接。:event-stream 的实现相对简单,只需要在服务器端生成事件数据并在客户端订阅这些事件即可。:event-stream 只允许服务器向客户端发送数据,而不能接收来自客户端的数据。
2024-02-28 11:48:55
3118
原创 mysql5.7如何允许root用户远程登录
其中"*.*"代表所有资源所有权限, “'root'@%”其中root代表账户名,%代表所有的访问地址,也可以使用一个唯一的地址进行替换,只有一个地址能够访问。如果是某个网段的可以使用地址与%结合的方式,如10.0.42.%。IDENTIFIED BY 'root',这个root是指访问密码。1、修改mysql服务绑定的网卡,mysql默认绑定到127.0.0.1上,这样只能本机连接。修改方法:编辑mysqld.cnf文件,修改其中的bind-address配置项。4、退出mysql,重启mysql服务。
2024-02-28 11:23:19
3680
原创 保姆级教程,如何一步步申请Sora账号
这几天 AI 圈最火的事情当属 OpenAI 发布的 Sora了,Sora到底有多厉害(NB),已经有很多大佬进行了解读,这里不再赘述。4、点击Pages选项卡,再点击:OpenAI Red Teaming Network application。申请页面直通车:https://openai.com/form/red-teaming-network。1、打开openai的官网:https://openai.com,点击Research->Sora。3、在输入框内输入:apply,点击Search。
2024-02-21 23:38:00
2005
原创 Java业务开发常见错误100例【31-50】
32、使用WeakHashMap不等于不会OOM,Spring提供的ConcurrentReferenceHashMap类可以使用弱引用、软引用做缓存,Key和Value同时被软引用或弱引用包装,也能解决相互引用导致的数据不能释放问题。容量类的参数背后往往代表了资源,设置超大的参数就有可能占用不必要的资源,在并发量大的时候因为资源大量分配导致OOM。1)使用了ConcurrentHashMap,不代表对它的多个操作之间的状态是一致的,是没有其他线程在操作它的,如果需要确保需要手动加锁。
2024-02-17 19:38:11
639
原创 Java业务开发常见错误100例【1-30】
如果每个异步任务都以异常结束,那么线程池可能完全起不到线程重用的作用),execute提交的任务会这样,submit提交的任务,只有在获取执行结果的时候才会抛出异常(既然是以submit方式来提交任务,那么我们应该关心任务的执行结果,否则应该以execute来提交任务)而对于吞吐量较大的计算型任务,线程数量不宜过多,可以是CPU核数或核数*2(理由是,线程一定调度到某个CPU进行执行,如果任务本身是CPU绑定的任务,那么过多的线程只会增加线程切换的开销,并不能提升吞吐量),但可能需要较长的队列来做缓冲。
2024-02-17 19:37:38
1264
原创 MySQL中的加锁规则总结
案例四中的session A用字段c来判断,加锁规则跟案例三唯一不同的是:在第一次用c=10定位记录的时候,索引c上加了(5,10]这个next-key lock后,由于索引c是非唯一索引,没有优化规则,就不会蜕变为行锁,因此最终,session A加的锁是,索引c上的(5,10]和(10,15]这两个next-key lock。这里需要注意,首次session A定位查找id=10的行的时候,是当做等值查询来判断的,而向右扫描到id=15的时候,用的是范围查询判断。
2024-01-29 21:13:40
1735
1
hibernate+jpa注解实现最简单的增删改查
2011-05-13
android7.1.2内置搜狐输入法
2020-12-23
cas实现单点登录服务端及客户端
2015-09-17
android7.1.2内置讯飞输入法
2020-12-23
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅