<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[我的地盘]]></title><description><![CDATA[好记忆不如烂笔头]]></description><link>https://blog.csdn.net/nlper</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; nlper]]></copyright><item><title><![CDATA[初学者如何查阅自然语言处理（NLP）领域学术资料]]></title><link>https://blog.csdn.net/nlper/article/details/40824971</link><guid>https://blog.csdn.net/nlper/article/details/40824971</guid><author>nlper</author><pubDate>Wed, 05 Nov 2014 16:02:13 +0800</pubDate><description><![CDATA[昨天实验室一位刚进组的同学发邮件来问我如何查找学术论文，这让我想起自己刚读研究生时茫然四顾的情形：看着学长们高谈阔论领域动态，却不知如何入门。经过研究生几年的耳濡目染，现在终于能自信地知道去哪儿了解最新科研动态了。我想这可能是初学者们共通的困惑，与其只告诉一个人知道，不如将这些Folk Knowledge写下来，来减少更多人的麻烦吧。当然，这个总结不过是一家之谈，只盼有人能从中获得一点点益处，受个]]></description><category></category></item><item><title><![CDATA[软件项目经理职责]]></title><link>https://blog.csdn.net/nlper/article/details/21522393</link><guid>https://blog.csdn.net/nlper/article/details/21522393</guid><author>nlper</author><pubDate>Wed, 19 Mar 2014 11:53:51 +0800</pubDate><description><![CDATA[国际软件项目经理的七大素质：
 
1、在一个或多个应用领域内使用整合了道德、法律和经济问题的工程方法来设计合适的解决方案。
2、 懂得确定客户需求并将其转换成软件需求的过程。
3、 履行项目经理的职责，善于处理技术和管理方面的事务。
4、 懂得并使用有用的项目管理工具。
5、调谐互相冲突的目标，在成本、时间、知识、现有系统以及组织的限制下找出可接受的折衷办法。
6、在一个典型的软件开]]></description><category></category></item><item><title><![CDATA[软件开发过程及岗位职责]]></title><link>https://blog.csdn.net/nlper/article/details/21522229</link><guid>https://blog.csdn.net/nlper/article/details/21522229</guid><author>nlper</author><pubDate>Wed, 19 Mar 2014 11:51:40 +0800</pubDate><description><![CDATA[本文主要讲述如何组织开发软件项目，使之更加快速、有效的完成。并分成以下几个阶段进行详细讲述：项目计划阶段、需求分析阶段、软件开发阶段、测试阶段、管理软件开发过程、各参与角色的具体职责描述及对人员的要求。最后提供了一些文档标准参考。

           本开发过程可以作为中小型（3-7人）软件项目的开发指南，而大型软件项目使用RUP会更好。

  

总体流程如下：

计划阶段－]]></description><category></category></item><item><title><![CDATA[特征选择]]></title><link>https://blog.csdn.net/nlper/article/details/20907335</link><guid>https://blog.csdn.net/nlper/article/details/20907335</guid><author>nlper</author><pubDate>Mon, 10 Mar 2014 11:16:36 +0800</pubDate><description><![CDATA[-1. TF-IDF的误区
TF-IDF可以有效评估一字词对于一个文件集或一个语料库中的其中一份文件的重要程度。因为它综合表征了该词在文档中的重要程度和文档区分度。但在文本分类中单纯使用TF-IDF来判断一个特征是否有区分度是不够的。
1）它没有考虑特征词在类间的分布。也就是说该选择的特征应该在某类出现多，而其它类出现少，即考察各类的文档频率的差异。如果一个特征词，在各个类间分布比较均匀，这样]]></description><category></category></item><item><title><![CDATA[Topic Model 与 LDA]]></title><link>https://blog.csdn.net/nlper/article/details/19159989</link><guid>https://blog.csdn.net/nlper/article/details/19159989</guid><author>nlper</author><pubDate>Thu, 13 Feb 2014 14:14:14 +0800</pubDate><description><![CDATA[参见：http://hi.baidu.com/ouyanggaoyan/item/5b5c01d4c518871cd78ed0d7#713670-tsina-1-29064-128ff9f28d958dae738be418601ffbcd]]></description><category></category></item><item><title><![CDATA[广告精准投放笔记]]></title><link>https://blog.csdn.net/nlper/article/details/18352293</link><guid>https://blog.csdn.net/nlper/article/details/18352293</guid><author>nlper</author><pubDate>Thu, 16 Jan 2014 10:45:19 +0800</pubDate><description><![CDATA[参考资料：

探索推荐引擎内部的秘密，第 1 部分: 推荐引擎初探
探索推荐引擎内部的秘密，第 2 部分: 深入推荐引擎相关算法 - 协同过滤
探索推荐引擎内部的秘密，第 3 部分: 深入推荐引擎相关算法 - 聚类]]></description><category></category></item><item><title><![CDATA[c++ xml 解析库 pugixml]]></title><link>https://blog.csdn.net/nlper/article/details/12431927</link><guid>https://blog.csdn.net/nlper/article/details/12431927</guid><author>nlper</author><pubDate>Tue, 08 Oct 2013 14:21:08 +0800</pubDate><description><![CDATA[之前一直使用 boost 的 property tree，测试显示解析速度慢，最近使用 pugixaml，速度提高很多，还支持 xpath。
留几个链接，已被以后查阅：

pugixml 一个xml解析库 简单快速, 支持XPath表达式, 感谢作者



pugixml库的使用（by yukin_xue)]]></description><category></category></item><item><title><![CDATA[linux环境下 C++ 性能测试工具 gprof 和 gprof2dot]]></title><link>https://blog.csdn.net/nlper/article/details/12058935</link><guid>https://blog.csdn.net/nlper/article/details/12058935</guid><author>nlper</author><pubDate>Thu, 26 Sep 2013 16:53:44 +0800</pubDate><description><![CDATA[1 简介
改进应用程序的性能是一项非常耗时耗力的工作，但是究竟程序中是哪些函数消耗掉了大部分执行时间，这通常都不是非常明显的。GNU 编译器工具包所提供了一种剖析工具 GNU profiler（gprof）。gprof 可以为 Linux平台上的程序精确分析性能瓶颈。gprof精确地给出函数被调用的时间和次数，给出函数调用关系。

gprof 用户手册网站 http://sourceware]]></description><category></category></item><item><title><![CDATA[SRILM 语言模型训练工具]]></title><link>https://blog.csdn.net/nlper/article/details/11472569</link><guid>https://blog.csdn.net/nlper/article/details/11472569</guid><author>nlper</author><pubDate>Mon, 09 Sep 2013 11:06:56 +0800</pubDate><description><![CDATA[1，下载
2，安装

make SRILM=$PWD
3，配置

将bin和bin/i686-m64添加到PATH环境变量中
4，测试
./ngram-count -help
5，海量语料训练
由于对于大规模语料进行语言模型的训练，经常会导致内存问题。
经过测试，用srilm处理一个3G的语料，训练3元语言模型，32G内存根本就不够用。
解决方案：把文件给分开了，然后分别算]]></description><category></category></item><item><title><![CDATA[mahout 聚类实战]]></title><link>https://blog.csdn.net/nlper/article/details/11116111</link><guid>https://blog.csdn.net/nlper/article/details/11116111</guid><author>nlper</author><pubDate>Thu, 05 Sep 2013 11:08:56 +0800</pubDate><description><![CDATA[0,mahout的安装与配置

mahout 0.8
1,准备数据
2503篇文本文件，存放在texts目录中

2,将文本文件转化为sequenceFile
$ mahout seqdirectory -c utf8 -i texts -o seqfiles

3,将sequenceFile生成文本文件
$ mahout seqdumper -i seqfiles -o se]]></description><category></category></item><item><title><![CDATA[python 处理 xml 异常问题]]></title><link>https://blog.csdn.net/nlper/article/details/9364791</link><guid>https://blog.csdn.net/nlper/article/details/9364791</guid><author>nlper</author><pubDate>Thu, 18 Jul 2013 11:05:22 +0800</pubDate><description><![CDATA[记录一下


参考资料：
1,Python中文全攻略 中文乱码 输出中文乱码]]></description><category></category></item><item><title><![CDATA[语录]]></title><link>https://blog.csdn.net/nlper/article/details/7865564</link><guid>https://blog.csdn.net/nlper/article/details/7865564</guid><author>nlper</author><pubDate>Tue, 14 Aug 2012 16:28:24 +0800</pubDate><description><![CDATA[这方面（能保持10年 20年基本没太大变化，...，别3，5年就给我来个天翻地覆。），UNIX，LINUX就很不错。变迁少。技术积累有沉淀。倒非说人老了，不想学了，而是不同阶段该学不同的东西。从工具语言的学习，到技术点的学习，到系统框架的构建，到产品，商业模式的应用，人是不断一层层拔高的。实在经不起起点，工具语言的变来变去。 -------- 开源中国社区 中山野鬼。
原帖：http://www]]></description><category></category></item><item><title><![CDATA[我的linux下c++开发环境]]></title><link>https://blog.csdn.net/nlper/article/details/7056584</link><guid>https://blog.csdn.net/nlper/article/details/7056584</guid><author>nlper</author><pubDate>Fri, 09 Dec 2011 13:11:42 +0800</pubDate><description><![CDATA[1, 工具
编辑器：emacs
编译器：gcc
调试器：gdb
构建器：scons

内存泄露器：valgrind

版本控制器：subversion

性能分析器：gprof
文档生成器：doxygen


2, 库
STL：标准模板库

glibc：glibc 是 GNU 发布的 libc 库，即 C 运行库。glibc 是 Linux 系统中最底层的 API]]></description><category></category></item><item><title><![CDATA[yum和apt-get的区别]]></title><link>https://blog.csdn.net/nlper/article/details/6925578</link><guid>https://blog.csdn.net/nlper/article/details/6925578</guid><author>nlper</author><pubDate>Tue, 01 Nov 2011 17:06:09 +0800</pubDate><description><![CDATA[一般来说著名的linux系统基本上分两大类： 

1.RedHat系列：Redhat、Centos、Fedora等 

2.Debian系列：Debian、Ubuntu等 



RedHat 系列 
1 常见的安装包格式 rpm包,安装rpm包的命令是“rpm -参数” 

2 包管理工具 yum 

3 支持tar包 


Debian系列 
1 常见的安装包]]></description><category></category></item><item><title><![CDATA[怎样才能成为一个优秀的产品经理？]]></title><link>https://blog.csdn.net/nlper/article/details/6866667</link><guid>https://blog.csdn.net/nlper/article/details/6866667</guid><author>nlper</author><pubDate>Wed, 12 Oct 2011 15:38:53 +0800</pubDate><description><![CDATA[现在，互联网公司里开始重视产品经理了，这是一个好事。以前互联网谈融资，谈商业模式，谈战略，很少有谈产品的，因为产品可以从国外抄，谁下手快谁就能获得先发优势。现在，互联网里的资本已经不成问题，抄袭速度都一样快了。这个时候，互联网比拼的就是谁能更好的理解用户需求，比谁能做出比别人更好的产品。此时，产品经理的作用至关重要。
那么，怎样才能成为一个优秀的产品经理？或者说，一个优秀的产品经理需要具备哪些素]]></description><category></category></item><item><title><![CDATA[到底什么是产品经理？]]></title><link>https://blog.csdn.net/nlper/article/details/6866655</link><guid>https://blog.csdn.net/nlper/article/details/6866655</guid><author>nlper</author><pubDate>Wed, 12 Oct 2011 15:36:49 +0800</pubDate><description><![CDATA[我经常会追问产品经理到底是一个什么职位，他们的职责是什么？该如何培养产品经理呢？
Marty Cagan的著作《Inspired》（中文名《启示录》）中曾如此描述“产品经理”这个职位：去发现有价值、可用且合理的产品。同样，我认为产品经理是商务、技术和用户体验三个岗位的交集。一个好的产品经理必须至少具有其中之一的从业经历、对三种岗位都有热情，同时还要与三种职业的从业者有很好的交情。

业务：产]]></description><category></category></item><item><title><![CDATA[Fedora 下配置源 rpmfusion]]></title><link>https://blog.csdn.net/nlper/article/details/6854780</link><guid>https://blog.csdn.net/nlper/article/details/6854780</guid><author>nlper</author><pubDate>Sun, 09 Oct 2011 10:40:41 +0800</pubDate><description><![CDATA[rpmfusion 是为 Fedora 及 Red Hat Enterprise Linux 用户提供的一个软件包仓库。


在这儿能看到如何配置 rpmfusion 源。]]></description><category></category></item><item><title><![CDATA[C++ 编码转换]]></title><link>https://blog.csdn.net/nlper/article/details/6800719</link><guid>https://blog.csdn.net/nlper/article/details/6800719</guid><author>nlper</author><pubDate>Thu, 22 Sep 2011 16:16:21 +0800</pubDate><description><![CDATA[采用 icu


1，安装 icu
# yum install libicu-devel


2，调用 icu
demo.c

#include 
#include 
#include 
#include   

int main(int argc,]]></description><category></category></item><item><title><![CDATA[Fedora 安装 Adobe Flash]]></title><link>https://blog.csdn.net/nlper/article/details/6778107</link><guid>https://blog.csdn.net/nlper/article/details/6778107</guid><author>nlper</author><pubDate>Thu, 15 Sep 2011 14:18:58 +0800</pubDate><description><![CDATA[# yum install --nogpgcheck http://linuxdownload.adobe.com/adobe-release/adobe-release-i386-1.0-1.noarch.rpm




# yum install --exclude]]></description><category></category></item><item><title><![CDATA[Java 应用显示中文乱码问题的解决方法]]></title><link>https://blog.csdn.net/nlper/article/details/6678430</link><guid>https://blog.csdn.net/nlper/article/details/6678430</guid><author>nlper</author><pubDate>Thu, 11 Aug 2011 12:02:25 +0800</pubDate><description><![CDATA[表现症状：
1. Java 控制面板上部分中文显示乱码;
2. Java 应用程序，比如 Netbeans，输入部分中文显示乱码;


原因：显示中文字体乱码是由于 JRE 的字体造成


解决方案：找一个可用于中文显示的字体（用增黑wqy 字体），更改 JRE 的字体。


具体操作：
$ sudo mkdir $JAVA_HOME/jre/lib/fonts/fallb]]></description><category></category></item></channel></rss>