<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[What]]></title><description><![CDATA[ | poised]]></description><link>https://blog.csdn.net/poised</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; poised]]></copyright><item><title><![CDATA[怎么学习分布式系统]]></title><link>https://blog.csdn.net/poised/article/details/51841567</link><guid>https://blog.csdn.net/poised/article/details/51841567</guid><author>poised</author><pubDate>Wed, 06 Jul 2016 18:45:15 +0800</pubDate><description><![CDATA[关于分布式系统怎么学课程6.824: Distributed Systems https://pdos.csail.mit.edu/6.824/
  MIT: 纸上得来终觉浅，绝知此事要躬行
知乎学习分布式系统需要怎样的知识？https://www.zhihu.com/question/23645117
  老鸟讲怎么学习分布式系统
论文The Google File System 
  惊异于如此]]></description><category></category></item><item><title><![CDATA[阅读GFS论文]]></title><link>https://blog.csdn.net/poised/article/details/51674427</link><guid>https://blog.csdn.net/poised/article/details/51674427</guid><author>poised</author><pubDate>Wed, 15 Jun 2016 14:55:16 +0800</pubDate><description><![CDATA[GFS论文发表距今已经十几年了，据之开源的hdfs也已经在业界得到了广泛应用。为了取得分布式系统的真经，拜读一下这篇经典论文。重要假设
软硬件失败乃家常便饭
我们写大文件，不屑小文件
文件改动的主流是追加新数据，随机写是非主流
一旦写完，仅会读取
系统结构先整一张比较风骚的图再看一张正经图 
那么你应该可以看出，系统就由四部分构成了
文件由固定大小的chunk (64 MB) 组成 
每个chunk]]></description><category></category></item><item><title><![CDATA[scala类型限定]]></title><link>https://blog.csdn.net/poised/article/details/51557303</link><guid>https://blog.csdn.net/poised/article/details/51557303</guid><author>poised</author><pubDate>Wed, 01 Jun 2016 16:54:54 +0800</pubDate><description><![CDATA[scala类型限定以类型下界限定举例，S>:T意味着：
  如果传入一个参数S，其类型与T相同，或者是T的父类型，那么将会使用类型S。如果传入一个类型T的子类型，那么将会使用类型T。
下面以代码来说明类型下界限定。 
首先定义一个链表类：case class ListNode[+T](h: T, t: ListNode[T]) {
        def head: T = h
        de]]></description><category></category></item><item><title><![CDATA[antlr提取代码注释]]></title><link>https://blog.csdn.net/poised/article/details/51451249</link><guid>https://blog.csdn.net/poised/article/details/51451249</guid><author>poised</author><pubDate>Thu, 19 May 2016 09:38:51 +0800</pubDate><description><![CDATA[使用antlr提取源代码注释的时候，需要定义不同的channel来导流，将注释导流到特定channel]]></description><category></category></item><item><title><![CDATA[Antlr代码生成及命令行验证]]></title><link>https://blog.csdn.net/poised/article/details/51420478</link><guid>https://blog.csdn.net/poised/article/details/51420478</guid><author>poised</author><pubDate>Mon, 16 May 2016 20:42:10 +0800</pubDate><description><![CDATA[什么是AntlrAntlr广泛应用于编程语言解析，但并不限于程序语言，实际上只要定义好语法规则，几乎无所不能，twitter的查询串解析就使用Antlr。Antlr使用很简单，第一步：定义语法文件，*.g4; 第二步：使用Antlr工具包生成解析代码，目前支持生成java, python, c#…当然对于解析程序语言来说，自己定义语法，那就太费劲了，实际上已经有人做好了，我们就不要重复造轮子了。各种]]></description><category></category></item><item><title><![CDATA[基于virtualbox安装spark-yarn-cluster]]></title><link>https://blog.csdn.net/poised/article/details/50974823</link><guid>https://blog.csdn.net/poised/article/details/50974823</guid><author>poised</author><pubDate>Thu, 24 Mar 2016 20:34:03 +0800</pubDate><description><![CDATA[打算自己玩玩spark-yarn-cluster，公司的环境是别人装的，没有亲自搞一遍，总觉得心里不踏实。另外一个重要的原因是，公司的服务器性能比较强，这样spark任务不容易暴露性能问题或者内存溢出，反而不便于深入学习spark。0. 环境    hp ProBook, intel core i3-4030u 1.9Ghz,伪四核，实际应该是双核，8G内存;
    windows7 旗舰版;]]></description><category></category></item><item><title><![CDATA[如何构建停用词列表]]></title><link>https://blog.csdn.net/poised/article/details/50587908</link><guid>https://blog.csdn.net/poised/article/details/50587908</guid><author>poised</author><pubDate>Tue, 26 Jan 2016 16:18:49 +0800</pubDate><description><![CDATA[在实际使用机器学习文本分类算法(比如lda, bayes, k-means)的过程中，会发现文档的预处理非常重要，如果包含太多杂词，则算法效果往往会大打折扣。预处理中，停用词过滤是非常关键的一步，但就目前而言，并没有完全自动一步到位的实现，而且针对不同领域停用词可能还有变化。但是大体有些规律可以遵循，加上人工干预，应该能达到不错的效果。
      下面是一些可行的停用词过滤方法，供参考：]]></description><category></category></item><item><title><![CDATA[Spark LDA 主题预测]]></title><link>https://blog.csdn.net/poised/article/details/50385796</link><guid>https://blog.csdn.net/poised/article/details/50385796</guid><author>poised</author><pubDate>Wed, 23 Dec 2015 11:37:17 +0800</pubDate><description><![CDATA[本文主要对使用Spark MLlib LDA进行主题预测时遇到的工程问题做一总结，列出其中的一些小坑，或可供读者借鉴。关于LDA模型训练可以参考：Spark LDA 主题抽取开发环境：spark-1.5.2，hadoop-2.6.0，spark-1.5.2要求jdk7+。语料有大概70万篇博客，十亿+词汇量，词典大概有五万左右的词。模型准备利用spark mllib LDA进行主题预测需要训练好的L]]></description><category></category></item><item><title><![CDATA[Spark LDA 主题抽取]]></title><link>https://blog.csdn.net/poised/article/details/50382107</link><guid>https://blog.csdn.net/poised/article/details/50382107</guid><author>poised</author><pubDate>Tue, 22 Dec 2015 20:26:44 +0800</pubDate><description><![CDATA[本文主要对使用Spark MLlib LDA进行主题抽取时遇到的工程问题做一总结，列出其中的一些小坑，或可供读者借鉴。关于LDA的具体理论等可以自行google。主题预测请参考：Spark LDA 主题预测开发环境：spark-1.5.2，hadoop-2.6.0，spark-1.5.2要求jdk7+。语料有大概70万篇博客，十亿+词汇量，词典大概有五万左右的词。训练语料代码：apache/spar]]></description><category></category></item><item><title><![CDATA[C++ 虚函数表]]></title><link>https://blog.csdn.net/poised/article/details/10967575</link><guid>https://blog.csdn.net/poised/article/details/10967575</guid><author>poised</author><pubDate>Tue, 03 Sep 2013 11:26:18 +0800</pubDate><description><![CDATA[其实关于C++虚函数表的原理和实现，网上的文章可谓汗牛充栋，我写这篇文章的目的不是为了狗尾续貂，其实是为了推荐两篇文章，以便于读者参考，这两篇文章结合起来读，大体可以理解虚函数表的原理和使用示例代码验证。
       参考1)：C++ 虚函数表解析。该文对于虚函数表的实现讲解的非常清楚。
       参考2)：我对C++ VTable 的理解 - theCFan的专栏 - CSDNBlog]]></description><category></category></item><item><title><![CDATA[有理想的程序员必须知道的15件事]]></title><link>https://blog.csdn.net/poised/article/details/7253645</link><guid>https://blog.csdn.net/poised/article/details/7253645</guid><author>poised</author><pubDate>Mon, 13 Feb 2012 01:18:08 +0800</pubDate><description><![CDATA[出处已经不详了。



   作为程序员，要取得非凡成就需要记住的15件事。
1、走一条不一样的路
   在有利于自己的市场中竞争，如果你满足于“泯然众人矣”，那恐怕就得跟那些低工资国家的程序员们同场竞技了。



2、了解自己的公司
    以我在医院、咨询公司、物流企业以及大技术公司工作的经验来看，这一点所言不虚。不同公司的运营模式差异极大。如果你理解企业的运营模式，那你]]></description><category></category></item><item><title><![CDATA[牢记职场生存中的10大职业铁律 让你受用一生]]></title><link>https://blog.csdn.net/poised/article/details/7253641</link><guid>https://blog.csdn.net/poised/article/details/7253641</guid><author>poised</author><pubDate>Mon, 13 Feb 2012 01:07:42 +0800</pubDate><description><![CDATA[信源：大旗网｜编辑：2011-06-05｜ 网址：http://www.popyard.org (被墙)


1、如果你不喜欢现在的工作，要么辞职不干，要么就闭嘴不言。初出茅庐，往往眼高手低，心高气傲，大事做不了，小事不愿做。不要养成挑三拣四的习惯，处处表现出不满的情绪。记住，不做则已，要做就要做好。


2、写出你一生要做的事情，把单子放在皮夹里，经常拿出来看。人生要有目标，要有计划]]></description><category></category></item><item><title><![CDATA[改善 C#程序的建议4：C#中标准Dispose模式的实现]]></title><link>https://blog.csdn.net/poised/article/details/7248128</link><guid>https://blog.csdn.net/poised/article/details/7248128</guid><author>poised</author><pubDate>Fri, 10 Feb 2012 11:40:46 +0800</pubDate><description><![CDATA[转自: 改善 C#程序的建议4：C#中标准Dispose模式的实现



        需要明确一下C#程序（或者说.NET）中的资源。简单的说来，C#中的每一个类型都代表一种资源，而资源又分为两类：

托管资源：由CLR管理分配和释放的资源，即由CLR里new出来的对象；非托管资源：不受CLR管理的对象，windows内核对象，如文件、数据库连接、套接字、COM对象等；]]></description><category></category></item><item><title><![CDATA[.Net下的线程同步:Part 6 of N--(避免锁定不恰当的同步对象)]]></title><link>https://blog.csdn.net/poised/article/details/7244947</link><guid>https://blog.csdn.net/poised/article/details/7244947</guid><author>poised</author><pubDate>Thu, 09 Feb 2012 13:30:10 +0800</pubDate><description><![CDATA[本文转自:改善C#程序的建议8：避免锁定不恰当的同步对象


        在C#中让线程同步的另一种编码方式就是使用线程锁。所谓线程锁，就是锁住一个资源，使得应用程序只能在此刻有一个线程访问该资源。可以用下面这句不是那么贴切的话来理解线程锁的作用：锁，就是让多线程变成单线程。在C#中，可以将被锁定的资源理解成new出来的普通对象。
既然需要锁定的资源就是一个C#中的对象，我们就该仔细思]]></description><category></category></item><item><title><![CDATA[.Net下的线程同步:Part 5 of N--(Interlocked && Volatile...)]]></title><link>https://blog.csdn.net/poised/article/details/7243674</link><guid>https://blog.csdn.net/poised/article/details/7243674</guid><author>poised</author><pubDate>Wed, 08 Feb 2012 22:09:18 +0800</pubDate><description><![CDATA[其它同步对象



Interlocked

"A statement is Atomic if it executes as a single indivisible instruction. Strict atomicity precludes any possible preemption. In C#, a simple read or assignment on a fiel]]></description><category></category></item><item><title><![CDATA[.Net下的线程同步:Part 4 of N--(Locks or Critical sections)]]></title><link>https://blog.csdn.net/poised/article/details/7243605</link><guid>https://blog.csdn.net/poised/article/details/7243605</guid><author>poised</author><pubDate>Wed, 08 Feb 2012 21:40:52 +0800</pubDate><description><![CDATA[Locks(或者Critical sections)
        锁定是一种一次只允许一个线程进入特定代码区段的机制，通过加锁实现。被锁定的代码区段称为critical section(关键区域)。锁定一段代码的方式有多种，下面将一一介绍。在介绍前，我们先来看看什么情况需要锁定：
using System;
using System.Threading;

namespace NoLock]]></description><category></category></item><item><title><![CDATA[.Net下的线程同步:Part 3 of N--(Mutex)]]></title><link>https://blog.csdn.net/poised/article/details/7243566</link><guid>https://blog.csdn.net/poised/article/details/7243566</guid><author>poised</author><pubDate>Wed, 08 Feb 2012 21:07:21 +0800</pubDate><description><![CDATA[Mutex
Mutex的工作原理与lock关键字基本相同，因此在这里就不多介绍。但Mutex与lock和Monitor的最大不同在于其可以作用于多个进程，可以提供进程间同步。

单实例运行
Mutex一个最广泛的运用就是使程序只能有一个实例在运行。下面这段代码实现了单实例运行，先打开一个实例，再打开一个实例时由于前面实例的存在则会直接退出。

using System;
using S]]></description><category></category></item><item><title><![CDATA[.Net下的线程同步:Part 2 of N--(Semaphores)]]></title><link>https://blog.csdn.net/poised/article/details/7243269</link><guid>https://blog.csdn.net/poised/article/details/7243269</guid><author>poised</author><pubDate>Wed, 08 Feb 2012 18:00:42 +0800</pubDate><description><![CDATA[Semaphores
Semaphore 继承自System.Threading.WaitHandle，因此，你可以调用WaitOne()，视情况需要也可以调用WaitAny(),WaitAll(),SignalAndWait()等函数。



Semaphore 就其用法而言，与夜店(国外)的运营方式很像。夜店有容量上限，由门卫确保，当满员时，外面的人不允许再进入，直到有一个人出来，才]]></description><category></category></item><item><title><![CDATA[.Net下的线程同步:Part 1 of N--(EventWaitHandle:AutoResetEvent and ManualResetEvent)]]></title><link>https://blog.csdn.net/poised/article/details/7242930</link><guid>https://blog.csdn.net/poised/article/details/7242930</guid><author>poised</author><pubDate>Wed, 08 Feb 2012 17:35:49 +0800</pubDate><description><![CDATA[写本系列的想法源自: 改善 C#程序的建议6：在线程同步中使用信号量，但是其中只是提到了AutoResetEvent、ManualResetEvent的用法，我觉得不够全面，因此想对.net下的同步方法做个逐一介绍。
        本文主要参考:Beginner's Guide to Threading in .NET: Part 3 of n，可以说是对于原文修改再加上个人理解和拆分后的译作]]></description><category></category></item><item><title><![CDATA[为程序员量身定制的12个目标--2)]]></title><link>https://blog.csdn.net/poised/article/details/7241803</link><guid>https://blog.csdn.net/poised/article/details/7241803</guid><author>poised</author><pubDate>Wed, 08 Feb 2012 11:12:51 +0800</pubDate><description><![CDATA[7)关注安全
　　很少有程序员具备好的安全习惯。如果你对自己的数字安全很在意，你就会对你写的代码安全性更加关心。确保你在每个站点都使用了唯一的高安全系数密码。使用加密的密码管理器来管理你的密码，例如
PasswordSafe 或者
KeePassX。如果你还没有对整个磁盘加密，留出时间完成它。（在 Mac 上可以轻松完成）
　　每年都要研究过去 12 个月中前 10 位的安全漏洞。他们是如]]></description><category></category></item></channel></rss>