STL库中的string类
-
字符串是表示字符序列的类
-
标准的字符串类提供了对此类对象的支持,其接口类似于标准字符容器的接口,但添加了专门用于操作单字节字符字符串的设计特性。
-
string类是使用char(即作为它的字符类型,使用它的默认char_traits和分配器类型(关于模板的更多信息,请参阅basic_string)。
-
string类是basic_string模板类的一个实例,它使用char来实例化basic_string模板类,并用char_traits和allocator作为basic_string的默认参数(关于更多的模板信息请参考basic_string)。
-
注意,这个类独立于所使用的编码来处理字节:如果用来处理多字节或变长字符(如UTF-8)的序列,这个类的所有成员(如长度或大小)以及它的迭代器,将仍然按照字节(而不是实际编码的字符)来操作。比如还有wchar_t类型(2 bytes),能更好地表示Unicode等编码,对应的还有wstring类
总结:
-
string是表示字符串的字符串类
-
该类的接口与常规容器的接口基本相同,再添加了一些专门用来操作string的常规操作。
-
string在底层实际是:basic_string模板类的别名,typedef basic_string<char, char_traits, allocator>string;
-
不能操作多字节或者变长字符的序列。
注意在使用string类时,必须包含#include头文件以及using namespace std;
string的常见接口说明
string类对象的常见构造
函数名称 | 功能说明 |
---|---|
string();(重点) | 构造空的string类对象,即空字符串 |
string(const char *s);(重点) | 用C-string来构造string类对象 |
string(size_t n,char c); | string类对象中拷贝n个字符c |
string(const string& s);(重点) | 拷贝构造函数 |
string(const char* s,size_t n); | 拷贝字符串s的前n个字符 |
string (const string& str,size_t pos,size_t len=npos); | 从对象str的pos位置开始,拷贝len个字符 |
测试代码:
void Teststring()
{
string s1; // 构造空的string类对象s1
string s2("hello world"); // 用C格式字符串构造string类对象s2
string s3(s2); // 拷贝构造s3
string s4 = "hello world";//隐式类型转换
string s5(s4, 0, 3);//从s4的第0个位置开始,拷贝s4从该位置开始的3个字符
string s6("123456", 3);//拷贝字符串123456的前3个字符
string s7(10, 'y');//获取10个'y'
cout << s1 << endl;//空字符串
cout << s2 << endl;//hello world
cout << s3 << endl;//hello world
cout << s4 << endl;//hello world
cout << s5 << endl;//hel
cout << s6 << endl;//123
cout << s7 << endl;//yyyyyyyyyy
}
对于s5和s6的创建,如果我们给的最后一个参数大于字符串的长度的话,那么就会把字符串中剩余的内容全部拷贝。
string 类对象的容量操作
函数名称 | 功能说明 |
---|---|
size(重点) | 返回字符串有效字符长度 |
length | 返回字符串有效字符长度 |
capacity | 返回空间总大小 |
empty(重点) | 检测字符串释放为空串,是返回true,否则返回false |
clear(重点) | 清空有效字符,并不会将容量清空 |
reserve(重点) | 为字符串预留空间 |
resize(重点) | 将有效字符的个数改成n个,多出的空间用字符c填充 |
测试程序
// size/clear/resize/capacity
void Teststring1()
{
// 注意:string类对象支持直接用cin和cout进行输入和输出
string s("hello!!!");
cout << s.size() << endl;//8
cout << s.length() << endl;//8
cout << s.capacity() << endl;//15
cout << s <<endl;//hello!!!
// 将s中的字符串清空,注意清空时只是将size清0,不改变底层空间的大小
s.clear();
cout << s.size() << endl;//0
cout << s.capacity() << endl;//15
// 将s中有效字符个数增加到10个,多出位置用'a'进行填充
// “aaaaaaaaaa”
s.resize(10, 'a');
cout << s.size() << endl;//10
cout << s.capacity() << endl;//15
// 将s中有效字符个数增加到15个,多出位置用缺省值'\0'进行填充
// "aaaaaaaaaa\0\0\0\0\0"
// 注意此时s中有效字符个数已经增加到15个
s.resize(15);
cout << s.size() << endl;//15
cout << s.capacity() << endl;//15
cout << s << endl;
// 将s中有效字符个数缩小到5个
s.resize(5);
cout << s.size() << endl;//5
cout << s.capacity() << endl;//15
cout << s << endl;
}
注意:
-
size()与length()方法底层实现原理完全相同,引入size()的原因是为了与其他容器的接口保持一致,一般情况下基本都是用size()。
-
clear()只是将string中有效字符清空,不改变底层空间大小。
-
resize(size_t n) 与 resize(size_t n, char c)都是将字符串中有效字符个数改变到n个,不同的是当字符个数增多时:resize(n)用0来填充多出的元素空间,resize(size_t n, char c)用字符c来填充多出的元素空间。注意:resize在改变元素个数时,如果是将元素个数增多,可能会改变底层容量的大小,如果是将元素个数减少,底层空间总大小不变。
-
reserve(size_t res_arg=0):为string预留空间,不改变有效元素个数,当reserve的参数小于string的底层空间总大小时,reserver不会改变容量大小
string类对象的访问及遍历操作
函数名称 | 功能说明 |
---|---|
operator[](重点) | 返回pos位置的字符,const string类对象调用 |
begin + end | begin获取一个字符的迭代器+end获取最后义字符下一个位置的迭代器 |
rbegin + rend | 反向begin+end |
范围for | C++11支持更简介的范围for的新遍历方式 |
operator[]
类似C语言里的数组,我们可以通过符号[]来获取对应下标位置的字符
operator[]有重载:一个可以修改内容,一个不可以
char & operator[] (size_t pos);
const char& operator[] (size_t pos) const;
还有一个接口at()也可以实现取出i位置的字符,但是使用[]越界使用断言停止运行,而使用at()则是抛出异常,也就是没有[]强硬,不推荐使用at().
迭代器
string s("hello C++!\n");
string::iterator it =s.begin();
while(it!=s.end())//end()返回的是最后一个位置的下一个位置所以一定要写!=
{
cout<<*it;
it++;
}
C++中凡是给迭代器一般都是给左闭右开的区间:[ )
对应于begin()和end(),还有cbegin()和cend()接口,这两个函数对应的迭代器就是const_iterator,也就是迭代过程中是不能修改对象的。而begin()和end()是可以的。
迭代器意义:像string、vector(使用数组实现,空间连续)支持[]形式的遍历,但是list、map(使用链表实现,空间不连续)等等容器不支持,于是我们就要用迭代器遍历,所以迭代器是一种统一使用的方式
范围for
string s("hello world!!!");
//依次取容器中的数据,赋给e,自动判断结束
for (auto e : s)//e也可以写成char,不过auto可以自行推导类型
{
cout << e;
}
范围for也可以进行赋值,不过要是用引用:
string类对象的修改操作
函数名称 | 功能说明 |
---|---|
push_back | 在字符串后尾插字符c |
append | 在字符串后追加一个字符/字符串 |
operator+=(重点) | 在字符串后追加字符串str |
c_str(重点) | 返回C格式字符串 |
find + npos(重点) | 从字符串pos位置开始往后找字符C,返回该字符在字符串中的位置 |
rfind | 从字符串pos位置开始往前找字符C,返回该字符在字符串中的位置 |
substr | 在str中从pos位置开始截取n个字符,然后将其返回 |
append
push_back十分简单,就是在对象尾部添加一个字符,而一个一个字符地添加效率太低了,append可以帮我们解决问题,append既可以添加单个字符,也可以添加字符串。当然,也可以添加一个对象的内容
void TestChange1()
{
string s("hello");
s.append(" world");
cout << s << endl;
string s1("aaa");
s.append(s1);
cout << s << endl;
}
重载
//从对象str的subpos位置开始,添加sublen个字符
string& append (const string& str, size_t subpos, size_t sublen);
//添加字符串s的前n个字符
string& append (const char* s, size_t n);
//添加n个字符c
string& append (size_t n, char c);
//从一个对象的first位置开始到last结束,添加该段内容
string& append (InputIterator first, InputIterator last);
使用:
string s("hello");
string s1("aaaaaa");
s.append(s1);
cout << s << endl;
s.append(s1, 0, 1);
cout << s<<endl;
s.append("bbb", 1);
cout << s << endl;
s.append(3, 'c');
cout << s << endl;
s.append(s1.begin(), s1.end());
cout << s << endl;
operator+=
+=
类似于append,可以+=
的对象有单个字符、字符串、以及其他string对象
string& operator+= (char c); string& operator+= (const char* s); string& operator+= (const string& str);
例:
void TestChange2()
{
string s("hello");
cout << s << endl;
s += ' ';
s += 'w';
s += 'o';
s += 'r';
s += 'l';
s += 'd';
cout << s << endl;
s += "aaaa";
cout << s << endl;
string s1("hehe");
s += s1;
cout << s << endl;
}
注意:
-
在string尾部追加字符时,s.push_back© / s.append(1, c) / s += 'c’三种的实现方式差不多,一般情况下string类的+=操作用的比较多,+=及append操作不仅可以连接单个字符,还可以连接字符串。
-
对string操作时,如果能够大概预估到放多少字符,可以先通过reserve把空间预留好
有这三种在尾部添加的方式,那有没有直接在头部添加字符的方式呢?string中没有专门添加在头部添加字符的接口函数,虽然可以实现,但效率低下
c_str
void Testc_str()
{
string s("hello world");
s.resize(20);
s += "haha";
cout << s << endl; //hello world haha
cout << s.c_str() << endl;//hello world
}
我们将只有11个字符的对象s的有效字符个数添加到20,多出来的9个自动补\0
,再添加字符串haha
,分别直接输出s和用c_str输出s,发现用c_str只输出了 hello world
,这是因为 hello world
后是 \0
,所以c_str就默认读取结束了。
find
函数原型:size_t find(char c,size_t pos=0)const;
函数功能:从pos位置开始,查找一个c字符,找到了就返回该位置(从左到右第一个出现的位置)。没找到就返回npos,即INT_MAX,实际上是不可能有这么长的字符串的,也就意味着搜索失败
例:
void TestFind()
{
string s("test.cpp");
size_t pos = s.find('.', 0);
if (pos == string::npos)
{
cout << "no" << endl;
}
else
{
cout << pos << endl; //4
}
}
rfind
find是从前向后查找,那么rfind自然就是从后向前查找了
函数原型:size_t rfind(char c,size_t pos=npos)const;
功能:从pos位置开始向前查找字符c,返回结果与find相同
例:
void test_rfind()
{
string s("www.cplusplus.com");
size_t pos = s.rfind('.', s.size() - 1);
if (pos == string::npos)
{
cout << "no" << endl;
}
else
{
cout << pos << endl;//13
}
}
substr
函数原型:string substr(size_t pos=0,size_t len=npos)const;
功能:从pos位置开始,取len个长度的字符串,以string的形式返回。
例:
void TestSubstr()
{
string s("hello world");
string s1 = s.substr(6, 5);//从s的位置6开始,取出长度为5的字符串
cout << s << endl;//hello world
cout << s1 << endl;//world
}
学了find、rfind以及substr后,我们就可以取出一个文件名的后缀,以及将一个网站中的协议名与域名取出 :
取文件后缀:
// 获取file的后缀
void Teststring1()
{
string file("string.cpp");
size_t pos = file.rfind('.');
string suffix = file.substr(pos);
cout << suffix << endl; //.cpp
}
如果要取出的是 test.txt.dat这种文件名的后缀呢?
使用rfind与substr的组合即可
获取网站的协议名与域名
在一个网站string::find - C++ Reference中,http是协议名,www.cplusplus.com是域名。
思路:用find找到字符串://的位置pos,再用substr取出从0位置开始,长度为pos的字符串,即可得到域名。
上面我们得到了pos,pos+3就是域名的起始位置,找到了起始位置,接下来要找的就是结尾,我们观察到,从域名开始,到第一个/,即为域名的结束。所以我们从pos+3的位置开始查找 /,就得到了域名的结尾,将该段字符串取出,即可的到域名
// 取出url中的域名
void Teststring2()
{
string url("http://www.cplusplus.com/reference/string/string/find/");
cout << url << endl;
size_t start = url.find("://");
//如果没有://,说明是无效协议
if (start == string::npos)
{
cout << "invalid url" << endl;
return;
}
else
{
string tmp = url.substr(0, start);//取出协议
cout << tmp << endl;
}
//找到域名的起始位置
start += 3;
//查找域名的结尾
size_t finish = url.find('/', start);
//取出域名
string address = url.substr(start, finish - start);
cout << address << endl; //www.cplusplus.com
}
insert
不过insert可以在对象的任意位置插入,当然也包括头部。
insert也有多个重载,不过我们只讲最基本的:
string& insert (size_t pos, const string& str); string& insert (size_t pos, const char* s);
功能描述:在string对象的pos位置之后,插入字符串或其他的string对象内容。
注:pos设置的位置不能大于size,否则会报错
例:
void TestChange3()
{
string s("ho");
cout << s << endl;
s.insert(1, "ell");//从s的下标为1的位置插入"ell"
cout << s << endl;
s.insert(0, "ss");//头插"ss"
cout << s << endl;
string s1(" world");//相当于尾插" world"
s.insert(7, s1);
cout << s << endl;
}
erase
既然我们有添加字符的操作,那么也一定有对应的删除操作。
接口erase就可以帮我们完成删除操作。
我们只讲erase多个重载中的一种:
string& erase (size_t pos = 0, size_t len = npos);
pos表示开始删除的位置,len表示删除的长度,也就是删除字符的个数。如果len > size,则表示从pos开始,删除后面所有的字符。
可以看到该重载是全缺省的,如果我们不输入参数,则默认从0位置开始,向后删除UINT32_MAX个字符,也就意味着删除整个对象。
而如果我们只输入一个参数n,函数是从左向右依次读取参数的,也就是输入的这个参数n是给了pos,而len参数依然是缺省的,于是就默认从pos开始删除后面的所有字符。
例:
void TestChange4()
{
string s("hello world");
s.erase(5, 2);//从下标5开始删除2个元素
cout << s << endl;
s.erase(3);//从头开始删除3个元素
cout << s << endl;
s.erase();//删除整个对象
cout << s << endl;
}
getline
getline的作用是获取一行字符串
我们在用cin或者C语言中的scanf输入字符串时,当输入了空白字符后,输入就停止了,这样使得输入的结果达不到我们的要求
函数原型:
istream& getline (istream& is, string& str);
第一个参数是输入流,第二个参数是需要输入的对象。
getline就可以实现输入整行字符串,如果需要输入多行,用一个while嵌套即可:while( getline() )
getline的使用需要包含头文件,以及使用命名空间std
实例:
用cin输入:To be a better man !
string s;
cin>>s; //To be a better man !
cout<<s<<endl; //To
用getline输入
std::getline(std::cin,s);//To be a better man !
cout<<s<<endl;//To be a better man !