[Python学习] 专题三.字符串的基础知识

        在Python中最重要的数据类型包括字符串、列表、元组和字典等.该篇主要讲述Python的字符串基础知识.

一.字符串基础

       
字符串指一有序的字符序列集合,用单引号、双引号、三重(单双均可)引号引起来.如:

s1=‘www.csdn.net‘   s2="www.csdn.net"   s3=‘‘‘aaabbb‘‘‘

其中字符串又包括:

1.转义字符串

像C语言中定义了一些字母前加"\"来表示常见的那些不能显示的ASCII字符,python也有转义字符.如下:

\\-反斜杠符号   \‘-单引号   \"-双引号  \ a-响铃   \b-退格(Backspace)

\n-换行   \r-回车   \f-换页   \v-纵向制表符   \t-横向制表符   \e-转义

\000-空   \oyy-八进制数yy代表的字符   \xyy-十进制yy代表的字符

2.raw字符串

Python中原始字符串(raw strings),r关闭转义机制.告诉Python后面是连串,"\"不当转义字符处理.例:

#转义字符和raw字符
s1="aa\nbb"
print s1
s2=r"aa\nbb"
print s2

#输出
aa
bb
aa\nbb

#raw原始字符串处理磁盘路径
open(r'C:\temp\test.txt','a+')
open('C:\\temp\\test.txt','a+')

        3.unicode字符串

告诉Python是Unicode编码,Unicode(统一码、万国码)是一种在计算机上使用的字符编码.在Unicode之前用的都是ASCII码,Unicode通过使用一个或者多个字节来表示一个字符.Python里面默认所有字面上的字符串都用ASCII编码,可以通过在字符串前面加一个‘u‘前缀的方式声明Unicode字符串,这个‘u‘前缀告诉Python后面的字符串要编成Unicode字符串.例:s=u‘aa\nbb‘

中文处理一直很让人头疼,推荐:Unicode和Python的中文处理

4.格式化字符串

字符串格式化功能使用字符串格式化操作符%(百分号)实现,在%的左侧放置一个字符串(格式化字符串),而右侧放置希望格式化的值,也可是元组和字典.如果需要在字符串里包括百分号,使用%%.如果右侧是元组的话,则其中每一个元素都会被单独格式化,每个值都对应一个转化说明符.例:

"your age %d,sex %s,record %f"%(28,"Male",78.5)

输出:‘your age 28,sex Male,record 78.500000‘

它有点类似于C语言的printf("%d",x),其中百分号%相当于C语言的逗号.其中字符串格式化转换类型如下:

d,i  带符号的十进制整数

o   不带符号的八进制

u   不带符号的十进制

x   不带符号的十六进制(小写)

X   不带符号的十六进制(大写)

e,E  科学计数法表示的浮点数(小写,大写)

f,F   十进制浮点数

c   单字符

r    字符串(使用repr转换的任意Python)

s   字符串(使用str转换的任意Python)

g,G  指数大于4或小于精度值和e相同,否则和f相同

二.字符串操作

        字符串的基础操作包括分割,索引,乘法,判断成员资格,求长度等.

1.+连接操作

如:s1=‘csdn‘ s2=‘Eastmount‘ s3=s1+s2

print s1,s2 => 输出:csdn Eastmount

print s3 => 输出:csdnEastmount

2.*重复操作

如:s1=‘abc‘*5

print s1 => 输出:abcabcabcabcabc

3.索引s[index]

Python的索引格式string_name[index],可以访问字符串里面的字符成员.

4.切片s[i:j]

Python中切片的基本格式是s[i:j:step],其中step表示切片的方向,起点不写从0开始,终点不写切到最后.如:

s=‘abcdefghijk‘

sub=s[3:8]

print sub => 输出defgh_

3      78 (起点是3 终点8不取)

其中当step=-1时表示反方向切片.如:

s=‘abcdefghijk‘

sub=s[-1:-4:-1]

print sub => 输出kji

因为最后一个"-1"表示从反方向切片,s[9]=‘j‘ s[-2]=‘j‘,正方向第一个‘a‘索引下标值为0,最后一个‘k‘索引下标值为-1.故‘j‘为-2,而sub[-1:-4:-1]表示从k(-1位置)切到h(-4位置,但不取该值).故结果为"kji".

如果想完成字符串逆序,s=‘www.baidu.com‘,则可s1=[-1::-1]即可.起点为m(-1),无终点表示切到最后.

5.字段宽度和精度

前面讲述的format()函数中涉及到该知识,如‘%6.2f‘%12.345678 输出"口12.35"其中6表示字段宽度,2表示精度,故补一个空格,同时采用四舍五入的方法结果输出12.35.

同时,零(0)可表示数字将会用0填充,减号(-)用来实现左对齐数值,空白(" ")意味着正数前加上空格,在正负数对其时非常有用,加号表示不管正数还是负数都标识出符号,对齐时也有用.例:

#字段宽度和精度
num = 12.345678
s1 = '%6.2f'%num
print s1
#补充0
s2 = '%08.2f'%num
print s2
#减号实现左对齐
s3 = '%-8.2f'%num
print s3
#空白
print ('% 5d'%10) + '\n' + ('% 5d'%-10)
#符号
print ('%+5d'%10) + '\n' + ('%+5d'%-10)

#输出
 12.35
00012.35
12.35
   10
  -10
  +10
  -10

三.字符串方法

        字符串从string模块中"继承"了很多方法,下面讲解一些常用的方法:

find()

在一个较长的字符串中查找子字符串,它返回子串所在位置的最左端索引,如果没有找到则返回-1.其格式为"S.find(sub [,start [,end]]) -> int",其中该方法可接受可选的起始点和结束点参数.而rfind()从右往左方向查找.

title = 'Hello Python,Great Python'
length = len(title)
print length
print title.find('Python')
print title.find('Python',10,30)

#输出:
25
6
19

        join()

其格式为"S.join(iterable) -> string",含义为"Return a string which is the concatenation of the strings in the iterable. The separator between elements is S."即用来在队列中添加元素,但队列中元素必须是字符串.它是split方法的逆方法.

seq = ['1','2','3','4']
sep = '+'
print sep.join(seq)   #连接字符串列表 sep表示'+'连接

dirs = '','usr','bin','env'
print '/'.join(dirs)
print 'C:'+'\\'.join(dirs)

#输出
1+2+3+4
/usr/bin/env
C:\usr\bin\env

        split()

字符串分割函数,格式为"S.split([sep [,maxsplit]]) -> list of strings",将字符串分割成序列,如果不提供分割符,程序将会把所有空格作为分隔符.

#按空格拆分成4个单词,返回list
s = 'please use the Python!'
li = s.split()
print li
print '1+2+3+4+5'.split('+')
#输出
['please', 'use', 'the', 'Python!']
['1', '2', '3', '4', '5']

        strip()

去掉开头和结尾的空格键(两侧且不包含内部),S.strip([chars])可以去除指定字符.而函数lstrip()去除字符串最开始的所有空格,rstrip()去除字符串最尾部的所有空格.

replace()

该方法返回某字符串的所有匹配项均被替换后得到字符串,如文字处理程序中"查找并替换"功能.

translate()

该方法和replace一样,可以替换字符串中某部分,但与前者的区别是translate只处理单个字符,它的优势在于可以同时替换多个,有时候效率比replace高.

如:s=‘eastmount‘ s1=s.replace(‘e‘,‘E‘) => 替换后‘Eastmount‘

字符串判断方法

isalnum()判断是否都是有效字符(字母+数字),如判断密码帐号,输出Ture\False.

isalpha()判断是否是字母

isdigit()判断是否是数字

islower()判断是否全是小写

isupper()判断是否全是大写

isspace()判断是否是空格(‘ ‘)

lower()

该方法返回字符串的小写字母版,在判断用户名不区分大小写时使用.upper()转换为大写,title()函数将字符串转换为标题——所有单词的首字母大写,而其他字母小写,但是它使用的单词划分方法可能会得到不自然的结果.

s = 'this is a good idea'
s1 = s.upper()
print s1
s2 = s.title()
print s2

#输出
THIS IS A GOOD IDEA
This Is A Good Idea
 

       PS:我主要是通过《Python基础教程》和"51CTO学院 智普教育的python视频"学习.所以文中引用了很多视频中的知识、书籍知识和自己的知识,感谢那些作者和老师,希望文章对大家有所帮助,才开始学习python知识,如果文章中有错误或不足之处,还请海涵,也希望大家提出意见与君共勉.勿喷~

(By:Eastmount 2014-9-28 中午11点 原创CSDN http://blog.csdn.net/eastmount/)

时间: 2024-10-09 09:25:34

[Python学习] 专题三.字符串的基础知识的相关文章

[Python学习] 专题一.函数的基础知识

        最近才开始学习Python语言,但就发现了它很多优势(如语言简洁.网络爬虫方面深有体会).我主要是通过<Python基础教程>和"51CTO学院 智普教育的python视频"学习,在看视频中老师讲述函数知识的时候觉得非常不错,所以就写了第一篇Python学习的文章分享给大家.主要内容:         1.Python安装与基本输入输出,print()函数和raw_input()函数简单用法. 2.我根据视频中学到的知识,讲解函数的基本知识: (1).系统提

Python学习系列(二)(基础知识)

Python基础语法 Python学习系列(一)(基础入门) 对于任何一门语言的学习,学语法是最枯燥无味的,但又不得不学,基础概念较繁琐,本文将不多涉及概念解释,用例子进行相关解析,适当与C语言对比,避免陷入语法的苦海.我认为初学者学习语法的目标是学会使用即可,关于对概念的深入理解,剖析,没有一定的知识积累是很难做到的. 学习Python,基本语法不是特别难,有了C的基本知识,理解比较容易.本文的主要内容是Python基础语法,学完后,能熟练使用就好.(开发环境依然是Python2.7,简单使用

python学习笔记三之上(基础篇)

深浅copy以及赋值 对于字符串和数字而言,赋值.浅拷贝和深拷贝无意义,因为其永远指向同一个内存地址. import copy n1 = 10242048 #n1 = 'hahahaha' #赋值n2 = n1#浅copy n3 = copy.copy(n1) #深copyn4 = copy.deepcopy(n1)print(id(i),id(i1)) #打印内存地址5787536 5787536print(id(i),id(i2))5787536 5787536print(id(i),id(

python学习笔记三之下(基础篇)

文件操作 打开文件 open(name[,mode[,buffering]])   open函数使用一个文件名作为强制参数,然后返回一个文件对象.python 3.5 把file()删除掉 with open(somefile.txt,'r') as files: do_something(files) with 语句打开文件并把值赋值到变量,之后可以对文件操作.文件在语句结束之后会自动关闭,即使异常引起也会退出. 文件模式 r   #只读模式(默认) w(>) #写模式 a (>>) 

Android WifiDirect 学习(三) 一些基础知识和问题

P2P架构介绍 P2P架构中定义了三个组件,一个设备,两种角色.这三个组件分别是: P2P Device:它是P2P架构中角色的实体,读者可把它当做一个Wi-Fi设备. P2P Group Owner(GO):P2P网络建立时会产生一个Group. P2P Group Client(GC): 在组建P2P Group(即P2P Network)之前,智能终端都是一个一个的P2P Device. 当这些P2P Device设备之间完成P2P协商后,那么其中将有一个并且只能有一个Device来扮演G

Python学习第三天----Linux基础命令

Linux基本命令 1.怎么以root账号登录? 按照常规方法安装好操作系统后是默认用普通用户登录系统的,这时候只需通过"sudo passwd    root"命令为root账号设置密码,然后"init 6"重启系统,登录时输入root账号及密码即可登录. 2.怎么切换到虚拟终端2,并且用普通账号登录? 3.使用快捷键切换到虚拟终端5,使用管理员身份登录,查看系统提示符 通过命令:logout退出当前虚拟终端 4.切回图形界面,右单击桌面打开终端,输入关闭系统的命

python学习笔记三之中(基础篇)

函数 内置函数 常用的内建函数: type()  列出指定对象的类型 help()  能够提供详细的帮助信息 dir()    将对象的所有特性列出 vars()  列出当前模块的所有变量 file,doc,name __file__  列出文件位置 __doc__  文档字符串 __name__ 被执行的脚本,name == __main__ if __name__ == "__main__": print("hello") int() abs() max() m

[Python学习] 专题二.条件语句和循环语句的基础知识

        前面讲述了"专题一.函数的基础知识",而这篇文章讲述的Python的条件语句和循环语句的基础知识.主要内容包括: 1.条件语句:包括单分支.双分支和多分支语句,if-elif-else 2.循环语句:while的使用及简单网络刷博器爬虫 3.循环语句:for的使用及遍历列表.元组.文件和字符串 前言: 语句块         在讲诉条件语句.循环语句和其他语句之前,先来补充语句块知识.(前面讲函数时已经用到过) 语句块并非一种语句,它是在条件为真(条件语句)时执行或执行

[Python学习] 专题四.文件基础知识

        前面讲述了函数.语句和字符串的基础知识,该篇文章主要讲述文件的基础知识(与其他语言非常类似). 一. 文件的基本操作         文件是指存储在外部介质(如磁盘)上数据的集合.文件的操作流程为: 打开文件(读方式\写方式)->读写文件(read\readline\readlines\write\writelines)->关闭文件 1.打开文件 调用函数open打开文件,其函数格式为: file_obj=open(filename[, mode[, buffering]])