pythoncoding

发布时间: 2023-04-17 18:41:34

‘壹’ python中#coding:gbk有什么用

它是一种编码格式，简单说明是：文件说明指令来确定不同的环境进行不同的解析，与代码有关，但与代码的内容无直接关联。
其中编码格式有多种，例如常用的还有：UTF-8
GBK即“国标”、“扩展”汉语拼音的第一个字母，英文名称：Chinese Internal Code Specification。GBK是汉字编码标准之一，中华人民共和国全国信息技术标准化技术委员会1995年12月1日制订，国家技术监督局标准化司、电子工业部科技与质量监督司1995年12月15日联合以技监标函1995 229号文件的形式，将它确定为技术规范指导性文件。
俗说的话，编码格式指定不明确的话，一般可能会有乱码出现。

‘贰’ python有哪几种编码方式

第一种：ASCII码。是基于拉丁字母的一套电脑编码系统，主要用于显示现代英语和其他西欧语言，它是现今最通用的单字节编码系统，并等同于国际标准IS/IEC
646。
由于计算机是美国人发明的，因此，最早只有127个字母被编码到计算机李，也就是大小写英文字母、数字和一些符号，这个编码表被称为ASCII编码，比如大写字母A的编码是65，小写字母a的编码是97，后128个称为扩展ASCII码。
第二种：GBK和GB2312。能在计算机中显示中文字符是至关重要的，然而ASCII表里一个偏旁部首都没有，所以我们需要一个关于中文和数字对应的关系表，一个字节只能最多表示256个字符，用处理中文显然一个字节是不够的，所以我们需要采用两个字节来表示，所以中国制定了GB2312编码，用来将中文编写进去。
第三种：Unicode。因为各个国家都有一套自己的编码，所以无法避免冲突，因此Unicode诞生了。它可以把所有语言都统一到一套编码里，这样就不会存在乱码问题了，现代操作系统和大多数编程语言都直接支持Unicode。
第四种：UFT-8。基于节约的原则，出现了把Unicode编码转化为可变长编码的UTF-8编码。而UTF-8编码把一个Unicode字符根据不同的数字大小编码成1-6个字节，常用的英文字母被编码成一个字节，汉字通常是3个字节，只有很生僻的字符才会被编码成4-6个字节，如果你要传输的文本包含大量英文字符，用UTF-8编码就能节省空间。

‘叁’ Python 编码转换与中文处理

python 中的 unicode 是让人很困惑、比较难以理解的问题. 这篇文章写的比较好， utf-8是 unicode的一种实现方式，unicode、gbk、gb2312是编码字符集.

Python 默认脚本文件都是 ANSCII 编码的，当文件中有非 ANSCII 编码范围内的字符的时候就要使用" 编码指示 "来修正一个 mole 的定义中，如果.py文件中包含中文字符（严格的说是含有非anscii字符），则需要在第一行或第二行指定编码声明： # -*- coding=utf-8 -*- 或者 #coding=utf-8
其他的编码如：gbk、gb2312也可以；否则会出现:

先说一下python中的字符串类型，在python中有两种字符串类型，分别是 str 和 unicode ，他们都是basestring的派生类；

在str的文档中有这样的一句话：

也就是说在读取一个文件的内容，或者从网络上读取到内容时，保持的对象为str类型；如果想把一个str转换成特定编码类型，需要把str转为Unicode,然后从unicode转为特定的编码类型如：utf-8、gb2312等。

unicode 转为 gb2312,utf-8等,使用 encode(encoding)

utf-8,GBK转换为 unicode 使用 unicode(s,encoding) 或者 s.decode(encoding)

普通的 str 转为 unicode,

如果直接执行s.encode('gb2312')会发生什么？

这里会发生一个异常：Python 会自动的先将 s 解码为 unicode ，然后再编码成 gb2312。因为解码是python自动进行的，我们没有指明解码方式，python 就会使用 sys.defaultencoding 指明的方式来解码。很多情况下 sys.defaultencoding 是 ANSCII，如果 s 不是这个类型就会出错。
拿上面的情况来说，我的 sys.defaultencoding 是 anscii，而 s 的编码方式和文件的编码方式一致，是 utf8 的，所以出错了:

对于这种情况，我们有两种方法来改正错误：

s = '中文'
s.decode('utf-8').encode('gb2312') ```

import sys
reload(sys) # Python2.5 初始化后会删除 sys.setdefaultencoding 这个方法，我们需要重新载入
sys.setdefaultencoding('utf-8')
str = '中文'
str.encode('gb2312')

print open("Test.txt").read()

import codecs
print open("Test.txt").read().decode("utf-8")

Traceback (most recent call last):
File "ChineseTest.py", line 3, in <mole>
print open("Test.txt").read().decode("utf-8")
UnicodeEncodeError: 'gbk' codec can't encode character u'ufeff' in position 0: illegal multibyte sequence

import codecs
data = open("Test.txt").read()
if data[:3] == codecs.BOM_UTF8:
data = data[3:]
print data.decode("utf-8")

s = "中文"
print unicode(s, "utf-8")

Traceback (most recent call last):
File "ChineseTest.py", line 3, in <mole>
s = unicode(s, "utf-8")
UnicodeDecodeError: 'utf8' codec can't decode bytes in position 0-1: invalid data

s = "中文"
print unicode(s, "gbk")

s = "中文"
print unicode(s, "cp936")

‘肆’ Python 源程序编码注意事项

默认情况下，Python 源文件是 UTF-8 编码。在此编码下，全世界大多数语言的字符可以同时用在字符串、标识符和注释中 — 尽管 Python 标准库仅使用 ASCII 字符作为标识符，这只是任何可移植代码应该遵守的约定。如果要正确的显示所有的字符，你的编辑器必须能识别出文件是 UTF-8 编码，并且它使用的字体能支持文件中所有的字符。
你也可以为源文件制定不同的字符编码。为此，在 #! 行（首行）后插入至少一行特殊的注释行来定义源文件的编码:
# -*- coding: encoding -*-
通过此声明，源文件中所有的东西都会被当作用 encoding 指代的 UTF-8 编码对待。在 Python 库参考手册 codecs 一节中你可以找到一张可用的编码列表。
例如，如果你的编辑器不支持 UTF-8 编码的文件，但支持像 Windows-1252 的其他一些编码，你可以定义:
# -*- coding: cp-1252 -*-
这样就可以在源文件中使用 Windows-1252 字符集中的所有字符了。这个特殊的编码注释必须在文件中的第一或第二行定义。

‘伍’ 如何辨认python的编码格式是unicode

Python文件里开头有coding:utf-8，则说明这个Python文件是Unicode编码。
在Python3中字符串是默认使用Unicode的，python2.x则得用u来表示它是Unicode字符串，如a=u“abcdefg”。type函数可以验证

‘陆’ 为什么python中，程序开始都要敲入“#-*-coding:UTF-8-*-”这个有什么作用呢

PY文件当中是不支持中文的，即使你输入的注释是中文也不行，为了解决这个问题，就需要把文件编码类型改为UTF-8的类型，核毁输入这个代码就可以让PY源文件里面有中文了。迟信
建议你写代码改旦备之前都把这句话加上，因为不管是注释还是弹出消息提示，免不了的要输入中文，所以这个基本是必须的。

‘柒’ 为什么我的Python3加注释也要用#coding:utf-8

#coding:utf-8
如果没有给出其他编码提示，Python将默认为ASCII作为标准编码
另外完整的Python源文件应该使用单个编码。不允许嵌入不同编码的数据，并且在编译Python源代码期间将导致解码错误。

‘捌’ 怎么在Python里使用UTF-8编码

一个完整的开头应该是这个样子的：
#!
usr/bin/python
#coding=utf-8
//这句是使用utf8编码方式方法，
可以单独加入python头使用。
#
-*-
coding:cp936
-*-
import
sys
reload(sys)
sys.setdefaultencoding('utf-8')
sys.path.append("../pythonLib/")
import
os,
string
import
json
import
time
from
time
import
*
希望可以帮到你。

‘玖’ 如何设置python的编码格式为utf-8

python的编码格式？
#coding=utf-8
这是文档编码
import sys
sys.setdefaultencoding("utf-8")
这是设置默认编码方式为utf-8
xx.encode("utf-8")
这是字符串编码操作
import codecs
codecs.open(xx,'r','utf-8")，这是文件编码读取方式

‘拾’ Python3 不用在开头声明#coding=utf-8也能中文注释啊

#coding=utf-8是告诉python文件的编搏扮码方改银滑式，跟你用注释没啥关系，跟中文输出是核腊否正常有关。你把文件存成gb2312然后开头#coding=utf-8试试print一下中文看看出不出问题

阅读全文

热点内容

脚本模拟鼠标点击发布：2025-04-03 12:06:19 浏览：315

老安卓接口是什么发布：2025-04-03 11:57:31 浏览：761

nginx资源服务器搭建发布：2025-04-03 11:44:52 浏览：405

安卓开发和嵌入式哪个难发布：2025-04-03 11:25:09 浏览：318

ftp链接本地虚拟机发布：2025-04-03 11:25:02 浏览：793

手机扣扣怎么找回密码发布：2025-04-03 11:24:17 浏览：222

安卓平板上做记事本哪个好用发布：2025-04-03 11:21:27 浏览：865

android图片的大小发布：2025-04-03 11:20:08 浏览：469

我的世界电脑版服务器怎么tp别人发布：2025-04-03 11:20:08 浏览：911

sql指定记录发布：2025-04-03 11:19:59 浏览：287

pythoncoding

与pythoncoding相关的资讯