热门标签 | HotTags
当前位置:  开发笔记 > 编程语言 > 正文

[从产品角度学EXCEL03]单元格的秘密

这是《从产品角度学EXCEL》系列——单元格的秘密。前言请看:0为什么要关注EXCEL的本质1EXCEL是怎样运作的2EXCEL里的树形结构或者你可以去微信公众号@尾巴说数获得连载

这是《从产品角度学EXCEL》系列——单元格的秘密。

前言请看:

0 为什么要关注EXCEL的本质

1 EXCEL是怎样运作的

2 EXCEL里的树形结构

或者你可以去微信公众号@尾巴说数 获得连载目录。

本文仅由尾巴本人发布于特定网站。不接受任何无授权转载,如需转载,请先联系我,非常感谢。


在讲了excel的树形结构之后,我们终于要进入正题,研究单元格的秘密了。

当我们打开excel的时候,首先映入眼帘的就是一大片格子,这就是单元格。

在excel里,单元格承担了几乎所有的存储信息的功能。你可以往一个单元格里填写你的名字电话,也可以把若干个单元格合并起来,就放一块信息。它还可以根据你的需要改变颜色,调整字体,甚至于可以输入各种计算函数,求和求匹配求重复,包罗万象。

正因为单元格是excel的基础,我们对excel产品的研究,也是从单元格开始。这一块的内容主要涉及到以下几块知识:

1 文本与数字不是一码事
2 数值的“模板”——论数字格式
3 单元格的“外套”——更广度的谈单元格格式
4 合并只是一种“假象”
5 单元格里最小的运算单位——函数

1 文本与数字不是一码事

我们先来讨论一个问题,那就是excel里的数据格式。

对于初学excel的人,最常遇到的一个困扰是,为什么我往单元格里填入一长串数字,譬如我的身份证号码,结果出来的却是科学计数法,更过分的是,这一串数字excel还给我四舍五入了,害得我数据丢失。

也有些人会有疑问说,我明明把很多个数字用sum来求和,怎么结果会跟实际的不一样?结果最后算错了数,被老板追着好一顿狠骂,偏偏我还不知道哪里错了。

这 些问题我们在一些教程,或者搜索引擎里随便搜搜,都能得到解答——因为你该用文本的时候excel用了数字,该用数字的时候excel帮你选了文本。文本 是不能加减乘除的,数字大到了一定程度就自动变成科学计数法了。如果你查的深入一些,你还会知道,我们可以通过列转换或者text()函数,实现文本与数 字之间的互相转换。

而在这个解答的背后,却藏着excel的一个产品逻辑:文本与数值并不是一码事。

还记得我们上一章节详细介绍的xml树形结构吗?在excel里,单元格里的数字是藏在worksheet文件夹里的每一个sheet1 sheet2 xml文件里的,而文本信息,却是统一藏在xl文件夹里的Sharestring文件夹里,在sheet1 xml里再通过引用编码的形式读取和展现。

譬如说,如果我们往单元格A1里键入一串数字110002,那么我们把这个excel解压缩以后,可以在worksheet文件夹sheet1.xml里找到这样一行代码:

110002

但是如果我们通过改变其格式的方法,把这个单元格改为文本格式,那么我们只会在sheet1里找到这样的一串数字:

0

在这里,110002的字样不见了,取而代之的是一个编号,以及一个t=’s’的样式。而我们再回到Sharestring.xml里,就会发现110002被储存在了里面,刚刚提到的那个编号,正是这个编号的一部分。

从excel对数字和文本的不同储存方式,我们就要意识到说,在excel里这两个东西真的不是一回事情。这是从底层的逻辑就决定了的功能和性质的不一样

2 数值的“模板”——论数字格式

文本与数字不是一回事情,那么我们常常看到的日期、科学计数法、货币、百分比等等,又是怎么一回事情呢?

要调这些格式,excel2007以后的版本,是从开始->数字->格式下滑框里选中的,就如下图一样。

技术分享

当然,我们也可以在右键->设置单元格格式->数字里面,自由地选择我们的定义。

技术分享

我们很容易会发现,里面的几种格式之间是可以互相转换的。譬如数字40001,你把它改为日期后,就变成了2009/7/7,再改为百分比的话,就成了4000100.00%。不管你怎么改,它的值都是40001,并不会改变。

事实上,在这些格式里,文本是唯一一个不能与其他格式自由转换的东西。它储存方式天然就与数字不一样,在处理起来,自然也格格不入。

那除了文本以外的那些数字格式,又是什么东西呢?

我们继续回归到xml文件。

假设我们在F2单元格键入了2009/7/7,即为日期格式;再在I2单元格键入0.55%,即为百分比格式。

回归到worksheet文件夹里的xml文件,你会看到以下两行代码:

40002
5.4999999999999997E-3

跟很多人想象的不一样,在xml文件里我们并不会直接去存储一个“2009/7/7”和“0.55%”的数字,取而代之的是一个40002,和一个浮点数。

excel会通过“s”(style)来控制这个单元格的样式,而这个样式控制了我们在单元格里,是看到日期,还是百分比,还是其他数字格式。

这个样式我们后面还会继续展开讲的,不过我们可以先得出一个总结是:

excel的单元格里,只存储文本和数字两种类型。而对于数字,却有不同的展现方法。这些展现方法被统一叫做数字格式。
由于数字格式与数字的存储在两个地方,所以我们对单元格数字的操作,与其样式没有关系。
由此我们可以说,数字格式是数字的“模板”和“衣服”,它不影响数字的值


补充知识:

1、在众多编程语言里,也是需要严格区分数值和字符的区别的。甚至有些编程语言,在一开始就要界定清楚,变量是整数型的int,还是字符型的string。
excel既然是编程出来的,它也维持了这个一贯的比例。

2、对于数值,计算机可以直接用二进制十进制十六进制去记录它和表达它,但是对于字符串,我们需要用额外的编码进行记录。
常用的编码如UTF-8,ANSI等等。
像xml文件的表头,总会有这么一段指明编码:

字符串的编码问题,尤其是涉及中文的部分,是我们日常处理文本、网页爬虫、数据清洗中,最头疼的一点。稍稍不留意,就会出现报错。

3、excel在导入外部数据时,我们可以选择不同的编码类型,如下截图:

技术分享 
这个编码类型基本针对的是文本。如果选错,就是乱码乱码乱码


本章节excel常问问题:

Excel教程身份证问题一次全搞定

Excel文件打开时所有的单元格格式都变成了日期格式

如何在EXCEL中快速实现文本和数值的相互转换

欢迎各位在评论里补充你们看完本章后,想到的相关问题,定期补充上去:)

欢迎扫码关注我的微信公众号

技术分享

[从产品角度学EXCEL 03]-单元格的秘密


推荐阅读
  • 本文介绍了lua语言中闭包的特性及其在模式匹配、日期处理、编译和模块化等方面的应用。lua中的闭包是严格遵循词法定界的第一类值,函数可以作为变量自由传递,也可以作为参数传递给其他函数。这些特性使得lua语言具有极大的灵活性,为程序开发带来了便利。 ... [详细]
  • 本文介绍了使用Java实现大数乘法的分治算法,包括输入数据的处理、普通大数乘法的结果和Karatsuba大数乘法的结果。通过改变long类型可以适应不同范围的大数乘法计算。 ... [详细]
  • HDU 2372 El Dorado(DP)的最长上升子序列长度求解方法
    本文介绍了解决HDU 2372 El Dorado问题的一种动态规划方法,通过循环k的方式求解最长上升子序列的长度。具体实现过程包括初始化dp数组、读取数列、计算最长上升子序列长度等步骤。 ... [详细]
  • 本文讨论了Alink回归预测的不完善问题,指出目前主要针对Python做案例,对其他语言支持不足。同时介绍了pom.xml文件的基本结构和使用方法,以及Maven的相关知识。最后,对Alink回归预测的未来发展提出了期待。 ... [详细]
  • 本文讨论了如何优化解决hdu 1003 java题目的动态规划方法,通过分析加法规则和最大和的性质,提出了一种优化的思路。具体方法是,当从1加到n为负时,即sum(1,n)sum(n,s),可以继续加法计算。同时,还考虑了两种特殊情况:都是负数的情况和有0的情况。最后,通过使用Scanner类来获取输入数据。 ... [详细]
  • 在说Hibernate映射前,我们先来了解下对象关系映射ORM。ORM的实现思想就是将关系数据库中表的数据映射成对象,以对象的形式展现。这样开发人员就可以把对数据库的操作转化为对 ... [详细]
  • 开发笔记:Java是如何读取和写入浏览器Cookies的
    篇首语:本文由编程笔记#小编为大家整理,主要介绍了Java是如何读取和写入浏览器Cookies的相关的知识,希望对你有一定的参考价值。首先我 ... [详细]
  • iOS超签签名服务器搭建及其优劣势
    本文介绍了搭建iOS超签签名服务器的原因和优势,包括不掉签、用户可以直接安装不需要信任、体验好等。同时也提到了超签的劣势,即一个证书只能安装100个,成本较高。文章还详细介绍了超签的实现原理,包括用户请求服务器安装mobileconfig文件、服务器调用苹果接口添加udid等步骤。最后,还提到了生成mobileconfig文件和导出AppleWorldwideDeveloperRelationsCertificationAuthority证书的方法。 ... [详细]
  • XML介绍与使用的概述及标签规则
    本文介绍了XML的基本概念和用途,包括XML的可扩展性和标签的自定义特性。同时还详细解释了XML标签的规则,包括标签的尖括号和合法标识符的组成,标签必须成对出现的原则以及特殊标签的使用方法。通过本文的阅读,读者可以对XML的基本知识有一个全面的了解。 ... [详细]
  • Java验证码——kaptcha的使用配置及样式
    本文介绍了如何使用kaptcha库来实现Java验证码的配置和样式设置,包括pom.xml的依赖配置和web.xml中servlet的配置。 ... [详细]
  • 在Xamarin XAML语言中如何在页面级别构建ControlTemplate控件模板
    本文介绍了在Xamarin XAML语言中如何在页面级别构建ControlTemplate控件模板的方法和步骤,包括将ResourceDictionary添加到页面中以及在ResourceDictionary中实现模板的构建。通过本文的阅读,读者可以了解到在Xamarin XAML语言中构建控件模板的具体操作步骤和语法形式。 ... [详细]
  • 延迟注入工具(python)的SQL脚本
    本文介绍了一个延迟注入工具(python)的SQL脚本,包括使用urllib2、time、socket、threading、requests等模块实现延迟注入的方法。该工具可以通过构造特定的URL来进行注入测试,并通过延迟时间来判断注入是否成功。 ... [详细]
  • 移动端常用单位——rem的使用方法和注意事项
    本文介绍了移动端常用的单位rem的使用方法和注意事项,包括px、%、em、vw、vh等其他常用单位的比较。同时还介绍了如何通过JS获取视口宽度并动态调整rem的值,以适应不同设备的屏幕大小。此外,还提到了rem目前在移动端的主流地位。 ... [详细]
  • SpringMVC接收请求参数的方式总结
    本文总结了在SpringMVC开发中处理控制器参数的各种方式,包括处理使用@RequestParam注解的参数、MultipartFile类型参数和Simple类型参数的RequestParamMethodArgumentResolver,处理@RequestBody注解的参数的RequestResponseBodyMethodProcessor,以及PathVariableMapMethodArgumentResol等子类。 ... [详细]
  • 本文介绍了使用Python解析C语言结构体的方法,包括定义基本类型和结构体类型的字典,并提供了一个示例代码,展示了如何解析C语言结构体。 ... [详细]
author-avatar
Cindere丷lla_茹满
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有