为何百兆静态库能打进数兆的可执行文件?

前言

第三方库是工程开发必不可少的部分,而第三方库可以是.a和.framework的静态库,也可以是.framework的动态库,其中静态库是最常用的方式。
静态库往往比较大,可在打包到可执行文件之后,对安装包大小的增加远远小于静态库本身的Size。
那么,就产生两个问题:
1、静态库里面存在什么内容?
2、静态链接到可执行文件后为什么体积变小?
本文就以.framework的静态库来分析具体情况。

正文

1、framework静态库的打包

新建工程,选择Cocoa Touch Framework,再到Build Settings选择Mach-O TypeStatic Library,然后build出来目标文件就是framework静态库。

2、framework静态库的内容

按照上面的步骤打包出来的LYTestKit.framework,具体的内容如下:


  • Headers为头文件;
  • plist文件和Modules文件夹是一些描述文件;
  • LYTestKit为Mach-O binary文件,LYTestKit占了静态库99%的体积。

3、LYTestKit文件内容分析

打开terminal(终端),进入文件夹所在目录,输入指令file LYTestKit

LYTestKit: Mach-O universal binary with 4 architectures: [arm_v7:current ar archive] [arm64]
LYTestKit (for architecture armv7): current ar archive
LYTestKit (for architecture i386):  current ar archive
LYTestKit (for architecture x86_64):    current ar archive
LYTestKit (for architecture arm64): current ar archive

可以知道LYTestKit包括armv7i386x86_64arm64四种CPU架构的指令。
接下来就是我们的大杀器Hopper Disassembler登场。


软件的链接地址,密码:vbrqit

Hopper Disassembler打开LYTestKit,选择架构为arm64,再选择一个原工程对应的.o文件,首先映入眼帘的是下面这段描述:(不知道.o文件是什么的,点这里复习下)

/*
--------------------------------------------------------------------------------

        File: /Users/loyinglin/Documents/LYTestKit/Framework/LYTestKit.framework/LYTestKit
        MachO file
        CPU: aarch64
        64 bits

--------------------------------------------------------------------------------
*/

接下来,是这个文件的描述:

        ; Segment
        ; Range: [0x0; 0x8a1b[ (35355 bytes)
        ; File offset : [3584; 38939[ (35355 bytes)
        ; Permissions: readable / writable / executable

整个文件的大小是35355 bytes,对应的区间为[3584, 38939]。
文件的最后一行为:

0000000000008a1a        db  0x01 ; '.'

整个Segment的地址是0x8a1b结束,十六进制0x8a1b = 35355 十进制。
从这里可以看出,静态库中地址与大小一一对应。
可以这么理解,假如某条指令需要到地址0x0008a1a取值,即是相对应起始位置加上0x0008a1a偏移的地址。
而静态库中的偏移应该等于内存中的偏移,那么0x0008a1a的偏移地址在内存中的大小就是35355 bytes。

紧接着是下面这段描述:

        ; Section __text
        ; Range: [0x0; 0x2300[ (8960 bytes)
        ; File offset : [3584; 12544[ (8960 bytes)
        ; Flags: 0x80000400
        ;   S_REGULAR
        ;   S_ATTR_PURE_INSTRUCTIONS
        ;   S_ATTR_SOME_INSTRUCTIONS

.Section __text表示接下来是代码段的内容,机器指令的大小为8960 bytes。
类似的,代码段之后还有:

  • Section __objc_classrefs 类的引用,大小为 64 bytes
  • Section __objc_methname 自动生成和声明的函数名, 大小为2140 bytes;("viewDidLoad"、"init"这样的函数名常量)
  • Section __objc_selrefs selector的引用),大小为 520 bytes;(@selector(init)、@selector(setProperty:))
  • Section __objc_data 初始化的变量, 大小为80 bytes;(@property、ivar、 struct __objc_class这样的变量)
  • Section __objc_ivar ivar的引用,大小为 84 bytes;(OBJC_IVAR$_SampleClass._property)
    ivar是objc_ivar的指针,objc_ivar有变量名、变量类型等成员,如下:
typedef objc_ivar * Ivar;
  struct objc_ivar {
     char *ivar_name;
     char *ivar_type;
     int ivar_offset;
  #ifdef __LP64__
     int space;
  #endif
  }
  • Section __cstring 代码中声明的字符常量,大小为 1360 bytes;(@"Hello"、@"你好"这样的字符常量)
  • Section __cfstring 代码中声明的CFString字符常量,大小为 224 bytes
  • Section __objc_classname Objective-C Class的类名,大小为 64 bytes
  • Section __objc_const __objc_metaclass_xxx常量的引用和__objc_class_xxx structs 的声明,大小为 3672 bytes;(OC的runtime用结构体比如struct __objc_method、 struct __objc_ivar 、struct __objc_property)
  • Section __debug_str 调试用的字符信息,包括方法对应的字符串,大小为 5489 bytes
  • Section __debug_line 调试用的代码行号信息,大小为 2891 bytes
  • 以及各类其他的Section。

在大致了解一个.o文件的内部构成之后,我们来看看链接过程.o文件变化。

4、静态链接的过程

静态连接就是把静态链接库中的文件链接到可执行文件中,整个过程由链接器负责。
链接过程分为两步:

  • 1、空间和地址分配,扫描所有的目标文件,获得各个段的长度、属性、位置信息,并把所有的符号定义以及引用收集起来,放到全局的符号表中。通过所有段的长度,计算和合并后的长度和位置,并建立映射关系;
  • 2、符号解析和重定位,使用上一步收集到的信息,读取文件中段的数据和重定位信息,进行符号解析和重定位。

静态链接的更详细内容点这里

那么可执行文件的内部是什么组成?
答案是:File Header.text secton.data secton.bss secton四大部分。
File Header是文件头,描述整个文件的文件属性,包括是否可执行文件、目标操作系统、目标硬件等信息。文件头还包括一个段表(Section Table)描述下面几个段的偏移地址以及属性。
.text section是代码段,存放编译生成的指令;
.data section是数据段,存放已初始化的静态常量数据;
.bss section存放未初始化的静态常量。

静态库链接过程体积变小的答案

framework静态库在链接之后,体积会急剧减少,原因有几个:
1、用于链接的信息被剔除,比如说类引用、函数名等,字符信息中的函数名字等在链接时会放入链接表,用于查找地址,但不打入二进制文件;
2、调试用的信息比如符号串、代码行号等不会打入二进制包,而是额外生成符号表;
3、Xcode默认在release下会用fastest的优化选项;

总结

经过此次思考,对静态库的内容有更清晰的认识,也对编译与链接更加了解。

附录
exploring Mach-O binaries
analysis of facebook app
classllvm MCSectionMachO
developer.apple Assemble asm_directives

最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 206,013评论 6 481
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 88,205评论 2 382
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 152,370评论 0 342
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 55,168评论 1 278
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 64,153评论 5 371
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 48,954评论 1 283
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 38,271评论 3 399
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 36,916评论 0 259
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 43,382评论 1 300
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 35,877评论 2 323
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 37,989评论 1 333
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 33,624评论 4 322
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 39,209评论 3 307
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 30,199评论 0 19
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 31,418评论 1 260
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 45,401评论 2 352
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 42,700评论 2 345

推荐阅读更多精彩内容