言文件操作全解析:從流模型到實(shí)戰(zhàn)避坑指南)
很多人學(xué)C語(yǔ)言學(xué)到指針就覺(jué)得到頭了結(jié)果一寫(xiě)到文件讀寫(xiě)就卡殼。我自己帶過(guò)幾個(gè)實(shí)習(xí)生問(wèn)fopen返回NULL怎么辦有人直接回答“報(bào)錯(cuò)唄”再往下問(wèn)errno、perror、文本模式和二進(jìn)制模式的區(qū)別基本就沒(méi)人能接住。其實(shí)文件操作沒(méi)有想象中難它背后就三件事把數(shù)據(jù)從內(nèi)存搬到磁盤(pán)、從磁盤(pán)讀回內(nèi)存、在搬的過(guò)程中不丟數(shù)據(jù)。這篇文章我打算把C語(yǔ)言文件操作的底層模型、常用API、實(shí)際案例和踩坑記錄放在一起講盡量把“為什么這樣寫(xiě)”也講清楚。不管你是剛學(xué)完指針的學(xué)生還是在嵌入式項(xiàng)目里需要保存參數(shù)的開(kāi)發(fā)者應(yīng)該都能從里面找到能直接用的東西。1. 文件操作要先想清楚C語(yǔ)言里的“文件”到底是什么1.1 從內(nèi)存到磁盤(pán)為什么程序需要文件先問(wèn)一個(gè)看起來(lái)廢話的問(wèn)題程序?yàn)槭裁匆僮魑募驗(yàn)閮?nèi)存是易失的。你定義了一個(gè)結(jié)構(gòu)體數(shù)組跑完函數(shù)數(shù)據(jù)都在可進(jìn)程一退出這些數(shù)據(jù)就沒(méi)了。要讓數(shù)據(jù)在下次啟動(dòng)時(shí)還在就必須落到磁盤(pán)、SSD或者其他持久化介質(zhì)上。配置文件、日志、數(shù)據(jù)庫(kù)文件、圖片、音視頻本質(zhì)上都是同一個(gè)操作程序跟外部存儲(chǔ)交換數(shù)據(jù)。C語(yǔ)言標(biāo)準(zhǔn)庫(kù)里說(shuō)的“文件”比操作系統(tǒng)里的“文件”范圍更寬。它可以是磁盤(pán)上的一個(gè)普通文件也可以是標(biāo)準(zhǔn)輸入、標(biāo)準(zhǔn)輸出、標(biāo)準(zhǔn)錯(cuò)誤這些設(shè)備。你在代碼里用printf往stdout打印其實(shí)就是在做文件操作只是這個(gè)“文件”默認(rèn)接的是顯示器。理解了這一點(diǎn)以后看到fprintf(stdout, hello)就不會(huì)覺(jué)得奇怪它跟printf(hello)是同一個(gè)動(dòng)作。1.2 流(stream)與文件指針先忘掉“文件”這個(gè)詞C語(yǔ)言操作文件核心概念不是“文件”而是“流”。你可以把流想象成一根水管數(shù)據(jù)就是從水管里流過(guò)的水。程序要讀文件就是打開(kāi)一根從文件指向程序的水管字節(jié)從磁盤(pán)流進(jìn)來(lái)要寫(xiě)文件就是打開(kāi)一根從程序指向文件的水管數(shù)據(jù)從內(nèi)存流出去。C語(yǔ)言使用FILE類(lèi)型來(lái)表示一根已經(jīng)打開(kāi)的水管。FILE是一個(gè)結(jié)構(gòu)體里面裝著文件描述符、緩沖區(qū)位置、讀寫(xiě)狀態(tài)、錯(cuò)誤標(biāo)志這些信息。但你不用關(guān)心它內(nèi)部長(zhǎng)什么樣只要拿到FILE *指針后續(xù)的讀寫(xiě)函數(shù)都靠它工作。注意FILE *不是文件內(nèi)容本身它只是訪問(wèn)文件的“把手”。用完了要fclose這個(gè)“把手”才會(huì)還給系統(tǒng)。標(biāo)準(zhǔn)庫(kù)在程序啟動(dòng)時(shí)自動(dòng)打開(kāi)了三個(gè)流stdin、stdout、stderr。所以你看C語(yǔ)言程序不需要fopen就能直接scanf、printf因?yàn)闃?biāo)準(zhǔn)流已經(jīng)預(yù)先打開(kāi)了。1.3 打開(kāi)文件前必須回答的四個(gè)問(wèn)題很多新手寫(xiě)文件操作上來(lái)就fopen(test.txt, r)然后發(fā)現(xiàn)打不開(kāi)就懵了。我建議在寫(xiě)fopen之前先問(wèn)自己四個(gè)問(wèn)題我要讀還是寫(xiě)還是既要讀又要寫(xiě)對(duì)應(yīng)r、w、a、r這些模式。文件不存在怎么辦讀模式會(huì)失敗寫(xiě)模式會(huì)創(chuàng)建。我處理的是文本文件還是二進(jìn)制文件這決定了要不要加b。打開(kāi)失敗了我怎么處理是直接退出還是提示用戶(hù)還是跳過(guò)繼續(xù)跑這四個(gè)問(wèn)題想清楚代碼就不可能寫(xiě)得太亂。我見(jiàn)過(guò)不少人把fopen的返回值直接傳給下一個(gè)函數(shù)完全不判空最后在無(wú)人值守的服務(wù)上崩掉查半天才發(fā)現(xiàn)是配置文件路徑寫(xiě)錯(cuò)了。文件操作和指針操作一樣第一原則就是任何可能失敗的調(diào)用都必須檢查返回值。2. 核心API使用拆解fopen、fclose和讀寫(xiě)函數(shù)怎么選2.1 fopen的打開(kāi)模式一張表記清楚fopen的第二個(gè)參數(shù)是模式字符串常見(jiàn)模式如下模式含義文件不存在時(shí)文件存在時(shí)r只讀失敗從頭讀w只寫(xiě)創(chuàng)建清空后寫(xiě)a追加寫(xiě)創(chuàng)建從末尾追加r讀寫(xiě)失敗從頭讀寫(xiě)w讀寫(xiě)創(chuàng)建清空后讀寫(xiě)a讀寫(xiě)追加創(chuàng)建讀從頭寫(xiě)在末尾rb/wb等二進(jìn)制模式同上同上這里最容易踩的坑是w。它會(huì)在打開(kāi)文件的一瞬間把原有內(nèi)容清掉不管你后面有沒(méi)有寫(xiě)成功。如果你只是想往日志文件里追加一行不小心用了w整份日志就沒(méi)了。所以“追加日志”這種場(chǎng)景我習(xí)慣直接寫(xiě)a既省了fseek到末尾又不會(huì)誤清空。在Windows上區(qū)分文本模式和二進(jìn)制模式很重要。文本模式下讀文件時(shí)系統(tǒng)會(huì)把\r\n轉(zhuǎn)換成\n寫(xiě)文件時(shí)會(huì)把\n轉(zhuǎn)換成\r\n二進(jìn)制模式下不做任何轉(zhuǎn)換。而在Linux/macOS上r和rb沒(méi)有區(qū)別文本模式只是名義上的。這就導(dǎo)致一個(gè)典型問(wèn)題在Windows上寫(xiě)出來(lái)的文件拷貝到Linux或者反過(guò)來(lái)會(huì)出現(xiàn)行尾多一個(gè)\r或者少一個(gè)\r。解決思路后面我會(huì)講核心就是如果文件是程序之間交換的盡量統(tǒng)一用二進(jìn)制模式如果必須跨平臺(tái)處理文本讀進(jìn)來(lái)之后自己處理?yè)Q行符。2.2 字符級(jí)、行級(jí)、塊級(jí)讀寫(xiě)各自用在哪C標(biāo)準(zhǔn)庫(kù)提供了好幾套讀寫(xiě)函數(shù)選哪套取決于你的數(shù)據(jù)形態(tài)。逐字符讀寫(xiě)用fgetc和fputc。比如你要統(tǒng)計(jì)一個(gè)文件里有多少個(gè)a最直接的辦法就是循環(huán)fgetc。優(yōu)點(diǎn)是簡(jiǎn)單缺點(diǎn)是每次讀一個(gè)字符代碼寫(xiě)起來(lái)啰嗦。好在標(biāo)準(zhǔn)庫(kù)內(nèi)部有緩沖區(qū)實(shí)際系統(tǒng)調(diào)用次數(shù)不會(huì)那么夸張但跟批量讀相比仍然慢。逐行讀寫(xiě)用fgets和fputs。fgets的簽名是char *fgets(char *s, int size, FILE *stream)它會(huì)讀取包括換行符在內(nèi)的一行最多讀size-1個(gè)字符然后在末尾補(bǔ)\0。這里有個(gè)關(guān)鍵點(diǎn)如果一行特別長(zhǎng)超過(guò)size-1fgets不會(huì)報(bào)錯(cuò)它只會(huì)先讀一部分剩下的留到下次調(diào)用再讀。你要么把緩沖區(qū)設(shè)大一點(diǎn)要么自己處理“半行”的情況。實(shí)際工程中我通常用fgets加上sscanf的組合既安全又好用后面配置解析器的例子就是這么干的。大塊數(shù)據(jù)用fread和fwrite。它們的簽名是size_t fread(void *ptr, size_t size, size_t nmemb, FILE *stream); size_t fwrite(const void *ptr, size_t size, size_t nmemb, FILE *stream);注意返回值的含義返回的是“成功讀寫(xiě)的元素個(gè)數(shù)”不是字節(jié)數(shù)。很多人寫(xiě)fread(buf, 1, 1024, fp)返回的是實(shí)際讀到的字節(jié)數(shù)如果寫(xiě)fread(buf, 1024, 1, fp)返回值只會(huì)是0或者1代表整個(gè)1024字節(jié)塊是否完整讀完。這兩者區(qū)別很大。做文件復(fù)制時(shí)我習(xí)慣用fread(buf, 1, sizeof(buf), fp)這樣返回值就是真實(shí)字節(jié)數(shù)不容易漏數(shù)據(jù)。下面給一個(gè)通用的文件復(fù)制函數(shù)#include stdio.h int copy_file(const char *src, const char *dst) { FILE *in fopen(src, rb); if (!in) { perror(src); return -1; } FILE *out fopen(dst, wb); if (!out) { perror(dst); fclose(in); return -1; } char buf[4096]; size_t n; while ((n fread(buf, 1, sizeof(buf), in)) 0) { if (fwrite(buf, 1, n, out) ! n) { perror(dst); fclose(in); fclose(out); return -1; } } fclose(in); fclose(out); return 0; }這個(gè)函數(shù)用二進(jìn)制模式打開(kāi)文件防止Windows在文本模式下把0x1A之類(lèi)的字節(jié)當(dāng)成EOF處理。緩沖區(qū)設(shè)成4096是權(quán)衡了內(nèi)存占用和系統(tǒng)調(diào)用次數(shù)之后比較常用的值。真正到了高性能場(chǎng)景還會(huì)用更大的緩沖或者直接用系統(tǒng)調(diào)用但作為通用復(fù)制邏輯這段代碼足夠穩(wěn)。2.3 格式化讀寫(xiě)fprintf/fscanf和sscanf的配合如果你想往文件里寫(xiě)“人類(lèi)可讀”的數(shù)據(jù)比如timeout30用fprintf非常方便。它跟printf的區(qū)別只是多了一個(gè)FILE *參數(shù)。讀取時(shí)對(duì)應(yīng)的fscanf卻是個(gè)坑它遇到空白字符會(huì)跳過(guò)遇到類(lèi)型不匹配會(huì)直接失敗而且不會(huì)告訴你失敗發(fā)生在哪一列。如果你只是讀一個(gè)整數(shù)fscanf(fp, %d, n)還能湊合用要解析結(jié)構(gòu)稍微復(fù)雜一點(diǎn)的文本就很容易留坑。我的經(jīng)驗(yàn)是讀文件時(shí)盡量用fgets先拿一行再用sscanf從字符串里解析。這樣每一行的錯(cuò)誤影響范圍可控你還可以針對(duì)某一行打日志。比如讀一個(gè)“keyvalue”的配置文件char line[256]; while (fgets(line, sizeof(line), fp)) { char key[64] {0}; char value[128] {0}; if (sscanf(line, %63[^]%127[^\n], key, value) 2) { printf(key[%s] value[%s]\n, key, value); } }這里%63[^]的意思是“讀取最多63個(gè)不是的字符”%127[^\n]的意思是“讀取最多127個(gè)不是換行的字符”。這種寫(xiě)法比%s安全因?yàn)樗薅俗畲箝L(zhǎng)度不會(huì)把緩沖區(qū)長(zhǎng)度的數(shù)據(jù)寫(xiě)到數(shù)組外面。注意sscanf不會(huì)幫你自動(dòng)去掉前后的空格所以解析后需要自己trim。后面配置解析器里我會(huì)放一個(gè)完整的trim函數(shù)。2.4 文件定位與錯(cuò)誤處理fseek/ftell/rewind除了順序讀寫(xiě)C語(yǔ)言還支持隨機(jī)訪問(wèn)。fseek可以把讀寫(xiě)位置移動(dòng)到文件任意偏移ftell返回當(dāng)前位置相對(duì)于文件開(kāi)頭的偏移rewind把位置重置到開(kāi)頭。這三個(gè)函數(shù)配合起來(lái)最常見(jiàn)的用途是獲取文件大小long get_file_size(FILE *fp) { long pos ftell(fp); fseek(fp, 0, SEEK_END); long size ftell(fp); fseek(fp, pos, SEEK_SET); return size; }先記住當(dāng)前位置跳到文件末尾拿到偏移再跳回來(lái)。這里的SEEK_SET、SEEK_CUR、SEEK_END對(duì)應(yīng)“從開(kāi)頭”“從當(dāng)前位置”“從文件末尾”三個(gè)基準(zhǔn)。有一點(diǎn)要提醒在文本模式下因?yàn)閾Q行符轉(zhuǎn)換ftell的返回值可能不是真實(shí)的字節(jié)偏移。所以如果你要處理的是二進(jìn)制數(shù)據(jù)請(qǐng)用二進(jìn)制模式打開(kāi)。另外ftell返回的是long在32位系統(tǒng)上最大只能表示2GB左右的文件。想要支持超大文件就得用fseeko/ftello或者平臺(tái)相關(guān)的接口普通課程作業(yè)和中小項(xiàng)目可以不考慮。錯(cuò)誤處理是文件操作最容易忽略的部分。fopen失敗時(shí)返回NULL同時(shí)設(shè)置全局變量errno。用perror(fopen)會(huì)打印“fopen: 具體原因”用strerror(errno)可以獲得錯(cuò)誤描述字符串。我一般這么寫(xiě)#include errno.h #include string.h FILE *fp fopen(path, r); if (!fp) { fprintf(stderr, open %s failed: %s\n, path, strerror(errno)); return -1; }這樣日志里能看到路徑也能看到原因排查效率高很多。3. 實(shí)操用C語(yǔ)言實(shí)現(xiàn)一個(gè)“鍵值對(duì)配置文件解析器”3.1 需求說(shuō)明與設(shè)計(jì)思路理論知識(shí)講太多容易飄下面寫(xiě)一個(gè)能直接用的例子解析類(lèi)似config.ini的鍵值對(duì)配置文件。要求支持空行、#開(kāi)頭的注釋、keyvalue格式并且兩邊可以有多余空格。比如# 服務(wù)器配置 timeout 30 server_name main debugfalse最終提供這樣一個(gè)函數(shù)int get_config_value(const char *filename, const char *key, char *out, size_t out_size);功能是讀取filename指定的文件找到key對(duì)應(yīng)的值拷貝到out。找不到配置項(xiàng)返回-2文件打開(kāi)失敗返回-1成功返回0。為什么要用這個(gè)函數(shù)而不是直接暴露一個(gè)全局結(jié)構(gòu)體因?yàn)椴煌K關(guān)心的配置項(xiàng)不同按需查詢(xún)比較靈活而且內(nèi)存由調(diào)用者管理不容易出現(xiàn)隱藏的全局狀態(tài)。設(shè)計(jì)上我選擇“逐行讀取再解析”的方式而不是用fscanf直接解析文件。原因前面提過(guò)fscanf遇到不匹配的行會(huì)打亂讀取狀態(tài)沒(méi)辦法只跳過(guò)一行繼續(xù)往后再試。用fgets一次讀一行解析失敗就繼續(xù)下一行容錯(cuò)性好很多。3.2 代碼實(shí)現(xiàn)與關(guān)鍵點(diǎn)講解先寫(xiě)trim_whitespace把字符串前后空白去掉。這里必須處理\r因?yàn)閃indows文件的行尾是\r\n我們用fgets讀進(jìn)來(lái)的行在Linux上可能末尾是\n在Windows文本模式下會(huì)變成\n但如果用二進(jìn)制模式讀或者從Linux拷過(guò)來(lái)的文件就可能在\n前面還有一個(gè)\r。trim把它去掉解析就統(tǒng)一了。#include stdio.h #include stdlib.h #include string.h #include errno.h #define MAX_LINE 256 #define MAX_KEY 64 #define MAX_VALUE 128 static void trim_whitespace(char *s) { char *start s; while (*start || *start \t || *start \r || *start \n) { start; } if (start ! s) { memmove(s, start, strlen(start) 1); } size_t len strlen(s); while (len 0 (s[len - 1] || s[len - 1] \t || s[len - 1] \r || s[len - 1] \n)) { s[--len] \0; } }然后是主函數(shù)int get_config_value(const char *filename, const char *key, char *out, size_t out_size) { FILE *fp fopen(filename, r); if (!fp) { fprintf(stderr, open %s failed: %s\n, filename, strerror(errno)); return -1; } char line[MAX_LINE]; int found 0; while (fgets(line, sizeof(line), fp)) { char *p line; while (*p || *p \t) { p; } if (*p # || *p \n || *p \0) { continue; } char k[MAX_KEY] {0}; char v[MAX_VALUE] {0}; if (sscanf(p, %63[^]%127[^\n], k, v) 2) { trim_whitespace(k); trim_whitespace(v); if (strcmp(k, key) 0) { if (out_size 0) { strncpy(out, v, out_size - 1); out[out_size - 1] \0; } found 1; break; } } } fclose(fp); return found ? 0 : -2; }幾個(gè)細(xì)節(jié)你別跳過(guò)。第一進(jìn)入循環(huán)之前我先用fopen(filename, r)打開(kāi)文件這里故意用文本模式因?yàn)樵跇?biāo)準(zhǔn)C里文本模式處理文本文件是符合直覺(jué)的。既然解析器只處理文本配置就不用擔(dān)心換行符轉(zhuǎn)換。第二fgets每次讀一行while循環(huán)判斷條件天然會(huì)在讀到EOF時(shí)結(jié)束。如果你用do-while就得先讀一次再判斷遇到空文件反而要多處理一次所以這里while更合適。第三sscanf的格式串里%63和%127分別對(duì)應(yīng)k和v的最大長(zhǎng)度加上結(jié)尾的\0不會(huì)越界。第四strncpy不會(huì)自動(dòng)補(bǔ)\0所以我手動(dòng)把最后一個(gè)字符置為\0防止目標(biāo)數(shù)組變成非字符串。3.3 編譯運(yùn)行與驗(yàn)證為了測(cè)試寫(xiě)一個(gè)mainint main(void) { char value[MAX_VALUE] {0}; int ret get_config_value(config.ini, timeout, value, sizeof(value)); if (ret 0) { printf(timeout %s\n, value); } else if (ret -1) { fprintf(stderr, config file open error\n); } else { fprintf(stderr, key not found\n); } return 0; }編譯命令gcc -stdc11 -Wall -Wextra -o config_parser config_parser.c當(dāng)前目錄下建一個(gè)config.ini# 服務(wù)器配置 timeout 30 server_name main debugfalse運(yùn)行./config_parser如果一切正常輸出timeout 30。你可以試試把timeout后面的空格去掉、在前后隨意加空格、加空行、加注釋結(jié)果都應(yīng)該一樣。這個(gè)解析器雖然不大但足夠作為文件讀取的一個(gè)完整模板。后續(xù)要擴(kuò)展成更復(fù)雜的格式比如數(shù)組、多行值再往深處加解析邏輯就行。4. 調(diào)試與避坑文件操作最常見(jiàn)的幾個(gè)翻車(chē)現(xiàn)場(chǎng)4.1 文件打不開(kāi)卻找不到原因fopen返回NULL首先要看錯(cuò)誤信息而不是猜。用perror或者strerror(errno)把原因打出來(lái)。常見(jiàn)的原因我整理成了一張表現(xiàn)象常見(jiàn)原因排查方向No such file or directory路徑寫(xiě)錯(cuò)或文件不存在確認(rèn)文件路徑用絕對(duì)路徑測(cè)一次Permission denied沒(méi)有讀/寫(xiě)權(quán)限檢查文件權(quán)限和運(yùn)行用戶(hù)Text file busy文件正在被執(zhí)行等進(jìn)程結(jié)束或換一個(gè)測(cè)試文件Is a directory把目錄名當(dāng)成文件打開(kāi)了確認(rèn)路徑指向普通文件文件被其他進(jìn)程鎖住別的進(jìn)程獨(dú)占打開(kāi)Windows下用資源監(jiān)視器查句柄我可以負(fù)責(zé)任地說(shuō)大部分“打不開(kāi)”的根因是路徑問(wèn)題。特別是程序的工作目錄跟你以為的不一樣。例如在IDE里運(yùn)行程序當(dāng)前目錄往往不是源碼目錄而是項(xiàng)目根目錄或調(diào)試目錄。這時(shí)候相對(duì)路徑config.ini就會(huì)失效。最快的定位方法在代碼里先打印當(dāng)前工作目錄或者在fopen失敗時(shí)打印完整路徑。4.2 換行符、中文編碼和文本模式的坑換行符是文本文件跨平臺(tái)的永恒話題。Windows用\r\nLinux/macOS用\n。C標(biāo)準(zhǔn)庫(kù)在Windows文本模式下會(huì)自動(dòng)轉(zhuǎn)換在Linux上不轉(zhuǎn)換。如果你用fgets讀一個(gè)Windows生成的文本文件在Linux上會(huì)在每行末尾多出一個(gè)\r。解決套路很簡(jiǎn)單解析前做一次“行尾清洗”也就是我前面寫(xiě)的trim_whitespace把\r和\n都去掉。中文亂碼的問(wèn)題要區(qū)分兩層。文件讀寫(xiě)本身只是字節(jié)搬運(yùn)你用fprintf(fp, %s, 你好)寫(xiě)入U(xiǎn)TF-8編碼的中文再用fgets讀回來(lái)內(nèi)存里的字節(jié)沒(méi)有變化。亂碼通常發(fā)生在終端顯示環(huán)節(jié)Windows控制臺(tái)默認(rèn)代碼頁(yè)可能是GBK你往控制臺(tái)打印UTF-8字節(jié)自然就是亂碼。這跟文件操作沒(méi)關(guān)系是終端編碼配置的問(wèn)題。我的建議是文件內(nèi)容統(tǒng)一用UTF-8保存程序內(nèi)部也按UTF-8處理終端顯示的時(shí)候再按終端規(guī)則轉(zhuǎn)碼。4.3 緩沖區(qū)沒(méi)刷新、fclose沒(méi)調(diào)用導(dǎo)致數(shù)據(jù)丟失標(biāo)準(zhǔn)庫(kù)的文件寫(xiě)入是有緩沖區(qū)的。fwrite或fprintf先把數(shù)據(jù)寫(xiě)進(jìn)內(nèi)存里的緩沖區(qū)等到緩沖區(qū)滿(mǎn)、調(diào)用fflush、調(diào)用fclose或程序正常退出時(shí)才真正把數(shù)據(jù)刷到磁盤(pán)。如果你寫(xiě)完沒(méi)fclose程序又異常崩潰數(shù)據(jù)就可能丟。這種問(wèn)題在日志系統(tǒng)里特別常見(jiàn)日志明明打了崩潰前卻沒(méi)刷出去。所以寫(xiě)文件一定要配對(duì)fclose。如果程序接下來(lái)還要繼續(xù)運(yùn)行但又需要確保數(shù)據(jù)立即可見(jiàn)就調(diào)用fflush(fp)。還有fclose本身也可能失敗比如磁盤(pán)滿(mǎn)、網(wǎng)絡(luò)文件系統(tǒng)出錯(cuò)嚴(yán)謹(jǐn)?shù)拇a會(huì)檢查它的返回值。不過(guò)對(duì)大多數(shù)場(chǎng)景只要能在退出前把每個(gè)fopen都對(duì)應(yīng)一個(gè)fclose就能避免90%的詭異問(wèn)題。4.4 二進(jìn)制文件讀寫(xiě)時(shí)結(jié)構(gòu)體對(duì)齊與序列化問(wèn)題很多新手喜歡把一個(gè)結(jié)構(gòu)體直接寫(xiě)進(jìn)文件typedef struct { int id; char name[32]; } Player; Player p {1, hello}; fwrite(p, sizeof(p), 1, fp);這在單機(jī)單版本程序里沒(méi)問(wèn)題一旦要考慮兼容性坑就來(lái)了。第一是結(jié)構(gòu)體對(duì)齊int后面可能跟幾個(gè)填充字節(jié)sizeof(p)在不同編譯器、不同架構(gòu)下可能不一樣。第二是整數(shù)大小端x86是小端ARM有大端也有小端同一個(gè)結(jié)構(gòu)體寫(xiě)出來(lái)的字節(jié)在不同機(jī)器上可能完全無(wú)法解釋。第三是版本演化結(jié)構(gòu)體里加一個(gè)字段老文件就沒(méi)辦法讀了。正規(guī)做法是序列化也就是明確每個(gè)字段的存儲(chǔ)格式。比如固定用4字節(jié)保存id手動(dòng)按字節(jié)寫(xiě)入讀取時(shí)按字節(jié)拼回去。C語(yǔ)言沒(méi)有內(nèi)置序列化庫(kù)你可以在項(xiàng)目里自己實(shí)現(xiàn)一組工具函數(shù)或者引入現(xiàn)成的序列化方案。核心原則是文件格式要由“字節(jié)布局”定義而不是由“結(jié)構(gòu)體定義”決定。4.5 文件被占用、權(quán)限不足和操作系統(tǒng)層面的問(wèn)題最后說(shuō)一個(gè)跟操作系統(tǒng)交互的問(wèn)題。在Windows上如果一個(gè)文件正在被Word、Excel或者其他進(jìn)程獨(dú)占打開(kāi)你的程序嘗試用fopen寫(xiě)它會(huì)返回NULL錯(cuò)誤原因往往是“Permission denied”。這種時(shí)候不是代碼邏輯問(wèn)題是文件鎖沖突。排查時(shí)不要只盯著代碼去任務(wù)管理器看看有沒(méi)有相關(guān)進(jìn)程正在占用文件。Linux下也有類(lèi)似情況比如可執(zhí)行文件正在運(yùn)行時(shí)你不能直接覆蓋它會(huì)出現(xiàn)“Text file busy”。還有一個(gè)常見(jiàn)需求是刪除和重命名文件C標(biāo)準(zhǔn)庫(kù)提供了remove和rename函數(shù)。它們也可能會(huì)因?yàn)槲募徽加枚?。調(diào)用之后記得檢查返回值并用perror打印原因。有一個(gè)小技巧在寫(xiě)測(cè)試程序時(shí)如果remove失敗先看是不是當(dāng)前程序自己還沒(méi)fclose自己占用自己是最容易忽略的。調(diào)試文件操作時(shí)我習(xí)慣在關(guān)鍵路徑上打日志打開(kāi)成功、讀到多少字節(jié)、定位到哪個(gè)偏移、關(guān)閉成功。這個(gè)習(xí)慣幫我省了大量排查時(shí)間。我試過(guò)在一臺(tái)服務(wù)器上排查一個(gè)寫(xiě)日志失敗的問(wèn)題代碼看起來(lái)沒(méi)問(wèn)題文件路徑也正確最后是磁盤(pán)滿(mǎn)了fwrite的返回值沒(méi)檢查導(dǎo)致錯(cuò)誤被吞掉。那之后我所有寫(xiě)文件的代碼都會(huì)檢查返回值至少打一條警告。文件操作沒(méi)有太多玄學(xué)你把每一步的返回值都盯住問(wèn)題基本就藏不住了。