色五月色开心色婷婷色丁香,五月婷婷丁香花综合网,婷婷丁香五月激情综合在线,五月婷婷六月丁香动漫,婷婷丁香五月激情综合在线,丁香花中文字幕在线观看,播五月色五月开心五月网,开心激情综合网,狠狠色丁香婷婷综合最新地址,丁香视频在线观看,狠狠做六月爱婷婷综合av,久久激情五月丁香伊人

ARTICLE DETAIL

資訊詳情

深耕商務(wù)建站與企業(yè)官網(wǎng)運(yùn)營(yíng)的一線實(shí)戰(zhàn)洞察。

本地大模型硬件需求計(jì)算器:從顯存估算到量化選型

本地大模型硬件需求計(jì)算器:從顯存估算到量化選型 很多開發(fā)者在剛接觸本地大模型時(shí)第一個(gè)困擾往往不是“模型怎么調(diào)”而是“我這臺(tái)電腦到底能不能跑起來(lái)”。去社區(qū)問(wèn)了一圈有人用 8GB 顯存跑 7B 模型很流暢有人說(shuō) 16GB 顯存加載就 OOM還有人拿著 4070 問(wèn)能不能微調(diào) 70B。你會(huì)發(fā)現(xiàn)網(wǎng)上關(guān)于本地 LLM 硬件需求的討論幾乎都是零散的個(gè)人經(jīng)驗(yàn)缺少一個(gè)從參數(shù)和公式出發(fā)的量化計(jì)算工具。本文就圍繞“Hardware requirement calculator for local LLMs”這個(gè)主題完整講解本地大模型硬件需求的計(jì)算邏輯并帶你從零實(shí)現(xiàn)一個(gè)可用的硬件需求計(jì)算器。文章會(huì)覆蓋精度格式FP32、FP16、BF16、INT8、INT4對(duì)顯存的影響、KV Cache 的估算方法、推理與訓(xùn)練兩種場(chǎng)景的差異、代碼實(shí)現(xiàn)步驟以及最終如何用計(jì)算結(jié)果指導(dǎo)選卡和配置。適合剛?cè)腴T大模型本地部署的開發(fā)者也適合需要做硬件選型評(píng)估的技術(shù)負(fù)責(zé)人。1. 為什么本地 LLM 需要硬件需求計(jì)算器先說(shuō)一個(gè)常見的現(xiàn)象很多人在決定下載模型之前完全靠“別人說(shuō)能跑”來(lái)做判斷。比如有人看到“7B 模型 Q4 量化只要 4GB 顯存”于是拿著 6GB 顯存的舊顯卡去下載結(jié)果加載到一半進(jìn)程被殺或者生成速度慘不忍睹。還有人在 CPU 上硬跑 70B 模型每個(gè) Token 等好幾秒以為是代碼寫錯(cuò)了其實(shí)是硬件帶寬遠(yuǎn)不達(dá)標(biāo)。要避免這種問(wèn)題最好在下載模型之前就手算出一個(gè)“下限值”這個(gè)模型至少需要多少顯存、多少內(nèi)存推理速度大概會(huì)落在什么區(qū)間。硬件需求計(jì)算器的價(jià)值就在這里。它本質(zhì)上是一個(gè)基于模型參數(shù)、精度格式、上下文長(zhǎng)度、批處理大小等輸入項(xiàng)輸出顯存需求、內(nèi)存需求、推薦硬件檔位的工具。它能幫你解決三個(gè)問(wèn)題我的顯卡夠不夠跑這個(gè)模型如果不夠量化到 INT4 之后夠不夠如果只是跑推理和做微調(diào)相比硬件差距有多大另外本地 LLM 部署并不是簡(jiǎn)單地“模型文件多大就要多少顯存”。模型加載后顯存里除了權(quán)重還有 KV Cache、激活值、CUDA Context 等一系列額外開銷。不考慮這些算出來(lái)的結(jié)果和實(shí)際情況會(huì)有很大偏差。2. 本地 LLM 硬件需求的基礎(chǔ)概念要理解計(jì)算器先要把幾個(gè)核心概念弄清楚。這一節(jié)的內(nèi)容會(huì)比較基礎(chǔ)但它們是后面所有估算公式的根基。2.1 模型參數(shù)量Parameters模型參數(shù)量是衡量 LLM 規(guī)模最直接的指標(biāo)。我們說(shuō)“7B 模型”就是指模型有大約 70 億個(gè)參數(shù)。參數(shù)量直接決定了兩件事模型的學(xué)習(xí)能力和表達(dá)能力模型文件的大小和運(yùn)行時(shí)占用資源。常見模型規(guī)模對(duì)應(yīng)的參數(shù)數(shù)量如下模型規(guī)模參數(shù)量7B約 70 億13B約 130 億33B約 330 億70B約 700 億需要說(shuō)明的是不同模型架構(gòu)在相同參數(shù)量下實(shí)際結(jié)構(gòu)會(huì)有差異比如 LLaMA 和 Mistral 層數(shù)、頭數(shù)都不同。但作為粗略估算參數(shù)量是最通用的起點(diǎn)。2.2 精度格式FP32、FP16、BF16、INT8、INT4同樣一個(gè)模型參數(shù)用多少位來(lái)存儲(chǔ)直接決定模型體積和顯存占用。大模型領(lǐng)域最常見的精度格式有FP3232 位浮點(diǎn)每個(gè)參數(shù)占 4 個(gè)字節(jié)。精度最高范圍最廣但顯存占用也最大?;旧蠜]有人在推理時(shí)用純 FP32 跑大模型更多是在訓(xùn)練時(shí)作為 Master Weight 存在。FP1616 位浮點(diǎn)每個(gè)參數(shù)占 2 個(gè)字節(jié)。精度比 FP32 低但因?yàn)轱@存減半是早期大模型推理的主流格式。它在數(shù)值范圍上有限制|x| 超過(guò) 65504 會(huì)溢出不過(guò)對(duì)推理影響通常不大。BF16BFloat1616 位浮點(diǎn)每個(gè)參數(shù)同樣占 2 個(gè)字節(jié)。BF16 的動(dòng)態(tài)范圍和 FP32 幾乎一樣犧牲了尾數(shù)精度但減少了溢出問(wèn)題。現(xiàn)在主流訓(xùn)練框架都推薦用 BF16因?yàn)榇竽P吞荻热菀壮霈F(xiàn)尺度差異。INT88 位整數(shù)量化每個(gè)參數(shù)占 1 個(gè)字節(jié)。把浮點(diǎn)權(quán)重縮放到整數(shù)范圍來(lái)存儲(chǔ)和計(jì)算顯存直接再減一半。推理時(shí)常用 Weight-Only 量化效果在小模型上會(huì)有所損失但在大模型上表現(xiàn)相當(dāng)好。INT44 位整數(shù)量化每個(gè)參數(shù)理論上只占 0.5 個(gè)字節(jié)。這是社區(qū)最常用的格式比如 GGUF Q4_K_M、GPTQ INT4 等。顯存占用極低但量化誤差相對(duì)更大。對(duì) 7B 模型來(lái)說(shuō)INT4 量化后權(quán)重文件只有 3.5GB 左右很多 4GB 獨(dú)顯的機(jī)器也能跑起來(lái)。為了直觀我把每個(gè)參數(shù)占用的空間整理成表精度每參數(shù)字節(jié)數(shù)7B 模型權(quán)重大小FP324約 28 GBFP16 / BF162約 14 GBINT81約 7 GBINT40.5約 3.5 GB這就是為什么同一個(gè)模型官方通常建議 28GB 顯存但量化到 INT4 只要 4GB 左右就能跑。2.3 KV Cache 與推理開銷很多人只算了權(quán)重顯存忽略了一個(gè)重要部分——KV Cache。在大模型推理時(shí)每生成一個(gè) Token都要把當(dāng)前的 Key 和 Value 緩存下來(lái)供后續(xù) Attention 計(jì)算使用。這部分的顯存占用和輸入輸出長(zhǎng)度成正比也和模型層數(shù)、頭數(shù)、維度有關(guān)。粗略估算公式KV_Cache_Size 2 × num_layers × num_kv_heads × head_dim × seq_len × batch_size × bytes_per_element不過(guò)在實(shí)際工程中我們可以用一個(gè)更簡(jiǎn)單的經(jīng)驗(yàn)值來(lái)估算。通常 KV Cache 大約占模型權(quán)重的 10% 到 30%在長(zhǎng)上下文場(chǎng)景下甚至更高。這也是為什么有人短上下文跑得好好的把 max_length 從 4096 調(diào)到 8192 之后直接 OOM。除了權(quán)重和 KV Cache顯存還需要容納CUDA Context大約 300MB 到 1GB 不等激活值A(chǔ)ctivation和臨時(shí)計(jì)算緩沖輸入 Token 的 Embedding推理框架的額外固定開銷。所以安全的做法是把權(quán)重顯存和 KV Cache 算完之后再額外預(yù)留 1GB 到 2GB 作為緩沖。這也是社區(qū)很多人“按理論算剛好夠?qū)嶋H一跑就爆”的原因——緩沖不夠。2.4 推理與訓(xùn)練的區(qū)別同一塊顯卡跑推理和做微調(diào)完全是兩個(gè)世界。推理只需要保存模型權(quán)重和中間激活梯度不需要保留。所以顯存需求約等于“權(quán)重 KV Cache 額外開銷”。微調(diào)則還要保存梯度梯度和參數(shù)同尺寸、優(yōu)化器狀態(tài)不同優(yōu)化器大小不同、以及更長(zhǎng)的激活鏈。例如用 Adam 優(yōu)化器訓(xùn)練一個(gè) FP16 模型僅優(yōu)化器狀態(tài)就要額外占用 8 字節(jié)/參數(shù)Momentum 和 Variance 各 4 字節(jié)加上梯度的 2 字節(jié)/參數(shù)訓(xùn)練時(shí)單個(gè)參數(shù)的顯存開銷遠(yuǎn)大于推理。近似計(jì)算訓(xùn)練顯存 權(quán)重(2字節(jié)) 梯度(2字節(jié)) Adam狀態(tài)(8字節(jié)) 激活值等 ≈ 每參數(shù) 12 字節(jié)以上也就是說(shuō)FP16 訓(xùn)練一個(gè) 7B 模型光是權(quán)重、梯度和優(yōu)化器狀態(tài)就需要 84GB 左右單靠一張 24GB 顯卡根本裝不下。這也是為什么 LoRA、QLoRA 這類參數(shù)高效微調(diào)會(huì)如此流行——它們把可訓(xùn)練參數(shù)量大幅壓縮從而把訓(xùn)練顯存需求降到普通消費(fèi)級(jí)顯卡能接受的范圍。3. 硬件需求計(jì)算器的核心計(jì)算邏輯理解了上面的概念我們就可以來(lái)設(shè)計(jì)計(jì)算器了。核心就是一組公式根據(jù)用戶輸入的模型參數(shù)、精度和運(yùn)行場(chǎng)景算出顯存和內(nèi)存需求。3.1 權(quán)重顯存計(jì)算公式非常簡(jiǎn)單weight_memory num_params × bytes_per_param例如 7B 模型FP16 精度7,000,000,000 × 2 14,000,000,000 字節(jié) ≈ 14 GBINT4 精度按 0.5 字節(jié)7,000,000,000 × 0.5 3,500,000,000 字節(jié) ≈ 3.5 GB這個(gè)部分是最確定的幾乎不會(huì)因?yàn)檫\(yùn)行環(huán)境不同而變化。3.2 KV Cache 估算嚴(yán)格計(jì)算 KV Cache 需要知道模型具體架構(gòu)但作為通用工具我們可以用模型參數(shù)量的比例來(lái)粗估。這里我用一個(gè)經(jīng)驗(yàn)系數(shù)kv_cache_factor取值范圍通常在 0.1 到 0.3 之間默認(rèn) 0.15。kv_cache_memory weight_memory × kv_cache_factor如果你想更精確一點(diǎn)可以讓用戶輸入層數(shù)、KV Heads、Head Dim 和序列長(zhǎng)度用公式直接計(jì)算。下面計(jì)算器代碼里我會(huì)同時(shí)提供兩種模式快速估算和精細(xì)估算。3.3 推理場(chǎng)景總結(jié)推理所需的總顯存total_vram weight_memory kv_cache_memory overhead其中 overhead 建議至少 1GB如果是 Windows 環(huán)境或者不用 WSL 的話可以再放大一些因?yàn)?Windows 的顯存管理策略不同驅(qū)動(dòng)也會(huì)占一部分顯存。3.4 訓(xùn)練場(chǎng)景適配 LoRA/QLoRA 時(shí)可訓(xùn)練參數(shù)量會(huì)大幅減少。QLoRA 通常只需對(duì)低秩矩陣做梯度計(jì)算所以我們可以用一個(gè)參數(shù)trainable_params_ratio來(lái)表示可訓(xùn)練參數(shù)占全量的比例。training_memory weight_memory weight_memory × (gradient_ratio optimizer_bytes_per_param / bytes_per_element) activated_memory不過(guò)這種精確建模會(huì)很復(fù)雜且不同框架差異大。計(jì)算器里我建議用簡(jiǎn)化模型直接輸出“推理所需顯存”然后按經(jīng)驗(yàn)系數(shù)顯示“全參數(shù)微調(diào)所需顯存約是推理的 5-8 倍”作為警告。對(duì)多數(shù)讀者來(lái)說(shuō)這個(gè)信息量已經(jīng)足夠。3.5 內(nèi)存帶寬與生成速度除了顯存容量還有一個(gè)容易被忽視的硬件參數(shù)——內(nèi)存帶寬。大模型推理屬于“訪存密集型”任務(wù)尤其在低并發(fā)場(chǎng)景下GPU 每生成一個(gè) Token都要把整個(gè)模型權(quán)重從顯存讀一遍。所以理論最大生成速度約等于tokens_per_sec ≈ memory_bandwidth / model_size_in_bytes舉例一塊 4090顯存帶寬約 1008 GB/sFP16 的 7B 模型權(quán)重 14GB理論速度約為1008 / 14 ≈ 72 tokens/s如果是 INT4 量化權(quán)重 3.5GB理論上限約 288 tokens/s不過(guò)實(shí)際還會(huì)受計(jì)算單元限制和其他開銷影響但方向是對(duì)的。所以計(jì)算器也可以輸出一個(gè)預(yù)估生成速度區(qū)間對(duì)用戶體驗(yàn)有很大參考價(jià)值。4. 完整實(shí)戰(zhàn)從零實(shí)現(xiàn)一個(gè) LLM 硬件需求計(jì)算器下面進(jìn)入實(shí)戰(zhàn)環(huán)節(jié)。我會(huì)實(shí)現(xiàn)兩個(gè)版本一個(gè) Python 命令行版本適合快速腳本調(diào)用和二次開發(fā)一個(gè) HTML JavaScript 網(wǎng)頁(yè)版本適合直接雙擊打開使用方便沒有 Python 環(huán)境的同學(xué)。4.1 創(chuàng)建項(xiàng)目結(jié)構(gòu)llm-hw-calculator/ ├── calculator.py ├── index.html └── README.md4.2 Python 命令行版本先實(shí)現(xiàn)核心邏輯。打開calculator.py寫入以下代碼# 文件路徑llm-hw-calculator/calculator.py def bytes_per_param(precision: str) - float: 返回不同精度下每個(gè)參數(shù)占用的字節(jié)數(shù) mapping { fp32: 4.0, fp16: 2.0, bf16: 2.0, int8: 1.0, int4: 0.5, } if precision.lower() not in mapping: raise ValueError(f不支持的精度類型: {precision}可選: {list(mapping.keys())}) return mapping[precision.lower()] def estimate_weight_memory(num_params_billion: float, precision: str) - float: 估算模型權(quán)重的顯存占用單位為 GB num_params num_params_billion * 1e9 return num_params * bytes_per_param(precision) / (1024 ** 3) def estimate_kv_cache_memory(weight_memory_gb: float, seq_len: int, config: dict None) - float: 估算 KV Cache 顯存占用。 如果提供了模型結(jié)構(gòu)參數(shù)則用精細(xì)公式 否則使用經(jīng)驗(yàn)比例粗估。 if config: num_layers config[num_layers] num_kv_heads config[num_kv_heads] head_dim config[head_dim] batch_size config.get(batch_size, 1) # 2 表示 K 和 V 兩份緩存 kv_bytes 2 * num_layers * num_kv_heads * head_dim * seq_len * batch_size * 2.0 return kv_bytes / (1024 ** 3) # 經(jīng)驗(yàn)值KV Cache 約為權(quán)重的 10%~30%這里取 15% return weight_memory_gb * 0.15 def estimate_inference_vram(num_params_billion: float, precision: str, seq_len: int 4096, model_config: dict None) - dict: 估算推理所需顯存和生成速度相關(guān)指標(biāo) weight_mem estimate_weight_memory(num_params_billion, precision) kv_mem estimate_kv_cache_memory(weight_mem, seq_len, model_config) overhead 1.0 # CUDA Context 激活值等固定開銷 total_vram weight_mem kv_mem overhead return { weight_memory_gb: round(weight_mem, 2), kv_cache_memory_gb: round(kv_mem, 2), estimated_overhead_gb: overhead, total_vram_gb: round(total_vram, 2), } def estimate_training_vram(inference_result: dict) - dict: 全參數(shù)微調(diào)粗略估算通常是推理的 5-8 倍 factor_min 5 factor_max 8 return { training_vram_min_gb: round(inference_result[total_vram_gb] * factor_min, 2), training_vram_max_gb: round(inference_result[total_vram_gb] * factor_max, 2), note: 全參數(shù)微調(diào)需要保存梯度與優(yōu)化器狀態(tài)顯存通常是推理的 5-8 倍使用 LoRA/QLoRA 可大幅降低。 } def estimate_generation_speed(bandwidth_gb_per_s: float, num_params_billion: float, precision: str) - float: 理論最大生成速度tokens/s只考慮權(quán)重復(fù)讀耗時(shí) model_size_gb estimate_weight_memory(num_params_billion, precision) if model_size_gb 0: return 0.0 return round(bandwidth_gb_per_s / model_size_gb, 2) if __name__ __main__: # 例子7B 模型INT4 量化上下文 4096在 4090 上推理 example_vram estimate_inference_vram( num_params_billion7.0, precisionint4, seq_len4096 ) print( 推理顯存估算 ) for key, value in example_vram.items(): print(f{key}: {value} GB) print(\n 微調(diào)顯存估算 ) training_info estimate_training_vram(example_vram) for key, value in training_info.items(): print(f{key}: {value}) print(\n 生成速度粗算RTX 4090 約 1008 GB/s ) speed estimate_generation_speed( bandwidth_gb_per_s1008, num_params_billion7.0, precisionint4 ) print(f理論最大生成速度約: {speed} tokens/s)這段代碼的核心就是幾個(gè)純函數(shù)輸入輸出都很清晰。逐個(gè)解釋bytes_per_param精度映射表INT4 返回 0.5 字節(jié)。estimate_weight_memory權(quán)重顯存。estimate_kv_cache_memory優(yōu)先用精細(xì)公式缺少架構(gòu)參數(shù)時(shí)退回經(jīng)驗(yàn)比例。estimate_inference_vram匯總。overhead 固定 1GB這個(gè)值你可以根據(jù)自己的環(huán)境調(diào)整Windows 下建議 1.5GB。estimate_training_vram給出全參數(shù)微調(diào)的粗估區(qū)間。estimate_generation_speed理論最大速度強(qiáng)調(diào)“理論”因?yàn)閷?shí)際要打折扣。運(yùn)行結(jié)果類似 推理顯存估算 weight_memory_gb: 3.5 GB kv_cache_memory_gb: 0.52 GB estimated_overhead_gb: 1 GB total_vram_gb: 5.02 GB 微調(diào)顯存估算 training_vram_min_gb: 25.12 GB training_vram_max_gb: 40.19 GB note: 全參數(shù)微調(diào)需要保存梯度與優(yōu)化器狀態(tài)顯存通常是推理的 5-8 倍使用 LoRA/QLoRA 可大幅降低。 生成速度粗算RTX 4090 約 1008 GB/s 理論最大生成速度約: 288.0 tokens/s如果你用 FP16 跑同一個(gè) 7B 模型weight_memory_gb: 14.0 GB kv_cache_memory_gb: 2.1 GB estimated_overhead_gb: 1 GB total_vram_gb: 17.1 GB同樣是 7B 模型FP16 和 INT4 的總顯存差了 12GB 左右。這就是量化對(duì)本地部署的意義。4.3 支持模型結(jié)構(gòu)參數(shù)的精細(xì)模式上面的estimate_kv_cache_memory已經(jīng)預(yù)留了config參數(shù)。如果你想在計(jì)算器中嵌入某個(gè)具體模型的結(jié)構(gòu)信息可以這樣用。這里以 LLaMA-7B 為例llama_7b_config { num_layers: 32, num_kv_heads: 32, head_dim: 128, batch_size: 1, } # 在 seq_len4096 時(shí)KV Cache 約為 1.0 GB kv_cache estimate_kv_cache_memory( weight_memory_gb14.0, seq_len4096, configllama_7b_config ) print(f精細(xì)模式 KV Cache: {kv_cache:.2f} GB)實(shí)際上不同模型架構(gòu)的 KV Cache 計(jì)算方式逐步演進(jìn)。像 GQAGrouped Query Attention在 LLaMA 2 70B 中出現(xiàn)后KV Head 數(shù)量遠(yuǎn)小于 Query Head 數(shù)量KV Cache 會(huì)更小。這也是為什么部分大模型在長(zhǎng)上下文場(chǎng)景下尤其依賴 GQA。你的計(jì)算器如果有模型庫(kù)把這些參數(shù)配置成 JSON 是不錯(cuò)的選擇。4.4 HTML 網(wǎng)頁(yè)版本為了讓沒有 Python 環(huán)境的同學(xué)也能用我把同樣的邏輯做成一個(gè)純前端頁(yè)面。打開index.html寫入以下代碼!DOCTYPE html html langzh-CN head meta charsetUTF-8 meta nameviewport contentwidthdevice-width, initial-scale1.0 title本地 LLM 硬件需求計(jì)算器/title style body { font-family: -apple-system, BlinkMacSystemFont, Segoe UI, sans-serif; max-width: 720px; margin: 0 auto; padding: 20px; background: #f7f8fa; color: #333; } .card { background: #fff; border-radius: 12px; padding: 24px; margin-bottom: 16px; box-shadow: 0 2px 8px rgba(0, 0, 0, 0.06); } h1 { font-size: 1.5rem; } label { display: block; font-weight: 600; margin-bottom: 6px; } select, input { width: 100%; padding: 10px; margin-bottom: 16px; border: 1px solid #ddd; border-radius: 8px; font-size: 1rem; box-sizing: border-box; } button { background: #1677ff; color: #fff; border: none; padding: 12px 24px; border-radius: 8px; font-size: 1.05rem; cursor: pointer; } button:hover { background: #0958d9; } .result-item { display: flex; justify-content: space-between; padding: 8px 0; border-bottom: 1px solid #f0f0f0; } .result-item:last-child { border-bottom: none; } .warn { background: #fffbe6; border: 1px solid #ffe58f; border-radius: 8px; padding: 12px; margin-top: 12px; font-size: 0.9rem; } /style /head body div classcard h1本地 LLM 硬件需求計(jì)算器/h1 p根據(jù)模型參數(shù)、精度、上下文長(zhǎng)度估算推理所需顯存、微調(diào)顯存范圍和理論生成速度。/p /div div classcard label formodelSize模型參數(shù)量B/label input typenumber idmodelSize value7 step0.1 min0.1 label forprecision精度格式/label select idprecision option valuefp32FP324 字節(jié)/參數(shù)/option option valuefp16 selectedFP162 字節(jié)/參數(shù)/option option valuebf16BF162 字節(jié)/參數(shù)/option option valueint8INT81 字節(jié)/參數(shù)/option option valueint4INT40.5 字節(jié)/參數(shù)/option /select label forseqLen上下文長(zhǎng)度Tokens/label input typenumber idseqLen value4096 step512 min512 label forbandwidthGPU 顯存帶寬GB/s/label input typenumber idbandwidth value1008 step50 min50 button onclickcalculate()計(jì)算硬件需求/button /div div classcard idresult styledisplay:none; h2推理顯存估算/h2 div idinferenceResult/div h2微調(diào)顯存估算/h2 div idtrainingResult/div h2理論生成速度/h2 div idspeedResult/div div classwarn idwarning/div /div script const PRECISION_BYTES { fp32: 4.0, fp16: 2.0, bf16: 2.0, int8: 1.0, int4: 0.5, }; function calculate() { const modelSizeB parseFloat(document.getElementById(modelSize).value); const precision document.getElementById(precision).value; const seqLen parseInt(document.getElementById(seqLen).value); const bandwidth parseFloat(document.getElementById(bandwidth).value); if (!modelSizeB || modelSizeB 0) { alert(請(qǐng)?zhí)顚懩P蛥?shù)量); return; } const bytesPerParam PRECISION_BYTES[precision]; const numParams modelSizeB * 1e9; const weightBytes numParams * bytesPerParam; const weightGB weightBytes / (1024 ** 3); // KV Cache 粗估權(quán)重 15% const kvGB weightGB * 0.15; // 固定開銷 const overheadGB 1.0; const totalVRAM weightGB kvGB overheadGB; const trainMin totalVRAM * 5; const trainMax totalVRAM * 8; // 理論速度 const theoreticalSpeed bandwidth / weightGB; document.getElementById(inferenceResult).innerHTML div classresult-itemspan模型權(quán)重/spanspan${weightGB.toFixed(2)} GB/span/div div classresult-itemspanKV Cache估算/spanspan${kvGB.toFixed(2)} GB/span/div div classresult-itemspan固定開銷CUDA Context 等/spanspan${overheadGB.toFixed(2)} GB/span/div div classresult-item stylefont-weight:700;span推薦顯存下限/spanspan${totalVRAM.toFixed(2)} GB/span/div ; document.getElementById(trainingResult).innerHTML div classresult-itemspan全參數(shù)微調(diào)估算/spanspan${trainMin.toFixed(2)} ~ ${trainMax.toFixed(2)} GB/span/div ; document.getElementById(speedResult).innerHTML div classresult-itemspan理論最大生成速度/spanspan${theoreticalSpeed.toFixed(2)} tokens/s/span/div div classresult-itemspan實(shí)際體驗(yàn)參考/spanspan約 ${(theoreticalSpeed * 0.4).toFixed(2)} ~ ${(theoreticalSpeed * 0.7).toFixed(2)} tokens/s/span/div ; let warnText ; if (totalVRAM 24) { warnText 推薦顯存超過(guò) 24GB常見消費(fèi)級(jí)顯卡較難滿足。建議嘗試更大量化如 INT4或選擇更小模型也可以考慮云 GPU 實(shí)例。; } else if (totalVRAM 12) { warnText 推薦顯存超過(guò) 12GB建議確認(rèn)你的顯卡顯存是否足夠。若不足可以改用 INT4/INT8 量化并縮短上下文長(zhǎng)度。; } else { warnText 當(dāng)前配置在主流 8GB~24GB 顯卡上都有機(jī)會(huì)運(yùn)行。具體流暢度還要看內(nèi)存帶寬和系統(tǒng)顯存共享策略。; } document.getElementById(warning).innerText warnText; document.getElementById(result).style.display block; } /script /body /html這個(gè)頁(yè)面就是一個(gè)完整的計(jì)算器。用瀏覽器打開后輸入模型參數(shù)量選擇精度格式設(shè)置上下文長(zhǎng)度填顯卡顯存帶寬點(diǎn)擊按鈕就能得到結(jié)果。頁(yè)面里我另外加了一個(gè)“實(shí)際體驗(yàn)參考”取理論速度的 40% 到 70%這是考慮到 Attention 計(jì)算、采樣、接口傳輸?shù)拈_銷。這個(gè)比例不是精確值但比直接報(bào)理論速度更貼近真實(shí)體驗(yàn)。4.5 運(yùn)行與驗(yàn)證Python 版本運(yùn)行方式cd llm-hw-calculator python calculator.py如果看到類似下面的輸出說(shuō)明代碼運(yùn)行正常 推理顯存估算 weight_memory_gb: 3.5 GB kv_cache_memory_gb: 0.52 GB estimated_overhead_gb: 1 GB total_vram_gb: 5.02 GB 微調(diào)顯存估算 training_vram_min_gb: 25.12 GB training_vram_max_gb: 40.19 GB note: 全參數(shù)微調(diào)需要保存梯度與優(yōu)化器狀態(tài)顯存通常是推理的 5-8 倍使用 LoRA/QLoRA 可大幅降低。 生成速度粗算RTX 4090 約 1008 GB/s 理論最大生成速度約: 288.0 tokens/s網(wǎng)頁(yè)版本直接用瀏覽器打開index.html即可不需要起服務(wù)也不需要聯(lián)網(wǎng)。4.6 結(jié)果解讀建議拿到計(jì)算結(jié)果后不要直接拿“推薦顯存下限”去對(duì)標(biāo)顯卡。我的建議是如果推薦顯存略小于你的顯卡顯存比如差了 1GB可以跑但盡量縮短上下文長(zhǎng)度同時(shí)關(guān)掉其他占用顯存的應(yīng)用。如果推薦顯存和顯卡顯存差不多建議使用 GGUF 的 k-quant 系列量化或調(diào)整 KV Cache 策略。如果要長(zhǎng)時(shí)間運(yùn)行服務(wù)要預(yù)留比計(jì)算值多 2GB 左右的余量因?yàn)橄到y(tǒng)和服務(wù)端框架會(huì)隨時(shí)間產(chǎn)生一些顯存碎片。5. 常見問(wèn)題與排查思路開發(fā)和實(shí)際部署過(guò)程中很多人會(huì)遇到類似的問(wèn)題。我整理成了一份表格方便你查閱。問(wèn)題現(xiàn)象常見原因解決思路加載模型時(shí)直接 OOM顯存需求超過(guò)顯卡容量或者上下文長(zhǎng)度設(shè)置過(guò)大計(jì)算器先算一次改用 INT4/INT8 量化縮短上下文長(zhǎng)度加載成功但生成速度極慢內(nèi)存帶寬不足或權(quán)重未完全載入顯存而使用共享內(nèi)存檢查nvidia-smi確認(rèn)模型確實(shí)在顯存降低 KV Cache 或分批量化Windows 下 OOM同樣顯存 Linux 卻可以Windows 顯存管理策略和驅(qū)動(dòng)占用量不同適當(dāng)調(diào)大 overhead 值或使用 WSL2 運(yùn)行短上下文正常長(zhǎng)上下文卡死KV Cache 隨序列長(zhǎng)度線性增長(zhǎng)導(dǎo)致顯存溢出在 Framework 層面限制 max_length或使用支持 PagedAttention 的推理框架計(jì)算器說(shuō)夠?qū)嶋H跑起來(lái)差一點(diǎn)忘記算 CUDA Context、驅(qū)動(dòng)占用、框架緩沖把 overhead 從 1GB 調(diào)到 1.5GB 再到 2GB 重新估算換量化格式后速度沒有明顯提升模型已經(jīng)變小但 Attention 計(jì)算占了主要耗時(shí)檢查是否滿足帶寬受限假設(shè)短序列下影響可能不大用 CPU 推理速度慢到不可用CPU 內(nèi)存帶寬遠(yuǎn)低于 GPU優(yōu)先用量化模型核數(shù)多少不是決定推理速度的唯一因素內(nèi)存帶寬更關(guān)鍵幾個(gè)排查步驟值得展開說(shuō)。5.1 驗(yàn)證顯存占用在模型加載后打開另一個(gè)終端運(yùn)行nvidia-smi觀察四塊區(qū)域GPU 顯存 Used進(jìn)程列表中 Python / llama-server 進(jìn)程的顯存Volatile GPU-Util如果是多卡確認(rèn)模型是否只用了其中一張。如果nvidia-smi顯示的 Used 顯存和計(jì)算器估算差別很大通常是因?yàn)槟阌玫哪P筒皇怯?jì)算器對(duì)應(yīng)精度的版本推理框架有額外的顯存優(yōu)化如 KV Cache 重用或者上下文長(zhǎng)度設(shè)置和設(shè)備上的max_seq_len不一致。5.2 是否真的把所有模型權(quán)存放進(jìn)了顯存有些推理框架在顯存不足時(shí)會(huì)自動(dòng)把部分權(quán)重放到內(nèi)存。從性能角度看這種模式雖然在短時(shí)間能運(yùn)行但每層之間都有 PCIe 或共享內(nèi)存的傳輸速度會(huì)嚴(yán)重退化。你可以用nvidia-smi看 CUDA Memory 的分配情況或者在日志里看框架是否打印出類似 “offload to CPU” 的信息模型文件是否被 mmap 映射到了內(nèi)存。如果確認(rèn)有 offload最直接的解決辦法是減小模型或用更高程度量化。5.3 訓(xùn)練顯存不夠時(shí)怎么辦如果你做的不是推理而是微調(diào)顯存不夠時(shí)優(yōu)先考慮LoRA只訓(xùn)練注入的低秩矩陣顯存開銷小很多QLoRA加載的模型先量化到 INT4再訓(xùn)練低秩適配器梯度累積不用一次性把 batch 都放進(jìn)顯存混合精度BF16 或 FP16 訓(xùn)練減少一半顯存梯度檢查點(diǎn)用時(shí)間換空間。你會(huì)發(fā)現(xiàn)推理場(chǎng)景的“量化”在訓(xùn)練場(chǎng)景里同樣有效而且 QLoRA 是當(dāng)前社區(qū)最熱門的低成本全參微調(diào)替代方案。如果你的模型是 70B 級(jí)別QLoRA 配合兩張 24GB 顯卡是可行的但全參數(shù)微調(diào)則可能需要多塊 A100 或 H100。6. 最佳實(shí)踐與工程建議這一節(jié)是本文最有工程價(jià)值的部分建議結(jié)合自己的使用場(chǎng)景去對(duì)照。6.1 計(jì)算器參數(shù)本身要?jiǎng)討B(tài)調(diào)整不要死守默認(rèn)參數(shù)。比如KV Cache 經(jīng)驗(yàn)系數(shù) 0.15 只適合中等上下文2048~4096。如果上下文是 8192 或 16384系數(shù)應(yīng)上調(diào)到 0.25 甚至 0.35。overhead 1GB 是最小值。生產(chǎn)環(huán)境建議 2GBWindows 建議 1.5~2GB。帶寬不是唯一瓶頸。如果你用的是 4090權(quán)重訪存確實(shí)主導(dǎo)如果模型比較小如 1B 到 3B計(jì)算密集型操作可能成為瓶頸實(shí)際速度會(huì)比理論值低更多。6.2 量化精度選擇的原則選擇量化精度時(shí)不能一味“越低越好”。我的建議7B 模型如果顯存有 8GB優(yōu)先 Q8/Q6效果和 FP16 差距很小如果顯存只有 4GB才考慮 Q4。13B 模型Q5/Q6 是甜點(diǎn)量化效果和 FP16 接近顯存需求又在可控范圍內(nèi)。70B 級(jí)別Q4 是唯一可行選擇。但如果模型對(duì)輸出質(zhì)量要求高可以試試 Q4_K_M 和 Q4_K_S 之間的差異。生成長(zhǎng)文本、代碼任務(wù)時(shí)量化損失會(huì)更明顯尤其是復(fù)雜邏輯和多步推理場(chǎng)景。如果是簡(jiǎn)單問(wèn)答、摘要INT4 的差距更容易接受。6.3 選型時(shí)不要只看顯存容量很多人在選顯卡時(shí)只看顯存忽略了帶寬和算力。其實(shí)對(duì)于本地 LLM 推理顯存帶寬的作用比很多人想象中大得多。以 7B FP16 模型為例顯卡顯存帶寬理論最大速度RTX 3060360 GB/s約 25 tokens/sRTX 4070504 GB/s約 36 tokens/sRTX 40901008 GB/s約 72 tokens/sM2 Ultra800 GB/s約 57 tokens/s注意這只是權(quán)重讀取的理論速度實(shí)際會(huì)更低但橫向?qū)Ρ仁强煽康膸挿独碚撍俣壬舷抟卜丁R虼巳绻愕闹饕猛臼潜镜卮竽P驮跐M足顯存容量的前提下盡量選帶寬更高的顯卡這一步比一味堆顯存更實(shí)際。6.4 生產(chǎn)環(huán)境建議如果你要把本地 LLM 做成服務(wù)給團(tuán)隊(duì)使用除了顯存計(jì)算還要注意并發(fā)請(qǐng)求數(shù)并發(fā)增加會(huì)擴(kuò)大 KV Cache 總和計(jì)算器里的 batch_size 要乘以并發(fā)數(shù)顯存泄漏長(zhǎng)時(shí)間運(yùn)行的服務(wù)建議定期監(jiān)控nvidia-smi --query-gpumemory.used --formatcsv發(fā)布前做壓力測(cè)試模型熱加載切換模型時(shí)如果顯存沒釋放可以先 kill 進(jìn)程再重新啟動(dòng)多用戶隔離盡量用支持 PagedAttention 的推理框架如 vLLM能更高效管理 KV Cache日志與監(jiān)控在容器或 systemd 服務(wù)中記錄顯存峰值方便后面調(diào)參。6.5 謹(jǐn)慎處理存儲(chǔ)與下載一個(gè)經(jīng)常被忽略的事實(shí)是模型文件下載后占用的是磁盤空間。如果做量化轉(zhuǎn)換中途還要存放未量化模型。例如 70B FP16 模型原始文件 140GB量化過(guò)程可能需要額外 140GB 臨時(shí)空間。所以磁盤最少要有模型文件大小的 2 倍空間再做量化轉(zhuǎn)換優(yōu)先使用 SSD因?yàn)榧虞d模型時(shí)有大量隨機(jī)讀取如果從 Hugging Face 下載提前配置好緩存路徑避免把系統(tǒng)盤占滿。6.6 用計(jì)算器輔助自動(dòng)決策如果你是運(yùn)維或平臺(tái)開發(fā)計(jì)算器邏輯還可以嵌入部署腳本。比如用戶選擇模型和精度后腳本自動(dòng)判斷當(dāng)前 GPU 可用顯存是否滿足不滿足就拒絕啟動(dòng)或者在啟動(dòng)時(shí)自動(dòng)切到更低的量化格式。這種做法雖然簡(jiǎn)單但能避免很多“部署后崩掉”的問(wèn)題。7. 擴(kuò)展方向與下一步學(xué)習(xí)路線本文實(shí)現(xiàn)的計(jì)算器核心邏輯已經(jīng)能覆蓋絕大多數(shù)本地 LLM 硬件評(píng)估場(chǎng)景但還有幾個(gè)方向可以繼續(xù)完善。7.1 接入更多推理框架參數(shù)不同推理框架的顯存行為差異很大llama.cpp / GGUF有 mmap可以通過(guò)--n-gpu-layers控制多少層放到 GPUvLLM有 PagedAttentionKV Cache 可以動(dòng)態(tài)劃分Hugging Face Transformers默認(rèn)行為是把所有參數(shù)加載到指定設(shè)備ExLlamaV2專門針對(duì)量化模型優(yōu)化顯存占用和速度表現(xiàn)都更理想。你的計(jì)算器可以在輸出里增加“不同框架推薦參數(shù)”這是很有價(jià)值的信息。7.2 引入模型結(jié)構(gòu)數(shù)據(jù)庫(kù)如果計(jì)算器能內(nèi)置常見模型的架構(gòu)信息層數(shù)、頭數(shù)、維度、KV Head 數(shù)KV Cache 估算精度會(huì)大幅提升。這部分?jǐn)?shù)據(jù)可以直接從模型目錄的config.json里獲取。{ hidden_size: 4096, intermediate_size: 11008, num_attention_heads: 32, num_hidden_layers: 32, num_key_value_heads: 32 }讀取這些字段后代入精細(xì)公式KV Cache 計(jì)算就會(huì)比經(jīng)驗(yàn)比例準(zhǔn)確得多。7.3 從靜態(tài)計(jì)算到動(dòng)態(tài)監(jiān)控更進(jìn)一步計(jì)算器可以不做成“一次性估算工具”而是做成“部署后監(jiān)控面板”。部署模型時(shí)記錄初始顯存運(yùn)行過(guò)程實(shí)時(shí)記錄顯存峰值和 Token 速度再用這些數(shù)據(jù)回填優(yōu)化估算模型。這種思路適用于企業(yè)內(nèi)部的 LLM 服務(wù)運(yùn)維平臺(tái)能逐步建立更貼近自己的硬件選型基線。7.4 加上成本模型如果你考慮云 GPU 實(shí)例建議在計(jì)算器里同時(shí)引入“按需價(jià)格”維度。例如 24GB A10G 和 48GB A6000 的價(jià)格差、性能和顯存的關(guān)系做成簡(jiǎn)單的性價(jià)比指標(biāo)。這樣同一個(gè)模型你不僅知道需要什么硬件還能知道用哪類實(shí)例更劃算。8. 寫在最后本地 LLM 部署的“硬件夠不夠”這個(gè)問(wèn)題其實(shí)完全可以量化不需要賭運(yùn)氣。通過(guò)精度、參數(shù)量、KV Cache 和帶寬這幾個(gè)核心參數(shù)你就能在下載模型前對(duì)顯存需求、生成速度和訓(xùn)練可行性心里有數(shù)。本文實(shí)現(xiàn)的硬件需求計(jì)算器無(wú)論是 Python 腳本還是網(wǎng)頁(yè)版本都保持了極低的依賴和較高的可移植性你可以直接復(fù)制到自己的項(xiàng)目中用。在實(shí)際使用中我建議你把“計(jì)算器估算值 實(shí)際 nvidia-smi 觀察值 生成速度實(shí)測(cè)值”三份數(shù)據(jù)放在一起對(duì)比。很快你就會(huì)發(fā)現(xiàn)顯存需求不再是個(gè)模糊概念而是能用公式推演、用監(jiān)控驗(yàn)證的工程指標(biāo)。如果你正在部署本地模型不妨先用這個(gè)計(jì)算器跑一遍再?zèng)Q定下載哪個(gè)量化版本。要知道在 8GB 顯卡上硬上 FP16 的 13B 模型和用 Q4 量化版跑流暢對(duì)話體驗(yàn)完全是兩個(gè)層次。選對(duì)硬件和精度可能比多花半個(gè)月調(diào)參更有效果。
返回列表
PREV
查看更多資訊
NEXT
返回資訊列表
av天堂手机版追回| 九九超碰综合网| 国产天天骚| 最新中文字幕av| 精品二区三四区五电影 | 3028国产精品| 99久久com免费视频′| 9999九九九久久久| 久久中文字幕不卡人妻| 免费的黄片wwwwww| 免费看污网站| 97在线/亚洲| 蜜乳AV免费观看| 五月婷婷综合网| 久久久久久久久久久久黄色| 日韩欧美日韩| 久都青青视频| 国产高清午夜成人在线观看| 天天添天天干电影| 欧美激情内射| 人妻嗯啊啊在线播放| 后入式在线免费观看60秒| 久久内射| 欧美日韩99| 亚洲日韩久久精品一区| 国产欧美精选激情视频| 岛国不卡超碰护士AV在线播放| 天天综合网91| 久久久一级| 国产综合久| 国模无码一区二区三区在线| 精品一区二区麻豆| 黄片aaaaa一区| 天堂伊人久久| 五月激情天| 夜夜操夜夜高潮夜夜爽国产精品区| AV一起草在线| 蜜臀久久99精品| 国产精品999zyz| 丝袜天堂| 熟女这里只有精品6| 欧美中字二区| 国产热RE99久久6国产精品首| 密臀成人视频久久久| 色噜噜人妻丝袜a∨先锋影 | 亚洲女人毛茸茸91| 五月天激情小说网| 精品国产91av一区二区三区| 亚洲欧美国产中文字幕| 手机看av网站在线看| 午夜噜噜噜| 国产无遮挡| 手机在线播放国产福利| 免费亚洲国产精品久久一区| 婷婷久久五月| 日韩性爱一级片| 91黑丝操| 大香蕉天天看妹子| 手机在线视频国内精品| 清纯唯美激情| 超碰97久久国| 欧美日韩超碰在线| 精品伊人久久久大香线蕉小说| 懂色av一区二区三区天美传媒| 黄污污污污| 日韩在线地址一| 粘花网06av视频| 亚洲视频中文一区| 蜜桃狠狠色伊人亚洲综合| 五月丁香| 熟女精品va中文字幕| 久久久久久少妇| 久久色人体| 午夜啪啪片| 国产精品网址| 天天看片麻豆| 精品亚洲国产成人AV制服丝袜| 青青草导航在线视频| 色一情一乱一乱一区91Av| 婷婷色综合欧美日韩| 男人的天堂.com| 日本污ww视频网站| 日韩激情小说一区二区| 亚洲天天综合| 激情内射| 一区二区国产视频在线观看| 五月婷婷深深爱| 自拍偷拍亚洲熟女妇人精品 | 亚精品无码毛片一区二区三区| 激情开心五月天| 亚洲精品xxx| 中文字幕天堂在线| 久久这里只| 色偷偷人人玩人人舔人人操人人摸人人爽| 亚洲AV乱码专区国产噜噜亚洲 | 久久综合五月天| 郑州宾馆老熟女露脸啪啪| 女性喷水高潮在线观看| 91亚洲情色| 亚洲限制级| 色色99| 久久久啊啊啊| 久久婷婷色| 亚洲一曲日韩精品| 国产又色又粗又黄又爽| 欧美v亚洲v综合v国产v妖精| 国产农村妇女精品| 国产精品福利资源在线尤物| A级片日韩欧美国产欧美视频精选观看| 久久久久久免费电影| 色九九九综合| 91爱看| av操操不卡| 久久精品一区二区三区不卡| 色婷婷久久| 人人搞人人插人人操| 丝袜综合网| 欧美 日韩第一性色| 国产少妇内射| 97天天| 中文字幕人妻丝袜乱一区三区| 欧美洲精品一级| julia ann久久| 97精品中文字幕| 久久久久久久久久久久久女过产乱-少妇高潮一区二区三区喷水-成人AV | 亚洲男人天堂2012| 色女99一级片在线观看| 超碰久久精品| 91插B网站| 大屁股熟女一区二区三区| 熟妇高潮一区二区免费视频| 久久国产三区| 自拍盗摄一区| 欧美色图成人网一区二区| 激情露脸爱| 伊人久久大香线综合无码| 国产乱弄免费在线视频。| 日欧美色| 东北女人操比视频| 超碰人妻中文在线| 超碰97久久国| 久久这里只精品| 91亚洲丝袜| 欧美性视频二区三区| 啊啊啊啊啊舒服| 欧美se综合| 亚洲男人天堂2| 久久亚洲一区女同性恋中文字幕| 91色插| 人人摸人人入| 思思热一热婷婷热一热| 麻豆婷婷成人一二三| 又黄又粗又硬又长又大| 四虎精品亚洲| 9美女超碰在线免费观看| 欧美日韩在线小说| 久久精品—区二区三区内射| 偷拍亚洲熟女视频播放| 六月丁香网| 男人的天堂激情| 性生活无遮挡纯毛片在线看| 乱人乱色一区二区三区免费| 日本操逼无码| 中文字幕精品日韩中文字幕| 婷婷中文字幕| 天天看人人操屄犊摸阴| 久久久婷婷| 亚洲骚男同com| 欧美v日韩v亚洲v最新在线| 一级特级aaaa毛片免费观看 | AV色五月| 青青青国产手线观看视频2| 人摸人人操人| 韩国女主播青草在线| 又黄又硬又粗又长国产视频| 国产无码三级视频在线观看| 婷婷亚洲天堂| 精品二999| 久久久久夜夜夜夜| 91丨熟女丨丰满熟女| 黄色大香焦1级‘′‘| 私色综合网| 亚洲欧美一区二区不卡视频播放| 久久国产精品m码| 国产精品亚洲一级av第二区| 色噜噜综合在线| 天天色怡春院| 激情网色| av情色影音| 欧美草草高清日韩视频| 精品人体无圣光凹凸| 色一射色一射| 91超碰碰在线| 丰满人妻区一区二区三| 国产AV久久久蜜爱影集| 亚洲精品天天影视综合网 | 99re6国产精品99re在线| 9 9无尺码天堂网| 91久久久亚洲| 首页亚洲国产高跟丝袜诱惑视频| 玖玖爱综合网| 伊人五月天激情| 高跟伊人julia ann| 欧美91精品国产自产| 欧美很很操视频| 日韩精品国模| 色综合久久88色综合久久天天| 国产传媒一区日韩| 熟女乱3伦999| 婷婷日韩一区二区三区中文字幕在线| 欧美性爱一区二区三区| 亚洲av无码成人精品国产| 日本五十路在线| 看日韩黄片| 黄污污污污| 日曰骚久久精品| 人妻日日干| 国产精品久久久999| 蜜乳中文字幕a在线| 日日夜夜天天| 日韩9区| 91人妻PORNY九色大屁股| 久久精品女同亚洲女同13| 欧美性爱第一区| 骚乳在线| 很黄很色的视频在线观看| 久久鲁夜| 又粗又长又爽在线观看| 91综合国产精品| 偷拍 欧美 日韩| 99re6久热只有精品6在线直播| 超碰碰97资源站| 色色色五月婷婷| 黑人性暴力毛片| 91精品久久久久久综合五月天| 久欲AV| 5278欧美一区二区三区| 青青草原成人| 日日日日日| 日韩9区| 18一区二区三区| 91啦人妻| 东方亚洲在线操逼天堂| 伊人久操| 天天肏夜夜肏| 欧美.亚洲.另类.丝袜.制服.诱惑| 久久骚| 激情接吻视频久久久久久| 97操综合| 中文字幕老熟妇黄色视频| 九九九九热| 亚洲91网。| 日本东京热加勒比久久| 91美女视频。| 老师充足的奶水小说| 日韩精品在线视频在线观看| 国产第11页| 婷婷AV一区二区三区| 天天综合网~91| 嗯嗯啊在线视频| 无遮挡男女激烈动态图| 60秒免费小视频| 日韩欧美经典在线观看| 伊人久久AV诱惑悠悠| 色女综合| 国产一区二区三区影片| 中文字幕av亚洲精品| 中文字幕-区二区三区四区视频中国| 熟女精品va中文字幕| 性91| 人妻少妇三级| 1024日韩| 日本国产高清色www视频在线| 91无码人妻精品一区二区三区蜜桃| 97视频在线免费看| av网页一区二区三区| 精品人妻一区二区免费看| 国产精品情侣啪啪| 亚洲国产高清福利视频| 超碰在线人人射| 91性| 香蕉99秘 精品一区丁香| 74成人在线| 乱老熟女一区二区三区| 99精品久久| 亚洲春色欧美激情自拍| 国产精品网址| 91精品人妻啪啪间| 欧美日韩国产传媒在线精品| 日本五十路熟女一区二区| 神马久久久久久| 国产九九九九九九| 亚洲Av噜噜一区二区三区妖精| 99热这里都是精品| 亚洲AV无码国产精品久久久久| 日韩成年人性爱视频| 精品女同一区| 亚洲限制级| 亚洲激情网一二三四区| 国产激情av女片自拍| 日韩成年人性爱视频| 91在线丝袜| 99re9这里只有精品| 欧美中出1| 6080YYY午夜理论片在线观看| 亚洲国产日韩精品久久久| 人妻免费观看| AV高清一区| 狼天天狼天天大香蕉| 日韩不卡a级视频专区| 久久精品 六十路 熟女 欧美| 青青草色AV| 日本最新1区2区3区| 香一区二区三区| 婷婷丁香五月综合| 大色综合网| 国产三级资源在线观看| 色色色日本| 中文乱码字幕观看| 婷婷人妻激情| 凹凸 69堂 在线播放| 91少妇香蕉久久精品| 日韩一级二级在线| 欧美亚洲一区二区久久久婷精品大包诱| 五月丁香综合网| 欧美性爱另类综合| 秋霞免费AV| 亚洲啪啪视频一区二区| 翔田千里AⅤHD无码| 精品久久久av无码免费| 999综合网| 97在线免费视频观看| 欧美激情一| 中文字幕、久久精品国产2020、久久综合久久自在自线精品自、亚洲 | 国产9熟妇视频网站| 9997se| 国产精品久久久久999| 国产视频小说| Julia Annxxxxx| 欧美 综合 亚洲| 少妇内射视频| 9997se| 超碰9 7女人| 中出20p| 欧美天天影院| 欧美97爱| 亚洲 无码 偷拍| 日韩国产精品人妻无码久久久| 亚州综合色| 国产白丝av| 亚洲欧美综合| 三级日本一区二区三区| 欧美偷拍区| 亚洲国产奇米影视久久| 国产精品自在线发布| 亚洲女毛多水多21P| 欧美激情中文字幕另类小说| 五月婷婷六月天| 久久久9视频| 日韩AV色图| 五月开心久久AV官网| 香蕉大久久久| 夜夜欧美| www.99色| 思思热影视| 99久久9| 91色碰| 97人人爱人人做人人乐| 人妻超碰青青草98| 欧美亚洲特P| 免费AV中文网在线观看| 久久成人国产| 志村玲子视频一区二区| 4141514逼喷水三级片| 亚洲在高跟鞋自慰久久在色线| 啊啊啊啊啊啊啊啊要喷了| 久热精品在线| 1769一区| 玖玖玖玖精品国产剧情| 91 刺激在线| 超碰97最新人妻| 欧美小说区视频区| 午夜国产综合视频在线观看| 操比国产| 熟妇高潮一区二区免费视频| 好爽免费视频,| 78m啪啪啪| 无码直播久久久| 日逼国产| 九久9热| 欧美日本视频一区| 东北少妇高潮zzzz| 操逼网站视频漫画国产| 欧美在线色图| 天美传媒AV在线播放| www.91理论| av天堂影视中文在字幕在线中文 | 老熟女搡BBBB搡BBBB视频| 熟女人妻一区二区三区| 国产污视频麻豆传媒一区二区| 后入式999| 亚洲熟妇一,二,三期| 亚洲av淫乱| 日韩99神马视频播放片在线播放| 狠狠爱AV| 视频一区二区三区精品| 丰满人妻一区二区三区| 日韩精品大香蕉伊人在线| 久久午夜色播影院免费高清| 日本操BAV| 亚洲第一页欧美| 久久久久久久9999| 91三级理论片播放器| 泰国AV在线观看| 97超碰影音| 欧美国产欧美在线观看| 久久99国产综合精品女同| 极品出轨视频网站| 人人摸人人添人人操| 麻豆国产av网| 超碰九区| 超碰av在线| 91色s| 丁香九月 婷婷| 97久久久久久久精| 黄页av| 国产成人无码久久精品| 五月天欧美色图| 操逼片国产| 亚洲狼狼干综合1| 激情欧美97| 久久伊人大香蕉| 99re在线视频这里只有精品| 国产精品视频白浆免费| 国产一区二区久久| 日本午夜操逼| 色色青青久久| 亚洲第2页| 精品一区二区三区四区外站 | 免费一级毛片在线视频观看| 日韩精品国模| 精品区国产区一区二区三区| 国产人妻精品一区二区三区秋霞| 国产亚洲精品av一区| 成人熟女区| 人人看人人插| 久热精品色情| 99在线免费公开视频| 亚洲淫乱骚妇AV| 午夜视频久久久久一区| 大香蕉啪啪啪啪在线| 免费福利视频中文字幕| 99黄页网站| 日本 色 导航| 超碰69| 亚洲综合精品国产一区| 欧美日日人人天天| 亚洲九区| 婷婷五月天激情四射| 亚洲国产精品久久久久久久久久| 精品无码秘 人妻一区二区| 久久人人妻| 黄片视频观看| 亚洲天堂日本| 久久久九九网站| 久久人妻熟女一区二区| 美女在线H91| www.亚洲黄色| 精人妻无码一区二区三区伊人直播 | 丁香7月婷婷| 国产精品秘 福利姬在线观看| 国产白丝网站| 99自拍B亚洲 | 91狠狠综合久久| 欧美 亚洲 综合 制服| 曰韩人妻中文字幕在线 | 中文乱码字字幕在线第5页| 色91综合网| 乱伦AVxx| 99热在线播放| 欧美 日韩 另类 亚洲| 国产一区二区精品久久99| 舔舔啊| 蜜臀少妇一区二区| 国产一级特黄大片处女| 超碰97极品9| 婷婷伊人一区| 日本护士高潮| 91狠狠综| 久久一区二区加油站| 超碰免费人人| 大香蕉视频一二三区| 国产蜜臀在线| 91网亚洲| 欧美日韩999| 欧美日韩国产成人高清| 精品无码一区二区人妻久久蜜桃 | 台欧久久精品视频| 欧美日韩香蕉| 极品销魂美女一区二区| 欧美专区17页| 青草香蕉网| 久久98| 免费观看性欧美一级| 久啪视频| 激情综合av| 色噜噜狠狠色综无码久久合欧美| 福利社区午夜一区二区| 中出欧美| 天天搞欧美| 第四色色综合91| 亚洲中文字母在线播放| 先锋影音av先锋一区| 国产精品伦理| 日日摸日日碰| 国产精品午夜成人福利| 婷婷丁香六月| 极品白嫩美女白浆成人福利在线看| 精品一区二区三区国产| 青青草一本道福利视频| 亚洲AV不卡在线观看尤物| 五月丁香六月激情| 日韩欧美字幕亚洲一区二区| 翔田千里AⅤHD无码| 麻豆91熟妇人妻中文字幕茄子| 超碰1997| 丰满少妇高潮无码| 97欧美精品综合| 日韩有码一区三区| 蜜乳AV色欲AVAV无码| 天天干天天燥| 欧美性生活男人的天堂| 超清中文乱码字幕| 色原狠狠天天天| 91AV天美在线视频| 欧美青青视频| 美女大乳久久久久久久女人18| 91大胆欧美| 五月激情小说| 丁香五月激情综合| 亚洲熟女av日韩熟女| 日本操逼二区| 国产欧美成人第一页在线观看| 麻豆久久精品亚洲精品88| 清纯唯美综合| 亚洲自拍小说| 深夜激情| 久区视频| 91熟女网| 色综合91好| 少妇淫妇久久久久久久| 97中文字幕九区| 男人天堂导航| 日韩十八禁| 日本布卡一区二三区| 日本免费二区三区| 亚洲综合在线91| 亚春色色| 欧美综合第一页| 91美女在线| 亚洲天堂资源网| 91黄站| 青草精品视频-日本久久久久网站| 99热销国产这里有精品| 天天伊人| 亚洲国产精品无码AV久久久| 免费又黄又裸乳的视频| 手机在线视频国内精品| 免费a在线播放v| 人人色人人操在线| 色婷婷丁香五月| 欧美黑人猛交春色影视大全| 日韩影片中文字幕一区二区三区| AV高清一区| 亚洲综合九| 日日嗨AV一区二区夜夜| 一本一道久久综合久久| 色欲久久99国产精品久久久久久| 日本一区不卡| 操逼日批| 91强奸乱轮| 色播五月丁香| 亚洲成人一二三区| 神马影院午夜福利久久久| 骚逼自拍99| 蜜臀中文无码午夜| 日韩97| 大香蕉黄色一级片免费看| 久久久久久国产无码精品| 无码少妇精品一区二区60岁老人| 亚州精人品大香蕉| 99九九久久| 天天天操天天天爱| 日韩情色一区二区| 精品人妻1区| 国产人妻天天干精品| 久久久98网站免费视频| 久久久久9999妇女| 国产后入式在线观看| 超碰97网站| 尤物网址| 五月婷婷五月天| 欧亚不卡| 超碰97人妻自拍| 12一15性XXXX粉嫩国产| 91精品啪在线观看国产城中村| 激情婷婷| 亚洲大胆人体av| 91高潮| 精品中文字幕一区二区| 9久热| 九九热超碰97亚洲最新香蕉 | oumeizonghese,www| 亚洲欧美国产其他二区| 91美女视屏| 久久视频,这里只有精品| 亚洲激情视频| 亚洲精品影视老司机| 天美精品av| 91精品免费| 17c嫩草51久久91嫩草| 国产一区二区在线电影| 久久综合日韩亚洲欧美| 91精品操美女| 黄色av网站在线播放| 五月天激情网站| 91天天爱| 电家庭影院午夜69久久夜色精品国产69乱| 91操人| 中文字幕视频2区| 色婷婷日韩精品一区二区三区| 少妇高潮流水av免费| 性爱综合网| 国产一线二线三线av| 日韩AV电影网站 | 成人日韩3| 久热伊人| 超碰久久网| 免费A片三p视频| 开心五月婷婷激情| 国产热av| 99国产在线 精品 视频| 亚洲熟妇图片| 欧美亚洲中文字幕| 日韩精品黄片免费观看| 色综合潮| 91亚洲色图| 99热色精品| 欧美色道啊| 乳欲人妻办公室奶水| 久久久久久久久久久久久久久乱码| 欧美激情 亚洲色图| 午夜福利精品| 1二区9| 精品人妻一二三| 亚洲天堂,男人| 男人的天堂三级| 国产精品自在自拍视频| 香蕉免费一区二区三区不读 | 凹凸视频特色日本特黄| 麻豆区久久久久亚| 日本高清_区二区三区| 激情终合网| 黄色香蕉视频网站一区| av在线人气 | 日韩中文字幕国产| 色狠人在线99| 麻豆国产视频精品观看| 91麻豆天美国产| 五月天婷婷在线看| 96爱综合| 国产强奸乱伦xd| 亚洲色图美腿丝袜| 久久久亚洲高清不打码| 无码男人天堂| 偷拍自拍在线视频观看| 97国产精品久久久久| 激情视屏国产乱伦强奸| 天堂精品| 欧美精品999| 亚洲欧洲日韩中文字幕一区| 99激情| 97超碰色色| 天天操av懂色| 无遮挡男女激烈动态图| 色情亚洲日本成人| www.av在线视频| 997色在线| 91精品久久久久久77777| 国产日韩怡红院| 极品色社| 最近2018中文字幕在线高清第一页| 中文字幕亚洲欧美在线不卡| 精品国产91久久久久久一区黄无| 久久精品国内Av熟女高清| 欧美日韩大陆黑人少妇99| 午夜激情成人在线观看| 亚洲青青草| 亚洲国产日韩欧美熟妇在线| 国产成人五月天丁香花| 热天堂一区二区| 热无码中文亚洲H一道本一区二区| 夜夜嗨绯色| 人妻熟女av国产网站| 伦理第一页| 蜜臀精品1区2区| 日本免费一级AAA大片器| 色97综合中文字幕| 99热在线播放| 亚洲欧美色图小说| 国产人妻精品一区二区三区秋霞| 久久综合婷婷| 边做饭边操逼逼| 青青草无码视频| 99色综合| 欧美黄色大片在线观看| 在线观看啊啊啊啊啊| 校园春色制服丝袜中文字亚洲 | 黑人黄片在线免费观看| 日韩97P| 超碰98综合网| 激情五月综合网| 超清福利精品视频在线| 久久久三区二区一区| 蜜色网色哟哟| 亚洲午夜福利在线影院| 久久一区二区三区四区五区| 爱爱久久| 亚洲青青青视频在线| 97精品熟女少妇一区| 好爽视频在线观看| 超碰这里只有精品| 久久久久免费少妇| 人人操人人操人人操人人操人人操人人人11.CM| 久久久青草青青国产亚洲免观精品高清完整版_97久久综合区小说区图片区,国精品 | 日韩精品影视| 中文字幕91综合| 激情干在线| 狠狠久久手机视频精品| 欧美性第1页| 亚洲视频,小说| 久久97| 秋霞成人一级在线观看| 欧成人精品H无码| 精品四五区| 日韩黄色一区二区三区| 一本色道无码DVD中文字幕| 黑白配性爱AV成| 激情欧美日韩女同久久| 亚洲少妇色| 欧美系列在线一区二区| 色哟哟综合| 欧美综合网A| 欧美高清在线| 日本精品免费一区二区三区四区| 亚洲影视综合网| 国产精品国产拍高清AV| 91亚洲人| 玖日综合网| 欧美久久人妻少妇一区二区| 天天操天天射青青草| 亚洲欧美经典一区二区| 青椒国产97在线熟女| 国产毛片片精品天天看视频| 亚洲天堂电影网99999| av无码精品久久久久| 欧美一级AAAAAAA| 亚洲97综| 日韩噜噜69| 中美日韩毛片| 一区=区三区视频| 日韩人妻大香蕉| 久久这里只精品99re66图| 国产精品黄色三级av| 久久中文字幕不卡人妻| 啊啊啊好多水| 精品久久久久久久| 天天欧美| 青娱乐91| 一区二区三区色综合| 女生自91网站| 天天做天天爱天天爽AV| 亚洲AV乱码专区国产噜噜亚洲 | A片大香蕉在线| 操逼网站网站| 97超碰人人操人人操| 久久男人天堂| 精品午夜福利| 天天草天天日| 人妻一区二区三区四区视频| 人妻 欧美亚洲| 天美传媒av在线| 夜夜爽爽夜夜精品视频| 久久精品人妻一区二区| 91欧美性| 玖玖爱伊人玖玖爱| avav青青草久久夜| 久久蜜桃一区二区| 91观看 国产白丝| 资源新线在线天堂| 日本精品999| 日韩成人无码| 国产美女销魂在线观看不卡| 国产av波波国产精品| 岛国色情视频在线观看| 日韩欧美午夜视频在线| 激情久久久| 九九黄色网| 久久极品一区二区| 熟妇高潮一区二区免费视频| 玖玖蜜臀资源网| 欧美韩国你懂得在线 | 青青青艹在线视频| 91精品又粗又猛又爽| yazhouzaixian| 国产精品久久泡妞网站| 淫荡网址| 亚洲成人性爱网站在线播放| 国产精品一二三在线看| 岛国精品视频在线观看| 超碰av人人人| 欧美日韩淫加| 欧美色色人| 亚洲丝袜二区在线| 中文久久| 多毛小伙内射老太婆| 国产精品亚洲免费| 国产性感骚丝袜在线| 欧美变态激情网| 蜜臀Av一区二区三区| 中文字幕三四区| 欧美黑人精品在线播放| 国产精品秘 福利姬在线观看| 久久国产精品一级二级三级| 白丝少妇一区二区| 色欲久久99精品久久| 青青草中文字幕| 脫衣舞一区二区三区| 色五月丁香五月| 日韩一级二级在线| 少妇精品久久久八区九区| 亚洲欧美另类小说| 国产91啪| 草草影院在线视频| 青青伊人加勒比海| 丝袜AV一区二区三区| 欧美探花网| 国产精品色色| 成熟熟女国产精品一区二区| 国产搭汕a级片| 岛国福利在线精品播放| 中字乱伦AV| 白丝AV网站| 亚洲同性aV综合| 九月丁香婷婷色| av天天在线观看| 亚洲日本天堂| 亚洲自拍偷拍视频在线| 欧美日韩国产色图在线| 国产精品制服丝袜中文字幕日韩一区二区三区 | 人人搞人人插人人操| 在线观看精品国产免费| 青青草吊丝| 四虎在线视频| 国产 日韩 欧美高清| 欧美一区91大爱| 欧美在线第五页| 麻豆国产视频精品观看| 丁香五月天社区| 91黑丝操| 男人的天堂午夜av| 午夜天天碰综合视频| 亚洲色棕合| 强奸国产在线| 欧美久久久15P| 男人天堂东京热| 亚洲中文字母在线播放| 国厂麻豆77q4| 国产精品久久久| 日韩中文字幕二区| 亚州男人的天堂| 午夜男女爽爽爽影院视频| 涩涩五月天| 欧洲自拍第一页| 精品久久久高清无码| 亚州成人A√| 97在线免费看视频| 综合色色网| 欧美性五月| 日本操逼二区| 超碰这里只有精品| 牛牛操视频逼| 白丝AV网站| 日韩成年人性爱视频| 亚洲91极品| 亚洲色人阁| 色婷婷亚洲婷婷| 91精品操美女| 蜜乳AV一区二区三区四| 国产精品亚洲日韩骚欢乐谷最新地址发布页huanieguty性屋娱乐妖精视频 | 久久久久久久久九九久孕交| 超碰95| 久久精品一区二区三区不卡| 亚欧洲日韩国产精品| 亚洲一本大道中文字幕无码在线| 素颜老阿姨乱情色| 人人看人人爰人人操| 久婷婷一区| 亚洲性爱电影| 撸撸成人在线视频| 激情抓乳插进去啪啪啪日韩 | 小草三级久久观看| 少妇一区二区三区| 中文字幕二区日韩天堂| 九热中文字幕| 麻豆亚洲Av成人无码一区精品| 国产91 丝袜在线播放00-百度| 大奶啊啊好爽| 超碰97护士| 久久精品亚洲婷婷| 香蕉欧美| 久久AV无码1区2区3区| 久久这里只精品免费福利| 色婷婷综合久久中文字幕雪峰| 夜夜草我| 久啪| 婷婷中文网| 99AV| 欧美熟女少妇| 秋霞一集毛片观看| 99国产精品免费| 欧美一区二区三区另类精品| 长久操视频| 青青草天天亲夜夜操网| 日本媚薬中文字幕在线| 亚洲国产欧美日韩人妻日中文| 沈阳熟女高潮对白视频| 超碰人妻中文在线| 九九探花视频在线观看| 欧美综合色| 欧美第一页性| 国产男女边吃边摸视频网站| 96久久久精品| 国产精品成人无码av| 亚洲激情网| 97欧美视频| 蜜桃色院一区久久| 日本道久久综合色色| 熟妇人妻精品一区二区| 一区=区三区视频| 白天啪啪晚上啪啪视频| 天天影视综合色| 亚洲人精品久久久喷水| 无码人妻精品一区二区中文| 少妇人妻在线| 四虎 精品 WWW| 免费看黄视频亚洲网站| 亚洲激情久久久伊人综合| 国产精品国产自产拍高清AV| 日韩免费大片一级播放| 亚洲男人天堂网站| 久久亚洲不卡一区二区三区| 精品黑人一区二区| 91久久青青草原精品| 东京热熟女亚洲视频网站| 国产67194| 欧美18 在线观看| 一区e区三| 欧美午夜色妇色鬼| 日韩AV熟女乱伦| 日韩性爱小视频| 欧美专区17页| 蜜臀AV一区二区三区激情综合| 浪人综合网| 久久亚洲AV无码白度| 中文字幕欧美日本乱码一线二线| 91在线欧色| 亚欧成人中文字幕一区| 久久久96| 久久9免费视频| 亚洲美欧999| 色色色热| 乱伦Av网| 欧美成年人性爱视频免费观看| 日韩无码服务区| 97视频在线观看高清资源| 日韩另类| 免费一级特黄特色大片在线观看看| 美女91| 欧美综合狠| 磁力99AV| 中文字暮97| 婷婷AV一区二区三区| 中文字幕美女91| 国产97视频| 欧亚韩国999| 91网站视频在线观看| 91麻豆天美国产欧美日| www.人人cao| 手机在线播放国产福利| 亚洲啪啪综合?v一区综合精品区| 噜噜噜亚洲精| 青青草玖玖爱| 欧美中文字幕一区 | 国产av强奸美女| 日本一级真人黄色性爱视频| 日韩91网| 亚洲综合色在线| 九九国产热| 免费9 1久久| 黄页18禁| 伊人网av| 丁香六月婷婷综合| 国产亚洲精品自在线亚洲情侣| 欧美精品xxxwww| 国产精品嫩草影院午夜两性 | 97高清啪啪| 亚洲天天艹| 天天日少妇逼AV| 九九综合久久| 亚洲操人| 婷婷亚洲五月***久久| 91c色| 多毛小伙内射老太婆| 欧美性爱免费短视频| a片 xxxx受爽视频| 97超碰中文在线| 久久国产精品m码| 91高清欧美| 精品国产a∨一区天美传媒| 精品女同一区| 乱色老一区二区三区的观看方式| 男人的天堂在线| ai欧美亚洲小说| 人妻无码久久一区二区三区免费| 欧美高潮在线| 超碰97玖玖爱| 99www.bibizy香蕉资源国产一区二区三区高清 | 天天大干大香蕉| 青青操视频在线| 天天拍天| 久久九九精品一区二区| 在线电影亚洲色图| 天堂av最新电影网| 精品无人区麻豆乱码1区2区图片 | 六月婷婷综合| 久久麻豆一区二区| 欧美嫩性色| 97精品一二区| 日韩成人午夜精品久久高潮| 国产精品成人无码a v毛片| 日本色色视频网站| 中文字幕一区二区三区高清| 免费在线黄片视频| 囯产乱伦一区二区三女 | 超碰社区97| 黑人性欧美| 亚洲97在线观看| 99人妻碰碰碰久久久久禁片| 国产亚洲精品精AV.| 北约熟女超碰| 中国国国产一级特黄毛片| 日韩性爱播放| 69精品少妇一区二区三区蜜桃| 日韩精品三区四区| 玖玖资源中文字幕制服丝袜| 97精品在线| 国产精品丝袜在线| 九七超碰| 午夜无遮挡男女啪啪视频| 欧美性爱www免费版| 去干网最新版| 超碰 97国产熟女| 中出789在线视频| 91网站18+| 五十路三区在线| A一区片| 久久精品国产亚洲AV无码电影| 97干在线视频| ,国产乱人伦精品一区二区三区| 精品人妻一区二区乱码一区二区| 久欲AV| 97爱爱| 逼逼逼逼操操操操操操操操操午夜剧场 | 久久精品人妻一区二区| 日日躁天天躁狠狠躁| 蜜臀久久99精品久久久久久-DVD原版全| 日韩 国产 欧美自拍| 亚洲黄色a级片| 亚洲综合色男人网| 成人精品一区二区三区| 久久超碰天天| 婷婷久久五月综合激情| 久久激情亚洲精品无码?V| 日韩一区二区精品视频| 久久精品72| 青青草原av| 成人精品久久久午夜福利| 国产成人在线观看综合| 亚洲城人男人的天堂| 亚洲情色综合网| 少妇综合| 婷婷中文网| 少妇毛片久久| 精品丰满熟妇人妻一区| 13小男生GAY自慰脱裤子| 牛牛aV| 中文字日本乱码| 五月天久久人妻| 欧美日韩性爱电影在线| 91久久久久久久| 熟妇精品juliaannAV| 久久久久久999| 操逼不卡中文字幕| 97综合在线观看| 97资源站国产精品| 精品中文字幕第一页| 看日韩美女二区三区免费操逼视频 | 午夜福利国产欧美日韩夜夜| 久久艹逼视频| 日本精品性生活久久久| 大奶的诱惑| 操比国产| 夜夜人妻爽| 日韩福利电影网| 亚洲激情av| 97超碰中文| 五月天我淫我色av| 五月综合色| 超碰在线1234区| 日韩三A大片在线观看 | 久久久久久久综合,国产| 国产黄色视频久久| 红杏大香蕉| 97操97干| 色久桃花影院在线观看| 操人妻逼91| 国产高清自拍视频| 99热精品在线| 国产嫩草精品A88AV| 日韩一级成人毛片免费观看| 97色论| 小说区 图片区色 综合区| 婷婷五月天伊人| 久久精品人妻一区二区三区| 日韩性爱毛片操骚逼| 日产国产精品中文久久婷婷| 97日韩超碰超碰中文字幕| 秋霞视频一区二区| 97久久天天综合色天天综合色电影| 国产美女自拍AV| 欧洲射精91| 国产强奸乱伦无码视频| 超91综合网| 色香综合| 丁香五月偷拍| 欧美日韩欧美| 综合色播| 少妇激情一区二区三区视频| 自偷自拍的亚洲视频|