Re: [閒聊] VRAM大就是正義?Intel B70 minimax h3

看板PC_Shopping (個人電腦購買)作者 (大怒神のスイッチ)時間1小時前 (2026/09/02 14:43), 編輯推噓1(100)
留言1則, 1人參與, 1小時前最新討論串2/2 (看更多)
※ 引述《kimisawa (楊回血了。)》之銘言: : YT Lon.TV 測了B70用ComfyUI跑 minimax : https://www.youtube.com/watch?v=HfevkEZ8w5Q
: 看起來VRAM大的優勢在這邊體現出來,無速度法跟NVIDA比, : 不過NVIDIA要32G的價格就很不舒服了 : B70生480p 5秒大概 2分半 : 生圖 1024x1024 大概 34秒 : 他還測了許多其他用途與模型,影片搭聲音,coding,等等 : 另外大vram的好處是跑LLM : https://www.youtube.com/watch?v=bLac7-toF68&t=363s
: Lon.TV 跑Qwen3.8可以全部放在vram 大概 25 token/s : 亞馬遜的價錢 : https://i.imgur.com/lErsamq.png
: 退一步B60 24G VRAM可以放絕大部分的模型只有B70一半的價錢 : 不過I卡的問題是待機功耗,待機要吃到50W有點高啊 : 單跑AI或許'目前'i卡是一種選擇?N卡的性價比實在太差了 在下做了 Qwen3.8 27B 的測試, 簡單的結論如下 1. 推薦模型: unsloth/Qwen3.8-27B-GGUF:UD-Q5_K_XL 2. 編譯 llama.cpp 建議用 F16 with oneDNN 那組編譯選項 3. 啟動 llama.cpp 建議不要改 -ctk -ctv, 預設 f16 的 kv cache 速度較快 測試報告可以參考 llama.cpp 討論區, 我寫了幾篇 B70 的測試結果 https://github.com/ggml-org/llama.cpp/discussions/23313#discussioncomment-18229981 目前搭配 ZooCode, axe, AnythingLLM 等 Agent 使用 邏輯複雜的任務, 需要搭配 MCP 使用, 邏輯簡單手續複雜的任務可以直接做 以目前測試結果, 應該已經接近榨乾 B70 SYCL 性能 接下來會再研究 OVMS 與 OpenVINO IR 量化, 看能不能進一步提升效能 -- 世界越快 心則慢 網路越慢 心則快 -- ※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 122.117.175.196 (臺灣) ※ 文章網址: https://www.ptt.cc/bbs/PC_Shopping/M.1788331380.A.1E5.html

09/02 14:50, 1小時前 , 1F
09/02 14:50, 1F
文章代碼(AID): #1gbyLq7b (PC_Shopping)
文章代碼(AID): #1gbyLq7b (PC_Shopping)