Re: [閒聊] VRAM大就是正義?Intel B70 minimax h3
看板PC_Shopping (個人電腦購買)作者tacovirus (大怒神のスイッチ)時間1小時前 (2026/09/02 14:43)推噓1(1推 0噓 0→)留言1則, 1人參與討論串2/2 (看更多)
※ 引述《kimisawa (楊回血了。)》之銘言:
: YT Lon.TV 測了B70用ComfyUI跑 minimax
: https://www.youtube.com/watch?v=HfevkEZ8w5Q
: 看起來VRAM大的優勢在這邊體現出來,無速度法跟NVIDA比,
: 不過NVIDIA要32G的價格就很不舒服了
: B70生480p 5秒大概 2分半
: 生圖 1024x1024 大概 34秒
: 他還測了許多其他用途與模型,影片搭聲音,coding,等等
: 另外大vram的好處是跑LLM
: https://www.youtube.com/watch?v=bLac7-toF68&t=363s
: Lon.TV 跑Qwen3.8可以全部放在vram 大概 25 token/s
: 亞馬遜的價錢
: https://i.imgur.com/lErsamq.png

: 退一步B60 24G VRAM可以放絕大部分的模型只有B70一半的價錢
: 不過I卡的問題是待機功耗,待機要吃到50W有點高啊
: 單跑AI或許'目前'i卡是一種選擇?N卡的性價比實在太差了
在下做了 Qwen3.8 27B 的測試, 簡單的結論如下
1. 推薦模型: unsloth/Qwen3.8-27B-GGUF:UD-Q5_K_XL
2. 編譯 llama.cpp 建議用 F16 with oneDNN 那組編譯選項
3. 啟動 llama.cpp 建議不要改 -ctk -ctv, 預設 f16 的 kv cache 速度較快
測試報告可以參考 llama.cpp 討論區, 我寫了幾篇 B70 的測試結果
https://github.com/ggml-org/llama.cpp/discussions/23313#discussioncomment-18229981
目前搭配 ZooCode, axe, AnythingLLM 等 Agent 使用
邏輯複雜的任務, 需要搭配 MCP 使用, 邏輯簡單手續複雜的任務可以直接做
以目前測試結果, 應該已經接近榨乾 B70 SYCL 性能
接下來會再研究 OVMS 與 OpenVINO IR 量化, 看能不能進一步提升效能
--
世界越快 心則慢
網路越慢 心則快
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 122.117.175.196 (臺灣)
※ 文章網址: https://www.ptt.cc/bbs/PC_Shopping/M.1788331380.A.1E5.html
推
09/02 14:50,
1小時前
, 1F
09/02 14:50, 1F
討論串 (同標題文章)
完整討論串 (本文為第 2 之 2 篇):
PC_Shopping 近期熱門文章
PTT數位生活區 即時熱門文章