嗨嗨
阿肥在想
之前開源模型
可能都要16g 才能用
後來開始有8g能跑的版本
為什麼呢
有木有掛
分享分享
作者:
syldsk (Iluvia)
2025-08-11 07:36:00會有一堆人一直去改良啊
作者:
ayuhb (ayuhb)
2026-08-11 07:42:00因為跑不動的人會去改
作者:
spfy (spfy)
2026-08-11 07:45:00量化
作者:
EXIONG (E雄)
2026-08-11 07:49:00資本家不喜歡這種事
作者:
Satoman (沙陀曼)
2026-08-11 07:49:00gguf
ACG點? 量化跟多模化,現在開源模型都趨向MOE,
每次處理只需要載入部分,再爛的電腦都可以執行,差在快慢
你說的是什麼模型啊 開不開源都是因為有作量化 壓縮但那個號稱能用其實沒算上context長度限制喔
還有開不開源都是資本家養的 因為模型本身沒啥好藏私本質上那就是一個超大的知識索引 真正能賣的是前後處理工程的調教 還有規模 16G vram能跑啊 但context可能只有幾千字 還要用上外在的輔助去記憶 我自己家裡一張5070ti 16G 拿來推理與日常維護用短script生成 稍微大的前處理要用上64GB 的Mac mini
真正的大文本整個專案還是要丟給Claude max pro才夠我還得自己搞pgvector做rag最近線代抽象代數都在複習就是為了這個LLM如果不是整個多層矩陣都載入vram 光是用上原始記憶體的資料搬移就會讓速度慢到無法接受了 基本上不可能部分載入 靠的是量化縮短單位資料量
第一沒點 第二有AI版 第三未來本地模型會像洛克人EXE一樣 每個人的手機都有個人化AI
作者: jack90352 (jack90352) 2026-08-11 08:44:00
Acg 點在哪
作者: david31476 (BombCHI) 2026-08-11 09:17:00
沒關係過沒幾天就會出現幾篇Ai是否可以取代誰的文章
作者:
GenShoku (放課後PLAY)
2026-08-11 09:34:00沒有context就只是玩具 塞得下跟能做事是兩回事