A high-performance 125B model now running locally on just 75GB RAM! Thank you @UnslothAI for the day...
Qwen(@Alibaba_Qwen)115 字 (约 1 分钟)
85
Qwen3.8-Flash模型可在75GB RAM上本地运行,性能超越Claude-Opus-4.6。
入选理由:125B MoE模型通过GGUF格式实现75GB RAM本地运行
FeaturedTweet#大模型#内存优化#UnslothAI#GGUF中英混合
