https://linux.do 论坛的话题更新通知频道。
996评测了qwen3.8-27B 3个不同的社区版本(3bit - 4bit量化)以鹈鹕、北极熊为例。 中发帖

一、本人硬件:
RTX3090 24G + DDR5 32G + i5-14600K,如下图所示: 
 [image] 
二、测评模型:
1、unsloth/Qwen3.8-27B-GGUF/Qwen3.8-27B-Q4_K_M.gguf 
(一个4bit量化版本,unsloth团队的量化质量极高。) 
2、JonathanColetti/Qwen3.8-27B-Uncensored-GGUF/Qwen3.8-27B-Uncensored-Q4_K_M.gguf 
(一个未审查4bit量化版本,社区热度极高) 
3、zerodigest/Qwen3.8-27B-Uncensored-YMQ-MTP-GGUF/Qwen3.8-27B-Uncensored-YMQ-M.gguf 
(一个未审查3bit量化版本,该作者声称此3bit能达到4bit的水准。) 
三、思考程度:
qwen3.8-27...
你叽里咕噜说啥呢 (@waitu1232)七夕这一天,我被... 中发帖

[image] 
覅搞了好吧(落泪)
hxcsugpt plus的apple pay支付怎么通过 中发帖

[image] 
日区gpt,今天看有个apple pay的三方支付 
但是手机扫码后显示 Apple Pay 服务不可用 
有佬分享一下成功吗
@linux_user现在站内还有哪些公益站可以嫖 中发帖

求推荐,目前用的几家都用不了,求大佬带一下
@qilmeQwen-3.8-27B 自部署与 api 体验 中发帖

不说废话直接上表 





对比项
RTX PRO 6000 96G
Mac M5 Pro 32G
Vercel*




模型精度
BF16
MLX 4-bit
BF16


上下文长度
262k
43k(随手调的)
262k


速度(tokens/s)
21
7**
100


内存占用
88G***
22G(模型 17G)




*可能限时免费 
**其中简单聊天的速度在 7 tokens/s 以上,使用 dsh 在 10k 上下文之后速度为5 tokens/s 
*** 88G = 52G 模型 + 4G 其他开销 + 32G KV Cache 
附图

 [令人绝望的吕布测试] 
 [缓慢但好像能用的 agent 测试]
Leo (@leoyan)GPT额度相关焚诀 中发帖

第一次发帖,轻喷,先说结论: 
无论是个人反代用户还是中转站用户,sub2api升级到178版本之后打开收敛配置为“设备+会话”或“完全收敛”即可解决百分之90以上的问题,但是仍然有遗漏,如下图: 
 [image] 
对于剩余的这些问题,如果是个人反代用户或者少量用户可以使用这个脚本运行一下,重启codex,该脚本作用如下: 
减少了正常模型请求之外的辅助关联数据: 

客户端行为事件、功能使用次数和会话指标不再额外上传。
Statsig/OTel 不再周期性发送进程、安装、会话和性能指标。
原始 prompt 不会复制进 OTel 导出事件。
即使 analytics/feedback 请求绕过 Sub2API 直连,客户端配置也会阻止相应流程。
analytics.enabled=false 会覆盖桌面进程中的 --analytics-default-enabled 默认值。 
Co...
qasszaz (@qassaza)慢讯,opencode go套餐的v4flash涨回30🔪 中发帖

从小红书上刷到的,没在站里刷到相关帖子,就水个慢讯。话说佬们体感上能感觉出来额度涨了吗? 
 [Camera_XHS_17870723912401040g2sg32408p1p370e05no5qnr0bnslemn1df8]
@bedrock_jie求院线电影大片精彩片段,支持5.1 7.1声道 中发帖

佬友, 
大家做家庭影院比较多,有没有能够有比较多的场景来测试电影的空间音频,还有影视以及音乐的音频文件。 
下载下来,尤其是支持5.1和7.1声道。然后DTS或者Dolby的一些解码,这些资源可以从哪里能下得到? 
尤其有一些经典的和震撼的片。
@MisfiringGreaser花大价钱去留学读一个名校本科是否不如把钱存着,等本科毕业再去读一所名校的硕士/博士? 中发帖

在乎上看到的,感觉很有道理. 留美本和留美硕博的成本差异这么大,不清楚为何还有这么多人想掏光家底得去留美本,还是说其中有玄机奥妙 🤨
Henry (@supersonicHenry)如何识别中转站GPT5.6sol模型的真假? 中发帖

rt,想请问一下佬友们,有没有什么好的办法处理这一类这问题?
白夜 (@Zyese)Zcode的闲时任务意外的好用 中发帖

[image] 
晚上的时候排队用不了几分钟就排到了,感觉按每日额度来算应该比lite的额度要高,对我这种夜间宣说来说意外的友好
ZeusFunk靠!显卡今天又涨了好多 中发帖

我本来看Qwen3.8 27B很强说搞两张4090 48g魔改版跑起来给佬们用,前几天包括今天早上-对比今天下午 
4090d 48g 22000左右 → 25000左右 
4090  48g 25000左右 → 28000左右 
真服了啊,日子什么时候是个头啊。年初纯运气好 2w块买到了5090d 32g现在涨到3w5 后悔没多买几张,32g根本不够用 🤐
🐟 (@stevessr)Claude Cowork 现已适用于所有付费计划的移动端和网页端 中发帖

Claude Cowork 现已适用于所有付费计划的移动端和网页端 
https://x.com/claudeai/status/2089756371570900999 
 [Screenshot_2026-08-19-00-56-05-892_com.microsoft.emmx.beta-edit]
@taosts关于随时跑路公益站的访问问题,提示“不可信赖的网站” 中发帖

访问随时跑路时遇到了这个问题,如图一。 
 [Snipaste_2026-08-19_00-45-47] 
看了下站里的帖子没有人反馈,所以我在想会不会是我自己的问题,然而换了个🪜,关了卡巴斯基也没有解决问题,反而还被定向到了百度 

www.baidu.com 

。求解,各位分析下这是啥问题。
musk007claude又挂壁了 中发帖

API Error: 529 Overloaded.
幻方集团Anthropic中心Gemini事业部MiniMax业务组GLM&Grok生态合作计划大中华区销售总监 - 山姆·奥特曼(试用期) (@icemapleyy)继DeepSeek不同思维链任务表现差异明显,我发现GLM似乎也一样 中发帖

众所周知,前几天D老师三种思维链吵得沸沸扬扬,“we need”是最强的,实打实的差异,感知还是挺明显。 
GLM5.3上了之后,听说谱子增加算力了,直接开了个冤种订阅,确实429不怎么出现了。 
 [image] 
这几天从早等到晚,就发现有的时候GLM像脑子抽筋了一样,比如上午干活还好好的,规划阶段能考虑到你没想到的方向提出盲点和新的创意,下午突然就开始听不懂话,干完返工,说一步干一步需要仔细盯着。 
一开始我把这种情况归类为降智,可能高峰期是高峰期的出生行为,毕竟Z/嘛,就在今天我突然注意到GLM思维链也不是完全相同的,最明显的就是语种不同,然后我开始翻会话内容,重点看thinking,发现思维链是英文任务过程都是很流畅的,中文就差点意思,甚至会让人破防 
英文思维链,还会自己评审方案 
 [image] 
中文思维链,没睡醒的糊涂蛋 
 [image] 
个人样本不足难下定论,并且...
紫米 (@micah)gemini-3.7-flash 鹈鹕 这真神了吧 中发帖

[图片] 
https://r2.535888.xyz/2026/08/xG08pjk.gif(图片大于 4 MB) 
这是我测的最好的
letr又是一年七夕 中发帖

佬友们今年七夕跟谁过呀? 
又一年七夕,又添一岁呢 
自己一个人过生日,也挺好🙃
perios (@Explero)google 你这反复封禁? 中发帖

全程保持同一个IP登录,Google这风控系统是在发癫吗? 
 [image]
Back to Top