https://linux.do 论坛的话题更新通知频道。
996 在 评测了qwen3.8-27B 3个不同的社区版本(3bit - 4bit量化)以鹈鹕、北极熊为例。 中发帖
一、本人硬件:
RTX3090 24G + DDR5 32G + i5-14600K,如下图所示:
[image]
二、测评模型:
1、unsloth/Qwen3.8-27B-GGUF/Qwen3.8-27B-Q4_K_M.gguf
(一个4bit量化版本,unsloth团队的量化质量极高。)
2、JonathanColetti/Qwen3.8-27B-Uncensored-GGUF/Qwen3.8-27B-Uncensored-Q4_K_M.gguf
(一个未审查4bit量化版本,社区热度极高)
3、zerodigest/Qwen3.8-27B-Uncensored-YMQ-MTP-GGUF/Qwen3.8-27B-Uncensored-YMQ-M.gguf
(一个未审查3bit量化版本,该作者声称此3bit能达到4bit的水准。)
三、思考程度:
qwen3.8-27...hxcsu 在 gpt plus的apple pay支付怎么通过 中发帖
[image]
日区gpt,今天看有个apple pay的三方支付
但是手机扫码后显示 Apple Pay 服务不可用
有佬分享一下成功吗@qilme 在 Qwen-3.8-27B 自部署与 api 体验 中发帖
不说废话直接上表
对比项
RTX PRO 6000 96G
Mac M5 Pro 32G
Vercel*
模型精度
BF16
MLX 4-bit
BF16
上下文长度
262k
43k(随手调的)
262k
速度(tokens/s)
21
7**
100
内存占用
88G***
22G(模型 17G)
*可能限时免费
**其中简单聊天的速度在 7 tokens/s 以上,使用 dsh 在 10k 上下文之后速度为5 tokens/s
*** 88G = 52G 模型 + 4G 其他开销 + 32G KV Cache
附图
[令人绝望的吕布测试]
[缓慢但好像能用的 agent 测试]Leo (@leoyan) 在 GPT额度相关焚诀 中发帖
第一次发帖,轻喷,先说结论:
无论是个人反代用户还是中转站用户,sub2api升级到178版本之后打开收敛配置为“设备+会话”或“完全收敛”即可解决百分之90以上的问题,但是仍然有遗漏,如下图:
[image]
对于剩余的这些问题,如果是个人反代用户或者少量用户可以使用这个脚本运行一下,重启codex,该脚本作用如下:
减少了正常模型请求之外的辅助关联数据:
客户端行为事件、功能使用次数和会话指标不再额外上传。
Statsig/OTel 不再周期性发送进程、安装、会话和性能指标。
原始 prompt 不会复制进 OTel 导出事件。
即使 analytics/feedback 请求绕过 Sub2API 直连,客户端配置也会阻止相应流程。
analytics.enabled=false 会覆盖桌面进程中的 --analytics-default-enabled 默认值。
Co...qasszaz (@qassaza) 在 慢讯,opencode go套餐的v4flash涨回30🔪 中发帖
从小红书上刷到的,没在站里刷到相关帖子,就水个慢讯。话说佬们体感上能感觉出来额度涨了吗?
[Camera_XHS_17870723912401040g2sg32408p1p370e05no5qnr0bnslemn1df8]@bedrock_jie 在 求院线电影大片精彩片段,支持5.1 7.1声道 中发帖
佬友,
大家做家庭影院比较多,有没有能够有比较多的场景来测试电影的空间音频,还有影视以及音乐的音频文件。
下载下来,尤其是支持5.1和7.1声道。然后DTS或者Dolby的一些解码,这些资源可以从哪里能下得到?
尤其有一些经典的和震撼的片。@MisfiringGreaser 在 花大价钱去留学读一个名校本科是否不如把钱存着,等本科毕业再去读一所名校的硕士/博士? 中发帖
在乎上看到的,感觉很有道理. 留美本和留美硕博的成本差异这么大,不清楚为何还有这么多人想掏光家底得去留美本,还是说其中有玄机奥妙 🤨ZeusFunk 在 靠!显卡今天又涨了好多 中发帖
我本来看Qwen3.8 27B很强说搞两张4090 48g魔改版跑起来给佬们用,前几天包括今天早上-对比今天下午
4090d 48g 22000左右 → 25000左右
4090 48g 25000左右 → 28000左右
真服了啊,日子什么时候是个头啊。年初纯运气好 2w块买到了5090d 32g现在涨到3w5 后悔没多买几张,32g根本不够用 🤐🐟 (@stevessr) 在 Claude Cowork 现已适用于所有付费计划的移动端和网页端 中发帖
Claude Cowork 现已适用于所有付费计划的移动端和网页端
https://x.com/claudeai/status/2089756371570900999
[Screenshot_2026-08-19-00-56-05-892_com.microsoft.emmx.beta-edit]@taosts 在 关于随时跑路公益站的访问问题,提示“不可信赖的网站” 中发帖
访问随时跑路时遇到了这个问题,如图一。
[Snipaste_2026-08-19_00-45-47]
看了下站里的帖子没有人反馈,所以我在想会不会是我自己的问题,然而换了个🪜,关了卡巴斯基也没有解决问题,反而还被定向到了百度
www.baidu.com
。求解,各位分析下这是啥问题。幻方集团Anthropic中心Gemini事业部MiniMax业务组GLM&Grok生态合作计划大中华区销售总监 - 山姆·奥特曼(试用期) (@icemapleyy) 在 继DeepSeek不同思维链任务表现差异明显,我发现GLM似乎也一样 中发帖
众所周知,前几天D老师三种思维链吵得沸沸扬扬,“we need”是最强的,实打实的差异,感知还是挺明显。
GLM5.3上了之后,听说谱子增加算力了,直接开了个冤种订阅,确实429不怎么出现了。
[image]
这几天从早等到晚,就发现有的时候GLM像脑子抽筋了一样,比如上午干活还好好的,规划阶段能考虑到你没想到的方向提出盲点和新的创意,下午突然就开始听不懂话,干完返工,说一步干一步需要仔细盯着。
一开始我把这种情况归类为降智,可能高峰期是高峰期的出生行为,毕竟Z/嘛,就在今天我突然注意到GLM思维链也不是完全相同的,最明显的就是语种不同,然后我开始翻会话内容,重点看thinking,发现思维链是英文任务过程都是很流畅的,中文就差点意思,甚至会让人破防
英文思维链,还会自己评审方案
[image]
中文思维链,没睡醒的糊涂蛋
[image]
个人样本不足难下定论,并且...紫米 (@micah) 在 gemini-3.7-flash 鹈鹕 这真神了吧 中发帖
[图片]
https://r2.535888.xyz/2026/08/xG08pjk.gif(图片大于 4 MB)
这是我测的最好的