https://linux.do 论坛的话题更新通知频道。
@Nathan3 在 GPT PRO回答降质量 中发帖
本人用的GPT PRO20x网页端,首先没降智,是否降智很明显的。
发现个问题,就是我感觉gpt思考一段时间后会自己截断思考直接回答。以往询问论文问题通常会思考25min,现在最长都只思考15min左右。
还有就是回答的内容很明显感觉出来内容的前部分像pro回答的语言,后面像mini输出的语言风格。
不知道佬们有遇到这问题吗。(我认为是算力不够偷偷降质量了)jeffccie 在 私有部署:4090-24G单卡 qwen3.8:27b现开放,佬轻蹬随时炸 中发帖
实时监控 Ollama 实时监控
配置
[image]
key
YmM0Y2JmODQyNWFlYTlhN2E1NzhkMDZkZThjNjk5MjM=
费用
[image]拿铁多加奶 (@tiemoremilk) 在 佬友们,你们Apple Watch有什么好用的软件推荐么 中发帖
如题,佬友们在Apple Watch上觉得好用的软件有推荐的么?
如果有图和简单描述就更棒了Guessed 在 公司开发新要求要用TDD开发模式,有佬友公司也是这套模式么? 中发帖
公司今天提出要用TDD模式,给了两个场景:
一、为啥一定要有一张失败的红图?
如果你代码全都写完了才补单测,跑出来直接就是绿灯。 这种测试很容易变成跟着现有代码“走个过场”:边界场景很容易漏测,甚至你断言本身写错了,测试都照样显示通过,根本起不到把关作用。
先跑出报错的红截图,目的只有一个:证明你写的这个测试用例真的能发现问题、拦得住bug,而不是一个永远不会报错的“假测试”。
二、平时开发照着这个流程来就行
场景1:修复线上或者测试环境的Bug
红:先根据bug复现步骤,把单元测试写出来。不改原有代码直接跑测试,必须跑失败、出现报错 → 截图保存这张红图
绿:再动手改业务代码,把Bug修好。重新跑一遍刚才的单测,测试成功通过 → 再截一张绿图
场景2:开发新功能、新接口
红:先写单元测试,把预期的入参、返回结果、异常情况全部写好。这时业务代码先不要实现,可以先写个空方...🐟 (@stevessr) 在 美国国务院暂停移民签证申请 中发帖
https://www.wsj.com/politics/policy/u-s-state-department-pauses-immigrant-visa-applications-25b31b23
[!quote]+
特朗普政府暂停了移民签证的审批,该签证允许申请人永久移居美国,以便对签证官进行新指导方针的培训,确保申请人有足够的经济能力在抵达美国后维持生计。
已预约在美国大使馆和领事馆面谈的移民签证申请人已收到电子邮件通知,他们的面谈预约将被推迟。移民签证申请人通常包括美国公民的配偶、父母和兄弟姐妹,以及一些由美国雇主担保的人员,例如前往医疗资源匮乏的医院工作的外国护士。持移民签证的外国人抵达美国后即可获得绿卡。温州程序员劝退师 (@Das) 在 雷达 15w 刀夺旗战落幕,TIBO 发文疑似将要重置,GPT 慢又蠢 中发帖
昨晚雷达 15w 刀夺旗战落幕,意味着贡献到雷达的 token 按 API 正价计算折合美元已破 15w 刀
[image]
为了庆祝这一时刻,tibo 在睡醒后发文,疑似将要再次重置 🤣
[624615a03f5d7a3eee5193fbd2d64251]
上次调价重置之后,GPT 出现了明显的降智和缓慢,期待下次重置能修复相关问题
[image]Think (@2515504707) 在 中转站现在还能挣钱吗 中发帖
也用了一年多的中转站了 慢慢也耳濡目染起来 想自己也搭建一个中转站,但是听说现在入局晚了,太卷了 ,每天都在琢磨挣钱,想钱想疯了,晚上一闭眼就是想钱。诚心想问一下佬友们,中转站现在还能做吗 还能挣钱不梦想之塔 (@mengxiangzhita) 在 gpt5.6是不是已经不干活了 中发帖
[企业微信截图_a852c4a2-c6be-4bf9-af39-706006bc24a9]下午一直这样,其他人也都是慢的要死谷恒调冶 (@luzmatrix) 在 牛来?glm-5.3-flash(ox-alpha)实测 中发帖
从opencode就用上,最大惊喜是道德绑架和风控没ds这么装,但仍比某mi高,看佬友具体项目(逆向还是选mi或某wen),目前harness用的workbuddy,感觉中规中矩wetothemars 在 【富可敌国】CUN.AI 上架牛来 Ox Alpha( GLM-5.3-Flash)大模型!0.9x倍率|综合低至 4.9 折,9.9刀速上车!新用户注册就送5.8刀!内附300张兑换码! 中发帖
GLM 官方也承认了!Ox Alpha 就是GLM-5.3-flash !
[image]
今天看了下最新排行!国产模型够争气!
于是把CUN.AI的国产模型套餐重新整理了一遍。
之前 GLM、DeepSeek、Kimi 和 Qwen 都是独立套餐,佬友们需要分别购买和切换。现在将几个国产旗舰模型整合到同一个专区,一份套餐即可自由调用:
GLM-5.3和5.2 系列
DeepSeek V4 Pro / Flash 系列
Kimi-K3
Qwen3.8-Max,昨晚刚发布的 Qwen3.8-Flash,还有Qwen3.7-Max都可以!
不仅仅是增加到账额度,同时倍率是 0.90× 低倍率计费。
套餐价格
套餐
实际付款
到账额度
有效期
倍率
国产模型体验版
$9.90
$13
30天
0.9x!模型体验、接口测试、轻量开发
国产模型开发版
$19.90
$...liu juntao (@chaoren) 在 实测下来glm-5.3-f 确实不太行 中发帖
丢三落四,说的指令也不能完全理解是什么意思。
该不会也是像 Deepseek V4 Pro 一样过拟合了吧?
还是继续glm-5.3吧。🐟 (@stevessr) 在 由于内核中 Zstd 的效率低下得令人尴尬,补丁程序提供了更快的内核 Zstd 计算速度 中发帖
[!quote]+
今天发送到 Linux 内核邮件列表的补丁可以解决现有代码中一个非常不幸的疏忽,从而提供更高效的 Zstd 压缩和解压缩。
Linux 开发者 Usama Arif 指出,内核中的 Zstd 代码在运行时创建压缩或解压缩上下文时,会决定选择通用代码路径还是使用 BMI2 指令的路径。BMI2 位操作指令集存在于 Intel Haswell 及更新的处理器,以及 AMD Excavator 及更新的处理器中。基本上,过去十年的 AMD 和 Intel CPU 都支持 BMI2 指令集。
虽然运行时检测本身并无不妥,它允许在旧 CPU 上回退到通用代码,但每次创建新上下文时都这样做就显得多余了。除非遇到某些罕见的 CPU 漏洞,否则系统启动并运行后,BMI2 支持不应该丢失。探测 BMI2 需要执行两条带有无条件 VM 退出的 CPUD 序列化指令。
问题在于...@seliote 在 本地 Agent 哪家强? 中发帖
之前一直使用 Claude Code for VSCode 插件 + 中转站,场景主要是代码 + 文档材料 + 绘图这三个方向,最近发现本地直装的 Agent 也开始变得好用了。
研究了:
Claude Desktop:A/ 一如既往不做人,Desktop 不允许直接接入名称非 claude-* 模型,即便改了名字走 gateway 也是各种工具没法正常调用,只有官方 API 才能正常使用。但是喜欢是真喜欢啊,看起来用起来都比较舒服。
ChatGPT:奥特曼大善人,5.5 5.6 模型能力是上来了,但是 VSCode 插件和 Desktop 端做的像是大学生的毕业设计,毫无使用体感加上各种隐藏 bug,每次打开 Desktop 得先把几个报错点击关掉。
Agent 的 PROMPT 也会影响模型的智力和实际体验,各种工具实际使用中是要 输出质量 >> 易用程度 > 美观程度。
其...古如龙 (@relinkd) 在 笔记本电脑涨价的有点厉害,各位佬觉得什么时候会降价 中发帖
去年买了一个荣耀笔记本,现在总是会莫名奇妙的卡住死机,有时候ppt100多页都会卡死。
打算换个败家之眼,一看价格两三万,这个价格一下子就不敢买了,各位佬觉得笔记本明年年初会不会降价啊@AXing 在 有大量生图需求,现在什么api生图渠道的性价比比较高? 中发帖
最近在找一个更合适的生图API渠道,想看看各位佬现在都在用什么方案。
我目前用的是中转站的反代image2api,主要是因为价格相对比较低,但是因为反代质量普遍偏低,image2本身的问题也比较大,画面都比较脏,处于食之无味弃之可惜的阶段。
现在主要就是觉得image2api的价格还行,但画质有点跟不上需求,所以想了解一下各位佬有没有测试过其他模型或者服务。
比较想知道的是,如果单纯从“大量调用 + 低成本 + 画质”这几个方面综合考虑,现在什么方案比较值得用?