https://linux.do 论坛的话题更新通知频道。
zhangn 在 发现opencode的muse的问题,推测是否和grok降智也有关系 中发帖
不知道是我理解有误,还是确实官方有问题
官方写的muse 接口是: https://opencode.ai/zen/go/v1/responses SDK是: @ai-sdk/openai
我实际使用发现的问题
1.美西机房使用,呈现出grok一样的现象,返回的拓展思考 summary:,不显示思考内容
2.response接口,无法续接 previous_response_id ,这样会导致前面会话的思考内容(加密,客户端看不到,但服务端可用),后续会话无法知悉,影响质量
3.completion接口, previous_response_id 可以续接。
请教各位,确认一下是否是这样的情况,如果属实,推断grok的降智,是否也是因为这个原因导致的?是否改为 completion接口就可以好了?@BlackTal 在 AI让一个Y9000X2022开机慢的陈年老BUG有了新进展 中发帖
我2022年的时候,买了一个联想Y9000X2022,这个电脑整体还不错,但就是按完开机按键之后,需要20秒才会亮logo,当时有个技术人员给了一个特殊bios屏蔽了板载内存,刷了再刷回正常bios之后好了几天,之后就又很慢了,之后就懒得管了。
最近突发奇想,让ChatGPT分析下这个问题,就把相关BIOS文件和现象描述给它了,之后经过好几天断断续续的分析,还真分析出一个比较靠谱的答案,大概意思就是这45S是在做MEM的训练,之后由于训练结果写不到BIOS里,所以就每次都得训练,就每次就很久。
还想继续分析的时候,ChatGPT就给我弹网络安全风险了,为了保护我的plus号,就没敢再继续了。
但是这样结束又有点不甘心,毕竟看到解决问题的希望了,所以就想着把现有的发现发出来,看有哪位感兴趣大大佬顺便研究一把吧。
Lenovo Y9000X 2022 BIOS 超长 POST 问题逆向...DaxianRen (@TianDao-35) 在 发现可以让GPT不降智的方法 中发帖
这两天GPT降智很严重,以至于我的项目效果大打折扣。这就让我想起月初时有几次会话表现不错,于是我在归档中找到那几次会话。我试着用这些旧会话继续做项目,几轮比较下来,我发现旧会话居然智商还在线,而且速度也很快。我不知道这是什么原理,大家可以测试一下。kailvin 在 太好了,ds昨天的会话今天还能用! 中发帖
昨天试了多次才命中了这个思维链,今天还能用,上下文已经34%了,估计费用会爆炸吧,不管了拼了,完成以后来分享
[f57bb184-39f5-4fb4-a576-129648f17e20]@crispyctt 在 不同提示词对grok生成我的世界的对比 中发帖
猛猛用了几天grok发现此模型真的是纯粹打工人人格模型🤣,几乎没有主观能动性可言,如果你不给充分的约束和指引就会偷工减料,提示词1的结果几乎是不可用水平。
提示词1:
请以你所能达到的最高水准,用web和其他技术一次性完整实现一个可在浏览器直接运行的网页版「我的世界」风格沙盒游戏。
不要自我设限,不要做成简化演示或MVP。把你对这类游戏的理解、技术和审美全部倾注进去,尽一切可能把它做成完成度最高、体验最接近正式作品的版本。直接输出完整可运行的代码,一次到位,展现你真正的上限。
[image]
提示词2
制作一个完整可玩的 Minecraft 风格 Web 方块沙盒游戏
使用现代 Web 技术(推荐 Three.js + Custom Voxel Engine 或 Babylon.js + WebGPU),实现高性能、可流畅运行的浏览器端体素沙盒游戏。所有材质、模型、U...Yiyabo! (@Yiyabo) 在 Sonnet日常开发够用不?对比国模呢? 中发帖
如题,最近Opus蹬太狠了…额度有点不够用了,Sonnet的话倒是可以畅用。问题来了,日常科研有佬是一直用的sonnet嘛?体验如何呢?目前我正在使用中。在考虑是否自己再去开一个max5x用opus了无所谓是不是哈瑞 (@HurryOS) 在 有佬友用了上午我发的渠道吗? 中发帖
上午发了一个自己找的渠道,7e token的glm5.2一个上午+下午被用完了,中途小鸡还炸了两次,现在已经用完了。但是帖子被移除了,不知道违反了什么站内规则?
[3799bf68630853bffd5b009bed16ef89]
本来我可以补号的,但是换电脑了忘记把注册机源码搬过来了要重新写,佬友们等等我吧。
[af0edf99686b1a89898f08e57966f2c9]
[image]火星文专家 (@uoqocjx) 在 有用vllm部署Qwen3.8-27B-FP8的佬吗 中发帖
4张3090部署Qwen3.8-27B-FP8
为啥token输出速度只有50tps
驱动版本是 Driver Version: 590.44.01 CUDA Version: 13.1
下面是部署配置
services:
vllm-Qwen3.8-27B:
image: vllm/vllm-openai:v0.27.0
ipc: host
restart: always
ulimits:
memlock: -1
stack: 67108864
gpus: all
ports:
- "8324:8000"
volumes:
- ./cache:/root/.cache
- ./triton:/root/.triton
environment:
...