https://linux.do 论坛的话题更新通知频道。
@zulongv 在 【求解】 在new-api中 添加火山方舟的渠道 输出tokens为0 中发帖
问题: 我在new-api中,添加火山方舟的渠道,使用火山提供的模型;在claude-cli中 连接 new-api ,使用该模型进行对话,没有输出任何内容;在new-api中的日志里也显示输出tokens是0; 有经验的大佬指点一二 🫡
配置渠道
类型选择了火山方舟, API基础URL选择了https://ark.cn-beijing.volces.com
[image]
模型使用了deepseek-v4-flash-ga-260731
[image]
模型定价
[image]
日志详情
[image]喜欢七月 (@like_July) 在 Win 下的 chatGPT Codex 桌面版千万不要更新 中发帖
[1787724146848_d]
如图, 如果更新了, 会因为win下的wsl 问题,起不来Cocowhy 在 请教下:GPT5.6的上下文长度、本地压缩和远程压缩如何设置? 中发帖
codex cli
请问下,1、本地压缩和远程压缩是否只启用一个最好,还是同时启用?
2、如果只启用远程压缩,上下文长度model_context_window还需要设置吗?
或者佬有什么好的关于压缩的设置方法?灰質心 (@snowunseasonl) 在 一个用于解决L站某个话题正在回复人数较多时输入框被挤压的问题的脚本 中发帖
在某些比较火热的话题里,当同时回复人数较多时,文本编辑器会被挤压导致极其不易用:
PC:
[image]
移动端:
[Screenshot_20260826_140149_com_microsoft_emmx_Ch]
一个简单的脚本协助改善该问题。
PC:
[image]
移动端:
[image]
👉LinuxDO回复防挤压@TiaNFer 在 求助,老黄的 kimi-k3 上午用的好好的下午 404 是账号问题吗 中发帖
上午还在慢悠悠的蹬,下午就 404了,看了 nvdia 论坛也比较混乱,求助有经验的佬 [image]
[image]MiaMiku (@hqt) 在 Grok Heavy 实际可用额度到底是多少 中发帖
在grok build 中使用
还剩32%周限 bunx ccusage 看一下 才用了150刀
300usd的套餐这也太少了吧梦仄 (@mz_DeepSea) 在 GPT路由到5.5mini确认是BUG 中发帖
ChatGPT消费者产品负责人 Adam Fry 发帖说已修复这个问题,并为造成的不便表示歉意
[image]
[image]fangxiusun 在 访问LInux.do没问题,但是访问cdk.linux.do 和 connect.linux.do 失败 中发帖
这事我自己的问题么?发现好像域名解析到不同的地方了
[image]Samko (@sumsxing) 在 OpenAI自研ASIC芯片已超越英伟达Blackwell? 中发帖
据彭博8月25日报道,OpenAI表示,Jalapeño在单位功耗可处理的AI工作量和响应速度两项关键指标上均领先英伟达GB300。该芯片由OpenAI与Broadcom合作开发,专为AI推理阶段设计,最快将于今年晚些时候投入实际使用。OpenAI芯片负责人Richard Ho表示,Jalapeño在700瓦低功耗下即可实现强劲性能,有助于大幅降低数据中心电力成本。
SemiAnalysis研究人员亲赴OpenAI实验室,使用其自研基准测试套件InferenceX对Jalapeño进行了实测,结论直接:该芯片在每瓦性能(perf/W)指标上击败了他们此前测试过的所有英伟达、AMD及谷歌芯片。
分析人士指出,Jalapeño的意义或许不在于它今天能替代多少英伟达芯片,而在于它证明了一件此前被普遍质疑的事:一家AI公司,用AI工具,在创纪录的时间内,造出了一颗真正具备竞争力的芯片。这个飞轮...fluent (@LeonardFluent) 在 RTK真的有用吗 中发帖
最近看到 JetBrains 对 RTK(Rust Token Killer)做了一次比较系统的 benchmark,觉得里面有个点挺值得讨论的。
RTK 的宣传是可以减少 60–90% 的 token consumption,它的做法也很直观:通过 Claude Code 的 PreToolUse hook 拦截 Bash 命令,把 git status、pytest、git diff 等输出进行压缩,再交给模型。
但 JetBrains 用 Claude Code + Sonnet 5 + SkillsBench 做了 86 个 coding tasks 的 A/B test,结果挺有意思:
RTK 自己统计的 token saving:96.2M
Low reasoning effort 下,实际成本反而 +7.6%
High reasoning effort ...