https://linux.do 论坛的话题更新通知频道。
Sawtone (@Sawtone_ovo) 在 得了一种睡前必须goal一下的bin 中发帖
连着两天goal着睡了,跑了1000M,今天刚写完prompt准备goal,十分钟前还正常的大肥鱼就陨落了,我恨你大肥鱼
[508e745a53f526819cc432dbe69a18cf]Al1cE (@ai1ce) 在 DeepSeek 官方 API 和 Web 炸了,是鉴别渠道是否官转的好机会 中发帖
DeepSeek API (DSv4.1 Flash) 和官网跟着一起爆炸了,V4 Pro 不影响
具体表现: 官方 Web 发送消息超时、官方 API 请求连接被 hang 住
好消息是 command code 里的 DSv4.1 Flash 也不能用了
Error: 429: {"message":"Upstream model provider is temporarily unavailable. Please try again in a moment.","type":"rate_limit_error"}Trump (@KaranocaVe) 在 有没有人觉得Gemini说话喜欢打官腔 中发帖
感觉 马克思列宁主义、毛泽东思想、邓小平理论、“三个代表”重要思想和科学发展观、习近平新时代中国特色社会主义思想 没少学WizisCool 在 Deepseek 炸了,趁机测试哪家是官方渠道 中发帖
[image]
[image]
目前测试发现
Workbuddy/Codebuddy/国内/国外 均为官方API
Command Code 为官方API
Opencode 经佬友反馈同样为官方API
看来大家常用的渠道目前都是对接官方啊
还是别纠结哪家降智了,放心蹬吧CCVV (@user179) 在 ios是怎么订阅gpt 5x pro的? 中发帖
[ios 5x]
看到卡网有人卖代充5X PRO,还标的ios充值,我自己试过充ios订阅,只有go和plus订阅,oai官网也写着pro订阅只能在网页版购买呀,最终只能用Google Pay充了。有没有懂的佬解释一下~感谢~ 😘@PolarisCN 在 自己注册的谷歌号封3次了,9/11封,9/15又封 中发帖
无语了,刚解封没几天又给我封号了,在用CPA反代的antigravity。
感觉是jio渠道的问题,我之前买的两个人机号只有刚登录封过,申诉解封后再没封号过,都是学生订阅号。sandiferresner 在 DSH agent team 效果实测 中发帖
DeepSeek v4.1 Flash 论文里面 dsh 的 agent team 性能很好, 所以用鹈鹕骑自行车简单测试一下.
原图如下, ProgramBench 测试的是能否仅凭一个黑盒的可执行文件(Executable)和相关使用文档,通过逆向工程完全复现出一个行为一致的软件. 可以看到开了 Agent team 之后性能提升了 50%. 这个图也可以看到工作时间不是越长越好, 可能有回退.
[image]
下面是实测结果, 使用 dsh 标准模式, 提供 chrome devtools mcp 供它验证. 使用 v4.1 flash + high (我使用的是 ClinePass 里面的 deepseek, 我之前查路由, Provider 不是官方, 是 fireworks 和 novita, 所以结果仅供参考). 没有用 max 是因为差别不大, 简单任务可能有回退,...jiah 在 DS比较有性价比的coding plan求助 中发帖
rt, 给实验室采购,涉及到网络安全的任务,所以gpt和Claude干不了,commandcode的20x好像完全没有10刀的套餐划算,有没有比较划算的200刀-300刀左右的月套餐,或者commandcode可以堆号池开goat吗,主要是怕封号shall mas (@xk1357240) 在 any 使用codex的时候,Context automatically compacted 之后就是invalid codex request 怎么办? 中发帖
如题,这个是属于本地压缩还是远程压缩?好像any在内的中转几乎都不支持远程压缩?@Bismarckdrei 在 想知道现在轻度使用是开GPTPLUS好还是CCPRO好 中发帖
如题 GPT的好处是网页和CODEX额度分开,但是最近降智严重有点害怕。CLAUDE的问题是额度通用,但是听说整体额度比CODEX多很多。所以非常纠结开哪个比较划算@rcins 在 关于astra降智后使用的模型的研究 中发帖
坊间传闻astra降智后回复的模型系4o或者其他gpt4模型,且有人通过询问知识截断日期来判断是否降智。我认为4o的说法基本是没有根据的谣传,并且该鉴定方法并不完全准确。
这里不过多叙述为什么不应以询问LLM关于它本身的信息作为判断模型的依据。询问LLM任何关于Reflexivity的问题,在上下文未插入关于Reflexivity的信息时是不可靠的。
已知OpenAI公布的截断日期:
|slug|截断日期(右开区间)|
|gpt-4o|2023/10|
|gpt-4.1-mini|2024/06|
|gpt-5-mini|2024/06|
|gpt-5.4-nano|2025/09|
|gpt-5.6-luna|2026/02|
|gpt-6-astra|2026/05|
关于模型的知识截断,可以通过一些prompt来探测,如先查询某个月有哪些名人死亡,然后询问模型该人...@ANG.eth 在 antigrivity的gemini今晚怎么这么慢呀 中发帖
今晚 AntiGravity 的 Gemini 特别特别慢,我不知道是因为上下文太长,还是其他原因。我已经换过几个账号了,它今晚的 TPS 比 Codex 还慢。大家也这样吗sun of beach (@h1xy) 在 美国运通订阅chatgpt business每年送$300账单抵扣 中发帖
偶然看到,不知道什么时候出来的
使用美国运通商务白金卡和商务金卡在美国境内通过 ChatGPT Business* 消费,每个日历年可获得最高 300 美元的账单抵扣额。需注册。自动续订。
*需注册此权益。只有商务白金卡 ® 或商务金卡账户的基本持卡人或授权账户经理才能注册此权益。符合条件的消费必须记入已注册的卡账户,权益方可生效。已注册的基本持卡人和员工持卡人使用该卡账户进行的消费均可获得账单抵扣。每个卡账户每个日历年最多可获得 300 美元的账单抵扣。此权益仅适用于在美国及美国领土内直接通过 OpenAI 购买的 ChatGPT Business 产品,且 OpenAI 为该笔交易的收款商户。
*FrozenGunr 在 关于大型项目的稳步开发与推进 卡了一个月多没进度了 佬们有现成的工作流或者编排相关的轮子吗? 中发帖
从6月末开始在开发一个比较大的功能比较复杂的gui软件 全栈都是rust完成。 问题在于,功能开发过程从6月末到7月末实际上已经完成了(基本上全部用gpt旗舰模型完成的) 具体就是不断堆屎和改 前端看着功能正常就算通过。
然后现在想做别的功能 但是它的数据和行情相关的底层已经烂掉了 改一处会涉及很多处。我本人不是资深开发 纯靠ai完成的。 那就想着 重构嘛,问题就来了 我想彻底对齐同类生产级终端 就不断生成施工文档系统和干活,从7月末到现在 已经一个月多 中转站重构用的token支出已经100e以上 可以说重构是0进度 我的收获只有工程经验和教训
重构过程中主要问题在于:1、每一步我做完 问有没有问题 是否对齐生产级 每次我问完就改 改完再问 再问一定还有问题 并且往往是新问题。2、文档已经对抗式评审过了 确认没有流程问题、没有冲突。从头开始施工,往往第二步开始又出问题,要改...