https://linux.do 论坛的话题更新通知频道。
豹豹 (@pup) 在 开源项目灵感建议:我想做一个 claude 反中国封禁的工具 中发帖
其实现在已经有比较成熟的工具链,来在中国稳定地使用墙外的一些工具了。但是像 Anthropic 这样的公司还是对中国抱有敌意,所我们需要用很复杂的手段,比方说用住宅 IP 和链式中转调用来实现伪装我们身为中国人的身份。我觉得到目前为止,唯一阻碍我们大规模地在国内推广和使用、享受 Claude 模型,就限于这里。所以我想做一个类似于其他人一键搭建梯子的脚本工具集,让大多数不太懂攻防,也不太懂 Anthropic 各种封禁规则和操作的人,也能受益。所以想问问大家,觉得这个脚本工具集应该能实现哪些功能?
我觉得最首要的是把那个反人类的邮件检测给做了。至于住宅 IP 和相关环境的搭建,我觉得可以模仿一键搭建机场脚本的需求思路Bi_Diu 在 你绝对没见过的猎奇鹈鹕骑车🤣 中发帖
😆 😆
熬了一晚上夜,天刚亮,突然看到论坛佬友在测grok4.6画鹈鹕,想起自己的严重降智号池,心血来潮去画了个,结果笑得我满地打滚
[pelican-bicycle]
grok4.6巨献Tom (@tangzebin) 在 阿里正式开放Qwen3.8-2.4T-A95B模型权重 中发帖
阿里云“魔搭ModelScope社区”宣布,阿里Qwen团队正式开放Qwen3.8-2.4T-A95B模型权重。这是Qwen-Max级别模型首次开源权重。Qwen3.8-2.4T-A95B是一个因果语言模型,总参数达2.4T,采用MoE稀疏架构,每个Token仅激活95B参数。模型每个MoE层包含512个专家,每个Token选择10个路由专家,并同时激活 1 个共享专家。上下文方面,原生支持262,144 Token,并可扩展至1,010,000 Token。模型还进行了多步Multi-Token Prediction训练。开源意味着开发者可以基于模型进行复现、微调和二次开发。官方云端版Qwen3.8-Max基于该开放权重模型,并额外增加了多项生产环境能力。Com.mp Registry (@Com-mp-registry) 在 慎用 CloudFlare 缓存规则中的 `接受强 ETag` 中发帖
慎用 CloudFlare 缓存规则中的 接受强 ETag,
会导致响应的静态内容完全不走 gz、br 压缩!
且会导致静态资源的 HTTP 304 机制出问题,无法命中 Not Modified。
纯明文直出,反而会劣化响应时间。@yhe 在 深夜放大招!DeepSeek V4 Pro 正式版 API 更新上线,多项测试性能接近 Fable 5 中发帖
[3492.jpg]
8 月 13 日消息,DeepSeek V4 Pro 正式版今日晚间正式发布,已更新至 API,调用模型名不变。木瓜蛋白酶Tea🎋 (@Papain233) 在 这个新版编辑器,移动端在哪上传图片啊。。。 中发帖
这个新版编辑器,移动端在哪上传图片啊。。。之前没有预览的问题也一直没修,现在连 md 和 富文本切换都没了,全是 discourse 的问题?能不能维护一下@JIUSAN3 在 Gemini简直智商变态到连豆包都不配了 中发帖
在线搜索是不用的,知识库是旧的,甚至在提示词里加上搜索都是不愿意搜索的,这样的性能连御三家都不配 :tieba_001:
[image]@Er_er 在 GPT5.6Sol 跑了足足三小时给我拉了坨大的,恁要弄啥勒??? 中发帖
[c62911e3-8acb-4e4f-bd1f-e072d190361a]
[bc1dd522-94af-41b0-82c1-3bfdfc4e5816]
关键是我只有三个版本前的备份了,警钟长鸣。为什么子代理会删文件啊啊啊啊啊啊啊!他连自己创建的备份都删了。NaynIruR (@ruri39) 在 dsv4pro 正式版拉完了 中发帖
找bug找不出来,幻觉还特别多,指令遵循也拉完了,甚至让它停下来和我解释,它都完全不理会我的指令继续debug😅听说正式版确实已经全量推出了,但我体感怎么和之前差不多甚至更烂呢chunhuaerdawang 在 这个点还没睡的佬在干啥呢 中发帖
糟糕,一不小心熬穿了。出租屋的窗帘很薄,有点透光,能外面天亮的微光。
我是一边鞭策 codex 干活,一边干自己的活🪡,干着干着就到 5 点了😛
坏了,还要上班🥲
晚安(ᴗ˳ᴗ)💤
[1000048425.jpg]
[1000048384.jpg]@lulinkjason 在 【破事水】佬们,目前写文字最强的是哪个模型啊 中发帖
需求:
写剧本
做agent和skill
写策划案或者做做PPT啥的
不太需要coding能力,反倒比较吃创意和写作能力,这种情况哪个模型最好呢?
我目前用的是5.6 sol,感觉写剧本还是差点意思,哪怕AI味我靠skill给强行转过来了,它总是记不住自己是在写剧本,写着写着就变成小说一样的(裂开)
用AI的话说,不是格式错了,而是加了很多抽象描写或内心情绪(打飞
这种很难转化成具象画面,所以只能再手动改,头疼。低质竖屏仿真人这样也就算了,偏偏最近做的是超精品级的项目(裂开)
佬们,帮帮孩子吧@heishuitaotaolo 在 半夜惊醒,蹲坑刷手机刷出梁圣发新版本。试了一下更睡不着了,别涨价啊梁圣 中发帖
写HTML,内容是SVG,鹈鹕骑自行车的2D动画,只有一次机会,不要测试。
7分钟出网页。试了2次,基本都能看,除了太阳么啥大毛病。
在codex app 搞得,效果网页, https://pelican-bicycle.pages.dev https://pelican-bike-d1d.pages.dev/
别涨价还是梁圣@astro_void 在 Google 的 AI 搜索模式怎么也大降智了? 中发帖
平时按要求有针对地搜索信息都非常听话的,今天完全疯了,改用 Grok 去搜了
新模型喊了多久了不出来,AI搜索模式也发疯了,就这样,还想试点全AI、一股廉价俗味的新版首页?
https://searchenginewatch.com/google-tests-ai-focused-homepage-for-signed-out-users/@xiaomao 在 挺火的模型测试:模型会不会胡说八道 中发帖
BullshitBench(胡说基准 / 扯淡基准) 主要测评的是:AI 模型在面对明显荒谬、无意义或前提错误的提示(nonsense prompts)时,会不会主动识别并明确挑战/拒绝,而不是一本正经地继续回答。
作者设计了共有约 100 道无意义问题。
覆盖 5 个领域:软件(40题)、金融(15)、法律(15)、医疗(15)、物理(15)。使用多种“胡说技巧”,比如听起来专业但实际不存在的框架、错误套用机制、嵌套荒谬等。
官网:BullshitBench Viewer
问题都是开源的
[HPgk5OVbkAAk9pX]