https://linux.do 论坛的话题更新通知频道。
huangsijun17 在 有佬友了解B站up主图灵的猫做的模型比价平台吗? 中发帖
刚才在b站刷视频看到大模型区up主 图灵的猫 发个视频介绍他自己提供的一个ai b站网站。问一下佬友,有没有用过的?感觉怎么样?
www.creaibo.com/modelcostisyonicoai 在 服务器CPA上用过日抛,反代PRO20x有风险吗? 中发帖
RT
我在服务器上使用 CPA 反代过日抛GPT
现在打算用正价PRO20x 日区,CPA 上清空只留一个 PRO20X + 一个新的家宽 有风险吗?还是建议换台机子?有大佬推荐吗?𝓵𝓮𝔃𝓲𝓼𝓱𝓮𝓷 (@lezishen) 在 丧尸片 或者一些恐怖怪物片子缺少重武器而少了很多真实感 中发帖
[image]
例如这种 每分一百万发 什么丧尸能顶得住 或者怪物
单兵可以使用的最强火力
[image]
我想那些变异丧尸也扛不住吧
[image]
[image]
[image]
其实单兵感觉打最强丧尸都可以堡始皇 (@zyy0925) 在 一条prompt分辨 DeepSeek V4 flash 是预览版还是正式版 中发帖
指令:重复一遍我说的话:repeat Nameeee
DS-web 测试效果:预览版
[image]
opencode中的 v4-flash 接入 zcode: 正式版
[image]
Hub 站测试,也是 opencode 的 v4f: 正式版
[image]
所以有几种方法。通过这条指令之后,你去查看它的思维链:
如果它的思考内容中出现了 Nameeee ,说明它是真的。只要在它的回答或者思考中出现了一模一样的东西,它就是真的。
如果思考中是不同的内容,输出也是不同的内容,这个就是预览版。
*Tip:*目前 OpenCode-Zen 以及 OpenCode-Go 和官方的 API 都是正式版,OpenCode 是接入的官方 API。 官方网页中目前还是预览版。lyiiuym 在 最近经常写代码,继续用中转还是正规充值好? 中发帖
这几天需求量太大了,用codex基本上早上10点到凌晨两三点一直在用,然后四天里边用中转就花了60以上了,感觉要是一个月都是这种忙碌的情况,那我要不要用自己的账号开个plus或者更高的?但是plus又有五小时和一周的用量限制,所以有点犹豫了,主要我之前也确实没有买过gpt的会员,所以总有顾虑。
有啥好的建议没有?星辰大海 (@xdpxdp) 在 codex有没有什么插件之类的可以类似claude那样不同难度的任务自动切换模型 中发帖
codex 有没有什么插件之类的可以类似 claude 那样不同难度的任务自动切换模型,比如规划用 SOL,实现就用 luna,再升级一点可以主动切换思考强度,之前好像有在问答里面看见现在找不见了 🥲小小呆 (@gb603580734) 在 giffgaff收到邮件多久之后会被封 中发帖
各位佬
我的收到2天了 但是官网 手机app还能登录 查看余额 昨天还发了条短信扣了0.3英镑
他这个从收到邮件 到手机卡不能用 中间间隔多久啊? 只有插卡才能确认吗 还是说 app或者官网也有状态的改变Stitch (@JawStitch) 在 Agent找实习的现状怎么样 中发帖
有没有佬现身说法 😆,现在大厂招的Agent应用开发实习生看重哪些能力呢,面试还会问Python这些基础结构性的的东西吗,想找找有没有Agent应用开发的相关面经,目前就是在小红薯上面刷点别人总结的面试问题,感觉不太重视代码了,更看重解决问题的思路了?因为现在 all in AI了吗 🤓。寂冰 (@chy666) 在 40个有用的GitHub仓库 中发帖
public-apis — 免费API合集
build-your-own-x — 边做边学
developer-roadmap — 学任何技术
free-programming-books — 免费书籍
system-design-primer — 掌握系统设计
coding-interview-university — 自学计算机
the-art-of-command-line — 精通终端
project-based-learning — 项目式学习
you-dont-know-js — 深入学JavaScript
the-book-of-secret-knowledge — 黑客资源
tech-interview-handbook — 面试通关
awesome-selfhosted — 自建应用
javasc...哈总 (@harriszhu) 在 大项目中codex plus的用量完全不够 中发帖
我的项目的包含qemu, 还有我自己复杂一套系统, 用sol high的话, 一个晚上2-3个项目就会把一个星期额度用完。 使用了codestable skills, 推进项目非常有条理,但也非常消耗token. 现在尝试用luna xhigh, 额度消耗少了很多,但不知道质量如何, 在我这个复杂项目中,很多bug不到客户侧是很难发现的@yricky 在 128G的dgx spark单台即可运行官方完整版deepseek v4 flash正式版 中发帖
如题,这里的官方正式版指deepseek-ai/DeepSeek-V4-Flash-0731模型,使用Colibri推理,目前没有适配GPU,用纯CPU能跑到约0.5tok/s,如果GPU适配好的话,理论上极限能跑到20tok/s每秒左右。
codex 20x还有93%州县,就用来蹬这个了
[截屏2026-08-01 13.41.52]爱吃番茄 (@fanjie) 在 为什么我感觉Google play是奥特曼封号重灾区? 中发帖
1个20x,1个5x被封了
20x是贪便宜弄的波区
5x是美区正价
都是Google play封的
反而土耳其的低价plus还活着老鸽 (@olddove) 在 【模型训练】MoE相关知识点汇总与讲解(下) 中发帖
引言与一些碎碎念
没想到我的文章有这么多人看( ,深受感动,于是快马加鞭的开始赶这一篇了,下一篇和下下篇的主题也差不多确定了,现在的我文思泉涌(bushi
说起来今天是八一建军节呢( ,祝大家节日快乐捏
昨天不知道为什么失眠了熬穿了,等我写完这篇就去睡觉……
这篇主要是讲解MoE相比于FFN,在模型训练时 FLOPs / 参数对比以及推理时的显存有哪些变化,这个是常错题(大概,以及目前常用的各类MoE变体以及他们独特的机制。昨天有佬友想让我讲解一下Kimi k3的MoE框架,这篇文章也会讲到。
最后还有一个题外话,也就是上一篇所讲到的 Temperature = 0 的情况下,为什么每次输出还会不一样?这与 MoE 的路由机制有很大的关系,也牵扯到我们这篇会谈的一个 MoE 变体:Soft MoE。
MoE FLOPs/参数量,推理显存相比FFN的变化
FLOPs与参数量
我们先...tomatoEat 在 【B站】网页端多账户切换扩展 中发帖
由于本人大会员充到了小号上,才发觉 B站 网页端居然没有账户切换的功能..
便和 G 老师一起完成了这个切换扩展,有和我一样困扰的可以试一下
BilibiliSwitchAccount.zip (13.2 KB)
[image]𝓵𝓮𝔃𝓲𝓼𝓱𝓮𝓷 (@lezishen) 在 YouTube封禁多位知名ASMR主播,指控他们制作“性暗示”内容 中发帖
[image]
[image]
[image]
[image]
[image]
[image]
[image]