https://linux.do 论坛的话题更新通知频道。
@mk132 在 DeepSeek V4.1 Flash 醍醐骑自行车 中发帖
WorkBuddy里的 DeepSeek V4.1 Flash
创建一个 HTML,内容是 SVG 绘制一个鹈鹕骑自行车的 2D 动画
[pelican-bicycle]
[image]
个人觉得效果不错,会不会是特调的?person 在 V4.1-Flash糖果问题都做不对 中发帖
用的PI,开了max等级思考,接的官方API,5.9s就出结果,还是错误的 😅
[图片]
我再提示它让它仔细思考一下,这回思考了62s,才回答正确。第一次5.9s就出结果感觉很像是缓存之类的?不知道是不是DS的缓存有问题,还是说这模型就这样?
[图片]
速度倒是都能达到200+t/s
[图片]sandiferresner 在 CommandCode Go 里面的 DeepSeek V4.1 Flash 是不是有点问题 中发帖
pi 里面用的时候长任务输出会截断, API 报错 Error: Stream ended unexpectedly before completion (no finish event) — response was truncated
稳定不能通过糖果题, 使用 command code 自己的 agent 工具也是这样, max 思考等级.
是我这个账号直接被降智了, 还是 goat 订阅也是这样. 感觉这家公司不靠谱呀.RioArisk 在 GPT风控终于还是到我了吗 中发帖
[image]
今天一天看到论坛大家都出现server is overload,还庆幸我是个例外,爽用了一天。结果晚上打开研究风控机制的时候就炸了。
个人情况:gpt pro20x 无分发无反代 美区正价虚拟卡付
代理:注册付款都是ATT家宽,日常使用是dmit的线路机Timetzh 在 Chatgpt接码whatsapp接码,saily卡牛逼 中发帖
本来只是自己的paypal一直绑着一个已经找不到平台的号码,看了看论坛里佬友们的帖子。
选了saily来测试一下,小白卡之前已经买了2个月一直没用。
第一张412开头的可以接paypal,不能接whatsapp和chatgpt,和客服简单聊了10分钟,客服去操作退款了,最终退不退无所谓了。
第二张940的吗,直接chatgpt可以接到,whatsapp也可以,一会把paypal的也改了去。
不知道让不让留推荐码?
[131880b07740417763f57f4019fd05d2]
[52ec2a8bb081f76ec36b901c73a03cde]Guilliman (@Guilliman-XIII) 在 求问各位佬,我的ChatGPT是被降智了吗,鹈鹕骑自行车做的很差 中发帖
用的网页版的极高,我是菲律宾虚拟卡免税官网直充Pro20X
[image]Vrans 在 GPT 6Pro怎么检测有没有路由到其他模型? 中发帖
[image]
让做一个创新方案,提示词写了六七行,然后他13分钟出报告这正常吗。我记得以前的深度研究要思考好久好久,所以有点怀疑把Pro路由成垃圾模型了。佬们有什么方法能检测吗@jiunian97 在 刚买了台硅谷服务器,准备部署cpa,结果遇到了问题 中发帖
第一个问题 codex的接码,不买手机卡怎么解决呢
第二个Gemini 登陆出现这个错误咋整
第三个问题,cc不充值可以反代吗? [image]@z1056544889 在 AI时代,类似若依,芋道源码这种开源的脚手架是否还有必要使用? 中发帖
相信有不少佬的公司项目都是基于这类脚手架搭建起来的,在没有AI的时代,他们提供的代码生成器确实很方便,但是这些始终是面向人的,现在AI来了之后,这些框架的生态位是否被挤压了?现在新启动项目还会使用这些框架吗,未来的发展趋势会是什么样,是否会出现一种新的框架,更利于AI去理解,去二开搭建,或者每个新项目都是从零开始搭一套?@impouo 在 想骂你的人,真是怎么都能找到角度 中发帖
不针对任何具体的人或帖子了,看一乐吧
新模型发布了,声音很大:都是营销,造势
新模型发布了,没有声音:我就说这家拉吧,新模型发了连点声音都没有
模型涨价了:哎,开始收割了吧,不支持**果然是对的,哎flower
模型降价了:没人用了收不回本知道降价了
新模型生了,跑分很高:都是刷分,也就会这一套了
新模型生了,跑分一般或者很低:我就知道做的不行
要下线一个效果不好且更贵的大尺寸模型:你怎么能这么做!!虽然新的小尺寸模型全面碾压旧的大尺寸模型,且所有模型都是开源的,大体量模型缺的世界知识这块谁给我补啊!!
(与此同时,在评价另一个世界知识专精模型时:世界知识有什么用 屁用没有 coding和agent能力才有意义 才有未来 谁家好人关心世界知识啊)
听取大家意见推迟下线:朝令夕改,草台班子,果然不行呐@SmallMain 在 短的 DeepSeek V4.1 Flash 评测(Unity / C# / 游戏开发方向) 中发帖
前言
记一次真实测评系列,正式停更。
停更的原因有两个,首先是它占用了我较多的时间。
其次是只有一个测试案例,且没有完全标准的评测标准。虽然这个案例能够大致反映模型的可用性,但是仅此而已,与我所期望测评能够带来的参考性有所差距。
我在考虑发布一个更全面、准确性更高、标准且透明化的评测。
而在此之前,我将减少测评的频率,并且这个测试案例会以短的测评系列和大家分享。
感谢大家的支持和阅读!
▶
本次测试案例
DeepSeek V4.1 Flash
模型来源:官方 API
效率
排名
模型
时间(分钟)
备注
39
DeepSeek V4.1 Flash
13
22
Grok 4.6(xhigh)
16
23
DeepSeek V4 Flash 0731
17
32
Claude-Fable-5(xhigh)
23
36
DeepSeek V...