https://linux.do 论坛的话题更新通知频道。
布尔什维克铁锤 (@ziugat) 在 《代码整洁之道》作者评价 vibe coding 中发帖
似乎想表达的是,无论代码整洁规范,还是 vibe coding,能让人有更多时间思考就是进步
[Screenshot_20261002-144733_Chrome~2]
[Screenshot_20261002-144910_Chrome~2]水星 (@Mercury) 在 codex在线渲染手机端应用方式 中发帖
rt,请问佬们,vibe出来的用于手机端的程序,用的flutter框架,有没有什么skill或者项目可以直接在codex里面查看效果并进行模拟点击测试,或者什么别的软件,除了安卓模拟器以外的别的方式,现在没出一版要移过去再测试,有点繁琐🐟 (@stevessr) 在 公平审核、公平获取与人工智能:arXiv 更新后的速率限制政策 中发帖
[!quote]+
arXiv以及整个科学界正面临着一个转折点。学术出版业目前正经历着快速变革,研究人员交流研究成果的方式也正在发生巨大转变。
arXiv 现已限制每位作者每月最多提交两篇论文,且任何时候活跃的论文总数不得超过三篇。此项政策更新旨在公平分配志愿者审核员的时间,确保所有 arXiv 作者都能获得高质量的论文,并防止 arXiv 数据库因不当论文的激增而受到影响。
限速是 arXiv 的一项既定政策,最初主要由审核员酌情决定。arXiv 一直要求作者遵守我们的行为准则和投稿指南。提交给 arXiv 的文章必须是原创的、新颖的、具有重要意义的、独立完整的研究,并且与 arXiv 的分类相关。所有提交给 arXiv 的文章都必须符合规定的学术标准,并对科学界具有学术价值。此次政策更新旨在公平地分配我们志愿者审核员的宝贵工作,他们负责审核文章是否符合这些标准。我们也希望此...wujunyyds 在 【干货】GPT6降智现象和行为分析 中发帖
背景:
最近在开发软件时被GPT降智搞得有亿点崩溃,不管是GPT 6 Astra还是GPT 6.1 Sol,几乎所有的中转站全都在降智,而且几乎是没有规律的降智,但我也因此获得了一些经验用于分辨GPT是否降智以及如何尽可能规避降智,故作此文对GPT的降智现象和行为进行分析。
模型降智现象和分辨方法:
现象:
据笔者所观察,模型的降智表现主要为1.未完成任务就结束,写的代码一大堆问题2.工具调用经常出现错误3.会出现一些莫名其妙的工具调用信息(后文会提到)
分辨方法:
目前流行的分辨方法主要为画鹦鹉、问juice值、问日本首相问题等。三种方法理论上都可行,但由于画鹦鹉需要较长时间且新手小白不容易分辨,juice值问题GPT 5系列模型也可以正常回答,笔者认为测得不完全准,因此笔者更推荐问日本首相问题。在使用GPT 6 Astra和GPT 6.1 Sol的过程中,据笔者观察,降智后的模型并...