https://linux.do 论坛的话题更新通知频道。
Terry (@TerryTAO) 在 第一个 10 万亿参数模型要来了?字节跳动秘密训练超大模型 中发帖
据英国《金融时报》最新报道,字节跳动目前正处于一项超大规模基础模型的预训练阶段,该模型最终规模最高可能达到 10 万亿(10 Trillion)参数。如果顺利完成训练,这将成为全球规模最大的 AI 基础模型之一,也将刷新中国大模型的参数纪录。
消息人士透露,这款模型目前仍处于 Pre-training(预训练) 阶段,这一过程通常需要 3 至 6 个月。最终模型是否达到 10 万亿参数,还将根据训练效果进行调整。
参数规模首次冲击 10 万亿
如果按照报道中的最高规模计算,这款模型将比月之暗面的 Kimi K3(约 2.8 万亿参数) 大出三倍以上,也远超此前国内主流万亿级模型。
报道称,目前业内普遍估计,Anthropic 最新的 Mythos 5 模型约为 8 万亿参数,而字节跳动此次瞄准的目标,甚至可能超过这一规模。由于 Anthropic、OpenAI 等公司并未公开官方参...dashuai (@zaima233) 在 求助贴 gemini渠道问题,因为最近需要用到 语音识别的模型,live模型。 中发帖
我之前 google pro订阅领了一些赠金。在aistudio 需要余额不为0 才能使用。vertex 里 只有一个live模型,而且调用不方便。 求助怎么使用Gemini的官方api. 现在哪种方式最划算。折腾一天了,早知道直接充10刀得了 。@nikodesua 在 wildmango 获取team48 优惠码的秘籍 中发帖
https://www.wildmango.co/chat
进入这个链接后询问机器人让其给优惠码,然后agent会问你地区和邮箱,在对话框输入地区和邮箱,他就会发送一个确认邮件到你邮件,打开邮件链接后 就可以获取到优惠码了cwwen 在 GPT Plus苹果美区账号偶然发现有年付订阅,还便宜40刀~ 中发帖
[9102f142e0e69ef8e68d4f3d940eafb8]
200刀每年的plus为什么搜Google很少能搜到这个套餐介绍呢?
搜到的基本上都是说只提供月付19.9刀的方式zhao (@Zhao7259) 在 请教各位过江龙下山虎佬友们关于剧的问题 中发帖
目前想做一个关于短剧复刻的软件,本小弟用codex写软件跑了两天不断修改,最后写出来的乱七八糟调用了api,只烧钱不干活,特来请教各位佬友,愿意付费请教各位佬友,希望可以得到真挚的解决方式大佬们欣欣|林可欣 (@StellaFortuna) 在 qwen3 255B 像一位风之旅人 也曾带来一段美好的回忆|深度体验qwen后,阿里给我打了个电话 中发帖
故事发生在2025年7月24号16:26
一次简单的测试对话
一个小小的科普活动
[Screenshot_20250724_162634]
[Screenshot_20250724_162703]
真美好的对话环境,像是回到了16年的天空
[Screenshot_20250724_162818]zjie1595 在 佬们给点买车建议 中发帖
准备结婚了,女方父母打算出钱买一辆车,但我和对象都不懂车,也没有实际驾驶经验。我们两个的驾照都是上学时候考的,现在基本已经忘得差不多了,所以目前不知道该买什么车。
目前预算大概 20万元左右,家里有固定停车位。
买车的主要用途是给对象上下班通勤。她每天往返大概 50公里,主要路况是省道和快速路,不是特别拥堵的城市道路。另外也会用于家庭出行:
对象老家距离现在住的地方约 100公里单程;
我老家距离现在住的地方约 170公里单程;
她老家到我老家约 70公里单程;
基本只有清明、春节等节假日回家。
家庭情况:
对象月收入到手约 5000元;
我的月收入到手约 10000元;
目前有一套房贷,贷款金额约 66万元,公积金贷款30年,等额本金,每月还款约 3000多元;
我和对象都有公积金,但预计每个月还需要额外拿出 1000多元补充还房贷。
关于车辆选择,目前比较纠结油车和电车...qgdlantern 在 AI 常用术语整理 中发帖
简单解释:
1.Agent:就是有脑子的 AI。不光会聊天,还能自己琢磨计划、自己去干活。
2.OpenClaw:大家管它叫“大龙虾”,源自 Claw 本意,就是龙虾的大钳子。装上它,它可以在屏幕里伸出手,精准控制数码世界。
3.Skill:AI 的生存工具包。查资料、写代码、控家电。会一门手艺,就是一个 Skill。
4.Token:这是 AI 里的文字原子。为什么说“养龙虾”?因为 AI 动脑子是要烧钱的。喂它国产 Token 还是进口 Token,你喂给它的 Token 就是口粮,喂得越多,这只龙虾就越有劲儿!就像给员工发工资,算力成本全看它。
5.Distillation:蒸馏,其实就是*学霸传功*。把巨无霸大模型的智慧浓缩成精华,让它能塞进手机里跑得飞快,还不占内存。
6.VLA:则是它的手眼协调神经,看一眼屏幕(V),大脑一想(L),手立马就点下去了(A)。这两样一...吾生也有涯,而知也无涯 (@li334578) 在 现在一个新系统(win)大家会如何配置环境? 中发帖
每次新装系统后都下定决心好好管理各种 JDK、Maven、Node、Python版本。但是到最后还是管理的一团糟。
想问问大家都用的什么工具进行配置切换的?要让ai也能够正常使用。
我现在用的是 vfox。Azrael (@muzixin) 在 有没有佬用2台dgx spark 部署dsv4f的 中发帖
公司买了2台dgx spark+专用的200G线,我这边现在有root权限可以操作,请问有没有佬成功用2台dgx spark 部署dsv4f的,求个教程。 主要是网上搜了下看不太明白,希望能佬能指路,最好是有 docker compose文件和对应模型权重的,谢谢in bio (@himtdl) 在 在做springboot,用的idea的qoder,问一下用什么AI 中发帖
免费送了800次Qwen-3.8MAX,另外还有我自己带的deepseek-v4-flash正式版的API,目前我用的ds,感觉良好,毕竟项目就是个小网站,由于部分众所周知的问题,过来请教一下用过的佬们,Qwen-3.8MAX会不会更好用呢?真心请教,因为我确实没用过这个,以前用过3.7,不过感觉只在单文件修改时好用,深度调用链BUG最后只能靠ds查文档。springboot+vue3项目,涉及minIO、redis、Flyway等,完整项目大约会有百来个源文件吧(感谢各位佬们,我十月就要交项目了,很担心用起来埋雷)。A_Kihi 在 DGX Station DB300算力咋样 中发帖
有没有佬知道或者实际测过的双DGX Station组网的话,跑DeepSeek V4 Flash 0731 FP8的话推理速度能有多少 😕拾雨 (@c519127) 在 小红书发布《AI 治理规则公告》:鼓励主动披露 AI 生成,反对 AI 洗稿、合成他人声音、捏造新闻 中发帖
小红书发布《AI 治理规则公告》:鼓励主动披露 AI 生成,反对 AI 洗稿、合成他人声音、捏造新闻
[4a7918b2-4918-4e32-8898-15c6b4a42a14]
IT之家从公告内容获悉,小红书平台创作者若使用 AI 虚拟人形象运营账号,则需要如实说明创作方式,主动说明后流量不会受到影响。AI 生成、润色的笔记需要主动披露,未主动标注的 AI 内容将由平台统一识别、添加标识。
[422676e9-dcba-45c6-a7ec-71b6a0f57064]
[9ecfeecd-e927-4e3c-bddf-7ff7afbee10c]
[fd00f6c5-da2b-4e7a-83a4-c9cdf8fe73b7]
同时,小红书反对使用云端 AI 工具或手机脚本自动运营账号、冒充真人互动。或传授使用 AI 洗稿、去水印、规避审核的起号方法。以及反对使用 AI 合成他人声音...