人工智能
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
量子位的朋友们 量子位
2 浏览
星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL
阅读原文:https://www.qbitai.com/2026/09/484437.html
← 上一篇
[AI Agent 智能体] 问下大家多台电脑的,如何同步桌面端 AI 软件(比如 ChatGPT, Claude)的对话呢?
下一篇 →
趋境科技与摩尔线程达成战略合作,高品质 AI Token 国产异构方案性价比超越国际先进算力
相关文章
[
人工智能
[问与答] Googledrive 和 outlook 为啥 winodws 闪退 打不开
几个月没用 win 电脑 怎么会这样。。。。。。按照 ai 提示 各种补丁修复 清理缓存重装还是不行。。。。 hp 家庭版系统 hp 电脑。。。。 你么没有遇到过吗、、、。。。 win 电脑和我我的 mac 电脑都是靠 google drive 连在一起的。。咋整
V2EX
[
人工智能
[程序员] 难绷,太相信 ai 了😭
workbuddy 的混元 3 模型,之前免费期用的还不错,感觉不比其他模型弱,一度让我重拾对混元模型的信任,结果今天调了一上午的 UI ,结果午睡前跑了个命令,一觉起来发现 UI 给我改的面目全非(ノ`⊿´)ノ。让回退,说某个文件删了,他没办法还原,让我自己从备份还原,这就是不看 ai 思考的后果吗🥲
V2EX
[
人工智能