OpenAI 接近实现让智能体像人类一样熟练操作电脑的目标
据《商业内幕》报道,OpenAI 接近实现让 AI 智能体熟练操作电脑的目标,已开始向客户逐步开放相关功能。团队通过加入屏幕截图、真人示范数据和强化学习提升模型能力,并改进信息获取方式。该技术有望改变人机交互方式,但速度和泛化能力仍有待提升。
据《商业内幕》报道,OpenAI 接近实现让 AI 智能体熟练操作电脑的目标,已开始向客户逐步开放相关功能。团队通过加入屏幕截图、真人示范数据和强化学习提升模型能力,并改进信息获取方式。该技术有望改变人机交互方式,但速度和泛化能力仍有待提升。
Generalist 发布机器人模型 GEN-1.5,通过观看 3-12 秒的动作演示即可学会新任务,平均成功率约 59%,经 5 分钟快速适应后可达 83%。该模型支持动作串联、从人手或电脑动画学习,并能灵活使用替代工具,有望大幅降低机器人编程门槛。
智谱发布新一代模型GLM 5.3,在Coding能力上刷新国产模型纪录,与Kimi K3并列开源第一,接近闭源旗舰。API上线推迟引发客户抢购,反映市场对智谱模型的热情。文章回顾智谱从GLM 5到5.3的迭代,探讨其背后的公司战略。
感谢 Unsloth 的杰出工作,这对社区来说是个好消息!Qwen3.8-27B 比以往更小更锐利,让我们试试吧!
智谱联合创始人唐杰透露,GLM-5.3 未更换基座,基于 GLM-5.2(743B MoE,激活 40B)通过一个月长周期强化学习,编码能力提升 50%。他强调总参数量决定知识量,激活参数与有效深度决定推理深度,并指出后训练仍有巨大潜力,模型扩展不止堆参数一条路。
智象未来(HiDream.ai)发布原生全模态交互式世界模型HiDream-O1-World,支持文本、图像及交互输入,具备漫游、编辑和交互功能。在WBench评测中,该模型以平均分80.9登顶Navi分榜,物理维度73.3分位列第一。模型采用自研UiT架构,通过3D先验注入Memory和测试时训练维持时空一致性,计划用于AI互动影游、具身智能仿真和3D场景生产。

