Alibaba Cloud
Qwen-AgentWorld 被 Qwen 定位为面向通用 Agent 的原生语言世界模型。公开版本包含 Qwen-AgentWorld-35B-A3B 开源权重,以及覆盖七类智能体交互领域的 AgentWorldBench 评测基准:MCP、Search、Terminal、SWE、Android、Web 和 OS。README 将 35B-A3B 描述为 35B 总参数、3B 激活参数、256K 上下文的 MoE 语言世界模型,并表示其基于 1000 万以上真实交互轨迹,通过 CPT、SFT 和 RL 三阶段训练。它可通过 SGLang 或 vLLM 以 OpenAI 兼容端点部署,也可用 Transformers 推理,并可通过仓库内 AgentWorldBench 脚本评测。
编辑结论
适合需要为工具、终端、SWE、Android、Web 和 OS 智能体环境构建模拟器或评测基准的研究者与 Agent 开发者。
不要把它当作通用聊天模型或面向终端用户的 IDE 助手;它更偏环境模拟和评测工作流。
Qwen-AgentWorld 与 Qwen Code 分开收录,因为它公开呈现的是语言世界模型和 AgentWorldBench,而不是终端编程产品。
Apache-2.0 open weights and benchmark; self-hosted inference infrastructure required
Hugging Face download, ModelScope download, Self-hosted inference, Configured judge-model API billing
商用应遵守当前产品、API、模型许可证和计费条款。
处理敏感负载前,请核验提示词、文件、媒体上传、保留和训练使用条款。
可用于预测 MCP、终端、SWE、Android、Web、OS 和搜索类智能体轨迹中的环境观测。
运行 AgentWorldBench,按仓库定义的五个维度评价预测观测。
在真实 Agent 训练前评估模拟 RL、可控扰动和虚构世界构建等思路。
模型名称、额度、发布状态、区域接入和商用条款变化较快,采购或生产使用前请重新核验官方来源。
qwen
qwen-code
openclaw
qwenpaw
deer-flow
official · en · verified 2026-08-04
确认 2026-06-24 发布、35B-A3B 开源权重、AgentWorldBench、七类领域、SGLang/vLLM 部署和 Apache-2.0 许可证说明。
benchmark · en · verified 2026-06-25
提供 Qwen-AgentWorld 面向通用 Agent 的语言世界模型研究报告。
other · en · verified 2026-06-25
托管官方 Qwen-AgentWorld 模型和 AgentWorldBench 数据集集合。
最后核验: 2026-08-04