Chinese AI Tools
产品模型库集成生态榜单最新变化
全球可用性使用场景提交工具账号
EN搜索

Chinese AI Tools

Independent directory for Chinese AI products. Product availability, pricing and terms can change. Verify before commercial use.

编辑标准认领产品更新资料申请推荐投放合作

Alibaba Cloud

Qwen-AgentWorld

Qwen-AgentWorld 被 Qwen 定位为面向通用 Agent 的原生语言世界模型。公开版本包含 Qwen-AgentWorld-35B-A3B 开源权重,以及覆盖七类智能体交互领域的 AgentWorldBench 评测基准:MCP、Search、Terminal、SWE、Android、Web 和 OS。README 将 35B-A3B 描述为 35B 总参数、3B 激活参数、256K 上下文的 MoE 语言世界模型,并表示其基于 1000 万以上真实交互轨迹,通过 CPT、SFT 和 RL 三阶段训练。它可通过 SGLang 或 vLLM 以 OpenAI 兼容端点部署,也可用 Transformers 推理,并可通过仓库内 AgentWorldBench 脚本评测。

全球可用完整英文界面公开 API免费

编辑结论

适合

适合需要为工具、终端、SWE、Android、Web 和 OS 智能体环境构建模拟器或评测基准的研究者与 Agent 开发者。

谨慎使用

不要把它当作通用聊天模型或面向终端用户的 IDE 助手;它更偏环境模拟和评测工作流。

核心原因

Qwen-AgentWorld 与 Qwen Code 分开收录,因为它公开呈现的是语言世界模型和 AgentWorldBench,而不是终端编程产品。

可信度: 3/3 个来源已核验,且最近核验覆盖度: 100/100

价格

Apache-2.0 open weights and benchmark; self-hosted inference infrastructure required

Payment

Hugging Face download, ModelScope download, Self-hosted inference, Configured judge-model API billing

Commercial use

商用应遵守当前产品、API、模型许可证和计费条款。

Privacy

处理敏感负载前,请核验提示词、文件、媒体上传、保留和训练使用条款。

适用场景

智能体环境模拟

强

可用于预测 MCP、终端、SWE、Android、Web、OS 和搜索类智能体轨迹中的环境观测。

世界模型基准评测

强

运行 AgentWorldBench,按仓库定义的五个维度评价预测观测。

合成训练与 RL 研究

中

在真实 Agent 训练前评估模拟 RL、可控扰动和虚构世界构建等思路。

全球用户决策清单

注册已确认GitHub 仓库、Hugging Face 模型、ModelScope 镜像、博客和 arXiv 报告均公开。
英文界面已确认README、快速开始和评测说明面向英文用户。
API 与文档已确认快速开始示例覆盖 SGLang、vLLM、Transformers 和 OpenAI 兼容本地服务。
国际支付已确认公开版本为开源发布,但用户需自行承担推理硬件和所配置 judge 模型 API 成本。
商用部分README 标注开源权重和 AgentWorldBench 为 Apache-2.0;生产使用前仍应核验模型卡许可证文件。
数据与隐私条款部分自托管可控制推理数据,但基准数据、生成轨迹和外部 judge 调用仍需内部策略审查。

模型名称、额度、发布状态、区域接入和商用条款变化较快,采购或生产使用前请重新核验官方来源。

Pros

  • - 发布 Qwen-AgentWorld-35B-A3B 开源权重和 Apache-2.0 基准
  • - 在同一模型体系中覆盖七类智能体环境领域
  • - SGLang 和 vLLM 示例可暴露 OpenAI 兼容本地 API
  • - AgentWorldBench 从格式、事实性、一致性、真实感和质量评价预测环境观测

Cons

  • - 它是世界模型和基准发布,不是开箱即用的编程 Agent 或托管助手
  • - 运行 35B MoE 和 256K 上下文需要较高本地或云端推理资源
  • - README 报告了 397B 研究成绩,但列出的开源权重是 35B-A3B

替代决策路径

qwen

qwen-code

openclaw

qwenpaw

deer-flow

Sources

Qwen-AgentWorld GitHub repository

official · en · verified 2026-08-04

确认 2026-06-24 发布、35B-A3B 开源权重、AgentWorldBench、七类领域、SGLang/vLLM 部署和 Apache-2.0 许可证说明。

Qwen-AgentWorld technical report

benchmark · en · verified 2026-06-25

提供 Qwen-AgentWorld 面向通用 Agent 的语言世界模型研究报告。

Qwen-AgentWorld Hugging Face collection

other · en · verified 2026-06-25

托管官方 Qwen-AgentWorld 模型和 AgentWorldBench 数据集集合。

最后核验: 2026-08-04

评论

Availability snapshot

可用性
available
英文界面
full
API
available
Rating
4.1 (0)

最新动态

最新变化
开源 · 2026-06-26

DeepReinforce Ornith 1.0 开源编程模型已收录

DeepReinforce 的 Hugging Face 组织页现已公开 Ornith 1.0 系列 MIT 许可智能体编程模型。合集包含 9B、35B、397B 公开模型卡,以及 GGUF 和 FP8 版本。模型卡将 Ornith 定位为基于 Gemma 4 和 Qwen 3.5 后训练的自改进模型族,通过强化学习同时优化解题 rollout 及其 scaffold,并披露 Terminal-Bench 2.1、SWE-Bench、NL2Repo、SWE Atlas 和 ClawEval 结果。档案已记录 vLLM、SGLang、Transformers 和 OpenAI 兼容本地服务路径。

开源 · 2026-06-24

Qwen-AgentWorld 模型与 AgentWorldBench 已发布

Qwen 已发布 Qwen-AgentWorld-35B-A3B 开源权重和 AgentWorldBench 评测基准。项目将 Qwen-AgentWorld 定位为用于模拟智能体环境的原生语言世界模型,覆盖 MCP、Search、Terminal、SWE、Android、Web 和 OS 七类领域。README 显示 35B MoE 模型为 3B 激活参数、256K 上下文,可通过 SGLang 或 vLLM 以 OpenAI 兼容 API 部署;AgentWorldBench 会从格式、事实性、一致性、真实感和质量五个维度评价预测环境观测。仓库也报告了 397B 研究结果,但公开发布的权重目前列为 35B-A3B。

Submit a review