DeepReinforce
Ornith 1.0 是 DeepReinforce 面向智能体编程的自改进开源模型族。Hugging Face 组织页和模型卡列出 9B-Dense、31B-Dense、35B-MoE、397B-MoE 定位,并公开了 9B、35B、397B 检查点及 GGUF、FP8 版本。模型卡表示这些模型基于 Gemma 4 和 Qwen 3.5 后训练,并通过强化学习同时优化解题 rollout 以及驱动 rollout 的 scaffold,目标覆盖 Terminal-Bench 2.1、SWE-Bench、NL2Repo、OpenClaw / ClawEval 等编程 Agent 基准。模型卡还记录了 reasoning model 行为、通过 vLLM 或 SGLang 以 Qwen 风格 reasoning 与 tool-call parser 提供 OpenAI 兼容服务、Transformers 加载、9B/35B/397B 的 262K 上下文服务示例、MIT 许可和全球可访问权重。
编辑结论
适合评估开源智能体编程模型的团队,用于自托管编程 Agent、终端自动化、SWE-Bench 工作流和长上下文工具调用。
如果需要成熟托管编程 IDE、团队计费管理,或无需 GPU 规划即可轻松运行的小模型,就不适合只看它。
Ornith 1.0 应归入 AI 编程,因为其公开模型卡和合集围绕智能体编程基准与编程 Agent 部署定位。
MIT open weights on Hugging Face; self-hosted inference costs depend on model size and quantization
Hugging Face model download, Transformers, vLLM, SGLang, GGUF local inference
商用应遵守当前产品、API、模型许可证和计费条款。
处理敏感负载前,请核验提示词、文件、媒体上传、保留和训练使用条款。
通过 vLLM 或 SGLang 启用 reasoning 与 tool-call parser,用作编程 Agent 实验后端。
在选择模型规模前复现 Terminal-Bench、SWE-Bench、NL2Repo、SWE Atlas 或 ClawEval 结果。
可用 9B 或 GGUF 版本做轻量实验;需要压缩大模型服务时评估 FP8 版本。
模型名称、额度、发布状态、区域接入和商用条款变化较快,采购或生产使用前请重新核验官方来源。
qwen-agentworld
qwen-code
kimi-k2-7-code
minimax-m3
zhipu-glm
official · en · verified 2026-08-04
确认 DeepReinforce 组织、官网、Ornith-1.0 合集、7 个公开模型仓库、数据集和组织卡定位。
official · en · verified 2026-06-26
确认 397B MoE 模型卡、MIT 许可、智能体编程定位、基准披露和 vLLM/SGLang 服务示例。
最后核验: 2026-08-04