2025年12月18日2 分钟阅读

DeepSeek-V3.2 在 Explyt Enterprise 中表现强势:智能超越 Qwen3-Coder-480B

Explyt Team发布于 2025年12月18日

我们很高兴地宣布,DeepSeek-V3.2 已成功部署至我们的 VPC 环境中。
该模型为 Explyt Enterprise 树立了全新的质量基准。
根据我们内部基准测试的结果,该模型在稳定性、推理深度以及将任务真正落实为可交付成果的能力方面,均显著优于 Qwen3-Coder-480B。

DeepSeek-V3.2 的运行方式更加审慎,对错误的分析更加精准,并且能够更高效地探索解决方案空间。

以下是基准测试中 LLM 裁判给出的评估结果,清晰地展示了两种模型在工作方式上的差异:

关于任务执行的完整性:
“代理 1(Qwen)存在一个反复出现的问题:在缺乏真实验证的情况下就宣称任务完成,有时还会修改错误的组件。代理 2(DeepSeek)的行为则截然不同:它会持续进行结果验证(运行测试、配置日志级别),并在无法准确完成任务时主动升级问题。”

结果优先,而非行为模仿:
“当 Qwen 停留在分析阶段、迟迟无法推进到实际代码修改时,DeepSeek 则交付了可用功能,并实现了备用方案。”

重结果完整性,而非形式主义:
“旧模型优先遵循形式化规则,但往往在过程中迷失方向并中途放弃任务。新模型(DeepSeek)恰恰相反:它优先保证任务的实质性完成,即便这意味着需要偏离用户在结构层面上过于僵化、但仅具形式意义的要求。”

更少噪音,更多实事:
“与 DeepSeek 的交互摩擦更低,体验更加顺畅。相比之下,Qwen 在有用的结构化输出与具有破坏性的‘过度活跃’之间反复摇摆,用大量日志和重复内容淹没流程,而 DeepSeek 的行为则更加安静且可预测。”

真正的开发闭环:
“DeepSeek 始终遵循完整的开发流程:‘编辑 — 编译 — 测试’。相比之下,Qwen 常常陷入无休止的文件搜索和死胡同分支,最终在未产生任何有效修改的情况下超时结束。”

总结:

  • DeepSeek-V3.2 明显更加智能
  • 能够稳定且自信地解决更复杂的任务
  • 在 Qwen3-Coder-480B 曾经失败的场景中成功规避错误
  • 在 Qwen3-Coder-480B 会停止并请求人工介入的情况下,仍能持续推进分析、调试和多角度探索,直到问题被解决

全新的 DeepSeek-V3.2 模型现已面向企业客户正式上线 Explyt Enterprise。

Explyt 研发团队持续致力于提升产品质量。
我们不断评估新的模型,引入业界领先的解决方案,并持续提升 Explyt Enterprise 的整体质量与可靠性。

在 JetBrains IDE 中复现、检查并修复问题——以调试器、运行配置和 IDE 事实作为证据。

订阅

通过邮件获取 Explyt 更新

版本说明、工程深度文章以及像这样的新文章。不发垃圾邮件,可随时退订。

评论

加载评论...

继续阅读

全部文章
版本2026年3月25日

Explyt 5.7:更多上下文,更少摩擦

在 Explyt 5.7 中,我们重点让日常智能体工作流变得更顺畅、更可靠。 本次发布减少了那些最关键时刻的摩擦点:为智能体提供更完整的项目上下文、更轻松地切换模型、在临时失败后自动恢复,以及在后台命令运行时依然保持专注。 本次更新带来了聊天中的目录附件、直接集成在输入区域中的模型选择器、智能体出错时的自动重试、更少打扰的终端行为,以及可从聊天界面更快提交 Bug 反馈的能力。 这些改动共同让 Explyt 在日常开发中的使用体验更连贯、更稳健,也更舒适。 你现在不仅可以向聊天附加单个文件,也可以附加整个目录。 文件夹现已支持通过拖拽、最近附件列表,以及项目视图窗口中的 “Add to Attachments” 操作来添加。 点击这样的附件会在 IDE 中打开对应目录,并将该文件夹路径作为上下文传递给智能体。

Explyt Team4 分钟阅读
版本2026年3月12日

Explyt 5.6:技能、新代理模式、自动审查和可预测更改的编辑范围

在 Explyt 5.6 中,我们重点优化了影响日常开发体验的核心工作流,让你与智能体协作时更便捷、更透明、也更可控。 本次发布将提交信息生成功能直接带入 IDE;新增了对聊天选中文本的 Ask/Copy 操作;提供了面向新用户的引导课程;支持通过斜杠命令手动调用 Skills;并可清晰查看每次提问附带的技术上下文。 我们还让聊天中的图片分享更顺畅,支持 Ctrl+V 粘贴、拖拽上传,以及文件发送到模型前的自动压缩。 整体来看,这些更新减少了重复的手动步骤,让智能体行为更容易理解,并帮助你在真实开发场景中更高效推进工作。 你现在可以直接在常用 IDE 的提交窗口中让智能体生成 commit message。 生成按钮会显示在提交信息输入框旁边:智能体会分析当前变更 diff,并给出有意义的提交说明。

Explyt Team4 分钟阅读
版本2026年2月26日

Explyt 5.5:技能、新代理模式、自动审查和可预测更改的编辑范围

在 Explyt 5.5 中,与智能体协作变得更可控、更安全,也更易于扩展。 SKILLs 提供了对开放技能标准的完整支持:你可以将它们存储在项目中,在不同任务和工具之间复用,智能体也会在需要时自动应用合适的技能。 我们还引入了新的智能体模式:Plan 和 Review。 Auto Review 可以快速检查已生成的修改,Edit Scope 用于限制智能体的编辑范围,并且你现在可以创建适配特定角色和工作流的自定义智能体模式。 我们新增了对 Claude 4.6 Opus 的支持,并刷新了 UI。 我们完整支持开放的 SKILLs 标准(Skills)。 Skill 用于解决某一类具体而狭窄的任务,智能体会在需要时自动使用它。 你可以像视频中展示的那样,从新建聊天菜单中添加新的 Skill。 Skill 会以一组 Markdown 文件的形式存储在项目的 .

Explyt Team4 分钟阅读

IDE 原生 AI 的感受

What impressed me most is how well the agent understands the existing project. Its plans fit naturally into what is already built, even when I am working outside my usual tech stack.

Mariya Remenyuk
Mariya Remenyuk

高级分析开发工程师 · DXC Technology

LSP gives an agent coordinates; the full IDE gives it the project model. That native IDE context makes all the difference on real Java code.

Akiner Alkan
Akiner Alkan

软件架构师兼 AI 委员会负责人 · Siemens

IDE-native stepping makes the difference on stateful Java applications.

Masaood
Masaood

软件工程师

为日常智能体工作流提供更多上下文,更少阻碍

将目录添加到聊天中,从输入栏选择模型,在临时失败后自动恢复,并在智能体工作时保持专注。

常见问题

Getting Started

IDE Integration & Workflow

How Explyt Compares

Models & BYOK

Pricing & Billing

Privacy & Security