Apodex 1.1 这次有点夯

关键它还开源了!

之前测它的时候,我就觉得这是少数真正有研究味的模型。

那种惊艳感,有点像第一次用Manus

但这次升级之后,它已经不只是帮你搜资料,然后憋一份报告出来了。而是开始真正干活可以直接处理论文、PDF、表格、数据集、图片和代码。

自己清洗数据、选择方法、运行分析、检查中间结果,遇到报错还能继续修,最后直接交付可验证的结果。

这点其实很重要因为以前很多所谓 Agent,本质还是“搜索 + 总结”。

Apodex 1.1 更像把:

研究 → 执行 → 检查 → 交付

真正串成了一条完整链路

这次 Agent Team 也不只是简单多开几个 Agent。

它会先拆任务,再把独立任务并行分给多个 Subagent,结果统一写回共享任务状态。

中途你再加文件、改要求,或者补充新的反馈,它也可以继续调整任务优先级,而不是整个任务推倒重来。

最后还有一层 Statement Review

会独立检查关键结论对应的来源、数据和计算。

证据不够、引用对不上,或者结果出现冲突,会继续修正再交付。

官方公布的 Benchmark,也能看出 Agent Team 的提升:

APEX-Agents:34.4 → 38.5

GDPval:69.5 → 78.8

FrontierFinance:48.7 → 54.3

FrontierScience-Research:55.0 → 63.3

BioMysteryBench:23.5 → 35.3 HLE:53.2 → 56.1

也就是说,同一代模型换成 Agent Team 工作流之后,6 项测试全部高于 ReAct。

这其实比单纯说一句“模型又变聪明了”,更值得关注。

还有一个我比较关注的地方

这次把

@Apodex_AI

的 Apodex-1.1-mini + FrontierAgent 一起开放出来了。

Mini 基于 Qwen3.5-35B-A3B

Hugging Face 显示约 36B 参数,支持原生 Function Calling。

官方也直接给了 SGLang 和 vLLM 部署方式,最长上下文配置给到了 262K。

再配上开源的 FrontierAgent,本地 Agent 这条链路基本算是打通了。

平时做商业分析、市场调研、学术研究,或者手里一堆 PDF、表格、数据集不知道怎么处理的,这次真的可以重点看看。

以前是研究完告诉你答案,现在是研究完之后,顺手把分析、代码、文件,甚至最后的交付物都做了。

我觉得这才是 Agent 真正该进化的方向。

如果想自己测试,最简单的方法还是直接扔一份自己的表格、论文、PDF 或数据集进去。

别只问它问题,直接给它一个完整任务,看看它到底能不能从头做到尾。

Web 端:

apodex.ai

API 平台:

platform.apodex.ai

另外,Apodex 还在 Hugging Face 放出了 Apodex-1.1-mini,可以自己部署,也可以搭配 FrontierAgent 使用:

https://huggingface.co/apodex/Apodex-1.1-mini

这次连 Agent Harness 也一起开源了

FrontierAgent 原生支持 ReAct 和Agent Team 两种模式,macOS、Linux 都有对应方案,工具、工作流和评测层也拆开了。

想自己研究 Agent 的,这个仓库反而很值得看:

https://github.com/ApodexAI/FrontierAgent