Apodex 1.1 有点夯研究完,连工作都顺手干了
Apodex 1.1 这次有点夯
关键它还开源了!
之前测它的时候,我就觉得这是少数真正有研究味的模型。
那种惊艳感,有点像第一次用Manus
但这次升级之后,它已经不只是帮你搜资料,然后憋一份报告出来了。而是开始真正干活可以直接处理论文、PDF、表格、数据集、图片和代码。
自己清洗数据、选择方法、运行分析、检查中间结果,遇到报错还能继续修,最后直接交付可验证的结果。
这点其实很重要因为以前很多所谓 Agent,本质还是“搜索 + 总结”。
Apodex 1.1 更像把:
研究 → 执行 → 检查 → 交付
真正串成了一条完整链路
这次 Agent Team 也不只是简单多开几个 Agent。
它会先拆任务,再把独立任务并行分给多个 Subagent,结果统一写回共享任务状态。
中途你再加文件、改要求,或者补充新的反馈,它也可以继续调整任务优先级,而不是整个任务推倒重来。
最后还有一层 Statement Review
会独立检查关键结论对应的来源、数据和计算。
证据不够、引用对不上,或者结果出现冲突,会继续修正再交付。
官方公布的 Benchmark,也能看出 Agent Team 的提升:
APEX-Agents:34.4 → 38.5
GDPval:69.5 → 78.8
FrontierFinance:48.7 → 54.3
FrontierScience-Research:55.0 → 63.3
BioMysteryBench:23.5 → 35.3 HLE:53.2 → 56.1
也就是说,同一代模型换成 Agent Team 工作流之后,6 项测试全部高于 ReAct。
这其实比单纯说一句“模型又变聪明了”,更值得关注。
还有一个我比较关注的地方
这次把
@Apodex_AI
的 Apodex-1.1-mini + FrontierAgent 一起开放出来了。
Mini 基于 Qwen3.5-35B-A3B
Hugging Face 显示约 36B 参数,支持原生 Function Calling。
官方也直接给了 SGLang 和 vLLM 部署方式,最长上下文配置给到了 262K。
再配上开源的 FrontierAgent,本地 Agent 这条链路基本算是打通了。
平时做商业分析、市场调研、学术研究,或者手里一堆 PDF、表格、数据集不知道怎么处理的,这次真的可以重点看看。
以前是研究完告诉你答案,现在是研究完之后,顺手把分析、代码、文件,甚至最后的交付物都做了。
我觉得这才是 Agent 真正该进化的方向。
如果想自己测试,最简单的方法还是直接扔一份自己的表格、论文、PDF 或数据集进去。
别只问它问题,直接给它一个完整任务,看看它到底能不能从头做到尾。
Web 端:
API 平台:
另外,Apodex 还在 Hugging Face 放出了 Apodex-1.1-mini,可以自己部署,也可以搭配 FrontierAgent 使用:
https://huggingface.co/apodex/Apodex-1.1-mini
这次连 Agent Harness 也一起开源了
FrontierAgent 原生支持 ReAct 和Agent Team 两种模式,macOS、Linux 都有对应方案,工具、工作流和评测层也拆开了。
想自己研究 Agent 的,这个仓库反而很值得看:

