Pestle-27B-Ternary 对比 Open Science Desktop

2026年哪款 AI 工具更胜一筹?让我们一探究竟。

快速结论

Open Science Desktop 凭借其综合评分 4.5/5 胜出!(Pestle-27B-Ternary 评分为 4.35/5)。

对比维度 Pestle-27B-Ternary Open Science Desktop
专家评分
★★★★⯨ 4.35
★★★★⯨ 4.5
价格方案 Free (Open Weights, Apache-2.0) Free (Open Source)
最适合场景 把 27B 模型压缩为单个 8.48 GB GGUF 的三值权重本地模型,面向医疗问答、生物医学检索、编程与通用助手 本地优先、模型无关的 AI 科研工作平台,支持 macOS、Windows、Linux。在一场可审计、可复现的桌面会话里跑完整套研究流程——调研、文献综述、假设、实验代码、分析、出图、成文。

Pestle-27B-Ternary 概览 ⭐ 4.35/5

优点与优势

  • 27B 级模型压缩为单个 8.48 GB GGUF(三值权重)
  • 强医疗基准:MedQA 89.79、MedMCQA 68.85、PubMedQA 76.70
  • 本地用 Mortar 运行于 Apple Silicon / CUDA / CPU
  • 通用能力保留:MMLU-Redux 83.53、GSM8K 93.25、HumanEval+ 87.20
  • 最长 262K 上下文,可选视觉输入

缺点与局限

  • 仅研究预览,不可用于临床
  • 需自行构建/运行独立 Mortar 运行时
  • 压缩相对全精度 FP16 损失部分准确率

Open Science Desktop 概览 ⭐ 4.5/5

优点与优势

  • 在一场可审计会话里跑完整研究闭环
  • 本地优先,会话、数据、溯源默认留在本机
  • 模型无关(内置 OpenCode 旁路,可自带模型)
  • 本地/SSH/Slurm/Modal/notebook 批处理均可复现
  • 可驱动你自己的 Chrome 研究实时网页
  • 通过带令牌的网关在浏览器或手机上访问
  • ResearchClawBench 榜 #1,7 种界面语言,MIT 开源

缺点与局限

  • 桌面应用,比聊天工具更重
  • 围绕科研流程构建,并非通用编码工具
  • 仍在演进,部分功能需选择开启或依赖平台