Arsenal Topic
模型评测
出现期数
4
贡献者
24
提到工具
24
核心洞见
模型实战排名:opus > gpt > composer2.5 > glm5.2,排名基于编码场景综合表现
Fable 5最佳用法是搭配架构师模型:Sonnet做规划,Fable做执行,不要反过来
Fable 5的执行力一流但有"什么都自己写"的倾向,会忽略可复用的开源代码,需要人工引导使用现有轮子
模型分工应按能力特长而非价格高低来决定
GPT Pro并非真正无限制,存在隐性降智机制
Pro订阅与Pro模型是两个概念,Plus用户无法使用Pro模型
目标模式是节省额度的有效策略
对于复杂创意型项目,Pro级模型的理解力投入产出比更高
模型选择应按任务价值分层,而不是把所有任务都交给最贵模型。
高质量模型适合做 plan 和 review,低成本模型适合做 execution 和 smoke test。
Gemini 在代码任务中的幻想、删代码和假数据风险需要额外防范。
视频生成和虚拟电脑式 Agent 的完成度可能更高,但成本必须先算清楚。