智能体先锋队
← 返回弹药库

Arsenal Topic

实测反馈

出现期数

6

贡献者

33

提到工具

9

核心洞见

群友集中反馈 GPT-6/Astra 虽然能力提升明显,但 Plus 和 5x/Pro 额度消耗都很快,已经影响日常使用决策。

关于 Codex 里看不到 GPT-6,群里给出了可操作路径:先更新 Codex CLI,再重启 Codex Desktop,并点击桌面端左下角更新;如果没有安装 CLI,可先让 Codex 安装。

群友集中实测 GPT-6 Astra:同样任务完成速度和一次通过率明显强于 5.6,但额度消耗也非常快。

Astra 的主线评价很一致:速度、执行和完成度明显强,但额度消耗也非常猛。

中午到下午的核心技术讨论集中在 OpenCode、Pi、Zcode、Codex Harness 和 DeepSeek Harness 的体感对比。

最后一轮讨论围绕 AI 写的 App 能否申请软著、高企和专精特新展开,群友给出的共识是软著本身门槛不高,市场价多在几百元,1500 元/个和“AI 代码不算原创”的说法更像销售话术。

群里集中反馈 Plus/Codex 额度规则发生变化:有人看到五小时限制恢复,并认为是在周额度之外又加了 5 小时限额。

群友对 Workbuddy 的能力边界给出实操反馈:写文案比 Codex 更顺手,但做数据搜索和真实执行任务时幻觉、编造和误操作风险高。

群里围绕 Codex 额度缩水、DeepSeek 涨价和替代模型展开了比较,重度开发者反馈一个月模型成本大约 800 元,DeepSeek 在涨价后即使低峰也显得偏贵。

多位群友讨论了 AI 工具订阅的真实消耗:API 点数在 Codex 场景下很快烧完,Grok Heavy/Bot 体验尚可但 CLI bug 多,Grok Build 重任务消耗也很快。

群里围绕垂类模型是否值得做展开完整讨论:PAI 认为 B 端行业服务仍有市场,专属 embedding/蒸馏可以提高行业黑话和内部术语命中率,并节省 token。

群里分享 DeepSeek V4 Flash Vision EXP 已上线,重点是多模态 Agent 能力、与 Flash 同价、Harness 支持,以及图片文件 ID 复用可免重复上传。

期刊时间线

9月5日 · 周六

模型、订阅与工具选择、AI 编程与项目交付

8月25日 · 周二

AI 编程与项目交付、模型、订阅与工具选择

8月21日 · 周五

模型、订阅与工具选择、AI 编程与项目交付

8月15日 · 周六

模型、订阅与工具选择、AI 编程与项目交付

8月3日 · 周一

模型、订阅与工具选择、商业化、电商与增长

7月26日 · 周日

AI 编程与项目交付、模型、订阅与工具选择