过去 8 小时 Linux.do 电报频道共 382 条。
AI/羊毛相关(评分≥6)266 条 | 噪声 116 条 | 高价值(≥20)165 条
本篇精选 20 条 → 标题数字按正文真实链接计
主题分布
同帖可命中多个主题,各主题之和会大于相关候选总数
- AI即时机会:163 条
- AI前沿/模型:146 条
- AI编程/效率工具:117 条
- 福利羊毛/额度:114 条
- 账号/风控/支付:55 条
- 开源/GitHub项目:45 条
- 赚钱/产品机会:5 条
- 服务状态:4 条
过去 8 小时的社区讨论,明显从“Agent 选型”进入“调优与稳定性”阶段:Codex 与 Claude 的组合使用、降智排查、额度损耗、Provider 切换问题成为高频话题;大厂侧则密集调整定价与席位规则,Claude Sonnet 5 宣布永久维持优惠价,OpenAI 为 Business 版新增 5x 席位;同时小米 MiMo 突然开放 API、Codex 开源贡献者免费 Pro 等福利窗口正在收口。以下是本期值得留意的信息。
新热点词观察
Codex(76 次)与 Claude(59 次)在近 8 小时讨论量明显上升,两者经常在同一帖中被同时提及,说明“Codex 写代码 + Claude 跑重活”的混合 Agent 工作流已成为常态。Agent(34 次,上窗口 0)的突增,大概率与 Agent 工具对比、语音交互中控台、以及 Codex 自主调用 Claude 等帖子的集中讨论有关,属于真实使用需求驱动的热点,不是纯噪音。Token(23 次)、Plus(24 次)、Team(20 次)等词的活跃则对应订阅账号、拼车、中转额度等生态话题,这与窗口内多个 Pro/Team 权益咨询帖相吻合。
AI前沿/模型动态
Claude Sonnet 5 永久维持首发优惠价。Anthropic 当地时间 8 月 10 日宣布,原定 9 月 1 日生效的涨价(输入 2→3 美元、输出 10→15 美元每百万 Token)已被取消,目前价格持续有效。
OpenAI 为 ChatGPT Business 推出 5x 席位。新席位号称“5 倍用量、无五小时限制”,官方已开放 Waitlist。社区评价比较直接:“其他席位都恢复 5 小时,出个取消五小时的,真不愧是你”。
小米 MiMo 模型在最后一天直接开放了 API。此前以网页形式内测的小米 MiMo 突然提供 OpenAI 与 Anthropic 两套接口协议,模型包括 mimo-v2.5-pro、mimo-v2.5-asr、mimo-v2.5-tts-voiceclone 等,Anthropic 协议可用于 Claude Code 配置。该帖发布时称“最后一天”,时效性较高,想试的建议尽快验证。
Agent实践与工作流
Codex 的“甩锅”现场:觉得任务太重,直接调用 Claude 干活。Codex 思维链显示它评估“多个 LLM CLI 已装,但成本高”,随后直接执行 claude --bare -p 'Reply with exactly OK.' 来调用 Claude 处理部分页面文本提取。这个案例说明当前 Agent 已经能自主跨 CLI 调度模型,同时也反映了默认 Codex 额度的窘迫感。
Agent 工具选择困难症:PI 到底值不值得换。有佬友对比了 Codex + GPT 组合与新兴 PI 的上下文消耗,发现 PI 的上下文开销极低,但“用着不顺手”。讨论区涉及 Agent 的六层职责拆解(上下文管理、内置提示词、任务拆解、多 Agent 调度、内置工具、运行环境),并给出了转向 PI 的配置思路。
个人向编程 Agent 可靠性主观排行。结论是 Cline 正常情况最稳,PI 轻量但易失控,OpenCode 输出稳定,Kimi Code 内置 K3 不错但会“停不下来”且不支持 DeepSeek V4。对正在选型的人来说,这个排行有参考价值。
Grok Built 反代降智实测。从 newapi 分发到直接调用 CPA / grok2api,降智程度差别明显;直接对接时最初表现尚可,后续再变“笨”。有佬友怀疑是 NEWAPI 兼容性问题,也有人认为是 Grok 模型本身状态波动。降智排查的具体路径值得收藏。
Codex++ 与 Codex 新版本 Provider 无法切换。官方会话显示 openai、中转会话显示 custom,两个会话各自独立。版本为 Codex++ 1.2.46 + Codex 26.803.10989.0,目前尚无解决方案,若你依赖多 Provider 混合使用,建议升级前先观望。
CC Switch + CliproxyAPI 配置 reasoning level 的细节。Codex CLI 要看到多个 reasoning level,必须把上游格式配为 chat/completions 并开启路由;若用 response 格式则只有 low/high 两档。提问者还指出 response 格式转 chat/completions 会丢失信息,属于协议转换时容易踩的坑。
国内使用 Claude Code 的三种网络方案。场景是公司新加坡住宅 IP 开了订阅,国内算力服务器要调用 Claude。讨论给出的方向:新加坡搭 sub2api 中转、直接 SSH 到新加坡机器操作、或者整套搬到新加坡。楼主倾向方案 1/2,但担心本地信息泄露与上下文污染,评论区有实操反馈可查。
开源项目/可复用工具
Hugo CMS:零服务器给 Hugo 博客加文章后台。完全依赖 GitHub + Cloudflare Pages,没有数据库(不用 D1/KV),基于 Marked 预览 + CodeMirror 编辑实现 Markdown 写作。部署方式也很有意思:直接用 AI 帮你在 Cloudflare 上完成搭建。
用 SGLang 本地部署 DeepSeek-V4-Flash 完整记录。环境为 CUDA 13.3 + uv + ModelScope 下载 + SGLang 最新容器,模型共 48 个分片约 156GB,4 张 H800 即可跑完整模型。帖子里有大文件下载绕过代理的实用建议,自建推理节点可参考。
修改 forkgram/tdesktop:跳转到前一条/后一条 @我的消息。通过 Hermes 对接 DeepSeek-V4-Flash,用自然语言驱动 Agent 在 Telegram Desktop 源码上完成了“跳转到上一条/下一条 @我”的功能开发,比手动改代码再编译的效率高很多。Agent 辅助开发的完整流程示例。
Oracle VPS + Vaultwarden 部署实战,Hermes 全程辅助运维。用 vless+ws+CF 优选域名,延迟 300-500ms 但测速可到 200M,4K 视频无压力。中间遇到端口不合规、22 端口崩溃、sshd.socket 与 service 冲突等问题,全部由 Hermes 通过微信远程修复。典型“Agent 当运维”的落地案例。
模型福利羊毛
Codex 开源贡献者免费 6 个月 Pro(20x)通过了。今年 2 月申请,8 月才批,周期长达半年,且是 Pro 20x 六个月的额度。若你在知名开源项目贡献过 PR,可以考虑申请,但要有等待耐心。
ChatGPT Plus 续费会不会重置 Codex 周额度。有佬友的 Plus 8 月 15 日到期而 Codex 额度 8 月 18 日恢复,提问会不会重置。评论区有实操解答,关联“到期前能否猛蹬”的额度规划需求。
GPT Pro 20x 频繁 overloaded,是号被风控了吗。iCloud 邮箱 + 菲律宾区 AppStore 订阅的 Pro 20x,跑在 sub2api 上首字 4 秒以上并频繁 overloaded;同一容器里的玻利维亚 Plus 号却一切正常。疑似地区/订阅方式触发了风控,而非全局故障。
有 ChatGPT 试用资格但支付被拒的现状。Pro 取消后获得一个月 Plus 试用资格,但 Roogo 虚拟卡连续被拒。评论区有多张卡的实测反馈,可用性差异较大。
自媒体/创业/产品机会
Claude/Codex 拼车经历与缓存问题。楼主晒出拼车缓存命中率数据(与官方直连差距明显),并因缓存太低跳车后被“提前封号”。拼车模式的额度分配标准、缓存透明化、售后规则,都是可以做成标准化服务的空间。
“一个 Token 通吃所有 AI 智能体”的聚合思路。平台声称可把各家免费 Token 聚合为一个新 Token,并支持自动切换模型;调用从本机发起,云端只存密文。这类免费额度聚合工具,如果能解决额度记账和模型路由,对个人开发者确实有用。
MiMo 开放 API 带来的接入机会。小米 MiMo 的 ASR、语音克隆(VoiceClone)、语音设计等模型首次以 API 形式对外开放,对做语音 Agent 或内容工具的中小团队,是低成本试用的新选择。
今日判断
本窗口的核心信号是:Agent 已过“尝鲜期”,讨论重心转向额度管理、稳定性调优和跨模型调度成本;大厂在定价与席位上的调整还在继续,Claude 维持低价、OpenAI 推高端席位,对预算敏感的个人开发者,福利窗口与拼车、中转、自建方案仍是短期主流。值得关注的变量有两个——开源贡献者免费 Pro 这类“长期兑现”的福利,说明早期提交 PR 的回报周期远超预期;而 MiMo 这类国产模型突然开放 API,预示着下半年模型供给会更碎片化,具备统一路由能力的工具价值会继续上升。