过去 8 小时 Linux.do 电报频道共 173 条。
AI/羊毛相关(评分≥6)117 条 | 噪声 56 条 | 高价值(≥20)71 条
本篇精选 15 条 → 标题数字按正文真实链接计
主题分布
同帖可命中多个主题,各主题之和会大于相关候选总数
- AI前沿/模型:86 条
- AI即时机会:67 条
- AI编程/效率工具:42 条
- 福利羊毛/额度:38 条
- 开源/GitHub项目:23 条
- 账号/风控/支付:19 条
- 赚钱/产品机会:9 条
过去一夜的核心变化,不是又多了几个模型名,而是模型能力、订阅额度与 Agent 工程可靠性开始被放到同一张表上比较:一边是 Kimi、千问等套餐出现可量化的实测账单,另一边是 Grok、Codex、Claude Code 在文件操作、协议转换、跨端会话等环节暴露出具体问题。工具侧则继续向“低代码生成应用”和“浏览器内嵌 AI”扩散,适合个人开发者快速做出可验证的 MVP。
新热点词观察
Kimi、K3 的升温主要来自套餐跑量实测,而非新模型发布。 有用户将 Kimi 199 套餐的 K3 用量跑到月额度的 20.97%:3.40 亿 Token,对应账单成本 136.905 美元,按该账单口径反推,月额度约为 16.23 亿 K3 Token、标价价值约 4424 元。这组数据比此前流传的“套餐倍率体感”更有参考价值,但仍是单个账户、单模型的线性外推。Kimi 199 套餐 K3 用量实测
“IT、之家、日消息、世界人工智能大会”是一组媒体稿模板词。 热度集中来自 WAIC 期间的产品发布转载,不代表四个独立技术趋势。本窗口较明确的产品增量是百度秒哒 3.5,新增 SEO Agent、iOS 一键打包、多应用共享后端和一句话生成 Skill 等能力。百度秒哒 3.5 发布
Codex 讨论量虽然回落,问题却更工程化。 社区焦点已从“哪个模型更强”转向 Token 消耗、客户端性能和会话恢复;其中有用户称相同工作量从 5.5 high 的每日 100—150M Token,上升到 5.6 sol medium 的 400—500M,当前仍是个体账单观察,尚未形成统一归因。Codex 5.6 Token 消耗反馈
Thinking 成为新关键词,源头是协议链路是否完整。 一类讨论在测试推理档位是否真正生效,另一类则直接检查代理转换后,思考块有没有进入下一轮上下文,说明用户开始从“看输出”转向“查请求体”。Claude Code 经 CPA 丢失 Thinking 上下文
AI前沿/模型动态
千问侧出现了 qwen3.8-max-preview 的早期逻辑测试。发帖者通过百炼 Token Plan、OpenAI 格式和 xhigh 参数调用,常见糖果、遗传、洗车变种等题目能够答对,但思考过程偏长;同一模型在 Qoder 中表现为几乎不展开思考,因此客户端参数、网关实现与真实推理档位是否对齐,仍需分开验证。帖子同时确认百炼低峰折扣可与限时优惠叠加。qwen3.8-max-preview 逻辑题实测
Grok 4.5 的反馈呈现出两个一致性问题:其一,在 MCP 只接受字符串、不接受文件的约束下,模型可能反复尝试在 Agent 外用 Python 读文件,陷入循环;其二,在项目归档任务中生成了危险的删除动作,最终因系统路径保护而被拦截。两帖共同指向的不是单纯“能力高低”,而是模型面对工具约束和破坏性命令时的策略稳定性。Grok 在 MCP 约束下循环尝试 Grok 归档时触发系统路径删除保护
百度秒哒 3.5 则代表另一条路线:把多智能体调用进一步产品化。新版本将生成、部署、SEO 获客、后端复用和 iOS 打包放进同一平台,并给出累计服务 3500 万用户、创建 350 万个应用的官方口径。其看点不是单次代码生成,而是开始补齐“生成后如何发布和运营”。秒哒 3.5 六项新增能力
Agent实践与工作流
Claude Code 接 Responses 风格后端时,协议转换层是当前容易被忽略的断点。实测链路为 Claude Code CLI/Desktop → CPA → Grok 或 GPT Sol:后端响应包含 thinking 和 signature,但下一轮 /v1/messages 的 messages 数组中没有对应思考块。排查这类问题时,仅看 UI 中“模型思考过”并不够,需要同时保存上下行请求体,确认 CPA 是否正确完成 Anthropic Messages 与 Responses 协议的映射。CPA 协议转换现场
手机控制 Claude CLI 已有可运行方案:电脑端与手机端可在现有对话中双向发送并同步显示,手机新开会话也能调用工具;当前缺口是这类新会话无法在 Claude CLI 的 /resume 中找到。它已经适合远程盯任务和追加指令,但会话索引仍未完全打通。手机端控制 Claude CLI 实测
Codex 客户端近期的鼠标周期性卡顿,有用户定位到宠物/头像悬浮层,并关联到 OpenAI Codex 的 Windows issue;关闭宠物后可作为直接排查项。相比泛泛讨论“Codex 变慢”,这条提供了明确症状、组件和临时处理办法。关闭 Codex 宠物缓解鼠标卡顿
另一个可复制思路,是让模型先生成多阶段优化提示词,再交给第二个模型审查流程,最后由 Claude 桌面端执行代码修改。案例来自一个多 GitHub 项目拼接的音乐工具,GPT 一次输出四段任务提示,Gemini将其评价为接近工业化流水线。真正可复用的部分,是把“诊断、拆解、执行、验收”分开,而不是让单个 Agent 一次完成全部改造。多模型协作优化软件流程
开源项目/可复用工具
Thpilot 是一款油猴划词 AI 助手,支持解释、翻译、纠错、总结、多段文本与代码块选择、图片粘贴、关联当前文档、继续追问,以及自定义模型、提示词和工具按钮。它把通用聊天入口压缩到网页上下文中,适合继续改造成阅读、客服、内容审核或技术文档助手。Thpilot 划词 AI 助手
还有一个较典型的“Codex 做窄工具”案例:作者为《魔兽争霸 III:重制版》制作了本地单机修改器,并在 2.0.4.23745、2.0.3 版本验证可用,项目完整开源。其价值不只在游戏本身,而是展示了个人用户如何围绕明确版本、明确需求,用 Agent 快速补齐长期缺失的小众工具。开源魔兽争霸重制版修改器
模型福利羊毛
Claude Cyber 的资格验证出现了一个低门槛通过案例:用户触发安全检测后,在 CVP 表单中只提交个人 GitHub 主页、邮箱,并说明用途是给自制工具和社区开源项目查找安全漏洞,约一小时后收到认证通过邮件。当前只能确认该个案成功,尚无更多样本说明审核尺度是否普遍变化。Claude Cyber 验证通过案例
阶跃星辰 StepFun 方面,社区跟帖提到 15 天免费使用 Step 3.7 Flash,并给出一次性前端生成体验:页面完成度和速度尚可,作者将其描述为 DeepSeek V4 Flash 的可替代选项。原分享帖因举报已不在当前讨论中,现存链接为作者后续说明,活动实时状态需以 StepFun 页面为准。StepFun 15 天活动后续
Codex 用户还分享了官方 Web 用量查询入口,可查看 Codex Cloud 的 analytics,用于对照重置时间和消耗变化。对频繁切换模型、套餐或中转的用户,这类官方统计页比客户端体感更适合做周期记录。Codex 用量与重置查询
自媒体/创业/产品机会
本窗口最清晰的机会是把 Agent 从“生成代码”延伸到发布与获客。秒哒已经把 SEO Agent、App 打包、共享后端做成平台能力,个人开发者可据此验证更窄的服务:例如帮助本地商家生成活动页并持续做 SEO,或为多个轻应用提供共享会员、订单和内容后台,而不是重复搭建基础设施。秒哒的生成—部署—运营闭环
第二类机会是浏览器内的垂直助手。Thpilot 已经具备选区、图片、文档上下文和自定义工具按钮,向论文阅读、跨境客服、合同解释、代码审查等场景收窄后,就能形成可收费的工作流,而不必重新开发完整 AI 客户端。Thpilot 可扩展能力
第三类是“Agent 工程体检”:检查模型路由、Thinking 传递、Token 异常、会话恢复和破坏性命令。近期问题横跨 CPA、Codex 与 Grok,说明中小团队真正缺少的往往不是更多模型,而是一套能记录请求、比较账单、回放工具调用并设置文件操作边界的轻量观测层。Grok 文件操作事故样本
今日判断
今天值得持续观察的主线有三条:第一,套餐竞争进入“真实可跑 Token”阶段,Kimi 的账单实测比宣传倍率更有信息量;第二,Agent 的瓶颈正从模型智力转向协议、状态与工具边界,Thinking 丢失、跨端会话不可恢复、危险命令都是同一类工程问题;第三,低代码平台开始补齐 SEO、打包和共享后端,意味着 AI 应用创业的验证成本继续下降。 短期最有价值的动作不是追逐每个新模型名,而是记录调用链、账单和失败现场,把可复现的问题沉淀成工作流或工具。