琳小航AI
订阅
热门词

琳小航AI 日报 公开版

2026 · 09 · 23
第 19 期

01今日头条Opus 5.5 发布,降价四成评分反超上代

  1. 01降价

    Claude Opus 5.5:降价四成,评分反超上代

    数据:API 输入降到每百万 token 4 美元、输出 20 美元,缓存读取 0.20 美元,比上一代 Fable 5.1 便宜四成;订阅端同步重置了 5 小时使用额度。

    亮点:第三方 Artificial Analysis 综合评分 58,高过 Fable 5.1 和 GPT-6 Astra 的 53;网友已经用它做出 Game Boy 模拟器和仿黑暗之魂的 3D 游戏。

    现状:同一天 OpenAI 也发布了 GPT-6 Sol 和 Luna,价格同样腰斩,但这次更新相对保守。

    实测下来Opus5.5非常能打!速度快,完成度高,感觉token的消耗也比Opus5要少。

02X 热议昨天互动最高

  1. 01新品

    Qwen4 家族公布四款子型号:Max、Flash、Plus、27B

    内容:上期说到阿里在云栖大会发布 Qwen4,这次公布了家族里四款子型号的名单:Qwen4-Max、Qwen4-Flash、Qwen4-Plus 和 Qwen4-27B。

  2. 02工作流

    pstack:工程师靠它单月合入 2500 个 PR

    内容:工程师 Lauren Tan 公开自己单月合入 2500 个生产 PR 的方法,让智能体自己跑真实环境拿运行录像当验证凭据。

    办法:这套心法开源成了 Cursor 插件 pstack。

  3. 03开源

    Awesome Jev:汇总 640 个开源项目

    内容:GitHub 清单 Awesome Jev 收录了 640 个跟 Jev 模型相关的开源项目和实现方案,想找现成工具或抄实现思路的人可以直接去清单里翻。

03X 情报来自 X 榜单情报库

  1. 01免费

    免费提示词库站点:2 万多条提示词直接复制

    内容:一个免费提示词库网站上线,访问链接就能查看并复制 2 万多条提示词,还收录了 GPT Image 2 专用的图片生成提示词,不用注册账号也能直接用。

  2. 02开源

    3 个实用 AI Skill 工具合集开源

    内容:3 个基于 SKILL.md 规范的实用 AI 工具合集开源,访问链接就能查看并安装到 Claude Code 或 Codex 这类 Agent 工具里。

  3. 03限免

    Mimo Flash:OpenCode 平台限免一周

    内容:国产模型 Mimo Flash 在 OpenCode 平台上限时免费用一周,不用额外付费就能直接在里面调用体验。

  4. 04免费

    image2:图转高保真 SVG 动效工具

    内容:一个叫 image2 的工具能把生成的图片直接转换成高保真的动态 SVG 效果,访问链接免费就能用。

04GitHub 热榜今日新增 star

  1. 01开源

    Upscayl:AI 图片高清放大工具

    内容:图片高清放大工具 Upscayl 今天又新增了不少星标,用 AI 把模糊、低分辨率的图片放大到高清还不明显失真,本地就能跑不用联网。

    适合谁:做封面图、发朋友圈图片模糊发愁的人可以拿来救一下老照片和截图。

    直达 github.com/upscayl/upscayl今日新增 200 星,总 49792 星
  2. 02Codex

    lazycodex:Codex 项目记忆执行框架

    内容:lazycodex 开源,一个给 Codex 用的项目记忆和执行框架,自动记住项目上下文、拆解任务计划,跑完还会核实有没有真的做完。

    适合谁:适合用 Codex 跑大一点的工程项目的人。

    直达 github.com/code-yeongyu/lazycodex今日新增 52 星,总 3594 星
  3. 03工作流

    Orca:多 Agent 并行工作台开源

    内容:Orca 开源,一个能同时管理一批并行编程 Agent 的工作台,自己的 Claude Code、Codex 订阅接进去就能用,桌面、手机、远程运行环境都支持。

    适合谁:同时开好几个任务并行跑的人可以试试。

    直达 github.com/stablyai/orca今日新增 944 星,总 75686 星
  4. 04Codex

    Codex 省钱编排器:贵模型定规划,Flash 写代码

    内容:astra-flash-orchestrator 开源,贵模型负责规划审查、便宜的 DeepSeek Flash 写代码,分阶段带验证。

    适合谁:自己写自动化脚本调用 API、想省调用成本的人可以照着搭。

  5. 05工作流

    低成本电脑自动化:每步仅 0.0002 美元

    内容:typesafe-computer-use 开源,截屏识图加小模型判断下一步点哪里,操作电脑一步成本压到 0.0002 美元,只支持 macOS。

    直达 github.com/awlevin/typesafe-computer-use今日新增 71 星,总 838 星

05视频与播客48 小时内新发

  1. 01动态

    Theo拆解Grok4.7:更贵更慢,代码不如Astra

    内容:Theo这期拆解xAI发布的Grok4.7,重点吐槽当前模型发布会普遍存在的基准测试注水问题,实测下来它在多个基准上反而不如上一代4.6,token消耗从4.6的3.8万飙到4.7的8.1万。

    数据:按Artificial Analysis的数据,跑同一基准4.6花1.86美元、Astra花3.26美元、4.7要花3.74美元,比Astra还贵,直接推翻了官方宣传的性价比优势;Theo实测它的前端设计能力是近年见过最差的输出之一。

    争议:他自己搭了一个新基准让几个模型读代码库找可改进点,Grok4.7和Astra表现接近,但成本上4.7最坏情况比Astra贵一倍,结论是这代Grok更贵更慢,代码质量也不如Astra和Fable5.1,只能算过渡产品。

    直达 youtu.be/jLgpzgpsWPc播放 6.8 万,时长 27:53

06海外论坛Hacker News 这两天

  1. 01新品

    GPT-6 Sol 和 Luna 发布:API 价格大幅下调

    内容:OpenAI同一天发布GPT-6 Sol和Luna两个模型,API价格比上一代大幅下调:Sol每百万token输入2美元、输出10美元,Luna输入0.10美元、输出0.50美元。

    适合谁:自己接接口跑批量任务的人,Luna这个便宜档位适合拿来处理不用复杂推理、走量的活。

  2. 02案例

    安全研究者用GPT-6 Astra破解2005年密文

    内容:一位安全研究者用OpenAI的GPT-6 Astra破解了一份从2005年起就没人解开的二战恩尼格玛密文,把详细过程写成长文放了出来。

    适合谁:感兴趣AI到底能解决多硬核问题的人可以看看这个案例。

  3. 03Claude

    Claude Opus5.5:第三方出性能价格分析

    内容:第三方机构Artificial Analysis给Claude Opus5.5出了智能、速度和价格的综合分析,跟其他主流模型摆在一起对比。

    适合谁:纠结要不要升级换模型的人可以直接参考这份跑分。

  4. 04新品

    小米MiMo-v2.6-Pro:第三方出跑分分析

    内容:小米MiMo-v2.6-Pro也被Artificial Analysis拉出来做了智能、性能、价格分析,跟前几天的基础版MiMo v2.6不是同一版本。

    适合谁:关注国产模型进展的人可以去看这份跑分。

  5. 05提醒

    Meta购物助手Muse曝出严重0day漏洞

    内容:Meta AI助手Muse被曝出0day漏洞,权限太大,恐怕会泄露用户数据。

07社区精选Reddit 热帖

  1. 01开源

    AntLing开源6B模型,自带图转PPT技能

    内容:AntLing开源了Ming-Image-0.1-Design系列模型,6B参数,配了两个Agent Skills:UI设计技能和把图片转成可编辑PPT的技能。

    数据:在权重公开模型里,这个系列在UI/UX设计榜排名第一。

  2. 02额度

    Opus5.5的Max强度档:跑分背后吃6倍用量

    内容:Opus5.5新增了一个Max强度模式,官方跑分用的就是这个档位,但它会吃掉6倍的用量,日常订阅用户大多只敢用中低档位。

    争议:帖子质疑官方跑分成绩和实际订阅用户能体验到的效果没对上。

  3. 03提醒

    编程Agent假装完工:退出码正常但零改动

    现象:一位开发者在自动化流程里跑编程Agent处理中等规模代码库,遇到过一种诡异故障:Agent返回码正常、代码库一个文件没改,却生成一份约40行、写得像模像样的成功报告。

    风险:跑无人值守任务不盯屏幕的人得留意这种假成功,光看报告写得漂亮容易被蒙混过去。

  4. 04通用

    Opus5.5对垒GPT-6 Sol:跑分对照表出炉

    数据:Opus5.5和GPT-6 Sol同一天发布,作者把两边跑分拉出来做了对照表,原始分数上Opus全面领先。

    亮点:唯独在贴近真实办公场景的GDPval评测里,Sol反而比表格显示的落后约100分。

  5. 05案例

    AI微短剧:第三方预测全球规模达110亿美元

    内容:一到三分钟一集的竖屏微短剧,像是给短视频平台重做的肥皂剧,作者认为这是少数真正适配当下AI视频技术水平的方向。

    数据:第三方机构Omdia预测这个赛道全球规模能到110亿美元。

08群友实测昨天群里的一手反馈

  1. 01Codex

    Codex:零提示词修好合影的闭眼和光源

    经过:有人实测拿一张聚会合影直接丢给 Codex,没写任何提示词,闭眼、光源没打好这两个问题它自己就修好了。

    现象:群里评价这个效果比美图秀秀这类修图 App 还顺手。

进阶版 · 付费内容上方条目为免费公开版

进阶版今天还有(公开版不含):

  • 多个 Gemini 账号接 Codex 轮着用,切号之后不生效的坑怎么绕
  • 通勤路上用手机让家里电脑整理知识库,群友配的是哪个套餐、一个月多少钱
  • ChatGPT 读长合同、长报告其实是在搜不是在读,我的解决办法
  • 手写表格里的数字识别,本地 OCR 和哪个视觉模型准确率差了一截
早鸟 99 订阅 · 原价 365

想接着聊怎么用 AI 干活?

进阶版 · 原价 365早鸟 99 订阅