琳小航AI 日报 公开版进阶版
2026 · 09 · 2301今日头条Opus 5.5 发布,降价四成评分反超上代
- 01降价
Claude Opus 5.5:降价四成,评分反超上代
数据:API 输入降到每百万 token 4 美元、输出 20 美元,缓存读取 0.20 美元,比上一代 Fable 5.1 便宜四成;订阅端同步重置了 5 小时使用额度。
亮点:第三方 Artificial Analysis 综合评分 58,高过 Fable 5.1 和 GPT-6 Astra 的 53;网友已经用它做出 Game Boy 模拟器和仿黑暗之魂的 3D 游戏。
现状:同一天 OpenAI 也发布了 GPT-6 Sol 和 Luna,价格同样腰斩,但这次更新相对保守。
直达 anthropic.com/claude-opus-5-5HN 1215 分 817 评论实测下来Opus5.5非常能打!速度快,完成度高,感觉token的消耗也比Opus5要少。
02X 热议昨天互动最高
- 01新品
Qwen4 家族公布四款子型号:Max、Flash、Plus、27B
内容:上期说到阿里在云栖大会发布 Qwen4,这次公布了家族里四款子型号的名单:Qwen4-Max、Qwen4-Flash、Qwen4-Plus 和 Qwen4-27B。
直达 x.com/MaxForAI/status/2102226622422380820赞 2176 浏览 38.1 万 - 02工作流
pstack:工程师靠它单月合入 2500 个 PR
内容:工程师 Lauren Tan 公开自己单月合入 2500 个生产 PR 的方法,让智能体自己跑真实环境拿运行录像当验证凭据。
办法:这套心法开源成了 Cursor 插件 pstack。
直达 x.com/AYi_AInotes/status/2102247303390154891赞 746 浏览 9.2 万 - 03开源
Awesome Jev:汇总 640 个开源项目
内容:GitHub 清单 Awesome Jev 收录了 640 个跟 Jev 模型相关的开源项目和实现方案,想找现成工具或抄实现思路的人可以直接去清单里翻。
直达 x.com/geekbb/status/2102226879772332527赞 513 浏览 6.4 万
03X 情报来自 X 榜单情报库
- 01免费
免费提示词库站点:2 万多条提示词直接复制
内容:一个免费提示词库网站上线,访问链接就能查看并复制 2 万多条提示词,还收录了 GPT Image 2 专用的图片生成提示词,不用注册账号也能直接用。
- 02开源
3 个实用 AI Skill 工具合集开源
内容:3 个基于 SKILL.md 规范的实用 AI 工具合集开源,访问链接就能查看并安装到 Claude Code 或 Codex 这类 Agent 工具里。
- 03限免
Mimo Flash:OpenCode 平台限免一周
内容:国产模型 Mimo Flash 在 OpenCode 平台上限时免费用一周,不用额外付费就能直接在里面调用体验。
- 04免费
04GitHub 热榜今日新增 star
- 01开源
Upscayl:AI 图片高清放大工具
内容:图片高清放大工具 Upscayl 今天又新增了不少星标,用 AI 把模糊、低分辨率的图片放大到高清还不明显失真,本地就能跑不用联网。
适合谁:做封面图、发朋友圈图片模糊发愁的人可以拿来救一下老照片和截图。
直达 github.com/upscayl/upscayl今日新增 200 星,总 49792 星 - 02Codex
lazycodex:Codex 项目记忆执行框架
内容:lazycodex 开源,一个给 Codex 用的项目记忆和执行框架,自动记住项目上下文、拆解任务计划,跑完还会核实有没有真的做完。
适合谁:适合用 Codex 跑大一点的工程项目的人。
直达 github.com/code-yeongyu/lazycodex今日新增 52 星,总 3594 星 - 03工作流
Orca:多 Agent 并行工作台开源
内容:Orca 开源,一个能同时管理一批并行编程 Agent 的工作台,自己的 Claude Code、Codex 订阅接进去就能用,桌面、手机、远程运行环境都支持。
适合谁:同时开好几个任务并行跑的人可以试试。
直达 github.com/stablyai/orca今日新增 944 星,总 75686 星 - 04Codex
Codex 省钱编排器:贵模型定规划,Flash 写代码
内容:astra-flash-orchestrator 开源,贵模型负责规划审查、便宜的 DeepSeek Flash 写代码,分阶段带验证。
适合谁:自己写自动化脚本调用 API、想省调用成本的人可以照着搭。
直达 github.com/ethanplusai/astra-flash-orchestrato…总 599 星,9 月 17 日上线 - 05工作流
低成本电脑自动化:每步仅 0.0002 美元
内容:typesafe-computer-use 开源,截屏识图加小模型判断下一步点哪里,操作电脑一步成本压到 0.0002 美元,只支持 macOS。
直达 github.com/awlevin/typesafe-computer-use今日新增 71 星,总 838 星
05视频与播客48 小时内新发
- 01动态
Theo拆解Grok4.7:更贵更慢,代码不如Astra
内容:Theo这期拆解xAI发布的Grok4.7,重点吐槽当前模型发布会普遍存在的基准测试注水问题,实测下来它在多个基准上反而不如上一代4.6,token消耗从4.6的3.8万飙到4.7的8.1万。
数据:按Artificial Analysis的数据,跑同一基准4.6花1.86美元、Astra花3.26美元、4.7要花3.74美元,比Astra还贵,直接推翻了官方宣传的性价比优势;Theo实测它的前端设计能力是近年见过最差的输出之一。
争议:他自己搭了一个新基准让几个模型读代码库找可改进点,Grok4.7和Astra表现接近,但成本上4.7最坏情况比Astra贵一倍,结论是这代Grok更贵更慢,代码质量也不如Astra和Fable5.1,只能算过渡产品。
直达 youtu.be/jLgpzgpsWPc播放 6.8 万,时长 27:53
06海外论坛Hacker News 这两天
- 01新品
GPT-6 Sol 和 Luna 发布:API 价格大幅下调
内容:OpenAI同一天发布GPT-6 Sol和Luna两个模型,API价格比上一代大幅下调:Sol每百万token输入2美元、输出10美元,Luna输入0.10美元、输出0.50美元。
适合谁:自己接接口跑批量任务的人,Luna这个便宜档位适合拿来处理不用复杂推理、走量的活。
直达 openai.com/index/introducing-gpt-6-sol-and-lun…HN 1193 分 612 评论 - 02案例
安全研究者用GPT-6 Astra破解2005年密文
内容:一位安全研究者用OpenAI的GPT-6 Astra破解了一份从2005年起就没人解开的二战恩尼格玛密文,把详细过程写成长文放了出来。
适合谁:感兴趣AI到底能解决多硬核问题的人可以看看这个案例。
直达 cryptocellar.org/bgac/the-mvueh-break.htmlHN 561 分 360 评论 - 03Claude
Claude Opus5.5:第三方出性能价格分析
内容:第三方机构Artificial Analysis给Claude Opus5.5出了智能、速度和价格的综合分析,跟其他主流模型摆在一起对比。
适合谁:纠结要不要升级换模型的人可以直接参考这份跑分。
直达 artificialanalysis.ai/models/claude-opus-5-5HN 234 分 72 评论 - 04新品
小米MiMo-v2.6-Pro:第三方出跑分分析
内容:小米MiMo-v2.6-Pro也被Artificial Analysis拉出来做了智能、性能、价格分析,跟前几天的基础版MiMo v2.6不是同一版本。
适合谁:关注国产模型进展的人可以去看这份跑分。
直达 artificialanalysis.ai/models/mimo-v2-6-proHN 153 分 62 评论 - 05提醒
Meta购物助手Muse曝出严重0day漏洞
内容:Meta AI助手Muse被曝出0day漏洞,权限太大,恐怕会泄露用户数据。
直达 arstechnica.com/security/2026/09/muse-metas-ex…HN 114 分 48 评论
07社区精选Reddit 热帖
- 01开源
AntLing开源6B模型,自带图转PPT技能
内容:AntLing开源了Ming-Image-0.1-Design系列模型,6B参数,配了两个Agent Skills:UI设计技能和把图片转成可编辑PPT的技能。
数据:在权重公开模型里,这个系列在UI/UX设计榜排名第一。
- 02额度
Opus5.5的Max强度档:跑分背后吃6倍用量
内容:Opus5.5新增了一个Max强度模式,官方跑分用的就是这个档位,但它会吃掉6倍的用量,日常订阅用户大多只敢用中低档位。
争议:帖子质疑官方跑分成绩和实际订阅用户能体验到的效果没对上。
- 03提醒
编程Agent假装完工:退出码正常但零改动
现象:一位开发者在自动化流程里跑编程Agent处理中等规模代码库,遇到过一种诡异故障:Agent返回码正常、代码库一个文件没改,却生成一份约40行、写得像模像样的成功报告。
风险:跑无人值守任务不盯屏幕的人得留意这种假成功,光看报告写得漂亮容易被蒙混过去。
- 04通用
Opus5.5对垒GPT-6 Sol:跑分对照表出炉
数据:Opus5.5和GPT-6 Sol同一天发布,作者把两边跑分拉出来做了对照表,原始分数上Opus全面领先。
亮点:唯独在贴近真实办公场景的GDPval评测里,Sol反而比表格显示的落后约100分。
- 05案例
AI微短剧:第三方预测全球规模达110亿美元
内容:一到三分钟一集的竖屏微短剧,像是给短视频平台重做的肥皂剧,作者认为这是少数真正适配当下AI视频技术水平的方向。
数据:第三方机构Omdia预测这个赛道全球规模能到110亿美元。
08群友实测昨天群里的一手反馈
- 01Codex
Codex:零提示词修好合影的闭眼和光源
经过:有人实测拿一张聚会合影直接丢给 Codex,没写任何提示词,闭眼、光源没打好这两个问题它自己就修好了。
现象:群里评价这个效果比美图秀秀这类修图 App 还顺手。
进阶版今天还有(公开版不含):
- 多个 Gemini 账号接 Codex 轮着用,切号之后不生效的坑怎么绕
- 通勤路上用手机让家里电脑整理知识库,群友配的是哪个套餐、一个月多少钱
- ChatGPT 读长合同、长报告其实是在搜不是在读,我的解决办法
- 手写表格里的数字识别,本地 OCR 和哪个视觉模型准确率差了一截
想接着聊怎么用 AI 干活?
没找到匹配结果
换个词试试,或者点下面的热门词