我之前说过每 100 万新增活跃用户就 reset Codex,直到 1000 万。结果我们远远突破了这个目标,从 1000 万之后就没声音了。明天给你个小惊喜。
查看英文原文
We blew past that and have been silent since 10M. Little surprise for you tomorrow.
8 月 12 日(北京时间)全球 AI 圈推文存档,按曝光排序,共 100 条。
← 返回最新 全部归档
我之前说过每 100 万新增活跃用户就 reset Codex,直到 1000 万。结果我们远远突破了这个目标,从 1000 万之后就没声音了。明天给你个小惊喜。
每月超过 10 亿人使用 @Geminiapp 来迸发新想法、完成工作。这是我们增长最快的产品,也是达到 10 亿用户里程碑的第 14 个产品。
感谢 @JoshWoodward 和整个 Gemini 团队,也感谢所有与我们一同踏上这段旅程的人 - 更多精彩还在后头!
现已推出预览版:ChatGPT Linux 桌面应用。在支持的 Linux 系统上,在你工作和开发的地方使用 ChatGPT、ChatGPT Work 和 Codex,配合你的项目和浏览器工作流。
你为啥切换到 Codex 了?喜欢它哪些地方,咱们还能咋改进?别说重置啊。
对了别提 Linux,咱们才上线。
Grok Bot 最初是个内部原型,已迅速改变了我们的工作方式。今天我们公开发布测试版。
引用 Grok Bot @botIntroducing Grok Bot, now in early beta. Bots are AI teammates that do real work for you. They sign in to your tools, use them just like you do, and come back with finished work.查看被引原帖 ↗
终于成了...Codex & ChatGPT 桌面版现在支持 Linux 了。
感谢大家的耐心等待,要是你等不及已经下单 MacBook 就把订单取了吧。真的就这么好用。
👀
引用 OpenAI @OpenAINow in preview: The ChatGPT desktop app for Linux. Use ChatGPT, ChatGPT Work, and Codex where you already work and build, with your projects and browser workflows on supported Linux systems.查看被引原帖 ↗
我们本来说好要飞行汽车的,结果等来的却是无限超级智能给所有人。
现在您可以将来自其他代理的工作与 ChatGPT Work 和 Codex 保持同步。导入项目、聊天、技能和插件,查看导入历史记录,并在设置中选择自动更新。现已在 ChatGPT 桌面应用中可用。
更多关于将您现有工作流导入 Codex 的信息:
以下是设置自动同步的方法:
learn.chatgpt.com/docs/impor…
完了..现在没人能看出这是AI生成的了
引用 el.cine @EHuangluAI video is now undetectable查看被引原帖 ↗
导入你的世界。Codex。运行。
引用 OpenAI Developers @OpenAIDevsYou can now keep your work from other agents in sync with ChatGPT Work and Codex. Import projects, chats, skills, and plugins, review your import history, and opt in to automatic updates in Settings. Now available in the ChatGPT desktop app.查看被引原帖 ↗
一样
Claude 现在越来越爱说教了,天天直接拒绝我
要是 Grok 写代码够给力的话,我很乐意直接跳过去
我的网站后端已经完全跑在
@xAI
上了
引用 Alex @ HispanicNomad | Freedom Based Lifestyle @hispanicnomad用户考虑取消Claude订阅。认为最近模型过度谨慎,频繁拒绝创建和编写请求内容,非Fable模型基本不可用。正考虑转向Manus或中文模型。查看被引原帖 ↗
这是我与 Khabib Nurmagomedov (@TeamKhabib) 的对话,他是有史以来最伟大的格斗手之一。
与他训练、进行这次深入的交谈,以及在过去几个月了解他,都是真正的荣幸。
我们完全用俄语进行了这次对话,翻译配音成英文。YouTube 上提供两种语言的音轨和字幕。在 X 上,我分别发布了英文和俄文版本的视频。翻译和配音工作量巨大(这对我很重要),由人类和 AI 协作完成。感谢 @ElevenLabs 团队的帮助。
祝 Islam Makhachev、Khabib 及其团队周末 UFC 330 的比赛好运!
如我在视频中所说,我真的很感谢你们所有人,感谢你们这些年的支持。爱你们 ❤️
时间戳:
0:00 - 介绍
1:35 - 为什么达吉斯坦产生如此多伟大的格斗手
11:41 - 达吉斯坦历史战士文化
21:02 - 在达吉斯坦山区的艰苦训练
24:53 - 名利权的陷阱
35:34 - Khabib 统治力的秘诀
46:47 - 纪律与努力
59:15 - 达吉斯坦街头搏斗
1:12:56 - Khabib 的压制力
1:18:40 - Khabib vs Conor McGregor
1:31:25 - Khabib 最艰难的比赛
1:39:12 - 有史以来最伟大的 MMA 格斗手
1:56:57 - 执教
2:02:30 - Daniel Cormier
2:06:48 - Islam Makhachev
2:16:46 - Dana White
2:20:16 - Joe Rogan
2:22:31 - Ali Abdelaziz
2:25:08 - 足球
2:32:23 - Messi vs Ronaldo
2:50:23 - Dubai
2:54:14 - 信仰
3:01:57 - 对年轻人的建议
新的Pixel 11系列发布,专为Gemini Intelligence设计,拥有众多实用新功能。
我特别兴奋的几个:Rambler,一个为自然说话方式优化的新语音输入。Magic Capture,轻松拍照。还有HiLight,当手机屏幕朝下时会微妙发光,让你知道生活中重要的人在给你打电话。
引用 Rick Osterloh @rosterlohThe best of Gemini is right at the heart of the new Pixel 11 phones and the new Pixel Watch 5. We call it Gemini Intelligence. It’s no longer just an operating system that helps you use your phone, it’s an intelligence system that gets things done for you.查看被引原帖 ↗
Imagine Image 2.0 现已推出到我们的 API:精确编辑、信息图、广告、游戏素材、UI/UX 原型、故事板等。
在我们的 Playground 试试看:
console.x.ai/team/default/im…
现在你可以在 Gemini 里接入更多应用来完成更多事。在设置里把你喜欢的服务连接到 Gemini,就能在一个地方轻松规划、创建和完成你的待办事项。这是 14 个新增的 Gemini 集成应用。🧵
通过@opentable预订餐厅来规划你的下一场约会晚餐。只需问 Gemini "用 OpenTable 帮我预订明晚两个人的户外餐厅座位"。
在@Ticketmaster上查找活动和购买门票。只需问 Gemini "在 Ticketmaster 上给我查一下本周五纽约的现场爵士音乐演唱会门票"。
在@wix的帮助下打造属于你的网站。只需问 Gemini "在 Wix 上为我的摄影生意创建一个网站"。
在@iHeartRadio上播放、发现和享受喜爱的音乐和播客。试试问 Gemini "在 iHeartRadio 上播放顶级访谈播客"。
在@fever_gl上发现和预订活动。只需问 Gemini "在 Fever 上给我找迈阿密这个周末的沉浸式艺术展览"。
在@pandoramusic上播放和发现适合各种心情的歌曲和播放列表。试试问 Gemini "在 Pandora 上放我的高能量攀岩播放列表"。
在@GetYourGuide上找到、浏览和预订旅游及其他活动。只需问 Gemini "在 Get Your Guide 上给我找一个日落峡谷徒步"。
在 Angi 上找本地承包商和手艺人。
试试让 Gemini “在 Angi 上查找本地草坪养护服务”。
管理你的会议,并借助 @otter_ai 获得转录帮助。
只需让 Gemini 来“总结 Otter.ai 中的客户婚礼愿景和供应商策划通话”。
在巴西租车,用
@localizabr
。
直接让 Gemini“找一下巴西里约热内卢的 Localiza 租车服务。”
在Thumbtack上比较并雇佣本地的服务专业人员吧。
直接对Gemini说“在Thumbtack上找评分最高的本地油漆工”。
预约一次医生看诊@zocdoc。直接问Gemini:“我需要配副新眼镜,在Zocdoc上找个离公司步行可达的预约。”
用 @meetgranola 来管理你的会议笔记吧。
直接在 Granola 里问 Gemini:“总结一下今天工作坊里提到的釉料和陶土偏好。”
用
@Zoho
优化你的工作流。
只要告诉Gemini“显示我在Zoho Bigin里的活跃交易”就行。
未来几周,这批新的 MCP 连接会陆续上线 Gemini。
想了解如何把你常用的服务直接连接到 Gemini,帮你规划旅行、管理项目、搞定每日待办,可以看看我们的博客:
goo.gle/3TTbF8s
SL2T 是我们的突破性手语转文字模型,为 @Android 上的聋人和听力障碍用户推出新功能。
首先在 Pixel 11 上推出美国手语转英文功能,用户可以直接用手语输入 Gboard 和 Live Transcribe,无需打字。
多年来,手语AI的研发进展缓慢,主要是卡在复杂的技术难题和对这些语言运作方式的误解上。
我们通过海量数据训练模型,直接把手、身体和面部的同步动作翻译成文字,解决了这个问题。
SL2T 在学术基准上达到最先进水平,同时针对真实场景进行了优化,比如用一只手打手语同时拿着手机。
为了保护隐私,它在设备上跟踪身体姿态,而我们的服务器将其翻译成文本。
我们与聋人社区一起构建了 SL2T —— 由聋人 Googlers 和我们的 AI 手语咨询委员会指导。
将 ASL 输入引入手机只是开始,我们正在致力于将这项技术扩展到更多手语和应用中。
了解更多 → goo.gle/3RM3kmx
DeepSeek v4 Pro 正式版发布了!Grok 4.6 API 也被曝光了!
太兴奋了!看到最近 DeepSeek v4 Flash 那波疯狂的更新,我预期这个也会有好几次迭代!
看起来今天是个大发布日啊!
引用 leo 🐾 @synthwavedd🚨 DeepSeek V4 Pro (GA) is now rolling out on the DeepSeek API and on DeepSeek Chat查看被引原帖 ↗
最后机会!在今晚 PT 时间 11:59pm (8/11) 前可以免费用 Gemini Omni 创建最多 10 个视频。
社区的一些灵感可以帮你开始 👇
有个地方没人知道它存在。由 mr.cobra_ai 创建。
OpenAI 🔥:美国大学生现在可以免费领一年的 ChatGPT Plus。
OpenAI 正在筹备"返校"活动,把 ChatGPT 定位为考试复习、学习等的必备工具!
> 从课程学习到期末项目,ChatGPT 帮你向前迈进。
> 这项优惠面向 220+ 所美国参与校园的在校学生。领取免费一年并验证学生身份,看看你的学校是否在列表里。
> 通过我们的安全验证合作伙伴 SheerID 领取免费一年并完成学生身份验证。验证后,你可以查看优惠详情并选择是否激活。
来了:DeepSeek 4 GA 的基准测试已经开始流传。
升级还是不错的,可惜拿来和 Opus 4.8 对比而不是 Opus 5。
结果普遍不错,与开源 SOTA(Kimi k3 和 GLM-5.2)势均力敌,接近 5.6 Sol 和 Fable 5 的水平。
引用 Chubby♨️ @kimmonismusDeepSeek v4 Pro GA is rolling out! Grok 4.6 API spotted as well! Really excited! After the most recent insane update to DeepSeek v4 Flash i expect sevel updates on this one as well! big release day it seems!查看被引原帖 ↗
Grok 4.6 发布了,疯狂的进步!xAI 确实在出绝活!
根据 xAI 的基准,Grok 4.6 在 AA Intelligence Index 上与 GPT-5.6 Sol 并肩(都是 61),在 CursorBench、FrontierCode 和 AA-Briefcase 上还领先。
但在 DeepSWE 和 Terminal-Bench 上还是落后于 GPT-5.6 Sol。
xAI 说这个模型进行了更长时间的补充训练、重新生成了 SFT 轨迹,以及在代码、网页开发、CAD 和内核优化方面的代理强化学习。公司还表示在更长的任务中看到了更多的'自我测试和验证'。
Grok 4.6 今天就可以通过 Cursor、Grok Build、API 和多个基础设施合作伙伴使用。
这些是公司报告的数据,但相比 Grok 4.5,在几乎所有公开评估中都有显著提升。
为
@xai
和
@cursor_ai
点赞!看着真的没得说!!
引用 Chubby♨️ @kimmonismusDeepSeek v4 Pro GA is rolling out! Grok 4.6 API spotted as well! Really excited! After the most recent insane update to DeepSeek v4 Flash i expect sevel updates on this one as well! big release day it seems!查看被引原帖 ↗
我是能不用worktree就不用worktree,要么不同任务用branch分支,要么就直接同一个分支多任务,一般不太用担心冲突,首先只要任务类型不一样冲突可能性较小。
另外现在 Harness 比如说 Claude Code、Codex 都很聪明,遇到冲突会等另一个执行完。
使用 worktree 主要是在做耗时较长的 PoC 场景,只是验证一下,同时要做其他任务,完了就删除目录。
引用 宝玉 @doteyworktree 会创建很多目录,导致磁盘空间占用比较厉害查看被引原帖 ↗
2025年AI预测博客'AI 2027'的预测几乎全部应验了。24条预测中有19条已经成为现实,其他大部分也都走在准确的轨道上。
他们预测到现在和明年会发生:
到2026年底,越来越强大、越来越便宜的AI代理开始替代初级软件工程师,重塑整个经济。
到2027年,超人类编码代理会自动化AI研究本身,引发智能爆炸,可能在年底前导致人工超级智能出现——以及严重的对齐危机。
在我看来,我们完全符合这个时间表。疯了。
笑死,中国老哥可能知道50种越狱这些模型的办法吧
大家都想要更高效的推理
所以有点难以避免 neuralese
引用 Can Bölük @_can1357guys you do know you can just disable thinking, and instead give it a "deep_think" tool, and it will call it with internal CoT reasoning format right? gl fixing that查看被引原帖 ↗
走起!
huggingface.co/Qwen/Qwen3.8-…
我们对 Vercel 构建系统背后的数据库进行了迁移,这是我们最关键的服务之一,当时还在每分钟处理 6000 次部署。
迁移怎么做的、我们的想法,以及学到的东西都在这里 ↓
vercel.com/blog/how-we-migra…
明天是日全食 🌑☀️ 无论你是在格陵兰、冰岛和西班牙的全食区,还是在线观看部分地区,我们都给你准备好了。
用 @GoogleAIStudio 开发的交互式 3D 可视化工具可以实时追踪月影扫过全球的过程,还能从雷克雅未克或瓦伦西亚这些观测站模拟当地的天空景象,快进或快退来看关键的日食时刻:goo.gle/4g4baQt
中国科技行业下一轮最大的泡沫破裂,应该就是具身智能+VLA+世界模型,会有几个公司上市后股价跌到零,剩下一批公司应该跟AI四小龙时代的一批调参大师一样突然关停或者暴雷。
虽然具身智能+VLA+世界模型的泡沫破裂,远远比不上2000年的美国dot com bubble互联网泡沫危机,但肯定比AI四小龙要猛烈得多。
方式也跟AI四小龙时代一样,一批大厂senior level到VP分别下场做demo,手搓个垃圾pick and place跑不通的灵巧手,或者全员跳舞,或者弄一堆metaverse元宇宙级别的物理世界仿真4399小游戏,烧完就关门。
这一轮会比以前任何一轮都要惨烈,核心原因就是宇树科技IPO全面开绿灯,马上要冲击上市,这一两年国内PEVC投资人已经全部杀红了眼,随便一个垃圾phd、垃圾教授、垃圾demo都能投进去几个亿,等着一个个也IPO开绿灯,让A股股民接盘。
表面上是科技大泡沫、技术大骗局,实际上本质还是金融监管的巨大漏洞,让宇树科技抢跑上市,导致后患无穷。
现在这事儿简直疯了;本来是个段子,现在竟然真的成了生产力工具。
Codex的里程碑这块儿,达到1000万用户的时候之前都是周周重置。
现在老哥给我们留了个大招:估计又是一次重置或者'囤积'重置。
OpenAI在社区运营上投入巨大。感谢啊!
引用 Tibo @thsottiauxI previously promised a reset for every 1M in additional active users for Codex, until 10M. We blew past that and have been silent since 10M. Little surprise for you tomorrow.查看被引原帖 ↗
他又做到了,EpochAI 的又一个开放问题被解决了
引用 levent @__alpoge__+++-+-+-+-+--+--+++-++----++--+----+-----+++---++-+---+++++++-+--+-+-+--++-+--+--+----+-+-+-+-++-++---+--++++--++-++++-+++++--+---++-+---+++++++++--+-+-+--++-+--+--+-----+++-+++-++-+-++++-++-+--+--+------++--+-++-+-+---+--+-+-+-+--++---+++++-----+++++++---+---+--+-+--+-+--+-++-++-++++++-+-++-++-+-+---+--+-+-+-+--++---+++++-----+++----+-+-++---+-++----+---+++++--+---+--++-+++++++-+--+---+----++-+++----++---+++---++++-+-+--+++-+--++++-+++-----++-+++-+++-++++++++-+--+---+----++-+++----++---+++---+++---+-+--++----+--+-+++-+--++------+++--++++++-+--++--+-++---+--++---+---++--+-+----+++-+-++--++++-++-+---+-++--++++++---++++++++-+--++--+-+++--+--++---+---++--+-+-+--+++--+---++++-+-++-+---+-+-+-----+--++-+----+-+-+----+-----++-+++++-+++--+--++++++-++--++---++-+++----+-+--+--++-+-+-+++++-++--+-+++-+-+-+----+-----++-+-+++-+++--+--++++++-++-+++---++++---+++++-++--+--+++-+++--+--+-++-+++--+++-+++--+-+--++++-----+-+-+--+--+---+-++---+++----+++-----+--+++++---+---++-++-+--+-++--+++-+++--+-+--++++-----+-+-+--+--+---+-+++-------+-+-++--++++---+--+-++-+--+---+-++-+-+++++-++--+----++++----+++---++--++-+---+-+--+++++++-+-+--++----+++-++-+--+-++-+++-+--+++-++++-++--+----++++----+++---++--++-+---+-+-------------+-+++-+++---++--++--+-+++--+-+-++---+----++++--+-+-++++-++---+--+----++-++-++++++++++++++-+---+---+++--++--++-+---++-+-+-+-+-+----++++--+-+-++++-++---+--+----++-++-++----++-++++--+++++--+--+--+--+++-----++--+-+-+++-+++-+++-+-+++-+++-+++++-++++---+++---+--+--++++--+++++--+---+++-+--+-----+-+++++++------+++-+--++-+++--++--+++-+-+++-++-+++-+----++-------+--+-+-++-+-+--+--+-+--+-+-+-++-+-+---+++++-+-++-++----++--++++-+--++-+---+-++--+-+----+------+--+-+-+--+---+++++-+++-++++---+-++-++--+-++-+---+++-+-+++-+-+--+++-+-----++-+++--+--++++-++-+-++++--+--++---+++++---+---++++-++----+--+-+-++++++-+++-++++--+---+--++--+-+-++-+++-+++---++---++----++------+--+--++++-+++-++++--+++++-+-+-++++-+-+-++--+++++-----+++-+++++-+---+--+++++-+---++------++-+++-+++-++---++-+--+--+-++++--+-+++-+++-+---++++查看被引原帖 ↗
这个可控视频生成的方法真有意思,而且很简单:
- 用代码先把视频的“骨架”搭出来,把所有的动作、物体等以低精度嵌入进去
- 再把生成的“草稿”丢给视频模型去“变真实”
在等待苦涩的教训在长视频生成上施展魔法之际,这或许是个实用的短期策略。
引用 GMI Cloud @gmi_cloudyou don't need Seedance 2.5, here's cheaper and more efficient workflow we made this entire game shooting scene in one shot for $1.97 with DeepSeek V4 Flash 0731 + MiniMax H3 we use DeepSeek to code the raw Three.js scene first: exact camera movement, character motion, timing, everything. keep tweaking it there for basically pennies. then feed the final footage into H3 and let it cook the realism 48 mins, $1.97 total, one H3 generation way cheaper than rerolling a video model 10 times查看被引原帖 ↗
这个道理我讲了将近10年了,绝大多数人根本不听我的任何警告,油盐不进。
所以我现在彻底反过来了,我支持任何985以上的robotics机器人嘉豪,一定要到美国EECS top 10大学扎扎实实读个robotics PhD,扎扎实实做五年机器人,或者去个头部工业机器人干三年,
否则他们永远不知道我到底在跟他们讲什么。
引用 枫原万葉 @46ge5国内具身智能/机器人卷得要死,加班非常严重,大把人月休1天2天(包括智元等头部企业 性质类似于早期的自动驾驶,因为算法垃圾,导致无止境的落地调优,case 分析修补,还有硬件链路问题,听着都累(我也不认为当前模式能跑通查看被引原帖 ↗
我们荣幸地宣布Glassdoor将我们的创始人兼CEO @JensonHuang 列为2026年最佳CEO榜单第一名。🎉
这是一项非常有意义的认可,基于使NVIDIA成为今日之NVIDIA的人们的反馈。
阅读故事:
nvda.ws/4gt2Ta0
所有错过了成立下一个AI Lab训练大模型的黄金窗口期、又蹬不动agent看不懂前沿技术的80~90后技术老登们,几乎无一例外地选择了具身智能、VLA、世界模型这些垃圾诈骗方向继续融资
Skyr 属于最少加工的食品。
我建议用 NOVA 量表,这是判断你的食物是否干净的好办法,本质上就是判断该不该吃。拍张照片,问 AI 你的食物是 NOVA 哪个等级就行。
我现在基本不吃 NOVA 3 和 4 组的食物了(偶尔作弊日除外😏)
有意思的是,几十年前还是 NOVA 1(未加工)的食物,现在不少都变成 NOVA 4(超加工)了。原因就是通货膨胀。
未加工食物便宜又乏味,不好营销,没什么利润。一块牛排就是一块牛排,哪儿买都差不多价钱。但要是你把它包装成「烤肉大师甜烟熏美国安格斯牛肉」,配上精美的标签、广告宣传,加上一堆盐水、色素、添加剂来增加重量,就能卖更高的价钱了。
卖超加工食品利润高得多,比卖未加工食品强太多了(那东西乏味还没利润)。
感谢资本主义啊!
我父母在荷兰吃过的某种肉,原来是未加工的,现在卖的是完全超加工的——防腐剂、乳化剂、色素、添加剂什么都有。他们压根没注意到,因为看起来还差不多。但这东西让他们不舒服。
还有酸奶。我长大的时候酸奶就是酸奶,发酵牛奶,NOVA 1(未加工)。现代酸奶不是这样了。我从前常买的高端品牌丹尼斯的 OIKOS 酸奶,原来就两种成分:牛奶和发酵菌。现在成分是一些牛奶、点奶油、大量来路不明的奶粉,还是用发酵菌来省钱,结果价格反而涨了!这还是原味的呢。调味酸奶更别说了,全是人工甜味剂、乳化剂、各种添加剂。
所以你真的没法再用眼睛判断食物是不是干净了。大部分食物都被改成了加工或超加工的,为了省钱或者为了营销卖出更高的价格。
拿不准的话,试试 NOVA 量表吧。
引用 Big Jim @_jmwebb“Not processed like X. But made through a process 😊查看被引原帖 ↗
Mistral 正在为欧洲汇集掌控 AI 未来所需的推理基础设施、开源模型和长期承诺,并为全球定方向。🧵:mistral.ai/news/regional-inf…
一个锁定长期 AI 算力的联盟:我们在欧洲聚合长期算力需求,来确定要造什么容量、造在哪儿、服务谁。通过这些多年承诺和欧洲计算单元,参与者可以根据需求灵活调用 Mistral Compute 上各类产品的容量。
区域端点和优先级:客户可以选择推理跑在哪——欧洲还是美国——这样请求留在本地,本地容量在高峰期也有保障,满足数据驻留、监管和延迟的要求。
用模型选择权实现 AI 主权:我们正扩展平台,支持第三方开源模型,从 Z.ai 的 GLM-5.2 开始,让企业能把工作负载分配到最合适的模型,保留自己积累的智能。
这就是 Mistral 要打造的框架:企业、政府、初创们都能用到最好的 AI,围绕自己的知识来定制,并且能保留它创造的价值。
💡这个世界需要开源平台,而这也正是我们在做的事——为客户提供更多选择和灵活性,让他们能针对不同任务挑最合适的模型。为此,我们会继续在跨模态的前沿、高效开源模型上推陈出新。
NVIDIA Nemotron 3.5 Lightning在Ollama上线了!30B模型,专为常驻agents设计,完全本地化。
Claude Code
ollama launch claude --model nemotron-3.5-lightning
Hermes Agent
ollama launch hermes --model nemotron-3.5-lightning
OpenClaw
ollama launch openclaw --model nemotron-3.5-lightning
- 30B mixture of experts模型,3B活跃参数
- 1M token上下文
- 为持续运行的agents而构建:编码、工具调用、多轮对话
- 吞吐量是其他同类开源模型的4倍,任务完成时间快30%
模型页面
👇👇👇
引用 NVIDIA AI @NVIDIAAIIntroducing NVIDIA Nemotron 3.5 Lightning⚡ An open 30B MoE model with 3B active parameters, built for always-on agents to complete high-volume, specialized tasks faster. It delivers up to 4x the output speed of similar-sized models.查看被引原帖 ↗
留意这个页面
vercel.com/ai-gateway/leader…
Firecrawl 现在是 @opencode 中web搜索的无密钥选项。
将我们设为您的搜索提供商,您的 AI agents 将获得最新搜索结果,精度顶尖(在 SimpleQA 上达 94.7%),无需 API 密钥或注册。
只需更新 opencode2,选择 Firecrawl,立即开始搜索!
查看 OpenCode2 文档在此:opencode.ai/v2/docs
了解更多 Firecrawl Keyless 相关信息:firecrawl.dev/blog/firecrawl…
说实话,我对任何用 pangram 来'曝光'别人这事儿的看法都是负面的
这总是假设最坏的情况 —— 就是纯粹的 AI 垃圾,发布者什么都没贡献
这就像发明了个'计算机程序检测器',然后用它抹黑某项工作,理由是人家没用脑子手工算所有东西
引用 Susan Zhang @suchenzangoh hell yeah american meituan let's goooo查看被引原帖 ↗
恭喜你发现了真实世界,在 AI 领域,群体是周期性失忆的。
引用 马天翼 @fkysly有点穿越,Pi 不是 OpenClaw 早期的时候就顺带火了么?4大基本 tool use,怎么现在又开始火了查看被引原帖 ↗
天哪我恨 Opus。太懒了。真的让我很生气。所有东西都得重新检查,还得不停地说:做对了!
我以为 Sonnet 5 是个糟糕的版本。我错了。Opus 5 是有史以来最差的版本。
一家 IPO 在即、估值 1.2 万亿的公司,怎么能弄得这么糟糕呢
又在用内部模型了
祝AI实验室外的所有科学家好运 :)
引用 levent @__alpoge__+++-+-+-+-+--+--+++-++----++--+----+-----+++---++-+---+++++++-+--+-+-+--++-+--+--+----+-+-+-+-++-++---+--++++--++-++++-+++++--+---++-+---+++++++++--+-+-+--++-+--+--+-----+++-+++-++-+-++++-++-+--+--+------++--+-++-+-+---+--+-+-+-+--++---+++++-----+++++++---+---+--+-+--+-+--+-++-++-++++++-+-++-++-+-+---+--+-+-+-+--++---+++++-----+++----+-+-++---+-++----+---+++++--+---+--++-+++++++-+--+---+----++-+++----++---+++---++++-+-+--+++-+--++++-+++-----++-+++-+++-++++++++-+--+---+----++-+++----++---+++---+++---+-+--++----+--+-+++-+--++------+++--++++++-+--++--+-++---+--++---+---++--+-+----+++-+-++--++++-++-+---+-++--++++++---++++++++-+--++--+-+++--+--++---+---++--+-+-+--+++--+---++++-+-++-+---+-+-+-----+--++-+----+-+-+----+-----++-+++++-+++--+--++++++-++--++---++-+++----+-+--+--++-+-+-+++++-++--+-+++-+-+-+----+-----++-+-+++-+++--+--++++++-++-+++---++++---+++++-++--+--+++-+++--+--+-++-+++--+++-+++--+-+--++++-----+-+-+--+--+---+-++---+++----+++-----+--+++++---+---++-++-+--+-++--+++-+++--+-+--++++-----+-+-+--+--+---+-+++-------+-+-++--++++---+--+-++-+--+---+-++-+-+++++-++--+----++++----+++---++--++-+---+-+--+++++++-+-+--++----+++-++-+--+-++-+++-+--+++-++++-++--+----++++----+++---++--++-+---+-+-------------+-+++-+++---++--++--+-+++--+-+-++---+----++++--+-+-++++-++---+--+----++-++-++++++++++++++-+---+---+++--++--++-+---++-+-+-+-+-+----++++--+-+-++++-++---+--+----++-++-++----++-++++--+++++--+--+--+--+++-----++--+-+-+++-+++-+++-+-+++-+++-+++++-++++---+++---+--+--++++--+++++--+---+++-+--+-----+-+++++++------+++-+--++-+++--++--+++-+-+++-++-+++-+----++-------+--+-+-++-+-+--+--+-+--+-+-+-++-+-+---+++++-+-++-++----++--++++-+--++-+---+-++--+-+----+------+--+-+-+--+---+++++-+++-++++---+-++-++--+-++-+---+++-+-+++-+-+--+++-+-----++-+++--+--++++-++-+-++++--+--++---+++++---+---++++-++----+--+-+-++++++-+++-++++--+---+--++--+-+-++-+++-+++---++---++----++------+--+--++++-+++-++++--+++++-+-+-++++-+-+-++--+++++-----+++-+++++-+---+--+++++-+---++------++-+++-+++-++---++-+--+--+-++++--+-+++-+++-+---++++查看被引原帖 ↗
今天是美好的一天:
DeepSeek-V4-Pro
Grok 4.6
Qwen3.8-2.4T
还有可能 OpenAI 也会发布点东西
从排名第 22 升至第 4!Qwen3.8-Max 进步明显。感谢突出推荐~✨
引用 Vals AI @ValsAIQwen 3.8 Max nearly doubled its score on Legal Research Bench in under three months, climbing from #22 to #4.查看被引原帖 ↗
这已经是今年最重要的论文之一了。
latent.space/p/ainews-how-to…
方法论讲得不太清楚,所以这里是我的进一步总结
引用 Alexander Panfilov @kotekjedi_mlWe can finally talk about it: We found a way to extract hidden reasoning of frontier models using a vulnerability in the APIs of every frontier AI company. We verified that our reasoning token count matches billed API thinking tokens 1:1 for most of the prompts we queried.查看被引原帖 ↗
快去 @openart_ai 上试试 Qwen-Image-3.0!🎨👀
引用 OpenArt @openart_aiQwen Image 3.0 is now on OpenArt ✨ The most Real Qwen image model yet. Native text across 12 languages, precise 10px type, and full interfaces like web pages, games, and livestreams rendered with real world knowledge. Available now on OpenArt: openart.ai/suite/create-imag…查看被引原帖 ↗
没有开思考模式,看看DeepSeek V4 Pro生成鹈鹕测试的效果。
提示词:“鹈鹕骑自行车svg,撞上大象,循环播放”
引用 向阳乔木 @vista8DeepSeek-V4-Pro-0813 来了,喜大普奔! 但是今天还是8月12日啊,为啥用0813命名啊,哈哈。 百万tokens输入(缓存命中)0.025元 (vs flash 0.02元) 百万tokens输入(缓存未命中)3元 (vs flash 1元) 百万tokens输出 6元 (vs flash 2元) 并发限 500,Flash 是 2500 注意:价格是当下价格,最近会上涨。查看被引原帖 ↗
OpenClaw 大众版现已推出。
引用 Matt Shumer @mattshumer_I’ve been testing Grok Bot for a couple of weeks, and I’ve been surprised by how much I’ve loved it. Honestly, this feels like it could be the thing that gets millions of normal people using agents for the first time. As many of you know, I haven’t always had the best experience with Cursor’s products, but this one feels different. The best way I can describe it is an agent for everything, not just code. The interface feels like iMessage, and you create bots that each have a job and actually get better over time as they learn how you work. There are a lot of products attempting this, but the little details are what makes Grok Bot special. For example, I set up a researcher bot and a writer bot, then made a Chief of Staff bot and asked it to get the other two working together on a project. I checked in fully expecting that to fall apart, because there was no way it just would work out of the box. It worked out of the box. Had a few more experiences like this too. The team clearly really cares about nailing the experience. My only real complaint (which, if they nail it, will end up being a huge win) was the model router, which wasn’t great when I tested it. You don’t choose a model for your Grok Bot. It’s all done automatically on the backend. Incredible for regular users when it’s done well, but frustrating for power users when done poorly. I’m told they’ve made it much better since I tested. It also clearly has sub-agents/workflows in the harness, as it runs Gauntlet Loops natively, and it handled everything I threw at it, from real work to 3D game builds. Very much worth your time to check out!查看被引原帖 ↗
OpenAI 🔥:现在用户可以在 Codex、ChatGPT Work 和其他 AI agents 之间保持项目、聊天、技能和插件的同步。
这很不错,特别是如果你经常测试不同实验室的不同订阅的话。
引用 OpenAI Developers @OpenAIDevs以下是设置自动同步的方法:learn.chatgpt.com/docs/impor…查看被引原帖 ↗
又开始打哑谜了。这是 OpenAI 的 Andrew Ambrosiono 今天发的,估计是在暗示即将推出的 Astra 模型家族。
为什么这有必要说?因为 Astra 因为安全和网络安全问题撤回了,这可能把发布时间推得很远。而且确实有充分理由这么做。
这条帖子可以两种方式理解:
1) Astra 的问题和隐患比预期更快得到解决了(原本计划这周前发布撤回),现在他们在为用户做准备。
2) 他们就是想让这个模型保持热度。
为什么重要?Astra 是新的模型家族,配合新预训练,最终应该能打破 Fable 的主导地位。OpenAI 通过 Codex 取得了重大进步,5.6 Sol 版本也是不错的模型。但 Fable 5 在很多关键指标上还是领先的。鉴于即将发布新模型,可以合理推测 Fable 5.5 或其他什么版本肯定会在 IPO 前推出。Anthropic 的 IPO 延到了 9 月/10 月,所以新的 Fable 也不远了。
所以,要最终超过 Anthropic,很多就取决于 Astra,我敢说 OpenAI 对 Astra 的发布是押重注的。从这个角度看,这个打哑谜的帖子不仅是个笑话。这是个信号。Astra 很关键。必须得继续被讨论。这是个大突破。
@aisdk 的增长简直离谱。每月 8050 万次下载,增速远超所有 AI Labs SDK。关键是它还完全开源、与厂商无关。
引用 AI SDK @aisdkAI SDK has crossed 20M downloads per week. We’re grateful to every developer who helped us reach this milestone.查看被引原帖 ↗
有四种对话播客,值得我花时间1.5~2倍速听完,
一种是主持人或者嘉宾控场能力爆棚,娱乐效果拉满,包袱和哏一个接一个,剪辑效果再创作一流,比如papi酱、大物是也,都是走当年康熙的风格;
一种是嘉宾是大明星,我从小就喜欢,愿意听TA讲自己的故事,比如HOPICO采访陈奕迅、方大同、王力宏、苏打绿 ,都是非常精彩的碰撞,有的我反复听了好几遍,
一种是主持人很牛,嘉宾也很牛,双方都是真正经历过大风大浪,或者是某个领域重大变革的亲历者/见证者,分析某个行业时可以随意跳入跳出,深入浅出讲一大堆硬核知识和观点分享,这种要碰运气,我个人比较喜欢咸鱼堡的某几期医疗行业的采访,
第四种是王阿姨和斑马酱的Yi马当先,可惜停更了。
大概就这些。
这些AI领域的播客最大的问题是,嘉宾表达欲望不强,主持人业务和技术水平更是差一大截,观看效果实在是不行。
引用 老董叔 @zhuodong666这几年大量ai领域的播客听下来,很明显不是任何一个ai研究者都适合上去聊两句的。真正好的效果,被采访者往往需要在大模型某个特定方向上有很深的积累,同时对整个大模型整体方向也有全面的认识,这时候才能以点带面,越聊越深入,这才是一场播客的合格水平。查看被引原帖 ↗
AI 视频最大的问题就是控制能力。你很难做出完全符合要求的效果。这个技术就是来解决这个的。在 3JS 里画草图,用图像生成来生成风格,再和视频生成融合。怎么做:somethingbig.ai/controllable…
这个技术基于 @gmi_cloud 分享的想法,但改进后稳定性更好,还能控制风格。他们的方法对运动控制很不错,但我经常碰到风格基本没变化的问题。这就解决了!
这也是采访者的问题,采访者大部分完全没听懂。
我点开过几期,我明显感觉那个播客的主持人手里有个大纲,列了七八个问题,然后嘉宾直接一条条往下讲,讲得模糊的也直接划过去了,
关键是主持人,不仅没听懂,而且就跟个大傻子似的,直勾勾盯着采访者,接不住话茬子,也不知道哪里该切入具体聊下去。
引用 老董叔 @zhuodong666现在大量的播客采访听起来味同嚼蜡,请上来的ai研究员要么只能在自己研究领域说上两句,但是扩展到整个大模型系统上就云山雾罩不知所云,要么满嘴片汤话都是都整个ai大行业的泛泛之谈,但是没有对自己多年积累的方向有任何深刻认识,要么表达不通顺说话漂移严重,查看被引原帖 ↗
terminal UI从来没死过,这东西哪怕在2023年以前,也一直大量存在于各种cli工具中,大量语言和框架已经把基建做得差不多了;
terminal UI也从来没活过,短期一堆LLM Agent糊了个UI,在大众强烈需求的情绪反弹下,依然会回到electron大号聊天机器人的技术栈。
TUI这种葱姜蒜级别的下脚料技术, 在今天依然被反复炒作,反复回锅,
充分证明了哈珀发明了合成氨这件事,导致太多人吃饱了撑的没事干了。
《立党基础教育》最核心的精髓,一个是给6岁孩子孩子买mac mini+大显示器,一个是订阅coding plan(claude/OpenAI/智谱/kimi/阿里/grok),
最核心是建立“党哥家庭图书馆”,卧室装满这些书,可以陪伴孩子从6岁到18岁的数学物理计算机教材,让孩子随机翻、随机看、躺着看、拉屎看,挖掘天赋潜能。
一定要听党哥的,党哥就住天津图书大厦旁边,这些书党哥没给童年的自己买齐,党哥想扇自己100个大嘴巴子,你们一定不要给自己家聪明的孩子留遗憾,先把书买齐了,孩子只看10%,每本书只看一章,都是有用的。
1. 小学、初中、高中全年级的数学、物理、信息学基础官方教材;
2. 小学、初中、高中全年级的数学、物理、信息学学科竞赛教材和题集;
上面这些书一定要买齐,供孩子随时按照兴趣翻阅,吃饭时翻阅,拉屎时翻阅,无聊时翻阅,
3. 大学本科基础数学教材《微积分》《线性代数》《概率统计》《复变函数》,如果孩子看得津津有味并且觉得太简单,立刻按照北大数学系培养方案继续买实分析、高代、抽代、组合数学等等,
喜欢物理直接买四大力学教材,或者直接买《费曼物理学讲义》,按照孩子需求买齐买全,挖掘孩子在数学和物理上的最大天赋;
4. 一定要买齐计算机教材,从6岁可以陪伴到60岁的几本书,都是党哥自己掏真金白银在天津或者Texas亲自买过的纸质书,哈佛MIT斯坦福也用这些书当做本科生或者graduate level(硕士博士阶段课程)教材,记住,一定要买齐,摆孩子卧室里,让孩子随机翻阅,随机看,拉屎看,吃饭看,睡觉看,周末看,看一章节就算稳赚。
记住,这些书尽量买齐,在中国就买影印版中文翻译版,一本书50块钱,买齐了并不贵,在英语国家可以买二手英文版,这些书可以陪伴绝大多数人从6岁到60岁。
a. 《Python Crash Course: A Hands-on, Project-based Introduction to Programming》(Python编程:从入门到实践),孩子的第一本编程书,让孩子一边拿着书,一边对着电脑敲敲敲,敲敲敲,敲敲敲,
python入门了以后,可以买《Thinking in Java》《C++ Primer》,挑着学Java和C++这两本书;
b. 计算机三套经典,党哥都买了纸质版,党哥都没看完。
- 计算机基础教材CSAPP《Computer Systems A Programmers Perspective》(CSAPP)
- 算法和数据结构圣经《introduction to algorithms》(算法导论)
- 可以陪伴到50岁、几代人读的圣经大套装《The Art of Computer Programming》(TAOCP)
记住,党哥没看完是因为岁数太大了(算法导论看得最多,其他两本进度很少),你的孩子只有6~18岁,如果激发了巨大的兴趣,你的孩子是完完全全有精力看完的。
如果18岁之前能扎扎实实看完这三本书,可以说比Google和Meta里面90%的员工要强。
c. 全球公认的计算机其余主要专业教材
操作系统《Operating Systems Concepts》(操作系统概念,恐龙书)
编译原理《Compilers: Principles, Techniques, and Tools》(编译原理,龙书)
《Modern Compiler Implementation in C》(现代编译原理,虎书)
《Advanced Compiler Design and Implementation》(编译器设计与实现,鲸书)
数据库《Database System Concepts》(数据库概念)
计算机网络《Computer Networks》Andrew S. Tanenbaum
计算机图形学《Fundamentals of Computer Graphics》(图形学虎书)
机器学习和深度学习《Pattern Recognition and Machine Learning》(PRML)和《Deep Learning》 by MIT Press
党哥不是拉书单,党哥给你推荐图书是非常谨慎小心的,已经砍到不能再砍,精简到不能再精简了,精简到再砍掉任何一本就会出现大问题了,
记住,这些计算机科学computer science书籍,要买全,买齐,在中国大陆就买影印版、翻译版,在美国就买二手,把这些书整整齐齐放在孩子书架上,
孩子靠兴趣驱动学习时,是跳跃的、离散的、冲动的,也许孩子感兴趣两个月看完一本书,也许两年翻不了三页,也许一本书只看零星两三章,
但是一定要给孩子买齐、买全、买完整,放在卧室书架上,吃饭看、拉屎看、无聊看、闲着看、呆着看、随机翻看、边看边敲、边看边在claude code里实现,
一定要买齐,在家里置办“党哥家庭图书馆”,孩子对知识的欲望和冲动,远比对抖音直播间大美女的冲动要强烈得多,当冲动来临的时候,一定要做好图书、知识、教材的准备,让孩子凭借一腔热血和兴趣,选择随机翻阅和学习。
当然,另一件重要的事情,就是听党哥的话,围绕北京、上海、深圳、bay area全球四大科技中心,每个月至少带孩子逛一次电子展、科技展会、技术大会、学术会议、路演日、融资大会、技术沙龙、AI线下沙龙、技术公开课、产业大会、学校技术论坛、学校学术展览,逐步建立世界观,认识技术,认识产业,认识各行各业,形成自己的价值观,并且开始接触一些各行各业的“大朋友”,
当这些大朋友给孩子一些启发的时候,孩子就会立刻回家,闷头去翻这些教材,继续去补充营养,带着白天开会时满脑子的小问号,回到自己的“党哥家庭图书馆”,去狠狠恶补自己欠缺的知识。
记住,除了买mac mini+大显示器+人体工程学座椅+订阅coding plan,除了开会,家长首先要做到的,就是买书,买书,买书,买书,买书,买书,买书,买书,买书。
如果要看视频课程,可以按照csdiy wiki上面课程去学习,可以上B站上中文平替,
先从哈佛CS50起,接下来看UC Berkeley CS61A、CS61B、CS61C,然后按照csdiy wiki上面对应的视频课程自己去学习,一般youtube有原版,B站有翻译版本。
让孩子自己自由随机去挑感兴趣的视频去跟着学。
但是一定他妈给我把这些书给孩子买齐,买全,加起来没有几千块钱,能改变你的孩子一辈子的命运,让他获得一个9位数的人生。
现在就给我去京东天猫拼多多闲鱼去下单,给我买!!!!
Higgsfield 又制作了一部完整的超长AI电影
这可能是 AI 电影真正开始进入长片时代的一个节点
片长110 分钟
4 周制作
花费200 万美元
Higgsfield 和 Cully Games 用 AI 完成了一部长达 110 分钟的剧情长片
有趣的是该AI电影由真人演员参与,但是并不是真的参演, 而是使用了他们的肖像授权进行AI制作…
而且他们将整个制作过程完全公开:每条Prompt、每个素材、每个角色,免费可复用。
过去两年,我们看到的大多数 AI 视频还停留在几秒、几十秒的 Demo,大家比的是画质、运镜和生成效果。
现在,AI 已经开始进入一部完整电影的生产流程,而且还有真人演员参与。
从「生成几个惊艳的镜头」,到「真正制作一部 110 分钟的电影」,这个变化来得比想象中快得多。
AI 电影真正值得关注的阶段,可能才刚刚开始。
引用 Higgsfield AI 🧩 @higgsfield_aiWe made the first 110-minute AI feature film with a real cast, The Cully Hill Boys, on Higgsfield for $2,000,000. Starring @N3onOnYT , @stylebender , @RampageJackson , and @MKIATPIS It's 100% open-sourced on Higgsfield: all prompts and assets are public now. Made with Seedance on Higgsfield. Watch full film below 👇查看被引原帖 ↗
解答世间万物(不要用蓝牙耳机)
x.com/i/spaces/1dKrPrPAnwXJX
Vercel 上的部署自今年年初以来增长了 3 倍。前 6 个月增长了 2 倍。Agents 喜欢部署。
我们通过卓越的可靠性支持了这种增长,同时在这段时间内的公开 changelog 上推出了 19 项构建和部署性能优化。
Redis 自从我 10 年前创建 z̵e̵i̵t̵ Vercel 基础设施以来一直给力,服务于很多地方。但就像很多这样的情况,Dynamo 才是应对这种规模需求的正确选择。
引用 Vercel @vercelWe migrated the database behind every build at Vercel, one of our most critical services, while it handled 6,000 deployments a minute. The story of how it happened, our philosophy, and what we learned ↓ vercel.com/blog/how-we-migra…查看被引原帖 ↗
我喜欢现在所有 AI 评论员都得假装自己从来深刻理解那些只有专家听过的一堆未解数学问题的区别:"Gromlach 猜想对 r 维矩阵是错的,哇,这比上周对受限样条的 Erdos 问题 444 的解决方案还牛逼!"
这个新的 AI 电影工作室真的很牛。你可以控制面部特征获得逼真的人物情感,生成详细的角色表。在 AI 时间线上编辑、添加 VFX 和 SFX,加入等候名单获取早期访问码和免费额度:filmera.ai
这是第一个具有专业电影制作工作流的 AI 平台。AI 代理帮你写提示词、在媒体库管理资产、在 AI 时间线上编辑。加入等候名单获取早期访问码和免费额度:filmera.ai
引用 el.cine @EHuangluAI video is now undetectable查看被引原帖 ↗
如果你拍的每段视频都能在原地变成永久的3D全息影像呢?我先用照片试过了,现在视频也可以。这是我几天前用iPhone拍的母鹿和小鹿,现在作为地理位置锚定的全息影像漂浮在拍摄地点。
大量照片的空间记忆宫殿:
有趣的研究表明,单从一个数据源判断谁赢了要谨慎啊...OpenRouter 的数据显示开源模型越来越猛,但 Pangram 上提交的作品大多是 ChatGPT,不过 Claude 的比例越来越高。pangram.com/blog/pangram-s-m…
我一直有个观点,就是:
人不用去跟汽车比谁跑的快,不用跟 AI 比谁更聪明博学;我们驾驭好汽车到达目的地,用好 AI 完成任务,就很好了。
引用 Jackywine @Jackywine我有一个绝望的观点: 人类已经彻底跟不上 AI 的发展速度了 但是在自己力所能及的情况下,还是尽可能多的学习一点 我的 Agent 启蒙是 anthropic 的官方教程,再加上一些其他的 AI 智能体官方文档,交叉之后发现 Agent =LLM +Loop 当然,人的参与也很重要查看被引原帖 ↗
关于 Anthropic 和水印问题:什么是真的,什么不是,真正的问题在哪。
根据我的了解,对 Claude 新文本水印的反对不是关心秘密追踪,而是关于作者身份认定、质量影响,和谁该为这个不完美的检测系统承担代价。
记住:Anthropic 计划在 Claude 模型生成的文本中嵌入一个不可见、机器可读的信号。
第一个问题是解释:
检测到的水印并不能证明是 Claude 写的文档。Anthropic 说,它也可能出现在有人用 Claude 校对、翻译或改进人类原创文本时。
但雇主、大学、客户或出版商能理解这个区别吗?
"由 Claude 处理"很快就会被理解成"由 AI 写的"。这是个真问题!
第二个问题是质量:
文本水印通过影响模型的 token 选择来创建可检测的统计模式。Google 的 SynthID 研究表明这可以在不明显降低质量评分的情况下完成,虽然某些配置会降低响应多样性。
但 Anthropic 还没有发布足够的技术细节或独立测试来证实"质量不受影响"的说法。这又是个问题!
第三个问题是有效性:
坚持不懈的用户可以通过大量改写、翻译、用其他模型或未标记的开源系统来减弱水印。而普通用户让 Claude 润色邮件、编辑文档或帮助写代码时,更可能保留水印。
EU 法规甚至豁免不实质改变输入或其含义的标准编辑。但 Anthropic 更宽泛的(!)实现似乎覆盖范围比这个最低要求还广。
所以真正的问题不是什么隐形间谍在监听,而是一个技术上有限的来源信号,可能被当成对人类作者身份的最终判定。这个担忧是合理的。
(顺便说,关于隐私:混淆来自 Anthropic 说水印在"模型级别"工作。
这不是说 Claude 能追踪文本回到你的账户、身份或之前的对话。
这是说标记是在模型生成文本时添加的。所以无论你用 Claude.ai、Claude Code、API、AWS 还是其他平台,标记都可能出现。这是在 Claude 产品中工作,而不是追踪你的个人会话。)
简版:水印确实有问题,我对这些问题有严肃的关切(我也批评 EU 想再次监管这个本不需要监管的东西),但问题不在隐私上,而是如上所述的其他地方。
如果LLMs对科学的贡献仅限于数学领域——以新颖方式跨子领域整合思想——那也将是革命性的。在LLMs出现之前,科学在知识的重压下停滞不前,信息太多难以吸收,工作也因此僵化。
引用 Ethan Mollick @emollickThe paradox of our Golden Age of science: more research is being published by more scientists than ever, but the result is actually slowing progress! With too much to read & absorb, papers in more crowded fields are citing new work less, and canonizing highly-cited articles more.查看被引原帖 ↗
很高兴 Ollama 能够与 @JensenHuang 和 @NVIDIAAI 团队合作推出开源模型。
开源模型没有边界,让我们继续合作使这个生态系统更好!
引用 Jensen Huang @JensenHuangLightning strikes for continuous and long-run agents! Nemotron 3.5 Lightning is smart, fast, efficient and open.查看被引原帖 ↗
Manus 还是挺了不起的,期待再创辉煌
引用 晚点 LatePost @latepostnews《Manus 第二季,浪子回头》 8 月 11 日晚间,Manus 网站上挂了小半年的那句 “Manus 现已成为 Meta 的一部分”,变成了 “Manus 即将恢复独立运营。” 从被收购到确认拆分,中间不到八个月。 2025 年 7 月,肖弘离开了长居的武汉,和整个团队搬去新加坡。同年 12 月 29 日,他决定将这家公司以超过 20 亿美元卖给 Meta,出任 Meta 副总裁。 这是大模型应用领域当时最大的收购案,交易从接触到签约仅约 10 天;也是 Meta 历史上第三大并购案,仅次于 WhatsApp 与 ScaleAI。 交易宣布一周后,中国商务部新闻发言人在例行记者会上说,将会同相关部门对此项收购与出口管制、技术进出口、对外投资等相关法律法规的一致性开展评估调查。 戏剧性转变引发了看戏的热情,社交网络上参与讨论的人远远多过用过 Manus 的人,“香槟开早了”“20 亿美金一夜归零” 被复读。也有人将其视为转折点——在中国创业,通过美国资本退出的终结。 这期间,曾经会从任何缝隙挤进来,争取股份的风险投资机构谨慎地保持着距离。肖弘、季逸超和张涛每日跟留在新加坡的团队打视频电话,同步进展,安排工作。 风波中,Manus 产品依然保持每周 1-2 个功能更新,跟 2025 年底的高峰相当,快过一年前。但没有大版本号变动,产品停留在 1.6,更多是功能完善,增加连接器(接入 GMail、Shopify、Slack 等全球产品)、上线客户端。一位 Manus 人士说,开发节奏如常,2.0 版本已经开发完,将在交易完全结束后再发布。 4 月 27 日,国家发改委发布决定:“对外资收购 Manus 项目作出禁止投资决定,要求当事人撤销该收购交易。”Meta 随后在发给媒体的一份声明中回应称,交易完全符合适用法律,并期待审查得到妥善解决。交易撤销(deal unwind)——通常是指,撤销已经完成的交易并尽可能恢复交易前的状态。 几天后,Meta 与 Manus 实际拆分开始。据媒体报道,两边停止了数据共享,Manus 员工也不再能访问 Meta 内部系统。 到了六七月,保持距离的投资机构开始意识到这是一个有利可图的机会。有一位投资人告诉我们,如果还有资金缺口,他们很想参与进来。 一些嗅觉敏感的 VC 和企业家开始行动,他们准备好资金,希望参与 Manus 回来之后的首轮融资。 因为在风波发生的这三个月里,Manus 收入增长了约 5 倍,从每日 30 万美元上涨至近 150 万美元,一度超过了 DeepSeek。 其间,各种传言不断。7 月,有报道称腾讯将控股 Manus。于是,Manus 北京与新加坡团队每天保持沟通,安抚情绪、稳定团队。几个月的动荡中,这家 150 人的公司无一人离职。 在北京的人有了新的生活节奏。肖弘重新学数学、研究大模型。张涛学习攀岩、练习魔方,花了半年把体重从 150 斤减到 120 斤,每天睡够 7 小时,连血压都降了下来。 这几个月重画了这家创业公司的轨迹,也让它的创业者想清楚自己到底想要什么。 回到 2025 年 12 月,Manus 正在融资,Meta 来人说想要见见核心团队,看是否有业务合作机会。几轮沟通之后,在一次核心团队全员参加的会议中,猝不及防地,Meta 当着一群人的面表明了收购意图。到这时,多位合伙人、核心技术人员已经跟随肖弘多年,经历过两次创业。卖掉公司,是对所有人的交代和回报。 收购结束后,2026 年元旦,肖弘走在新加坡海边,觉得曲折的十年旅程已经走到终点,接下来要去大公司上班了。但真正抵达这个看似圆满的终点时,他心里反而有些失落。 而在收购明确将被撤销后,外界眼中的巨大反转和打击,反而让这几位连续创业者重新有了期待:他们的创业故事进入了第二季。 据一位接近 Manus 的人士说,肖弘在团队电话会上表示,他不想旁观或回忆这个时代,而要继续置身浪潮、参与其中。否则,他只会变成一个写自传回忆当年的人。 Manus 是一个经典的科技创业故事。有 ChatGPT 之前,肖弘用了更早发布的 GPT-3 大语言模型,看到技术的可能性,拉季逸超、张涛入伙,给 GPT 做了个浏览器的壳 “Monica”。 浏览器很难让人看到下一个超级产品的可能性。一位创业者在 Manus 发布前一年见到肖弘的一位合伙人,聊到已经发布的 Monica,觉得对方颇有些不自信。 开发 Monica 期间,伴随大模型的进步,这个团队在试错中找到了超前的产品形态,让 agent 像人一样全自动工作。到 2024 年,Cursor、Copilot 乃至 ChatGPT 都还在假设人盯着屏幕,不断发提示词指挥 AI 工作。当时模型推理成本比现在高一个量级,但 Manus 已查看被引原帖 ↗
我们最新的代码模型速度快 25%,质量更好,成本仅为 6 月版本的四分之一。现在已在 GitHub Copilot 中上线 - 去试试吧。
看起来 @SpaceXAI 在追赶最前沿。
如果这个模型像基准测试显示的那样好,他们很快就能成为领先实验室...
真是 AI 竞赛中激动人心的搅局!
引用 SpaceXAI @SpaceXAIIntroducing Grok 4.6. It delivers frontier intelligence and is a significant improvement over Grok 4.5 at the same price.查看被引原帖 ↗
这影响太疯狂了
引用 Andrew Ambrosino @ajambrosinotibo查看被引原帖 ↗
👇👇👇
注意看:这就是AI发展的转折点——从威胁科技公司,变成威胁整个银行系统和经济体系。那些向来擅长把烂账打包给别人的银行,这回开始玩起"AI接盘侠"游戏了。
下面是个恐怖的长推文链
引用 Porter Stansberry @porterstansbHere's the real reason the A.I. boom is going to run out of capital. It's the same reason why rates are rising. And it's exactly why there's suddenly a mad scramble for capital in A.I. Equity values will fall as the cost of capital increases 20%-30%. But that's only the beginning👇查看被引原帖 ↗
好的,听起来 Composer 3 要来了。真的很想看评测结果
引用 Ricky Doar @rdoar4我认为Cursor没有经历过更大的一周,理由有三个。查看被引原帖 ↗
这就是我喜欢看到的研究:Google 让 Gemini 经历了一次模拟医学实习,它在临床咨询上明显变强了。
ResidencyRL 在 49,870 个模拟远程医疗对话中训练了 Gemini 3.5 Flash,覆盖 81 种疾病。
AI 患者会隐瞒症状、拒绝建议、提出不合理要求,迫使模型在长达 60 轮的对话中收集信息。
训练后,对抗性条件下诊断准确率从 81% 升到 88%,漏诊关键症状的情况下降 31%。在 97 个病例的盲测中,临床医生在 87.6% 的情况下更倾向于训练后的代理而不是基础模型。
这个改进还转移到了未见过的肿瘤学案例和外部基准上。
AI 健康代理要来了 <3
引用 Samuel Schmidgall @SRSchmidgallDoctors don't become doctors from textbooks. They become doctors through residency, requiring years of practice across thousands of patient encounters. Can AI learn the same way? Introducing ResidencyRL 🧵查看被引原帖 ↗
微信官宣了自己的模型
目前其微信里的小微助手就是由该模型驱动的
两款:
WeLM-80B
总参数量:800 亿
每次推理激活30 亿
已部署到微信原生 AI 助手小微中,可以调用微信原生功能和小程序
用户说一句话 → WeLM 理解需求 → 调用微信功能/小程序 → 帮用户完成具体操作。
WeLM-617B
总参数量:6170 亿
每次推理激活参数:230 亿
Expedia 前不久把排名模型迁移到了最先进的 Keras 3 架构。效果:训练快了 30%,推理延迟降低了 70%。
阅读他们关于此升级的文章:
medium.com/expedia-group-tec…
这篇文章有大量关于推荐服务性能优化的深度技术见解。想在超低延迟下大规模部署排名和推荐模型,必看。
“你行的,再努力点,坚持下去”这类提示词背后有个很妙的地方,这就是工程管理。
你知道结果就在眼前,所以决定投入更多时间和金钱去追。你鼓励前行。但你也需要智慧,明白自己可能是在追一个死胡同,必须调头止损。
这是Agent管理。
Google 在 Gemini Enterprise 上测试聊天和任务的新切换功能。看起来很熟悉 👀
赞,正想找个 Rust + GPUI 的代码库学习下👍
不完全是一通百通的事,这种 Harness,会越来越复杂,到后面你完全跟不上!就像 pi 这样的,现在勉强还能看得懂啃的下来,再迭代下去就像 Claude Code 的代码已经没办法看下去了。
x.com/Jackywine/status/20874…
我的 Agent Loop 启蒙就来源于 Claude Code 最早的泄漏版,那时候就几万行代码,核心代码就几百上千行,当时看到核心就是一个 While loop (就是看 LLM 结果是工具调用还是结束了)我都惊呆了,大道至简的感觉。
懂了后面就万变不离其宗了。现在动辄几十万行代码已经没法看了。
引用 EGOIST @localhost_5173Introducing ⚡Waku, a fast and native desktop app (Rust+GPUI) for all your coding agent CLIs. waku.sh is free and open source.查看被引原帖 ↗
用你对 Vercel 仪表板的批评反馈回复我们,我们会修复!
引用 wits @witsdevI lead the dashboard team at Vercel every day we ship some changes based on a feedback channel in our Slack reply here with your feature requests, bug reports, or any other feedback and I'll forward it to that channel查看被引原帖 ↗
没想到 minimax 不卷 coding 靠 video 杀回来了。真厉害。
哇!话想不到我之前的这个项目还有 fork!当时大模型太慢了,效果不太好,就搁浅了这个项目,想不到还有后续。哭死😭
引用 码妞 @niuniu_8964@yetone 还是太超前了 顺便打个广告,这是我和 @XYen0n 共同维护的 fork github.com/XYenon/smart-sugg… yetone 可以把重心放在探索下一个奇点上🫡查看被引原帖 ↗
《Build a Reasoning Model (From Scratch)》终于也在Amazon上架啦!真的要感谢所有预订的各位!
特别提醒印度的朋友们:最近千万别从@amazon India(@amazonIN)下单,他们在卖假货(黑白版)。正版这次是彩印的,还配有Manning网站的注册码。如果你在印度,我建议直接从Manning官网订购。(要是收到假货的话一定要退货啊,真的很抱歉给你添麻烦。)
这些假冒销售直接伤害了我这个独立作者的利益。而且从Amazon India收到的假货评价也会显示在全球Amazon.com页面上,这样正版的评价看起来也跟着有问题了。
根据昨天从Amazon.com收到书的读者那儿听到的反馈,Amazon.com本身应该是安全的。我自己也从Amazon.com订了一本,可以确认是正品。
如果你收到的是正版,并且已经开始看了,我真的很希望你能在Amazon.com上留个评价,哪怕就一两句。这真的很有帮助,尤其是因为Amazon India假货的评价也会显示在Amazon.com的评价页面里。谢谢大家!
这是关于2024年那本《Build a Large Language Model (From Scratch)》的澄清,不是2026年《Reasoning From Scratch》那本:2024年正版是黑白印刷。假冒版因此可能更难识别,但通常质量较低,不包含Manning注册码。
本地 AI 爆炸式增长!
我们在 @huggingface 过去三年一直在开发的 Transformers.js,现在已经成为在浏览器中直接运行 AI 模型最受欢迎的开源库,月下载量突破 1000 万(!!),比半年前增长了接近 10 倍。
更广泛地说,我很高兴看到有意义的一部分 AI 工作负载迁移到本地,因为它既免费又完全私密!在计算资源短缺和网络攻击风险增加的时代,我们比以往任何时候都需要它。
一起来!
Unitree 人形机器人
累计生产和下线数量:约 18,000🥳
仅统计仿生双足人形机器人,不包括其他人形机器人类型和轮式人形平台
当前企业 AI 领域存在一个奇怪的问题:公司花费数百万美元来集成他们的竞争对手五分钟后就能访问的同样模型。
这可能有用,但这不是护城河。
Oumi 今天推出的东西很有趣,因为它把 AI 看得不像是部署一次就算完事的软件,而更像是应该从它实际做的工作中学习的系统。
构建一个专用模型,部署它,看它在哪里失败,把那些失败转化成训练信号,改进它,再部署。
一个循环,而不是一次发布。
公司保留对所创建的模型、数据、评估和配方的访问权。甚至编码 agents 也可以通过 Oumi 的 CLI 操作工作流。
如果访问强大模型变成了商品,真正的优势将是围绕它们的学习循环。
这就是 Oumi"复合 AI 工厂"背后的大想法:公司不应该只是租用智能。他们应该积累它。
引用 Manos Koukoumidis @Koukoumidis企业AI面临矛盾困境:既要差异化竞争又租用相同模型;需求专业化却依赖通用模型;为大模型支付高价但仅用1%功能;要求控制主权却租用核心业务智能。Oumi认为下一代企业AI应由企业自建、拥有并持续改进。企业应通过自有数据与经验构建专业智能作为竞争优势,而非租用通用AI。查看被引原帖 ↗
Brad Lightcap 是 OpenAI 最重要的非技术型建设者之一,工作八年后离职创业。他 2018 年加入,建立了 OpenAI 的大部分运营体系:财务、法律、人事、安全、市场销售、政府关系和合作。作为首席运营官,他帮助把一个小型研究实验室转变成为近 10 亿用户服务的公司。今年 4 月他从首席运营官转到负责复杂交易和投资的特别项目。为什么离职?Lightcap 说他一直在思考"当 AI 进入下一阶段时世界需要做对的一些重要事情"。这是巨大的损失。祝他一切顺利!
引用 Brad Lightcap @bradlightcapOpenAI 团队成员宣布离职创业。他加入 OpenAI 已 8 年,见证公司从研究实验室发展为最具影响力的公司之一,构建了多个关键部门,服务超 10 亿用户。虽然离职,但对 OpenAI 团队能力和未来充满信心。查看被引原帖 ↗
v0 新增了侧边栏功能。• 聊天按项目分组 • 实时显示流式传输、等待和就绪状态 • 悬停卡片预览网站、已修改文件和 git 分支
ChatGPT 桌面应用现在可以预览使用了,支持以下 Linux 发行版的桌面版本:
• Ubuntu 24.04 LTS 和 26.04 LTS
• Debian 13
• Fedora 43 和 44
通过 .deb 或 .rpm 包安装,支持 x64 或 ARM64 架构。
openai.com/codex
Google I/O 大会
来中国了…
有在现场的兄弟吗?
在Google IO大会上介绍百度使用Google的技术和服务😂
一分钟快7000万,真是燃烧啊
这张地图上有个明显的遗漏👀
引用 Hassan @nutlopeAnnouncing the NYC AI Atlas! An open source 3D map of the top AI startups in New York City. nycaiatlas.com查看被引原帖 ↗
又有羊毛薅了,Manus 从 Meta 剥离以后开启了限免。
如果你之前自己买过 Manus 会员,或者是通过 Lenny's Newsletter 领过会员的话,最近可以用一用。
仅限 Manus 1.6 和 Manus Lite 两个模型
小红书发布了他们的 Read Skills Top 100 排行榜,这个有专门的页面,而且会自动更新。
结果发现,藏师傅居然有两个 Skills 在前十的位置,其中一个居然排在第二!
他们这个也挺有意思的,排名第一的居然是一个占星应用。
PPT 技巧:
github.com/op7418/guizang-pp…
社交媒体卡片技巧:
github.com/op7418/guizang-so…
新功能:ChatGPT 赠送额度 - 符合条件的用户可以购买额度作为礼物送给他人,然后分享一个一次性领取链接,收礼人可以将额度兑换到个人 ChatGPT 账户
GitHub Copilot 在 JetBrains 里现在支持 Ollama 了。
OpenAI:我们增强了 GPT-6 推理效率
GPT-6:已完全非语言化
那还费劲说话干什么呢,不说话不是更高效
AI 编码代理默认带着一些设置:用哪个模型、要花多少钱、什么数据会离开你的电脑。你可以把这些默认设置改成自己选择。
我们的新短期课程《AI Coding Workflows: From Cloud to Local》是与
@JetBrains
联合开发的,由 JetBrains 开发者倡导 @paulweveritt 讲授。你会在云端、混合模式和完全本地的环境中重建同一个应用。
过程中你会学到怎样在子代理之间分配工作、用更便宜的模型来处理日常任务,最后用在你自己机器上运行的模型来做最后的工作。
免费报名:
hubs.la/Q04sM4rQ0
本站由 Jedee杰哥 打造 · 公众号「Jedee杰哥」每早送 AI 日报
姊妹站:𝕏 简中账号数据榜单 · X 关注 @jedeeai · RSS 订阅 · AI 日报 · 历史归档