AI Product Founder · Building in Public Raphael https://t.co/tJOiC33sAI AnyVoice https://t.co/MQkmOW2lbu Fast3D https://t.co/6m3JO8jJvc

公众号停更十天干货。(可能会加更毫无干货的避暑图片)一个冷知识:地处非洲且横跨赤道的肯尼亚温度在10℃~25℃之间,妥妥的避暑胜地祝大家暑假愉快
哎哟,有意思!支持。
昨晚DeepSeek Harness 发布了 我们把官方 DeepSeek Harness 打包成了一个开箱即用的桌面应用 不需要安装 Node.js,也不用再通过命令行启动 目前支持: macOS Apple Silicon Windows x64 本地运行 自动管理 Harness 服务 保留官方插件能力和 Web UI GitHub:https://github.com/anywhere-labs/deepseek-harness-desktop
来复习一下 我在一个月前的预测。当时,很多人不信。现在看看? 恭喜 Qwen 3.8、GLM 5.3 !
预测: 一个月内,中国模型将大爆发,全面超过Opus 4.8 ! 包括并不限于以下厂商的很快会发布的模型 - Kimi K3 ,已发布 - Qwen 3.8, 一周内发布 - Minimax 下一代, 一月内发布 - Deepseek v4 Pro Max ,一周内发布 - GLM 5.3/5.5,一个月内发布 很快,就算Claude Code封号,我们也不怕了!
View quoted post再加一条 GLM 5.3 >> DeepSeek V4 Pro 0813
说一个很多人没注意到的事实: Gemini Flash 3.7 > DeepSeek V4 Pro 0813 包括并不限于:速度、代码能力、审美、多模态能力
这个不能称之为证据啊,你可以点进去看一看。这个文件夹是为了方便 Claude Code 能够使用DHS 内置的 skill。这是有意为之的,挺好的设计。
我原本预测Codex会在8月14日重置,因为8月13日大家的重置卡过期。 我预测失败了。因为,我完全没想到, @thsottiaux 老师比我以为的还要更腹黑:他竟然选择在8月13日当天重置,这比在8月14日重置更省钱。 👍
一个非常合理的猜测:codex下次重置时间是8月14日。 原因:7月codex赠送大家的banked resets,如果你还没使用,将会在是8月13日过期,也就是说,大家一定会在8月13日使用。 @thsottiaux 如果在8月14日选择对所有人重置codex,实际付出的成本最低、又能延续了“codex会将重置狂欢延续下去”的童话。
View quoted postDeepSeek Harness 在开发时候明显使用了Claude Code (看截图,你肯定懂),并且在新版本抹去了痕迹。 https://github.com/deepseek-ai/deepseek-harness/blob/39b3db4b9cc3668cf4ce285f8d262978fe720efc/.agents/skills/dsh-code-review/SKILL.md?plain=1#L28 真诚发问: 1. 既然DeepSeek Harness这么好,为什么你们要用Claude Code呢? 2.用Claude Code,大方承认不好吗,为何要欲盖弥彰地抹去痕迹呢?
昨天,我打算一个产品的集群部署。 大概任务是:从现有的单机部署变成集群部署、不能丢线上用户的数据、保证以后上线新版本的时候可以“不停机升级”等等。 我自己并不掌握太多集群部署的经验和技能,只有理论知识。 我先用Codex (GPT-5.6-Sol Max) ,说清楚要求后,它从昨天下午18:00工作到今天14:00,整整20个小时,没搞定。因为中途它一直觉得自己弄好了,然后尝试打包、部署,然后出错,读日志后发现问题,继续修,然后再去部署,又出错…… 周而复始。 14:00,我叫Codex别弄了,写个交接文档。 然后我用Fable 5读取交接文档, 1小时后,完全做好了。 仔细研究了一下为什么:发现是Fable 5的1M上下文立功了。这件任务的链条太长,GPT-5.6-Sol老是压缩,无法把整个链条串起来。
李老师所言甚是!
@bourneliu66 @thsottiaux 这个推断框架本身就是平台运营的底层账:补贴最划算的时刻,是用户行为已经自发集中的时刻。平台发的从来不是福利,是在买行为峰值。我在平台方做过,每个宠粉动作背后都是一张成本测算表。
View quoted post家人们,可能有反转: 虽然绝大多数人说新版更好看,但是,我上线测试的这段时间,发现每天的收入情况跌了很多!! 这是什么原因?
明确表示喜欢新版(左):10人 明确表示喜欢旧版(右):5人 谢谢大家!我正式发布新版了!
我学生的产品,谢谢大家支持!
🎁 转发 + 评论,免费领取 SiteData Pro 和 2000 API Credits! 如果你平时会做 SEO、网站分析、Google Ads、AI Agent 或竞品研究,推荐试试 SiteData。 SiteData 不只是一个网站流量查询工具。 它整合了网站流量、Google
View quoted post我看评论区才发现,已经很多人用上了!!补充几个其他朋友的截图
最近,我已经习惯不直接使用电脑了。 无论在哪儿,我都只需要一台手机(或者iPad),同时操作4台电脑上的Agent (Claude Code和Codex)。 - 看不清怎么办? —— 需要我验收和做决策的时候,放大即可 - 需要打字怎么办? —— 语音输入 99%不看屏幕,无论是手机还是电脑! 是自由的滋味!

Codex 当产品经理和 QA,ChatGPT Pro 当高级程序员:一套真正闭环的双 Agent 编程工作流
Vibes are strong. Never seen the Codex reset crowd more focused and humming. Please press the reset button. @thsottiaux
原本这只是我编的一个段子,没想到美国政府真的在认真的评估Kimi K3是否蒸馏了Fable 5 ?? 有点脑子好不好,如何靠蒸馏获得一个比原版更强的模型呢?
🚨 BREAKING: Anthropic CEO Dario Amodei 向美国国会提交报告: “经过调查,我们发现 Kimi K3 可能蒸馏了一个 Anthropic 尚未开发完成的模型。” 国会议员追问:“你们的模型还没做出来,它怎么蒸馏的?” Amodei:“这正是我们召开听证会的原因。” AI 安全领域迎来新课题:Future Model Leakage
View quoted post
不眠不休的连续、深度、大量使用GPT-5.6和Fable 5整整3天,每天消耗的Token都在50亿以上(图2)不过,可能是因为GPT-5.6使用的缓存Token虚高,如果排除缓存来看,我两者每天都只使用了2亿Token而已。下面是我的感受1. 整体而言,Fable 5的比GPT-5.6更好。它更像一个患有ADHD的CEO,思路广,主动性强,干活利索,但是没啥耐性。2. 狭义的「写代码」能力,GPT-5.6更强。有耐性,一丝不苟,哪怕是做最简单的活,(如果你打开Ultra档位的话),它也可以花很多精力很多时间来完成。 任何代码都能一次写完,当然,审美另说。 GPT-5.6 适合做CTO。3. 模型评测不能只看「一次任务谁写得最好」,还要看「一小时能交付多少可接受的代码」。虽然GPT-5.6在各种测评集上霸榜,但是在Agent类产品里的表现(类似Manus、Genspark那样的),GPT-5.6完全无法和Fable 5抗衡,无论是质量、审美、完成速度上,工具越多,差距越明显。 说来非常奇怪,在任何权威榜单上,Fable 5都打不过GPT-5.6,实际使用手感却正好相反。也许我们需要更好的榜单了。4. Fable 5真正领先的,不一定是能力上限,而是「第一次就更接近正确答案」。 它会更早发现架构问题,前端审美也明显更好,因此需要纠正、返工的轮数更少。GPT-5.6可能最终也能做到,但中间更容易经历“实现—审查—推倒重来”。所以Fable 5贵,但在人的时间更贵时,它反而可能更便宜5. 更好的组合:让Fable 5只出现在一个功能的「两端」。 开始时让它做产品定义、架构、交互和高保真原型;中间大量实现交给GPT-5.6;最后再让Fable 5做一次有明确边界的Polish与QA。6. GPT-5.6过去一周至少重置了4次,并且刚才宣布临时取消了5小时限额! 我想,GPT-5.6最大的作用,是给我们的Fable 5续命。Anthropic原计划再7也要7日就要收回Claude Max套餐内免费使用Fable 5的权限,后来延期到7月12日,刚才又宣布延期到7月19日,并且免费提高了50%的使用额度。7. 大模型就是一个海鲜生意,打捞起来的一两周内卖不掉,就再也卖不掉了。 例如,GLM-5.2才牛逼了一两周而已,已经快被遗忘了,本周老外无论是谁(Meta、xAI、OpenAI、Anthropic)的新模型,都足以让你彻底忘记GLM-5.2。 8. 市场竞争真好!衷心祝愿各大模型厂商尤其是国产模型厂商,尽快打捞出来更好的海鲜。希望我能每天消耗50亿国产模型Token的那天早日到来。感谢这个伟大的时代!欢迎评论区讨论,说说你的感受。

GPT-5.6已经发布!1. GPT-5.6有至少四个版本,Sol Ultra、Sol、Terra、Luna,未来很可能还会有其他版本。 其中,Sol Ultra和Sol,显著超过了Anthropic的Mythos/Fable 5。2. GPT-5.6 Sol 在 Terminal-Bench 2.1 创下新的 SOTA(State of the Art) 成为该基准测试历史最佳成绩。3. OpenAI号称GPT-5.6是“目前最强的网络安全模型”(Cybersecurity模型)。 4. 难能的贵的是:GPT-5.6推理效率相当高。使用GPT-5.6 Sol ,不到100K token就超过Opus 4.7需要200K的智能。对了,顺便提一句,目前国产模型的推理效率较低,要达到和Opus 4.6~4.7同样的智能水平,GLM 5.2往往需要使用超过其2倍甚至3倍的Token。5. OpenAI官方表示在正式上线前进行了数周的安全加固(Hardening)。6. 价格屠夫。无论是ChatGPT-5.6的哪个版本,即便是最强的ChatGPT-5.6 Sol,也比Anthropic的Opus/Fable模型便宜很多。ChatGPT-5.6 Luna更是白菜价,价格简直可以和国产模型媲美。7. 普通人暂时还用不上,美国商务部长亲自给Sam打电话,要求暂时只能给非常有限、经过美国政府审核过的客户先试用。 不过,Sam表示有信心在“未来数周内”让广大用户使用。