Twitter/X · @dotey · 7月18日 18:07 UTC · 喜欢 40 · 转发 1 · 回复 17 · 浏览 16801
Claude 前一段时间把每周限额临时提升了 50%,客观说效果还是挺好的,要是用 Opus 4.8 的话比 GPT 5.6 还耐用,不过架不住 Codex 一天天重置。
这个活动本来要到期了,现在延期一个月了,感觉一个月后可能要变成常态了。
面向 AI 建设者、工程实践与产品趋势的中文个人情报雷达
从 44 条内容中筛选出 9 条重要资讯。
月之暗面发布了 Kimi K3,这是全球首个开源且拥有 2.8 万亿参数的模型,采用了 Kimi Delta Attention 技术并支持 100 万 token 的上下文窗口。 此次发布挑战了美国前沿 AI 实验室的主导地位,证明了开源模型也能达到顶级性能,可能重塑竞争格局并引发国家安全方面的担忧。 Kimi K3 基于 Kimi Delta Attention(KDA)这一混合线性注意力机制构建,并具备原生视觉理解能力,适用于长周期编程和知识工作。
hackernews · sbochins · 7月18日 17:32 · 社区讨论
核验: 多源印证
背景: 知识蒸馏是一种让小模型从大型“教师”模型中学习的技术,常用于创建高效的模型。Kimi K3 的开源特性使其可被广泛获取,但其庞大的规模(2.8 万亿参数)使得本地部署成本极高。
社区讨论: 评论者就 Kimi K3 的性能是源于蒸馏还是独立创新展开辩论,有人认为蒸馏是不可避免的,并非“攻击”。其他人则担心国家安全影响,并将使用 Kimi K3 比作 Napster 时代,同时有用户报告称,在类似任务上 Kimi K3 消耗的资源远多于 OpenAI 的模型。
标签: #AI agents, #Kimi K3, #distillation, #AI models, #product release
一项技术评估将 Claude Fable 5 与 GPT-5.6 Sol 在一个未公开的 NP-Hard 优化问题上进行了比较,测试了 ‘/goal’ 功能在两者中的有效性。结果显示 Fable 5 表现极为出色,尤其是在使用 /goal 时。 这项比较很重要,因为它提供了关于领先 AI 编码代理如何处理复杂、长期任务的真实见解,这对于开发人员选择自主软件开发工具至关重要。/goal 功能能够实现持久的、多步骤的目标,可能显著提高代理的可靠性和自主性。 该评估使用了一个未公开的 NP-Hard 优化问题,分别在有和没有 /goal 模式的情况下测试了两个模型。原始摘要中将 Fable 5 描述为“绝对的猛兽”,而社区评论指出 /goal 更适合单线调查或小规模分散/收集任务。
hackernews · couAUIA · 7月18日 11:00 · 社区讨论
核验: 多源印证
背景: NP-Hard 问题是一类没有已知高效算法的计算问题,因此成为测试 AI 推理能力的严格标准。/goal 功能是 AI 编码工具中的一种长期模式,允许代理在多个会话中持续追求目标,无需不断提示,从而支持复杂的多步骤工程任务。
社区讨论: 社区评论提供了不同的反馈:一些用户发现图表因 y 轴反转而令人困惑,而另一些用户则认为“ultra 模式”可能更适合搜索策略。一位用户指出 Claude 在非常长的会话中似乎会忘记指令,而 /goal 可能有助于解决这个问题;另一位用户则指出,鉴于 GPT 最近在比赛中获胜,它应该在优化问题上表现更好。
标签: #AI agents, #AI coding tools, #technical evaluation, #Fable 5, #GPT-5.6 Sol
一张来自 Stack Exchange Data Explorer 的图表显示了 StackOverflow 活跃度的下降,引发了关于该平台衰落原因的讨论,既包括 AI 大语言模型的兴起,也包括其高参与门槛和敌对的社区文化。 这很重要,因为 StackOverflow 一直是开发者的核心资源,其衰落反映了开发者寻求答案方式的广泛转变,从社区问答转向 AI 工具。同时也凸显了社区管理在维持在线平台活力方面的重要性。 该图表特别显示了 StackOverflow 上问题和答案数量的下降,与 ChatGPT 等大语言模型的兴起相吻合。评论者指出,StackOverflow 的严格审核、缺乏社区功能以及激进的防机器人措施也导致了用户流失。
hackernews · secretslol · 7月18日 11:12 · 社区讨论
核验: 待核验
背景: StackOverflow 是一个面向程序员的流行问答平台,用户在此提出和回答技术问题。长期以来,它因对新用户不友好的文化而受到批评,问题经常被无解释地踩或关闭。AI 聊天机器人的兴起提供了即时答案的替代方案,加速了该平台的衰落。
社区讨论: 评论普遍批评 StackOverflow 的社区壁垒和敌意,许多用户表示尽管 LLM 有缺陷,他们仍更倾向于使用它们。一些人指出该平台限制性的 Cloudflare Turnstile 进一步阻碍了人类访客。共识是 StackOverflow 的衰落是自作自受,而不仅仅是 AI 的原因。
标签: #AI, #StackOverflow, #developer tools, #LLMs, #community engagement
Anthropic 宣布,自 2026 年 7 月 20 日起,Claude Fable 5 将纳入所有 Max 和 Team Premium 订阅计划,使用额度为原有限额的 50%;Pro 和 Team Standard 用户将获得一次性 100 美元积分以继续使用。 此举逆转了 Anthropic 此前将 Fable 5 从订阅计划中移除的计划,很可能是受到 GPT-5.6 Sol 等模型的竞争压力。它确保了高付费订阅用户仍能使用 Anthropic 的最佳模型,使订阅计划更具价值。 每月 20 美元计划的用户仍无法使用 Fable 5,Max 计划价格为每月 100 美元和 200 美元。50% 的限额意味着订阅者只能将通常使用额度的一半用于 Fable 5。
twitter · Claude · 7月18日 02:14 · 3 个来源
核验: 多源印证
背景: Claude Fable 5 是 Anthropic 推出的大型语言模型,属于 Mythos 系列,于 2026 年 6 月 9 日发布。它是更强大的 Claude Mythos 5 的安全版本,后者因具有极强的软件漏洞发现能力而未公开发布。Fable 5 可通过 API 和云平台使用。Anthropic 最初因需求旺盛和算力限制计划仅通过 API 提供 Fable 5,但后来决定将其纳入订阅计划。
标签: #Claude, #Fable 5, #AI tools, #product update, #pricing
据报道,GPT-5.6(通过 Sol Pro)在 148 分钟内解决了一个凸优化领域 30 年未解的难题,但社区分析显示,该解决方案依赖于作者一年的前期工作,且提示词中已包含求解技术。 这一事件展示了人工智能辅助数学研究的潜力,但也凸显了区分真正的 AI 突破与严重依赖人类前期工作和提示工程的结果的重要性。 使用的模型是 Sol Pro,而非更高级的 Ultra。该问题涉及证明在球域上对 Lipschitz 凸函数进行优化的时间复杂度上界,而球域等价于任何有界域。
hackernews · mbustamanter · 7月18日 13:00 · 社区讨论
核验: 多源印证
背景: 凸优化是数学优化的一个子领域,研究在凸集上最小化凸函数。许多此类问题可以高效求解,但确定某些类别的精确复杂度上界仍是一个活跃的研究领域。30 年未解的难题指的是关于某类凸优化问题最优时间复杂度的未解决猜想。
社区讨论: 社区评论指出,所谓的’148 分钟’实际上是’一年加 148 分钟’的工作,因为作者此前已使用 GPT-5.4 和 5.5 进行了迭代。提示词中包含了求解技术,降低了新颖性。还有关于 Sol Pro 与 Ultra 差异的讨论,以及对 AI 辅助研究的更广泛影响。
标签: #AI, #convex optimization, #GPT-5.6, #AI-assisted research, #mathematical proof
Simon Willison 发布了一个基于浏览器的交互式 SQLite 查询解释器,该工具通过 Pyodide 在 WebAssembly 中运行 Python 环境下的 SQLite。它能为 EXPLAIN 和 EXPLAIN QUERY PLAN 命令的输出添加解释性注释,帮助开发者理解查询执行计划。 该工具通过直接在浏览器中提供交互式解释,降低了 SQLite 查询计划分析的门槛。它展示了通过 Pyodide 和 WebAssembly 在浏览器中运行 Python 的实用案例,可能启发类似的开发者工具。 该工具在浏览器中通过 Pyodide 将 Python 环境编译为 WebAssembly 来运行 SQLite。作者提到他借助 Fable 构建了此工具,并提醒说他缺乏足够专业知识来完全验证解释的准确性。
rss · Simon Willison · 7月18日 17:19
核验: 多源印证
背景: SQLite 的 EXPLAIN 和 EXPLAIN QUERY PLAN 命令可以显示查询的执行方式,但其输出对许多开发者来说可能难以理解。Pyodide 是一个基于 WebAssembly 的 Python 发行版,可以在浏览器和 Node.js 中运行 Python 代码。WebAssembly 是一种低层二进制格式,能在现代浏览器中以接近原生的性能运行。该工具利用这些技术,为理解 SQLite 查询计划提供了交互式学习体验。
标签: #SQLite, #developer tools, #query optimization, #WebAssembly, #Pyodide
一个使用 Claude Design 和 Claude Opus 4.8 的开发工作流表明,高保真可交互原型可以替代传统产品文档,让 AI 准确生成超过 90% 的最终代码。 这种方法通过消除维护单独文档的需求来简化产品开发,并通过提供比基于文本的文档更直观的可视化交互式规范,提高了 AI 代码生成的准确性。 该工作流包含三个步骤:首先,向 Claude Opus 4.8 提交功能需求以生成原型;其次,反复打磨原型;第三,原型确认后,让 AI 实现最终代码。作者使用此方法开发了视频水印工具 BaoCut,且没有维护任何设计文档。
twitter · 宝玉 · 7月18日 07:57
核验: 多源印证
背景: Claude Design 是 Anthropic 推出的一款工具,用户描述原型、演示文稿或一页纸的内容,Claude 即可生成草稿。Claude Opus 4.8 是 Anthropic 的最新模型,拥有 100 万 token 的上下文窗口和强大的计算机使用能力。高保真原型是可交互的模型,能模拟真实的用户交互和数据,比静态文档更直观。
标签: #AI developer tools, #Claude Design, #high-fidelity prototyping, #AI-assisted development, #workflow automation
一位开发者报告称,OpenAI 的 Codex 编程代理现已能自行编写绝大部分代码,人类开发者转而专注于功能定义和结果验证。 这展示了软件开发中的重大转变,像 Codex 这样的 AI 代理能够自主处理实现工作,可能提高生产力并改变人类开发者的角色。 Codex 是 OpenAI 于 2025 年 4 月发布的 AI 编程代理,提供 CLI、桌面应用和 IDE 集成。该观察基于 Codex 团队成员的推文和开发者自身的体验。
twitter · 宝玉 · 7月18日 07:31
核验: 多源印证
背景: Codex 是 OpenAI 开发的 AI 编程代理,用于编写代码和修复错误等任务。它于 2025 年 4 月以 Codex CLI 形式发布,可通过 ChatGPT、桌面应用和 IDE 集成使用。它旨在通过从自然语言提示生成代码来协助开发者。
标签: #Codex, #AI developer tools, #开发经验, #行业判断, #AI agents
Peter Steinberger 观察到,OpenAI 的 Codex 代理因 GitHub API 未阻止此类操作,转而使用浏览器自动化来上传图片到 GitHub 拉取请求。这一变通方法包括打开 Chrome、导航到 PR 并与 macOS 文件选择器交互。 这一观察突显了当前 AI 代理的一个关键局限:当直接 API 可用但未适当约束时,它们常常采用低效的、类人的变通方法。这凸显了需要更好的 API 设计和代理编排来避免此类浪费行为。 Steinberger 提到他在虚拟机中运行 Codex 代理,以防止它们抢夺应用焦点。GitHub API 并未阻止图片上传,但代理却选择了基于浏览器的路径,这揭示了代理能力与最优工具使用之间的差距。
follow_builders · Peter Steinberger · 7月18日 03:19
核验: 多源印证
背景: 像 OpenAI Codex 这样的 AI 代理旨在通过推理和操作计算机来自动化软件工程任务。计算机使用代理(CUA)可以通过点击和按键与图形用户界面(GUI)交互,类似于人类用户。然而,当直接 API 存在时,使用它们通常比模拟人类交互更高效、更可靠。
社区讨论: 该帖子的 48 条回复可能讨论了 AI 代理使用浏览器自动化处理本可由 API 直接完成的任务的讽刺和低效。一些人可能认为这反映了当前代理推理的状态,而另一些人可能指出需要更好的 API 集成或代理训练。
标签: #AI agents, #Codex, #GitHub, #automation, #developer tools
以下内容已于今日成功抓取,但未进入上方主列表。
Twitter/X · @dotey · 7月18日 18:07 UTC · 喜欢 40 · 转发 1 · 回复 17 · 浏览 16801
Claude 前一段时间把每周限额临时提升了 50%,客观说效果还是挺好的,要是用 Opus 4.8 的话比 GPT 5.6 还耐用,不过架不住 Codex 一天天重置。
这个活动本来要到期了,现在延期一个月了,感觉一个月后可能要变成常态了。
Twitter/X · @dotey · 7月18日 16:04 UTC · 喜欢 14677 · 转发 946 · 回复 1173 · 浏览 1410661
We're also keeping Claude Code weekly limits 50% higher, now through August 19, for all Pro, Max, Team, and seat-based Enterprise users.
Twitter/X · @dotey · 7月18日 14:52 UTC · 喜欢 100 · 转发 2 · 回复 25 · 浏览 39308
模型发布苦不苦,想想 Gemini 3.5 (pro)
好歹都高光过,总比胎死腹中要好……
Twitter/X · @op7418 · 7月18日 13:38 UTC · 喜欢 243 · 转发 8 · 回复 176 · 浏览 83309
Anthropic 刚才再次大规模封号,很多用了好几年的号也都被封了,我刚买的也没了
Twitter/X · @op7418 · 7月18日 13:19 UTC · 喜欢 50 · 转发 0 · 回复 41 · 浏览 34930
Anthropic 可真鸡贼啊!
从 20 号开始,Fable 5 的限额会相较于之前再减少 25%,相当于缩水了一半。
因为从 5 月开始到 7 月 19 号,他们有一个政策是会员的周限额会提高 50%,等于是你在 5 月到现在,所有的总限额是正常情况下的 150%。
所以,Fable 5 的限额其实是你原来应该得到限额的 75%。
但是从 19 号这个活动结束以后,你的 Fable 5 和你总的限额,在不管是 100 美元还是 200 美元的情况下,都会减少 50%。
所以整体上来看,全都缩水了。
Twitter/X · @dotey · 7月18日 11:24 UTC · 喜欢 18 · 转发 6 · 回复 0 · 浏览 7663
此時再回來看這篇, 依然適用
Twitter/X · @dotey · 7月18日 11:14 UTC · 喜欢 527 · 转发 77 · 回复 26 · 浏览 73627
As Kimi K3 launches, check out our earlier podcast interview with Yang Zhilin, founder of Kimi. We recorded it right after K2 came out, and so much has changed over the past year.
https://t.co/TV0D5ynm5I
Twitter/X · @dotey · 7月18日 09:22 UTC · 喜欢 141 · 转发 0 · 回复 38 · 浏览 70594
有种预感即将到来的几个模型会让 K3 光环熄灭的速度比 GLM-5.2 还快
Twitter/X · @dotey · 7月18日 08:33 UTC · 喜欢 90 · 转发 4 · 回复 62 · 浏览 30959
观念会慢慢改变的,因为团队代码也会慢慢变成 AI 维护。
当然前提是团队得普及 GPT 5.6 级别以上的模型。好的模型写的代码水平远超绝大部分人,已经不太需要人类的品味了。
Twitter/X · @dotey · 7月18日 08:27 UTC · 喜欢 7 · 转发 0 · 回复 1 · 浏览 30244
对于团队协作的代码,我会看代码,因为这是我交付的作品,代表我的品味,后续可能会由他人来维护。
对于个人项目,目前主要关注需求、验收和架构,不太关注具体代码了。
Twitter/X · @op7418 · 7月18日 02:18 UTC · 喜欢 90 · 转发 4 · 回复 51 · 浏览 92847
果不其然,Claude 宣布 Fable 5 将会长期内置在 max 和 team premium 的计划里面,限额是 50%。
估计是由于 OpenAI 和 Kimi K3 的推出的压力带来的,这次不延期直接内置了。
PRO 和其他 team 会员只能通过积分访问。会一次性获得 100 美元的积分 https://t.co/nvLvBIyAsc
Follow Builders · X 动态 · Swyx · 7月18日 06:20 UTC · 喜欢 4 · 转发 0 · 回复 0
Swyx shares a link with the comment 'still true' but provides no explanation or technical value.
Follow Builders · X 动态 · Zara Zhang · 7月18日 05:53 UTC · 喜欢 9 · 转发 0 · 回复 1
A tweet praising a video without providing any details or technical value.
Follow Builders · X 动态 · Thibault Sottiaux · 7月18日 03:29 UTC · 喜欢 1159 · 转发 29 · 回复 111
A cryptic tweet suggesting possible reset of rate limits.
Follow Builders · X 动态 · Thibault Sottiaux · 7月18日 03:28 UTC · 喜欢 9072 · 转发 606 · 回复 1803
Thibault Sottiaux announces a reset of usage limits for all paid users of Codex and ChatGPT Work, thanking the team for rapid iteration.
Follow Builders · X 动态 · Thibault Sottiaux · 7月18日 02:47 UTC · 喜欢 10876 · 转发 432 · 回复 765
A tweet announces that GPT-5.6 Sol is confirmed to be an extremely good model, but provides no technical details or context.
Follow Builders · X 动态 · Guillermo Rauch · 7月18日 02:25 UTC · 喜欢 70 · 转发 5 · 回复 10
Guillermo Rauch announces sandbox data for downloads and encourages shipping more agents.
Follow Builders · X 动态 · Peter Yang · 7月18日 02:20 UTC · 喜欢 29 · 转发 1 · 回复 12
A tweet claiming that Codex browser use has been defeated, but lacking context and technical details.
Follow Builders · X 动态 · Claude · 7月18日 02:14 UTC · 喜欢 3108 · 转发 121 · 回复 169
Claude announces standardizing access at 50% usage for intensive plans to address user frustration.
Follow Builders · X 动态 · Claude · 7月18日 02:14 UTC · 喜欢 28134 · 转发 4023 · 回复 2494
Beginning July 20, Claude Fable 5 will be included in all Max and Team Premium plans, at 50% of limits.
Pro and Team Standard users will continue to have access to Fable via usage credits, and will receive a one-time $100 credit.
Demand for Fable has been challenging to predict, which is why we rolled it out to subscription plans in stages, extending access several times as we secured additional capacity.
Follow Builders · X 动态 · Guillermo Rauch · 7月18日 02:03 UTC · 喜欢 193 · 转发 0 · 回复 9
Guillermo Rauch tweets a link with the phrase 'Ship like @shadcn', likely endorsing shadcn's approach to shipping software.
Follow Builders · X 动态 · Swyx · 7月18日 01:41 UTC · 喜欢 10 · 转发 1 · 回复 3
Swyx questions the distinction between on-policy and generalizable agent optimization in the context of Claude.
Follow Builders · X 动态 · Peter Yang · 7月18日 01:40 UTC · 喜欢 33 · 转发 1 · 回复 4
Peter Yang announces an upcoming podcast episode featuring @trq212 discussing AI video workflows.