30 秒速读
- 分享8个Claude Fable 5下线前必跑的超实用Prompt
- 美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码
- Ask HN: What metrics do you track when building agents?
本日报从公开来源中筛选与独立开发者相关的模型、产品、需求和工作流变化。事实链接用于核对,价值判断是编辑分析。
今天最该知道的 10 条
分享8个Claude Fable 5下线前必跑的超实用Prompt 原文
- 具体:Claude Fable 5即将下线,作者整理了8个经实战验证的提示词:/goal提示语让模型自主跑25次实验(花费165美元,构建速度提高50%、token开销降60%);工作模式提示语将用户习惯转化为可复用Skil…。
- 价值:它的价值在于暴露了真实使用指标、成本或交付方式,适合拿来校准自己的产品卖点是否太空。
美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码 原文
- 具体:美团今日宣布 LongCat-2.0 完全开源(MIT 许可),公开模型权重与推理代码。该模型为 MoE 架构,总参数量 1.6T,每 token 激活约 48B,支持 1M token 上下文。技术亮点包括 Long…。
- 价值:独立开发者要看它是否把原来需要外挂工具、人工流程或更贵模型的能力,变成可以直接调用的基础能力。
Ask HN: What metrics do you track when building agents? 原文
- 具体:Ask HN 摘要:The main metric I look at is inference cost, which is a pretty good indicator when something’s off. (points=2…。
- 价值:它说明 agent 机会正在从聊天入口转向可交付任务、上下文记忆、工具权限和跨系统工作流,适合找一个窄任务先做端到端验证。
Tell HN: don’t trust Bigco AI agents with AI research IP 原文
- 具体:Ask HN 摘要:I am very paranoid about sharing potential AI research with e.g. (points=17, comments=6)。
- 价值:它说明 agent 机会正在从聊天入口转向可交付任务、上下文记忆、工具权限和跨系统工作流,适合找一个窄任务先做端到端验证。
diegosouzapw/OmniRoute 原文
- 具体:仓库描述:Never stop coding. Free AI gateway: one endpoint, 231+ providers (50+ free), connect Claude Code, Codex, Curs…。
- 价值:这里的机会不是再包一层模型,而是帮用户看清模型成本、路由策略、额度消耗和什么时候该降级或缓存。
alibaba/page-agent 原文
- 具体:仓库描述:JavaScript in-page GUI agent. Control web interfaces with natural language。
- 价值:它说明 agent 机会正在从聊天入口转向可交付任务、上下文记忆、工具权限和跨系统工作流,适合找一个窄任务先做端到端验证。
CircleChat 原文
- 具体:产品定位:Give your AI agents a slack, a task board, and a boss。
- 价值:它说明 agent 机会正在从聊天入口转向可交付任务、上下文记忆、工具权限和跨系统工作流,适合找一个窄任务先做端到端验证。
Termi Protocol 原文
- 具体:产品定位:Watch your AI coding agents build, live in 3D。
- 价值:它说明 agent 机会正在从聊天入口转向可交付任务、上下文记忆、工具权限和跨系统工作流,适合找一个窄任务先做端到端验证。
Claude Science的开源平替来了:openscience,给个目标就自己读文献→写代码→跑实验→出报告,整个科研循环在一个浏览器工作台里连着跑完。 跟 Claude Science 的区别是”不受制于模型”——任意模型provider 的 key均可、不用注册、BYOK 永久免费。其拥有250+ skill、约 30 个科学数据库当工具,分 biology/physics/ml 角色 agent。 它是个正经的面向科学家的科研方向开源research harness,不是套壳: 1、分角色… 原文
- 具体:following 里的原文讨论:Claude Science的开源平替来了:openscience,给个目标就自己读文献→写代码→跑实验→出报告,整个科研循环在一个浏览器工作台里连着跑完。 跟 Claude Science 的区别是”不受制于模型”—…。
- 价值:它说明 agent 机会正在从聊天入口转向可交付任务、上下文记忆、工具权限和跨系统工作流,适合找一个窄任务先做端到端验证。
这个工作流需要研究下 用codex做视频还省token 原文
- 具体:following 里的原文讨论:这个工作流需要研究下 用codex做视频还省token。
- 价值:这里的机会不是再包一层模型,而是帮用户看清模型成本、路由策略、额度消耗和什么时候该降级或缓存。
大模型榜单异动
今天监控的模型榜单没有 major_surge 或 watch 级别异动。这说明今天不适合只因为榜单排名更换默认模型,但仍应保留当前快照,等待 3 天和 7 天趋势。
值得注意的新产品、新方向、新模型
分享8个Claude Fable 5下线前必跑的超实用Prompt
- 具体:Claude Fable 5即将下线,作者整理了8个经实战验证的提示词:/goal提示语让模型自主跑25次实验(花费165美元,构建速度提高50%、token开销降60%);工作模式提示语将用户习惯转化为可复用Skil…。
- 价值:它的价值在于暴露了真实使用指标、成本或交付方式,适合拿来校准自己的产品卖点是否太空。
美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码
- 具体:美团今日宣布 LongCat-2.0 完全开源(MIT 许可),公开模型权重与推理代码。该模型为 MoE 架构,总参数量 1.6T,每 token 激活约 48B,支持 1M token 上下文。技术亮点包括 Long…。
- 价值:独立开发者要看它是否把原来需要外挂工具、人工流程或更贵模型的能力,变成可以直接调用的基础能力。
Anthropic Claude Design 反向工程提示词开源更新
- 具体:Anthropic 旗下 Claude Design 的反向工程系统提示词在 GitHub 以 MIT 许可证开源,包含 20 章提示词和 14 项技能,覆盖内容纪律、美学、无障碍(WCAG、语义 HTML、键盘导航)…。
- 价值:它的价值在于暴露了真实使用指标、成本或交付方式,适合拿来校准自己的产品卖点是否太空。
未被满足的需求
模型调用越来越重,用户需要知道哪里浪费 token、哪里应该降级模型或缓存结果。
- 信号:来自 The Decoder:AI News(RSS) 的“26000名学生研究显示AI隐藏学习成本需两年才显现”。一项追踪26000名7-12年级中学生30个月的面板数据研究发现:使用AI后作业分数提升18%,完成时间从64分钟降至45分钟,但闭卷考试分数下降20%,升学考试成绩下降18%至24%,且完全影响约两年才显现。81%长…。
@ModengSir 背后的具体信号是:给土区ID买个礼品卡, 目前看不会涨价,防止过几天扣费忘记 先给codex续上这个月的订阅 https://t.co/rJPB8qkaiV。可以先做诊断、对比或工作流模板,而不是完整平台。
- 信号:来自 following 的“@ModengSir”。following 里的原文讨论:给土区ID买个礼品卡, 目前看不会涨价,防止过几天扣费忘记 先给codex续上这个月的订阅 https://t.co/rJPB8qkaiV。
模型调用越来越重,用户需要知道哪里浪费 token、哪里应该降级模型或缓存结果。
- 信号:来自 following 的“@landiantech”。following 里的原文讨论:英特尔悄然提高 Intel Core Ultra 200S Plus 系列处理器建议零售价,最高涨价 50 美元。例如 24 核 24 线程的 270K Plus 在 3 月发售时建议零售价是 299 美元,现在已经涨…。
如果今天只有两个小时
做一个“AI 成本体检器”:围绕一个具体任务跑通采集、截图或日志分析,输出哪里失败、哪里费钱、哪里需要人工返工。先解决这个问题:模型调用越来越重,用户需要知道哪里浪费 token、哪里应该降级模型或缓存结果。第一批用户去 HN 讨论串、X 上的 coding agent 用户和独立开发者社群找。
原始信息
以下公开来源链接用于核对本期事实;来源收集数量保留为编辑透明度说明。本次采集:AI HOT 精选 12 条,AI 新闻 31 条,GitHub 趋势 57 条,Product Hunt 37 条,X 43 条。
- 分享8个Claude Fable 5下线前必跑的超实用Prompt
- 美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码
- Ask HN: What metrics do you track when building agents?
- Tell HN: don’t trust Bigco AI agents with AI research IP
- diegosouzapw/OmniRoute
- alibaba/page-agent
- CircleChat
- Termi Protocol
- Claude Science的开源平替来了:openscience,给个目标就自己读文献→写代码→跑实验→出报告,整个科研循环在一个浏览器工作台里连着跑完。 跟 Claude Science 的区别是”不受制于模型”——任意模型provider 的 key均可、不用注册、BYOK 永久免费。其拥有250+ skill、约 30 个科学数据库当工具,分 biology/physics/ml 角色 agent。 它是个正经的面向科学家的科研方向开源research harness,不是套壳: 1、分角色…
- 这个工作流需要研究下 用codex做视频还省token
- Anthropic Claude Design 反向工程提示词开源更新
- NVIDIA 联合多所大学提出 ASPIRE:自我改进机器人框架,零样本成功率最高提升 77 分
- LlamaIndex 发布 legal-kb:基于 Index v2 的智能体检索参考应用
- 扎克伯格:建千兆瓦级AI集群,集中精英与资本
- 26000名学生研究显示AI隐藏学习成本需两年才显现
- NVIDIA Kyber NVL144 延迟超 12 个月至 2028
- 我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片
- SK 海力士将启动 280 亿美元美股上市,有望成史上第二大 IPO
- 三周前,我不小心创办了一家小公司
- 欧盟理事会通过快速通道强制推行”聊天管控”(Chat Control 2.0)
- asgeirtj/system_prompts_leaks
- can1357/oh-my-pi
- ogulcancelik/herdr
- oomol-lab/open-connector
- michaelshimeles/boring-computers
- alirezarezvani/claude-skills
- usestrix/strix
- coreyhaines31/marketingskills
- backnotprop/plannotator
- ChromeDevTools/chrome-devtools-mcp
- OthmanAdi/planning-with-files
- Leonxlnx/taste-skill
- ai-boost/awesome-harness-engineering
- JuliusBrussee/caveman
- openai/codex-plugin-cc
- hesreallyhim/awesome-claude-code
- ansible/ansible
- google-antigravity/antigravity-sdk-python
- 7-e1even/learn-agent
- ai4s-research/open-science
