跳到正文
AI Dayline · AI 独立开发者日报
← 全部专题

TOPIC

AI 模型

按日期倒序浏览相关日报。

共 81 期 · 本页 12 期

AI 模型Agent 与开发工具

AI 日报:OpenAI 发布 GPT-5.6 系列医疗评估结果

OpenAI 称 GPT-5.6 Luna 在最低推理强度下超过最高推理强度的 GPT-5.5,成本低 25 倍;GPT-5.6 Sol 树立医疗任务新标杆。评估覆盖患者端和临床端任务,共 20000 次医生盲评。

AI 模型Agent 与开发工具

AI 日报:GPT-5.6 系列模型发布:Sol、Terra、Luna

OpenAI 把 GPT-5.6 分成 Sol、Terra、Luna 三档。Sol 在 Agents' Last Exam 得 53.6 分,Coding Agent Index 得 80 分;Terra 和 Luna 主打低成本,资料称约十六分之一成本超过 Fable 5。

AI 模型Agent 与开发工具

AI 日报:分享8个Claude Fable 5下线前必跑的超实用Prompt

Claude Fable 5即将下线,作者整理了8个经实战验证的提示词:/goal提示语让模型自主跑25次实验(花费165美元,构建速度提高50%、token开销降60%);工作模式提示语将用户习惯转化为可复用Skil…。

AI 模型Agent 与开发工具

AI 日报:pxpipe:通过图像化压缩输入token降低Claude Code成本

这个本地代理把系统提示、工具文档和历史记录渲染成 PNG,再交给 Claude Code。原始信息里给出的测试是:约 25k 文本 token 变成约 2.7k 图像 token,端到端账单降低 59%-70%;SWE-bench Lite 10 个实例全部通过,成本从 54 美元降到 27 美元。

AI 模型Agent 与开发工具

AI 日报:pxpipe:通过图像化压缩输入token降低Claude Code成本

pxpipe 把系统提示、工具文档和历史记录渲染成 PNG,让 Fable 5 读取图像 token。原始测试里约 25k 文本 token 变成约 2.7k 图像 token,端到端账单降低 59-70%;SWE-bench Lite 10 个实例全部通过,成本从 54 美元降到 27 美元。

AI 模型Agent 与开发工具

AI 日报:Claude Code v2.1.198 发布

v2.1.198 让 Claude in Chrome 全量可用,给后台 agent 增加 agent_needs_input / agent_completed 通知,新增 /dataviz skill,并让后台 agent 在 worktree 完成代码后自动提交、推送、创建草稿 PR。