用户反映OpenAI API速率限制趋紧
原文:API rate limits constricted?
有人在自家的 harness 里使用 OpenAI API 时遇到问题吗?我弄了个 key,把 Luna 跑在 Lumina 里当日常主力。第一个问题是它告诉我只能用推理或者工具调用(二选一),这是个大红灯。Luna 回答问题快如闪电,但工具调用的限流太糟糕了,导致除了当聊天机器人之外几乎没法用。它能跑一两个调用,然后就触发限流:“请在 14.753 秒后重试”。需要十几次“继续”轮次,这不仅消耗大量上下文(用量,而非窗口长度),而且完成任何 agent 任务都要慢上 10 倍。此外,你还得坐在旁边盯着它,每隔一两个工具调用就要说一次“继续”。最后我去搞了个 GLM 5.3 的 API,给它一个大编程任务,它能做 54 步推理、级联 74 次工具调用,然后回来报告任务完成。我不明白为什么一个付费提供商要限流限得这么狠。