建议控制在 10 个以内。工具多时用 tool_search 动态加载(仅 gpt-5.
168.222.65:8085/v1/chat/completions", "ai_model": "Qwen3.
所以选平台,缓存支持与否,对 Agent 场景是决定性的。光看单价那个“元/百万 token”根本不够,得看它算不算缓存价。
我建议 S3,因为你后续会做 CDN 加速。对吗?" Q3: "裁剪在前端做还是后端做?
建议控制在 10 个以内。工具多时用 tool_search 动态加载(仅 gpt-5.
168.222.65:8085/v1/chat/completions", "ai_model": "Qwen3.
所以选平台,缓存支持与否,对 Agent 场景是决定性的。光看单价那个“元/百万 token”根本不够,得看它算不算缓存价。
我建议 S3,因为你后续会做 CDN 加速。对吗?" Q3: "裁剪在前端做还是后端做?