anthropic 公司近日正式发布 claude 5.5 系列全新轻量级模型——claude haiku 5.5。针对长度在 10 万 token 以内的常规请求,其输入与输出单价分别下调至每百万 token 0.10 美元和 0.50 美元,相较上一代产品,标称价格直降 90%。
作为目前响应速度最快的模型之一,Haiku 5.5 聚焦高并发、低延迟及高性价比应用场景,尤其适用于实时客服交互、文档摘要生成与结构化数据分类等高频、轻量型任务。值得一提的是,该模型首次集成自适应推理机制与动态资源调节能力,可依据任务难度智能调整思考深度与算力投入,在保障效果的同时优化资源使用效率。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

新分词器引发成本关注:Token 实际消耗或上升
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
不过官方也特别指出,Haiku 5.5 启用了与旗舰级模型一致的全新分词器,导致相同文本在编码后产生的 Token 数量普遍增加。实测数据显示,长文本类任务的 Token 消耗量可能提升 25%–30%,因此在真实业务负载下,整体成本降幅约为 75%。
需特别注意的是,一旦单次请求超出 10 万 Token 的阈值,其输入与输出单价将跃升至基础费率的 5 倍。开发者在享受低价优势的同时,必须对具体工作流进行细致的 Token 消耗预估,以防因超限触发隐性成本激增。










