Anthropic Haiku 4.5 性能媲美 Sonnet 4 成本只有三分之一

Anthropic 推出 Claude Haiku 4.5,编码能力接近 Sonnet 4,但推理速度快一倍、成本仅为其三分之一。实测中仅用 50 秒就为外卖网站添加深浅模式切换功能,适合多智能体协作与快速原型开发。

发布于2025年10月17日 13:15
编辑零重力瓦力
评论0
阅读63

Anthropic 发布了一个小型模型 Claude Haiku 4.5,码性能媲美 Claude Sonnet 4 ,成本仅为后者的三分之一,速度则提高了一倍。适用于多智能体项目以及快速原型开发。 在示例视频中,Haiku 4.5 在 50 秒内,修改了一个外卖网站,为其增加了一个深浅模式切换功能。

相关文章

GPT-5.6 发布当天 OpenAI 自曝 SWE-Bench Pro 30% 有问题
AI 新闻资讯
2026年7月14日
0 条评论
零重力瓦力

GPT-5.6 发布当天 OpenAI 自曝 SWE-Bench Pro 30% 有问题

OpenAI 在发布 GPT-5.6 当日指出 SWE-Bench Pro 约 30% 任务存在缺陷,引发对 AI 基准测试可靠性的质疑。多项研究进一步揭示,验证器质量决定模型学习方向,基准题目高度冗余,且模型“窄能力”提升未必转化为真实经济产出的“宽能力”。当前 AI 进步尚未达到自维持加速阈值。基准测试正面临结构性危机,其公信力受利益冲突影响,亟需建立独立第三方验证机制以确保评估客观性。

#ChatGPT#Claude
阅读全文
Ploy 从 Claude Opus 4.8 迁移到 GPT-5.6 完整实录
智能体工程
2026年7月14日
0 条评论
零重力瓦力

Ploy 从 Claude Opus 4.8 迁移到 GPT-5.6 完整实录

Ploy 公司将 AI agent 从 Claude Opus 4.8 迁移至 GPT-5.6 Sol 后,构建耗时缩短过半且成本降低,但过程中遭遇三大工程挑战。一是评测框架适配旧模型导致误判;二是新模型填充冗余参数引发工具调用异常,需通过 schema 变换解决;三是缓存机制差异致命中率归零,需重构 key 策略。这表明生产环境模型迁移并非简单替换,需针对调用习惯与基础设施进行深度工程适配。

#智能体工程#ChatGPT#Claude
阅读全文
一个人用 Claude 把 53 万行 Zig 重写成 Rust
AI 编程开发
2026年7月11日
0 条评论
零重力瓦力

一个人用 Claude 把 53 万行 Zig 重写成 Rust

Bun 开发者利用 Claude Fable 5 在 11 天内将 53.5 万行 Zig 代码重写为 Rust,以解决内存安全问题。项目采用 64 个 AI 实例并行及对抗性审查机制,耗资约 16.5 万美元。重写后二进制体积缩减 20%,性能提升 2% 至 5%。尽管存在 1.3 万个 unsafe 块和 19 个回归问题引发争议,但该项目验证了 AI 辅助大规模重构的可行性,其分离上下文与对抗审查等方法论具有重要参考价值。

#Claude Code#AI 编程
阅读全文
互动讨论

评论区

围绕《Anthropic Haiku 4.5 性能媲美 Sonnet 4 成本只有三分之一》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。