爱看AI
返回列表
最新资讯国内industry

Claude最强迷你模型登场,价格暴降90%,直逼DeepSeek?

来源智东西(zhidx.com)20小时前 · 2026/10/8
Claude最强迷你模型登场,价格暴降90%,直逼DeepSeek?

智东西

编译 | 程茜

编辑 | 云鹏

智东西10月8日消息,今日凌晨,Anthropic发布其迄今最便宜、最快且功能最强大的迷你模型 Claude Haiku 5.5 ,平均运行成本比Claude Haiku 4.5低 约75% 。

Anthropic的官方博客称,Claude Haiku 5.5适用于 高吞吐量且对成本敏感的任务 ,可以处理快速且重复性的工作负载,例如摘要生成、数据整理、数据库查询、分类任务、实时客户支持以及浏览器相关操作等。Haiku 5.5也可以和Sonnet 5.5搭配,作为编程工作的子智能体使用。

在Artificial Analysis上, Haiku 5.5在AI分析指数上得分为 43 ,在最高性能模式下,得分略高于GLM-5.3 Flash(42分)、Gemini 3.8 Flash(41分)和GPT-6 Luna(38分)。

Claude Haiku 5.5不超过10万token时的输出价格比 DeepSeek-V4.1-Flash空闲时段还要便宜 。

Claude Haiku 5.5的定价比Claude Haiku 4.5 低90% ,适用于请求量不超过10万个token的情况;而超过10万个token的请求可享受 50% 的折扣。在Claude Haiku 4.5版本中,有90%的请求属于上述范围。

此外,Anthropic还对全系模型性价比进行了优化,其将Claude Sonnet 5.5的缓存读取操作价格下调至一半,即每百万个token只需支付 0.1美元(约合人民币0.67元) ,在大多数智能体任务场景下,其运行成本降低约 20% ;Claude Max和Team订阅用户还将拥有新的月度API积分奖励。

Claude Haiku 5.5现已可在所有平台上使用,包括Amazon Web Services、Google Cloud和Microsoft Azure。在Claude平台上,开发者可以立即开始使用 claude-haiku-5-5 。

一、动画效果实测惊艳,但部分场景 比GPT-6 Luna贵12倍

不少开发者实测对比了Claude Haiku 5.5和GPT-6 Luna的表现。

一位开发者生成了斑马在奔跑的动画,其中从斑马的花纹、形态到背景,Haiku 5.5生成的画面都更为和谐自然。

另一位网友实测了Haiku 5.5和Sonnet 5.5作为子智能体协同使用,在下方的案例中,两个模型协同只花了不到1分钟就完成任务。

有开发者对比发现,Claude Haiku 5.5在相同场景下的成本是GPT-6 Luna的12倍。

下图中两个项目的API价格相同,在Claude Haiku 5.5平台上构建同一个动画化的体素式3D宝塔岛屿需要24.96美元(约合人民币167.27元),在GPT-6 Luna平台上为1.91美元(约合人民币12.8元)。

另一位开发者使用Haiku 5.5与GPT-6 Luna生成了夜班列车动画。GPT-6 Luna在54.6秒内以低于0.01美元(约合人民币0.07元)的价格,生成了上面的内容,列车在夜间的森林里运行,摄像机还会切换远景、近景。

Haiku 5.5则使用了5分钟12秒,成本为0.03美元(约合人民币0.21元),但开发者放出的案例中Haiku 5.5只生成了一张火车的静态图。

综合来看,Haiku 5.5在绝大多数上下文不超过10万token的自动化任务、浏览器与计算机操作、轻量智能体场景下可以实现更优的综合收益。但面对更为复杂,需要重度编程、极高复杂度的多步规划任务时,其能力仍存在短板,这类场景依旧需要选用更高阶模型来保障输出质量。

二、相比上代模型得分几乎翻倍,整体可对标GPT-6 Luna

Anthropic放出的基准测试表中,对比了Haiku 5.5与Haiku 4.5、GPT-6 Luna、Sonnet 5.5在知识工作、计算机操作、多学科推理、智能体编程、视觉推理等方面的表现。

8项基准测试中,Haiku 5.5的表现均超过了Haiku 4.5、GPT-6 Luna。其中相对于上一代的Haiku 4.5,Haiku 5.5的知识工作得分几乎翻倍,Terminal‑Bench智能体编程得分从0%上涨到39.2%,这说明Haiku 5.5已经具备较强的智能体能力。

整体来看,Haiku 5.5综合性能相比GPT-6 Luna更强,尤其在OSWorld电脑操作测试中具有明显优势。Haiku 5.5距离高端模型Sonnet 5.5仍有差距。

Haiku 5.5是Anthropic首款支持可调算力档位(adjustable effort setting)的Haiku系列模型。用户可以自主选择优先优化成本,或是优先优化模型智能度。

▲Haiku 5.5在不同算力档位下,三项基准测试的表现。

定价方面,Anthropic称,当提示词长度不超过10万token时,Haiku 5.5的性价比尤为突出。

下图展示了Haiku 5.5与Anthropic更先进模型之间的关键差异。

对于需要复杂智能体编程任务的场景,如那些通过Terminal-Bench 4.0进行评估的任务,Sonnet 5.5和Opus 5.5仍然是更好的选择。Haiku 5.5则更适合那些范围较为狭窄的任务,这些任务在Claude的先前版本中可能会因为成本过高而难以实现,比如压缩、摘要处理或子智能体工作等任务。

此外,本周Anthropic将向所有Max和团队订阅者提供新的月度API信用额度,供他们在Claude平台上使用。使用Max 5x的用户每月可获得100美元(约合人民币670元)的信用额度,使用Max 20x的用户则每月可获得200美元(约合人民币1340元),团队订阅者最多可获得500美元(约合人民币3350元)的信用额度。

面向开发者,他们同时更新了Claude Python与TypeScript SDK,新增计算机操作与浏览器操作的测试版能力支持。

三、对齐错误案例减少,Haiku 5.5网络安全保护更严格

Claude Haiku 5.5在几乎所有对齐评估指标上都取得了显著改进。相比上一代模型,研究人员发现的对齐错误案例大幅减少,同时,模型在应对错误行为时的协作意愿也更强。

根据其功能特性,Haiku 5.5的网络安全保护措施比Haiku 4.5更为严格。在网络安全方面,这些措施允许执行更广泛的防御任务,但无法阻止攻击者进行的渗透测试及其他攻击手段。

Haiku 5.5的生物安全机制与Sonnet 5、Sonnet 5.5以及Opus 5相同。这些机制允许研究相关生物学问题,但会限制那些可能带来危害的请求的访问权限。

结语:轻量模型也要有智能体能力,小模型不再只追求“便宜够用”

时隔一年,Anthropic更新了自家迷你模型,并升级了智能体能力,这或许将改写过去小模型主打“便宜够用”的定位,如今Haiku 5.5补齐了计算机操作、终端编码、图表推理短板,搭配可调推理档位,可以用更低成本承接10万token以内的智能体业务。

这意味着AI智能体开发的成本门槛被进一步压低,开发者不必动辄调用高价主力模型来做网页浏览、桌面自动化这类高频任务。不过值得注意的是,Haiku 5.5依然存在能力边界,在复杂场景高端模型的价值依旧不可替代。

未来,轻量模型或许也会成为智能体产品规模化落地的主力选型,这也会倒逼各家厂商在低成本智能体赛道加速竞争。

来源:Anthropic、X

资讯由采集器定时从公开的机器人 / AI 信息源自动聚合。

相关内容

国内industry

搭载英伟达RTX Spark N1X超级芯片:联想YOGA Pro 15开启盲约,端侧跑通超千亿参数大模型

智东西 作者 | ZeR0 编辑 | 漠影 智东西10月8日报道,全球首批搭载NVIDIA RTX Spark N1X超级芯片的本地智能体AIPC——联想YOGA Pro 15 RTX Spark笔记本电脑,于今日9:00正式开启全网盲约。 在联想YOGA家族的产品矩阵中,Pro系列始终坚持“专为创作打造”的基因,代表着专业表现。这款新品面向AI创作、开发以及研学(学术科研与数据分析)等高算力需求人群,助力用户提升个人生产力。 联想YOGA AIPC产品专为既追求实用性与工作效能,又不妥协生活品质的高质量人群精心打造,具备高颜值的外观设计与轻便易携的设计,搭配卓越的性能与高端配置,无论是高效办

来源智东西7小时前
国内industry

海量终端等待被AI重做,破局的关键到底在哪里?

智东西 作者 | 陈骏达 编辑 | 漠影 过去几年,AI的发展都集中在云端:越来越多的参数,越来越强的模型,越来越费电的算力中心。如今一个更深层的变化正在发生: AI开始明显地从云端向终端设备扩散。 机器人、自动驾驶汽车、智慧视觉设备等越来越多的终端正在拥有自己的AI能力。 这一趋势并不难理解,终端是AI抵达真实世界的关键入口:摄像头、麦克风、传感器就长在设备上,物理世界的数据由终端源源不断产生。云端的模型和算力再强,进不了终端,就无法触及真实世界。可以说, AI竞争的下一个战场, 就 在端侧 。 在这个节点上, 上海海思给出了一个鲜明的判断: 每个IoT 终端都值得被 重构成轻智能终端,成为

来源智东西12小时前
国内industry

WorkBuddy上新,与Office三件套“合体”了

AI应用风向标(公众号:ZhidxcomAI) 作者|江宇 编辑|漠影 智东西10月8日报道,今日,腾讯旗下AI办公智能体 WorkBuddy正式上线独立文件浏览器 ,用户无需先将本地文件上传至聊天框,直接在电脑中 右键选择WorkBuddy ,即可打开文件,并调用AI进行 分析、修改和后续处理 。 此次更新支持Word、Excel、PPT、PDF、Markdown、HTML等多种文件格式,用户可以在独立窗口中查看文件,并通过右侧的Buddy对话框调用AI能力。 对于支持编辑的文件,用户还可以直接修改内容,并将结果保存回原来的本地文件。 并且该功能无需单独下载,更新WorkBuddy后即可使用

来源智东西14小时前
国内industry

超33亿元!Manus拿下国内Agent创企最大单笔融资,腾讯投了

智东西 作者 | 程茜 编辑 | 云鹏 智东西10月8日消息,刚刚,Manus母公司蝴蝶效应宣布近日已完成超5亿美元(约合人民币33.52亿元)新一轮融资。这是国内Agent原生创企获得的最大一笔融资。 本轮融资由博裕投资、IDG资本领投,老股东腾讯、红杉中国、真格基金继续加持。 今年9月,外媒彭博社就曾报道,蝴蝶效应计划以40亿美元(约合人民币268.3亿元)估值融资5亿美元(约合人民币33.5亿元),较此前20亿美元的估值,多了整整一倍,预计将会使Manus的母公司蝴蝶效应成为中国估值最高的AI Agent创企。 就在9月29日,Manus发布了Manus 2.0版本,以及多Agent群聊

来源智东西18小时前
国内industry

造物 100#07 | 给硬盘养个图书馆员、指纹钥匙给 AI 上锁、AI 对讲机住着科幻宇宙

产品的创新,究竟应该如何定义它的价值? 上周,华为、小米、苹果在 72 小时内接连发布折叠屏旗舰。华为 Mate XT 2 非凡大师 19999 元起售,小米 18 Fold 10999 元,苹果首款折叠屏 iPhone Duo 市场预计 1.6 万起。与此同时,一组数据冲上热搜,通用内存合约价环比涨超 58%,固态硬盘涨超 70%,主流性能机比去年贵了 2800 到 4500 元。「普通人没必要追求电子产品顶配」登上热搜,年轻人转向二手电脑和标准版机型,不再一味追求顶配功能。 一边是厂商急需拓展新产品线的渴望,一边是用户日益下探的购买力。当「更贵」不再自动等于「更想要」,创新到底该如何定义价

来源极客公园21小时前
国内industry

ChatGPT 推出全新 IUI 智能用户界面;谷歌推出试验性 AI 游戏平台 Playground;苹果被曝联合 LG 开发门锁、摄像头等智能家居配件|极客早知道

2026 年诺贝尔化学奖公布:二人因解开不对称有机合成难题获奖,其中一位 96 岁高龄 10 月 7 日,2026 年诺贝尔化学奖正式公布,瑞典皇家科学院决定将 2026 年诺贝尔化学奖授予亨利 ·B· 卡甘(Henri B. Kagan)和硖合宪三(Kenso Soai),「表彰他们在不对称有机合成中发现非线性效应和自催化现象。」 有些分子,例如氨基酸,以两种变体形式存在,互为镜像。然而,生物体只包含这些镜像之一。像这样的化学不对称性是如何出现的,长期以来对化学家来说一直是个谜。 亨利 ·B· 卡甘和硖合宪三因发现这一难题的解决方案而荣获 2026 年诺贝尔化学奖。 亨利 ·B· 卡甘(19

来源极客公园22小时前