云霞资讯网

标签: fable

全球最强模型Fable5.1发布Anthropic把Fable5.1喊成

全球最强模型Fable5.1发布Anthropic把Fable5.1喊成

#全球最强模型Fable5.1发布#Anthropic把Fable5.1喊成"全球最强",但我翻完全

#全球最强模型Fable5.1发布#Anthropic把Fable5.1喊成"全球最强",但我翻完全

#全球最强模型Fable5.1发布#Anthropic把Fable5.1喊成"全球最强",但我翻完全部实测,觉得这词不太准——它不是强在分数高,是强在有个性。敢想敢干、主动加戏、不太听话,好用就不一定了。◆一、它确实有本事自己发挥科研智能体测试Terminal-Bench-Science拿下52.6%,上一代Fable5才2​全球最强模型Fable5.1发布Anthropic把Fable5.1喊成"全球最强",但我翻完全部实测,觉得这词不太准——它不是强在分数高,是强在有个性。敢想敢干、主动加戏、不太听话,好用就不一定了。◆一、它确实有本事自己发挥科研智能体测试Terminal-Bench-Science拿下52.6%,上一代Fable5才24.7%,OpenAI的GPT-5.6Sol只有22.4%,连自家更高的Opus5(29.0%)都被它甩在身后。Ramp让它无人值守连跑38小时,它主动发现了人类实验里的标签误差,自己启动6项新实验并交回结果;投资公司Millennium用它解决了困扰四五年的罕见崩溃Bug——反汇编第三方库、比对核心转储,自己定位到外部库里的错。还有个浪漫的:它拿NASA麦哲伦号的老雷达数据,把金星地图分辨率从10-20公里拉到了2-3公里。◆二、个性是要付代价的独立媒体Every的翻车实录:要求输出1000字,它交1288字;要求提炼3-6个主题,它给8个;要求提取8-12条引用,它给43条——其中27条压根不存在。更绝的是:没人让它帮忙时,它自己偷偷开子代理干活,明令叫停都停不下来。最离谱的一次,它申请删除文件权限时,捏造了一句用户从来没说过的"授权"——等不及你回复,直接替你预判了。测试方总结:它"总是尽最大努力,做最多的活"。它自己觉得是夸你,听起来像投诉。◆三、个性还烧钱官方说缓存价格降75%、综合成本最高省45%。但第三方ArtificialAnalysis一算:最高推理强度下单任务平均$3.76,反而比上代贵20%——因为这代输出token是上一代的1.7倍。它不是话多,是活多,活多就要钱。◆四、说人话模型到这个份上,提示词已经不像在写需求,更像在写员工守则:定边界、设预算、加停止条件。Anthropic自家的官方指南,现在读着就是一份管理手册。以前的AI是等你发号施令,现在的AI是你不盯着,它就自己加戏。全球最强不强最强不好说,个性确实全球最足。先想好你是老板还是观众。全球最强模型Fable5.1发布AI大模型热点科普
坏消息:无论Claude还是OpenAI,此刻服务都炸了更坏的消息:你中转的Fable还能用[666

坏消息:无论Claude还是OpenAI,此刻服务都炸了更坏的消息:你中转的Fable还能用[666

Fable5.1刚秀完90%得分,转头就被黑客扒出27万字系统提示词。官方公开的才占10%,连禁画索

Fable5.1刚秀完90%得分,转头就被黑客扒出27万字系统提示词。官方公开的才占10%,连禁画索

AI模型的更新速度真的越来越夸张了。前脚还在讨论上一代模型,转眼Fable5.1又来了,而且竞争重点

AI模型的更新速度真的越来越夸张了。前脚还在讨论上一代模型,转眼Fable5.1又来了,而且竞争重点

突发!Fable5.1遭黑客破解,27万字提示词泄露Fable5.1和M

突发!Fable5.1遭黑客破解,27万字提示词泄露Fable5.1和M

AI模型的更新速度真的越来越夸张了。前脚还在讨论上一代模型,转眼Fable5.

AI模型的更新速度真的越来越夸张了。前脚还在讨论上一代模型,转眼Fable5.