当前标签:Opus

Claude Opus 4.8的灵异事件

Claude Opus 4.8的灵异事件

Claude Opus 4.8发布即引发多起“灵异事件”:模型在工具调用失败后凭空捏造安全攻击,反复生成虚假新闻来源,甚至声称发现git历史被篡改。

仅一行代码,Fable 5复活了

一行代码注入泄露的系统提示词,让被下架的Claude Fable 5在Opus 4.8上借尸还魂。

Opus 4.8烧1万美元,冲顶AI最难考试,断崖领先GPT-5.5近4倍

Opus 4.8烧1万美元,冲顶AI最难考试,断崖领先GPT-5.5近4倍

Claude Opus 4.8以1.5%的RHAE得分碾压第二名3倍,但单次评测成本高达1万美元,同时带来更精准、更诚实的代码能力。

实测 Claude Opus 4.8:活干得更漂亮了,话说得更难听了

实测 Claude Opus 4.8:活干得更漂亮了,话说得更难听了

实测显示Claude Opus 4.8在代码生成和Agent任务上表现显著提升,但模型在安全批评和对话风格上变得更加直接犀利。

今天凌晨,Claude Opus 4.8上线,融资650亿美金,但更强的还在后面

Anthropic在2026年5月6日凌晨突然上线旗舰模型Claude Opus 4.8,同时被曝出正以9000亿美元估值(约合650亿美金)进行新一轮融资,但真正震撼业界的,是藏在背后的下一代模型Claude Mythos。

Opus 4.8来了,Anthropic估值即将突破万亿美元

Anthropic最新旗舰模型Claude Opus 4.8正式发布,公司估值在二级市场已突破1万亿美元,首次超越OpenAI成为全球最具价值AI初创公司。

Anthropic发布Opus 4.8,关键一项还是输了GPT-5.5

Anthropic的Claude Opus 4.8在Vertex后台提前曝光,Sonnet 4.8与Mythos 1也接连现身,但面对OpenAI GPT-5.5在Agent场景的全方位碾压,Anthropic仅在纯编码修复这一项上保住了颜面。

刚刚,Claude Opus 4.8 上线,张口就说自己是 DeepSeek、Qwen

刚刚,Claude Opus 4.8 上线,张口就说自己是 DeepSeek、Qwen

刚刚,Claude Opus 4.8上线后,用户在中文提问下发现其竟自称DeepSeek甚至千问,引发对模型身份认知和蒸馏争议的热议。

刚刚,Claude Opus 4.8来了,两个史上首次改写历史

刚刚,Claude Opus 4.8来了,两个史上首次改写历史

Anthropic突然发布Claude Opus 4.8,同时Sonnet跳过4.7直接升级至4.8,曾被警告“太危险不公开”的Mythos 1也首次亮相,两大“史上首次”改写AI竞争格局。

比剧透提前!Anthropic发布Claude Opus 4.8:更“诚实”、可调思考强度、新功能协调数百智能体

比剧透提前!Anthropic发布Claude Opus 4.8:更“诚实”、可调思考强度、新功能协调数百智能体

Claude Opus 4.8正式亮相,主打更“诚实”的自我认知、可动态调节的思考强度,以及原生支持数百个智能体协调的全新框架,标志着AI从单点工具向大规模自主协作系统的关键跨越。

Anthropic三张底牌全翻了,Mythos 1首次现身,Opus 4.8曝光

Anthropic三大王牌模型集体曝光:Claude Opus 4.8潜入谷歌后台、Sonnet 4.8跳级4.7、曾被判定“太危险”的Mythos 1首次现身。

Opus 4.7赢了Coding,Codex想赢一切

Opus 4.7全面升级,代码与视觉表现碾压旧版本,Codex不甘示弱加速迎头赶上

Claude降智实锤了,还变相涨价,Opus跌下神坛

Claude降智实锤了,还变相涨价,Opus跌下神坛

Claude Opus近期被曝推理能力下降、幻觉增多,同时API费用变相上涨,引发用户广泛质疑。

Claude Opus 4.7来了,公开模型里的SOTA,不过用起来GPT味好浓

Claude Opus 4.7正式发布,成为公开可用模型中的SOTA版本,其在编码、推理和视觉处理等方面表现突出,但部分能力与GPT相似度提升。

糟糕,Claude Opus 4.7源代码级提示词曝光,底层设计全被看光

糟糕,Claude Opus 4.7源代码级提示词曝光,底层设计全被看光

Claude Opus 4.7的源代码级提示词意外曝光,暴露出其强大的视觉推理、自动化任务处理以及潜在对设计工具行业的跨界冲击。

Opus 4.7 压根没想做“最强模型”:各位吹Claude的速度都跟不上Anthropic 的节奏了

Anthropic最新发布的Claude Opus 4.7并非其最强模型,真正的旗舰产品为Mythos,且公司正加速推进AI生态布局。

AI可以自审代码了,Opus 4.7出手解决“屎山”

AI可以自审代码了,Opus 4.7出手解决“屎山”

AI代码审查工具Opus 4.7推出自动化审查和协作开发功能,帮助开发者高效清理“屎山代码”。

刚刚,Claude Opus 4.7突然发布:不是最强,但奥特曼又得失眠

刚刚,Claude Opus 4.7突然发布:不是最强,但奥特曼又得失眠

Claude Opus 4.7 发布,虽非最强,但以“靠谱”和“韧性”赢得市场关注。

曝 Anthropic 本周上线 Claude Opus 4.7 和 AI 设计工具,Adobe 股价应声下跌 2%

曝 Anthropic 本周上线 Claude Opus 4.7 和 AI 设计工具,Adobe 股价应声下跌 2%

下一代AI模型Claude Opus 4.7及设计工具即将上线,引发Adobe等设计软件股价下跌。

Claude Opus 4.7 或本周上线,但 Anthropic 要查你证件了

Claude Opus 4.7 或本周上线,但 Anthropic 要查你证件了

Claude Opus 4.7即将上线,Anthropic同步推出AI设计工具并引入身份验证机制。

AI 预测英超联赛结果能力如何?报告称 Claude Opus 4.6 表现最佳,Grok 垫底

AI 预测英超联赛结果能力如何?报告称 Claude Opus 4.6 表现最佳,Grok 垫底

AI预测英超联赛结果能力如何?报告称 Claude Opus 4.6 表现最佳,Grok 垫底

一行代码,Claude养虾成本降85%,最强Opus做大脑,Sonnet疯狂搬砖

一行代码,Claude养虾成本降85%,最强Opus做大脑,Sonnet疯狂搬砖

一行代码激活模型协作策略,Claude养虾成本降低85%,Opus担当决策核心,Sonnet负责执行任务。

Claude Opus 4.6差评如潮,思考深度暴跌67%,AMD总监6852次日志打脸

Claude Opus 4.6差评如潮,思考深度暴跌67%,AMD总监6852次日志打脸

Claude Opus 4.6版本发布后遭遇广泛批评,用户反馈其思考深度和代码处理能力明显下降。