Skip to content
-
Subscribe to our newsletter & never miss our best posts. Subscribe Now!
WuQuQu
WuQuQu
  • Home
  • 博客
  • 资讯
  • Home
  • 博客
  • 资讯
Close

Search

  • https://www.facebook.com/
  • https://twitter.com/
  • https://t.me/
  • https://www.instagram.com/
  • https://youtube.com/
Subscribe
其他

AI自主攻击5个月翻倍 安全警报升级 Claude Mythos「打破所有基准」

By LC
June 28, 2026 1 Min Read
0

前沿AI模型嘅自主网络攻击能力,正以每5个月翻一倍嘅速度指数级提升。英国AI安全研究所(AISI)最新报告用咗一个惊人嘅数字:Claude Mythos Preview同GPT-5.5完成复杂攻击任务嘅时间,比原本每8个月翻倍嘅趋势线再加速一大截。直白讲,AI已经识得「分钟级」发动网络攻击,企业安全团队如果唔同步升级,随时冇得挡。

规模竞赛变局:GPT-5.5与DeepSeek V4同日对撼

4月24日,两单重磅发布正面交锋。OpenAI正式推出GPT-5.5,定位「最强模型」,上下文窗口拉高到100万tokens,足够一口气吞低成个《三体》三部曲。API定价每百万输入tokens收5蚊美金,唔算便宜,但佢哋自己话幻觉问题大大减少。同一个下昼,中国DeepSeek释出V4系列,其中V4 Pro以1.6万亿参数成为全球最大开源权重模型,活跃参数490亿。成本更加惊人——V4 Flash推理每百万tokens只收0.14美金,平到冇朋友。

呢种同日对撼,喺一年前仲係难以想象。Stanford AI Index 2026记录咗一个标志性时刻:2025年2月DeepSeek-R1首次喺LMSYS Arena短暂追平美国领先模型,当时报告形容係「分水岭」。到咗今年3月,中美模型差距已经从超过300分缩到仅剩39分,即係2.7%。开源生态重心明显东移。

「暴力美学」撞墙:从Scaling Law到专业小集群

业界有一个逐渐形成嘅共识,「Scaling Law」已经撞墙。更大唔等于更好。Axios同IEEE Spectrum嘅综合报道直指,行业正从单一巨型模型转向分布式、专业化小模型集群协作。呢个转向有迹可循:Anthropic同Snowflake签咗2亿美元「智能体AI」合作,布局企业级AI Agent;Anthropic与Google联手推出新协议,令AI Agent处理速度提升70%,成本降低50%。连OpenAI都低头,2025年8月发布GPT-5之馀,破天荒释出开源权重模型gpt-oss(120B/20B)。

Sam Altman喺2025年底眼见Gemini 3 Deep Think全面超越GPT-5,下令内部进入「Code Red」状态,急推GPT-5.2推理模型,同时俾媒体爆出秘密研发生物医学专用模型「Garlic」。另一边厢,Meta重金挖角Scale AI CEO Alexandr Wang,负责Llama 4.X研发,高薪抢人才。Elon Musk嘅xAI就用实战说话:Grok 4.20喺真实资金交易联赛中击败所有前沿模型,唔声唔声打咗场硬仗。

安全加速:自主攻击力5个月翻倍,企业应接不暇

5月15日,Anthropic释出Claude Mythos Preview,喺自主网络安全任务中「打破所有基准」。呢个唔係宣传口号,英国AISI嘅报告俾出咗量化证据。之前,前沿模型完成复杂自主网络任务嘅时间每8个月翻一倍,而家加速到5个月,效能增速远超过去任何时期。报告警告,企业必须喺「分钟级」部署AI安全响应,因为AI驱动嘅攻击已经唔係按日计数。

呢个趋势同大模型能力飙升直接关联。Gemini 3.1 Pro喺人类终极考试取得超过50%分数,Claude Opus 4.6喺Stanford AI指数评分冲到1503分,其后Opus 4.7继续迭代。当模型可以自主规划、适应复杂环境,网络攻击自然变成佢哋嘅「杀手应用」之一。

科研渗透与隐忧:论文多了,质量降了

LLM正快速渗透学术界。Cornell大学研究团队喺《Science》期刊发文指出,使用LLM辅助令科学家发文量增加33%至50%,但代价係论文质量出现下滑,提出新颖科学问题嘅比例明显减少。科研同质化风险已经成为学界面嘅警示。

不过,正面应用依然亮眼。Axios形容2025年係「AI科学突破之年」,蛋白质结构解析、阿尔茨海默症早期诊断、端到端天气预测等领域都有实质进展。Google最先进天气模型预报速度提升8倍,「靠晒AI帮手」。

政策与资本:中国行动方案与全球5810亿美元投资

面对AI加速落地,中国工信部等八部门喺今年1月联合发布行动方案,目标到2027年实现AI核心技术「安全可靠供给」,打造3至5个通用大模型深入製造业,培育100个高质量工业数据集。政策导向明确:唔单止要追技术,更要落地應用。

全球资金继续涌入。2025年AI投资总额达到5810亿美元,规模律虽然撞墙,但市场热度未减。资本正流向更专业嘅垂直模型、AI Agent同安全解决方案。

下一个战场:分钟级攻防

GPT-5曾被批评基准测试只有单位数增幅,外界当时用「边际改善」形容,但半年唔到,GPT-5.5同Claude Opus 4.6已经将上下文窗口推到百万token,推理能力大幅跃升。从DeepSeek开源狂欢,到Claude Mythos嘅黑暗技能,AI竞赛进入新阶段——唔再係单纯斗参数大,而係斗快、斗专、斗安全可控。

英国AISI嘅报告留低咗一个刺痛业界嘅问题:当模型可以喺几分钟内完成一次精准网络渗透,人类嘅防御速度跟唔跟得上?答案,可能就喺未来5个月。

Tags:

AI 大模型最新突破性进展
Author

LC

Follow Me
Other Articles
Previous

AI競賽步入「自我進化」階段 中國開源模型威脅矽谷霸權

Next

阿爾及利亞對奧地利:四十四年血仇生死戰 馬列斯領軍誓破「希洪魔咒」

No Comment! Be the first one.

Leave a Reply Cancel reply

Your email address will not be published. Required fields are marked *

Copyright 2026 — WuQuQu. All rights reserved. Blogsy WordPress Theme