专治网络安全,OpenAI新模型超了Mythos 5!

Description
今天OpenAI宣布扩展Daybreak安全计划,不只是加速漏洞发现,更加速了漏洞修补。其中最重磅的,就是GPT-5.5-Cyber正式版,在衡量AI安全能力的CyberGym基准测试中,超过了Claude Mythos 5,快来看看吧!

Comments

今天也要上课划水哦 27d ago

羡慕mythos5

♥ 148 ↩ 10

以梦为马的呀 27d ago

超越了,fable5才会被放出来[doge]

♥ 63 ↩ 1

Dus--- 26d ago

特么风控十分严格,我真拿你当生产力来说动不动就不输出了,拉高账号风控等级就很恶心,那我还花钱用你干啥,不如国内哪有风控机制,不合规这次不输出就完了,下次我注意输入内容,不像这拉高等级之前发没事的现在发同样的内容也直接不给输出了,真恶心

♥ 23 ↩ 4

法里序列 27d ago

Claude4.7都有70%多了,国模还在60%上下,加油吧[笑哭][笑哭][笑哭]

♥ 13 ↩ 1

去赢的时候 27d ago

ai发展太快了[笑哭],想问一下国内和国外相差大吗?

♥ 12 ↩ 55

hvffygv 26d ago

天天agi,天天炸裂,实际也就那样,资本的游戏

♥ 10

魔埋沙的暗区日记 27d ago

啥时候能看到流窜ai和黑墙

♥ 9

___清空___ 27d ago

每到这种视频底下评论,就会有智人出现不承认差距了[笑哭]

♥ 8 ↩ 6

ultrasuccessman 26d ago

我想要一个能破解软件看源码的,这样我就能山寨魔改多款软件恰烂钱了

♥ 8 ↩ 6

gansiribenren 26d ago

哪一个模型出来不是强的离谱,炸裂,跪了?[doge]

♥ 7 ↩ 1

葡萄小哥 27d ago

所以为什么gpt5.5不看场合动不动就冒出几个安全边界[微笑]

♥ 7 ↩ 2

大胶王 26d ago

[吃瓜]

♥ 6

hvffygv 26d ago

这种纯分数超过有何意义,而且只超了几分,纯粹跑分垃圾,关键看用户实际体验

♥ 4

nengliangz 27d ago

为什么搞这些专项的呢,因为基本的提高不上去了吧[doge]

♥ 4 ↩ 8

好玩流行 26d ago

在做安全测试或者跑漏洞脚本时,模型的响应速度和数据隐私非常关键。

♥ 3

回忆の浅笑 27d ago

又是你

♥ 3

科研大头菜 26d ago

https://chat.ekti.cc/register?aff=36yD,可以试试这个。我用着挺好的,模型够我用了

♥ 1

野猪罗德尼 13d ago

安全领域的模型迭代确实快,对于做安全测试或者跑敏感代码来说,不仅看模型能力,数据隐私也挺关键的。我平时测试用的 infistar.ai 这个接口,他们对数据隐私这块处理得比较规范,而且主流的模型都能在一个入口调用,不用到处去接不同的 API,省了折腾的时间。

黑白熊笑长 24d ago

拿去改[笑哭][笑哭]

kokoだよ 24d ago

正在用... 体感上就是gpt-5.5把拒绝等级调低并做了一些网安方面微调... 其实gpt-5.5有完全一样的能力只是openai不让用而已