Web appOpen in Telegram

Post为了验证这一点,我化身大模型民科(全靠大肥鱼代打),让大肥鱼扒了CryptoPals、CryptoHack和其他一些crypto CTF题(好验证,纯代码,词表小,舒适区),持续从0731和V4.1暴力蒸CoT,然后在一台GB10上,对着L…

17 September 2026
P
Pseudorandom Thoughts
Reply一个月过去了,眼看网安类bench上不断发生一些涌现,我更加怀疑乙方给甲方企业推销的VDH和PTS产品的意义。 Workflow:你做的workflow和工具适配是很好,但很快AI就要带着agentic RSI杀过来了(哪怕DSH因为过度的FP洁癖区了,这个概念也已经被验证成立,下一批模型会把定制agent runtime和pi的能力训进去); 漏洞知识:你攒的漏洞知识库是很棒,但思维下一个版本就会OPD训进模型里面再给你涌现点奇迹; 也就是乙方交付慢慢从定制workflow,到定制agent(知识+技能),接下来可能不得不去定制高速小模型(带着自己的场景OPD,譬如找大模型摇一点CoT再拿点
为了验证这一点,我化身大模型民科(全靠大肥鱼代打),让大肥鱼扒了CryptoPals、CryptoHack和其他一些crypto CTF题(好验证,纯代码,词表小,舒适区),持续从0731和V4.1暴力蒸CoT,然后在一台GB10上,对着Ling-3.0-Tiny(一个8B-A1B的小模型)暴力叠logits做SFT。目前在验证集上的最终结果还没跑完,但已经提示SFT过的小模型获得了显著的长思维链和工具调用倾向。后面本频将会写个文简单讲讲过程。
4 · 342 ·

Nearby in the feed

PPseudorandom Thoughts生活在堆上 洗澡的时候突发恶疾,我觉得可以一个agent不给他正常的Read Write List Exec,而是给它自由(或黑白名单)的反射,给LoadClass,Invoke等tool,让它自己在JVM的疯狂宇宙里掀翻池塘。找大肥鱼Vibe了一下,意外发现真的能用。但暂时没想好这玩意能做什么,可能拿来找链或者做魔怔PPseudorandom Thoughts因为经常让v4搞一点运维/扫描/构建工作,难免会遇到超长bash job,所以魔改了crush的job_output做成可传timeout的超时重入,结果这个tool注入之后跑在crush里的大肥鱼时间观念就特别强,干啥都要掐表,刚才让它跑个默认k=3的eval,它看了眼系统时钟说现在16:55了不想加班太久,直接给我
this message
PPseudorandom Thoughts说到固定任务,这两天X上面炒的Typesafe AI的jev & RLCD,如果是真的,可能有非常可怕而广泛的应用场景,首先让大肥鱼寻过宝的朋友们都知道LLM彻底颠覆了基于规则的防护,而蓝队算力又支撑不起针对海量请求日志拿LLM跑batch;RLCD如果是真的,则可以重新把蓝队面向通用攻击的防护研判成本拉回到可接受的范PPseudorandom Thoughts我觉得必应中文,百度和 360 搜索应该改名叫搜狐,因为搜出来前几条经常是银狐
PPseudorandom ThoughtsPseudorandom Thoughts@prdm_thoughts · channel
735subscribers526average post reach
Venue feed Open in Telegram

An open public feed from the search index ChatCrawler — “Google for public Telegram”; refreshed as the venue is crawled. Times are UTC.

Public content only, official Telegram API. About · FAQ · What we do not do · Remove a page · Catalog · Search · How we count