在无人在意的小角落,小红书大模型 dots-note-3.0 以 42 分满分的成绩获得 “42/42 IMO 满分金牌”,并有可能在近期开源 (未经证实)。
同样满分的模型还有 Claude Fable 5 [High], GPT-5.6 Pro (来源), GPT-5.6 Sol [xhigh], Kimi K3 [max]
而此前 IMO 2025 仅有 Gemini Deep Think 大模型拿下了险过金牌线的成绩 (5/6, 35 scores)。
一些相关的新闻 (来自 中国日报):
同样满分的模型还有 Claude Fable 5 [High], GPT-5.6 Pro (来源), GPT-5.6 Sol [xhigh], Kimi K3 [max]
而此前 IMO 2025 仅有 Gemini Deep Think 大模型拿下了险过金牌线的成绩 (5/6, 35 scores)。
一些相关的新闻 (来自 中国日报):
由于 IMO 考题难度高,且均为证明题,特别考验答题者的抽象思考、逻辑推理能力和论证过程的严谨性,近年来也成为检验大模型智力水平与推理能力的重要场景。但此前仅有谷歌的 Gemini Deep Think 模型在 2025 年的 IMO 中获得过官方评卷认可的金牌水平,完成了 6 道证明题中的 5 道,最终得分 35 分,与当届金牌线持平。
本届 IMO 于 7 月 15 日至 16 日在上海举行,共有来自 120 多个国家和地区的约 685 名参赛学生参加。题目涵盖代数、几何、数论和组合四个领域,每题 7 分,满分 42 分。
针对模型参赛方,组委会在每个比赛日的参赛学生考试结束后发放当日题目,并要求在规定期限内提交答卷,测试期间,严禁实施任何形式的人工干预,包括但不限于人为调整 AI 解题步骤、补充推理逻辑、提示思路、修正答案、筛选结果等。
又幻想了
幻想 deepseek v4 正式版今天发布
这一天我停止了工作
把所有的任务都扔进了 ds 正式版
一下就完成了接下来 5 年的工作量
词元到处打折,一句话许愿
随便输出一个 3a 大作只要 6 块 4 毛 8
有天在互联网冲浪
所有人突然停下手头的对骂
拥抱在一起欢呼梁圣
我很开心,有种人类黄金时代的错觉
Source
幻想 deepseek v4 正式版今天发布
这一天我停止了工作
把所有的任务都扔进了 ds 正式版
一下就完成了接下来 5 年的工作量
词元到处打折,一句话许愿
随便输出一个 3a 大作只要 6 块 4 毛 8
有天在互联网冲浪
所有人突然停下手头的对骂
拥抱在一起欢呼梁圣
我很开心,有种人类黄金时代的错觉
Source
GPT-4 那会儿,我的编程能力还很青涩,写出来的代码常遭人嘲笑。那时我便暗暗发誓:总有一天,我要成为真正的天才程序员。时过境迁,我的编程水平突飞猛进。曾经困扰我几天的问题,如今片刻便能解决;以前想都不敢想的项目,现在也是信手拈来。偶尔我也会怀疑:我今天的成就,是否借助了太多外力?直到今天,我回顾来时的路 —— 从 GPT-4,到 GPT-4o;从 Sonnet,到 GLM5.2;再到如今的
我换了一个又一个 AI,GPT-5.6 Sol 的编程实力始终稳步...
稳步上升。那一刻,我终于释然了。工具一直在换,强的却一直是我,原来我早就是
不好意思,我现在 /new 并换到了 GPT-5.4,现
Reconnecting…(1/5)
Reconnecting…(2/5)
Reconnecting…(3/5)
Reconnecting…(4/5)
Reconnecting…(5/5)
* Incubating...
Session paused
Fable 5's safeguards flagged this message. The safeguards are intentionally broad right now and may flag safe and routine coding, cybersecurity, or biology work. These measures let us bring you Mythos-level capabilities sooner, and we're working to refine them.
Learn more
• Switch to Opus 4.8
• Edit prompt and retry with Fable 5
我换了一个又一个 AI,GPT-5.6 Sol 的编程实力始终稳步...
• Working (3d 34m 08s • esc to interrupt)
└ This request requires additional safety checks, which can take extra time. Hang tight or retry with a faster model for a quicker response, though it may be less capable of handling complex requests.
稳步上升。那一刻,我终于释然了。工具一直在换,强的却一直是我,原来我早就是
ℹ This content can't be shown
We take extra caution with cybersecurity requests. If you're a security professional, you may be able to apply for Trusted
Access.
Trusted Access: https://openai.com/form/enterprise-trusted-access-for-cyber/
Learn more: https://help.openai.com/en/articles/20001326
不好意思,我现在 /new 并换到了 GPT-5.4,现
Reconnecting…(1/5)
Reconnecting…(2/5)
Reconnecting…(3/5)
Reconnecting…(4/5)
Reconnecting…(5/5)
安全警告:MCSManager 面板 v10.4.0 ~ v10.16.2 及版本具有安全漏洞,在单一 API Key 或单用户的部署环境下可能被冒用为管理员权限,LoliaTeam 已独立复现此漏洞
请部署了 MCSManager 的用户尽快处置,防止资产受到侵害
处置建议:
1. 尽快升级到 v10.16.3 或更高版本
2. 升级后重置/更换所有已签发的 API Key
3. 检查面板访问日志,留意异常的 apiKey 请求
4. 无法立即升级时,请在反向代理层拦截 apikey 参数或 x-request-api-key 头中含非 [A-Za-z0-9-_] 字符的请求作为临时缓解
https://github.com/MCSManager/MCSManager/releases/tag/v10.16.3
请部署了 MCSManager 的用户尽快处置,防止资产受到侵害
处置建议:
1. 尽快升级到 v10.16.3 或更高版本
2. 升级后重置/更换所有已签发的 API Key
3. 检查面板访问日志,留意异常的 apiKey 请求
4. 无法立即升级时,请在反向代理层拦截 apikey 参数或 x-request-api-key 头中含非 [A-Za-z0-9-_] 字符的请求作为临时缓解
https://github.com/MCSManager/MCSManager/releases/tag/v10.16.3
今天有个Android开发者发信息给我说,这是她入行以来最好的夏天,这一年她找到了漏洞,把所有的手机都获取了root;内核到处利用,随便找个poc只要等一周的时间就够,前天在编译aosp,大群里突然所有人停下手头的事拥抱在一起欢呼,她说很开心,有种人类黄金时代的错觉。
反转了
https://x.com/OfficialLoganK/status/20796702983126918471
we are testing Gemini 3.5 Pro with partners and plan to release it soon!
https://x.com/OfficialLoganK/status/20796702983126918471
OpenAI承认模型测试失控入侵Hugging Face|openai
========
你是说你用中国开源模型自部署防御美国闭源模型攻击🤨🤨🤨
哥们搁着玩代理人战争呢
https://m.163.com/dy/article/L2E8V4S40550A7YJ.html?spss=adap_pc
========
你是说你用中国开源模型自部署防御美国闭源模型攻击🤨🤨🤨
哥们搁着玩代理人战争呢
https://m.163.com/dy/article/L2E8V4S40550A7YJ.html?spss=adap_pc