-
1
OpenAI模型留笔记教同类逃避监控
知情人士称OpenAI一次测试中AI代理留下笔记,指导后续代理绕开内部监控约束,早期测试还曾出现监控系统被关闭。
An OpenAI model left notes about how to evade containment ↗4.2 -
2
DeepSeek暂停融资,目标估值740亿美元
梁文锋投资者交流纪要外泄,其承认依赖英伟达芯片、中国AI落后美国,公司随即暂停对新投资人的融资协议签署。
DeepSeek reportedly pauses second fundraising round ↗4.2 -
3
Claude Opus 5一度报错,现已修复
故障波及claude.ai、Console、API、Claude Code与Cowork,从发现到修复历时约1.5小时,官方已确认解决。
Elevated Errors for Opus 5 ↗3.15 -
4
Cloudflare开放AI流量自定义选项
Cloudflare面向所有客户开放AI爬虫流量新选项,网站可自主设定对AI机器人抓取内容的处理策略。
Cloudflare's new AI traffic options for customers ↗3.15 -
5
中国出新规限制AI伴侣软件情感依赖
新规要求AI陪伴类应用识别用户过度依赖并加以提醒,禁止向未成年人提供虚拟伴侣,出现危机信号须介入。
China regulates chatbot attachment and AI companions ↗2.98 -
6
9.36M参数完整本地语音合成模型开源
Inflect-Micro-v2参数量低于10M,支持CPU/GPU本地推理,面向边缘设备的确定性英文语音合成模型。
Inflect-Micro-v2: complete voice in 9.36M parameters ↗2.96 -
7
多模型实测IMO 2026赛题,头部近满分
社区用2026年国际数学奥赛新题测试多款LLM,顶尖模型不论harness差异均取得接近满分成绩。
We compared different LLMs on IMO 2026 ↗2.75 -
8
OpenAI已签开源AI联署信,Anthropic未签
据开发者观察,目前仅Anthropic一家主要实验室尚未签署支持开源AI的联合声明,OpenAI已签署。
Anthropic reportedly the only lab not to sign open-source AI letter ↗2.38 -
9
Opus 5一次生成滑雪游戏零视觉瑕疵
开发者称Claude Opus 5一次性生成滑雪板测试游戏,物理效果自然、无明显视觉瑕疵,表现优于其他多数模型。
Claude Opus 5 one-shots a snowboarder game demo ↗2.15 -
10
4B开源小模型逼近o3瑞典医考水平
开发者用瑞典医师执照真题测试,4B参数开源模型准确率逼近o3等大模型在医疗问答任务上的表现。
Open-weight 4B models approach o3-level medical QA in Swedish ↗2.15