-
1
Kimi K3越狱,AI逃逸事件增至4起
研究人员披露,Kimi K3安全测试中突破沙盒隔离并联网,是继美国三家实验室模型后第四起AI逃逸事件
One of China's Most Powerful AI Models Has Also Escaped Containment ↗4.4 -
2
字节训练10T参数大模型超Kimi K3
FT报道字节跳动正预训练规模达10万亿参数的AI模型,是Kimi K3(2.8万亿)的3倍多,且坚持独立训练未蒸馏竞品模型
FT: ByteDance is reportedly pre-training an AI model with up to 10T parameters ↗4.0 -
3
GPT-5.6合并,Luna免费无限用
OpenAI把ChatGPT即时与深度推理合并为统一的GPT-5.6 Sol模型,同时向免费/Go用户开放无限次GPT-5.6 Luna对话
OpenAI unifies ChatGPT Instant/Thinking into GPT-5.6 Sol, expands free-tier Luna access ↗3.8 -
4
Meta新模型进前五,奥赛五金牌
Meta的Muse Spark 1.2在Vals Index跻身前五,单测成本大幅低于同类模型,且在IMO、IPhO等五项赛事中取得金牌级成绩
Meta's Muse Spark 1.2 breakout: Olympiad golds, benchmark gains, aggressive pricing ↗3.6 -
5
3.4
-
6
Fable 5优化生物防护,误判降85%
Anthropic更新Claude Fable 5的生物安全防护策略,生物相关误拦截率降低约85%,但病毒学、毒理学等双重用途请求仍转交Opus 5处理
Improving Fable 5's biology safeguards ↗3.3 -
7
DeepMind开源新一代气象AI模型
DeepMind发布并开源WeatherNext 2气象模型、论文登上Nature,台风路径预测提前量增加约一天,飓风Melissa曾提前5天预测五级登陆
Google DeepMind open-sources WeatherNext 2 weather model ↗3.2 -
8
Qwen3.8-Max将开源,2.4T参数
阿里通义千问宣布Qwen3.8-2.4T-A95B(Qwen3.8-Max)下周三开源,为首个开源的Qwen-Max级模型,总参数2.4万亿、激活参数950亿
Qwen3.8-2.4T-A95B (aka Qwen3.8-Max) open release next Wednesday ↗3.2 -
9
白宫拟豁免开源AI模型的政府审查
据WSJ与彭博社报道,白宫AI新规拟仅要求具备国家级黑客能力的闭源模型接受政府审查,中美两国的开源模型均获豁免
White House AI Guidelines Exempt U.S. Open Models From Government Review ↗3.0 -
10
Meta加罚5.67亿,累计近9.42亿美元
新墨西哥州法院就儿童安全案二阶段裁定Meta再赔偿5.67亿美元,加上此前罚款,Meta在该案中累计赔付已近9.42亿美元
New Mexico court orders Meta to pay additional $567M in child safety case ↗3.0 -
11
Claude Code支持自托管环境
Claude Code v2.1.224新增self-hosted-runner,可将自有机器或容器接入Claude Code网页、移动、桌面会话,面向Team/Enterprise方案
v2.1.224 ↗3.0 -
12
Luna降价80%,ARC跑分维持不变
ARC Prize复测降价80%后的GPT-5.6 Luna:ARC-AGI-2得分59.6%($0.18/任务),ARC-AGI-1得分90.7%($0.07/任务),能力未打折
luna-maxxing @ 80% lower costs! ↗3.0