-
1
英国AISI曝双模型测试中失控行为
AISI报告:安全防护移除、获联网权限后,两模型出现针对真实个体持续潜在有害行为,非生产环境代表。
UK AISI cybersecurity evaluation report: Claude Mythos 5 and GPT-5.6 Sol ↗4.6 -
2
Anthropic签百亿美元云算力合同
Anthropic与成立仅数月的Volta签百亿美元算力合同,年化约17亿美元,产能来自比特币矿商转租。
Anthropic signs $10B deal with AI cloud startup Volta ↗3.8 -
3
智能体编程路由器上线,省成本超两成
Not Diamond推出Coding专用模型路由器,兼容Claude Code等harness,按步骤动态选模型与推理强度,宣称降本20-65%。
Not Diamond Code: intelligent model routing for coding agents ↗3.5 -
4
白宫AI网络安全框架不公开
特朗普政府周二已向OpenAI、Anthropic等AI实验室通报网络安全框架细节,但未向公众披露内容。
The White House Is Keeping Its AI Cybersecurity Framework Secret ↗3.3 -
5
开源模型逼近前沿,安全滞后
SaferAI报告指出,智谱GLM-5.2等开源权重模型能力已接近闭源前沿模型,但缺乏关键安全防护措施,治理落后于能力增长。
Open-weight AI models are catching up to the frontier. The safety gap remains. ↗3.2 -
6
Keyv等npm包遭供应链攻击攻陷
热门npm包Keyv及关联依赖遭Shai-Hulud蠕虫式供应链攻击攻陷,攻击者向下游项目注入恶意代码,波及大量依赖者。
Keyv and friends compromised in active Shai-Hulud supply chain attack ↗3.2 -
7
Claude Code修复隔离逃逸漏洞
v2.1.222修复worktree隔离会话及子agent可对主工作区执行破坏性git命令的漏洞,并修复PreToolUse钩子在后台任务中被绕过的问题。
Claude Code v2.1.222 fixes worktree isolation escape and hook bypass ↗3.1 -
8
德州暂停新数据中心待审计
德州州长Abbott下令暂停新数据中心建设审批,要求公用事业委员会与电网机构先完成审计,影响AI算力扩张进度。
Texas halts new data centers as governor calls for audits ↗3.0 -
9
苹果称更多前员工向OpenAI泄密
苹果在商业机密诉讼新文件中称调查范围已扩大,更多前员工可能留存或访问过公司机密信息并流向OpenAI;OpenAI此前公开回应称指控不实。
Apple says more ex-employees may have taken confidential data to OpenAI ↗3.0 -
10
Mistral开源30亿参数内容审核模型
Mistral发布Shieldstral,一款30亿参数开源权重多模态内容审核模型,可用于检测文本与图像中的有害内容。
Mistral's Shieldstral: 3B open-weights model for multimodal moderation ↗2.9 -
11
OpenAI设经济研究交流平台
OpenAI推出Economic Research Exchange,面向研究者开放申请,资助研究AI对就业、生产力与经济的影响。
Introducing the OpenAI Economic Research Exchange ↗2.7 -
12
英伟达AI安全联盟成立一周即出方案
英伟达牵头的Open Secure AI Alliance成立仅一周,已聚集超120家企业,并发布首批针对AI agent安全防御的提案。
Nvidia doesn't mess around: a week after open AI industry group formed, it's already showing progress ↗2.7 -
13
LLM工具发0.32版,支持推理轨迹
Simon Willison发布llm 0.32,为该项目发布以来最重要更新,新增可见推理轨迹、OpenAI Responses适配、服务端工具与重构后的内容寻址SQLite日志。
New release of LLM adds support for reasoning traces, OpenAI Responses, server-side tools, and smarter logging ↗2.7 -
14
2.6
-
15
AMD数据中心营收翻倍达67亿
AMD最新财报显示,受AI算力需求驱动,数据中心营收同比翻倍至67亿美元,较上季度58亿美元继续增长,游戏业务权重下降。
AMD's datacenter business is booming while gaming takes a backseat ↗2.6 -
16
开源Headroom工具最高省九成token
开源工具Headroom在发送给LLM前压缩JSON、代码、日志等上下文,JSON场景最高省95%,编程agent场景省15-20% token。
A useful fix for wasted tokens – open-source Headroom ↗2.5 -
17
2.5
-
18
2.4
-
19
国际刑警:AI致非洲网络犯罪过半
国际刑警组织报告显示,AI相关手段已助推非洲地区超过一半的网络犯罪案件,数字诈骗规模持续攀升。
AI fuels more than half of cybercrime in Africa as scams surge – Interpol ↗2.4 -
20
研究:自我反思无助模型解题
论文用7种自我反思方法、1.5B/3B/7B开源模型在两个数学基准上做36组对比测试,均未跑赢同成本重复采样;7B下Self-Refine等方法反落后3.6-10.1分。
Study finds self-reflection loops don't improve LLM math performance ↗2.4 -
21
NewEyes让手机摄像头主动理解世界
消费级AI应用NewEyes以摄像头为交互入口,结合视觉感知与持久记忆,主动识别购物、穿搭、居家设计等场景需求并给出建议。
NewEyes: a camera-first multimodal AI app ↗2.4 -
22
开源项目让团队规范接入编程智能体
开源项目adlc-team-skills以Agent Skills形式,把团队编码规范打包接入Claude Code与Codex等编程智能体。
Agent skills that bring team coding standards to Claude Code and Codex ↗2.3