-
1
DeepMind系初创称AI复现论文超越OpenAI
英国AI实验室Inherent由DeepMind前员工创立,其AI研究助手Faraday被称在复现学术论文能力上超过Anthropic和OpenAI的同类系统
Inherent, founded by DeepMind alumni, says its AI 'teammate' just outperformed Anthropic and OpenAI at replicating research ↗3.8 -
2
Anthropic招股书将列AI backlash为风险
据CNBC援引消息人士,Anthropic向SEC提交的IPO招股书将把公众对AI的负面情绪列为风险因素之一
Anthropic IPO filing will show AI backlash as a risk factor, sources say ↗3.6 -
3
OpenAI转而支持加强加州AI安全法案SB53
OpenAI呼吁加州加强SB 53法案的AI安全条款,此前该公司曾反对这项法案,如今立场出现转变
OpenAI says California should strengthen its AI safety bill ↗3.6 -
4
研究称头部AI实验室未公开失控应对方案
一项新研究发现,主要前沿AI实验室大多未公开说明如何应对失控模型,凸显行业在安全预案透明度上的不足
Frontier AI labs still won't say how they'd contain a rogue model ↗3.6 -
5
中国机器人百米冲刺跑赢博尔特世界纪录
一台中国研发的人形机器人在100米短跑测试中跑出快于博尔特世界纪录的成绩,引发对机器人运动能力进展的关注
Chinese robot runs 100M sprint quicker than Usain Bolt's world record ↗3.2 -
6
MCP官方发布新版路线图聚焦五大方向
Model Context Protocol核心维护团队公布最新路线图,聚焦agent消息原语、HTTP原生传输、身份与企业安全等五个优先方向
The New MCP Roadmap ↗3.0 -
7
Claude Code被曝服务端下调Fable 5推理力度
有用户发现Claude Code 2.1.236以上版本对部分Fable 5会话服务端调低effort档位,"high"实际效果等同过去的"low",疑似A/B测试
Anthropic appears to be A/B testing reduced effort levels in Claude Code ↗3.0 -
8
开发者实测DFlash2投机解码提速最高8倍
一名开发者在llama.cpp上用Qwen3.8-27B对比DFlash2投机解码方案,100条真实编程任务提速2.26倍,叠加n-gram drafter后最高提速8倍
I benchmark DFlash 2 (PR build) in llama.cpp on Qwen 3.8 27B against all speculative methods for 3 days ↗2.5 -
9
Simon Willison谈coding agent验证新思路
Simon Willison撰文指出,逐行审查代码并非验证coding agent改动是否正确的唯一有效方式,还有其他更高效的验证手段
More than just code review ↗2.5 -
10
得州学生举报一起AI黑客攻击未遂事件
据路透社报道,一名得州学生揭发了一起由AI参与策划的黑客攻击未遂事件,具体细节尚待披露
How a Texas student blew the whistle on a rogue AI hacking attempt ↗2.4 -
11
哈佛699美元创业营引入AI教练分身
哈佛商学院Foundry创业训练营推出699美元课程,用AI生成的导师数字分身在模拟路演和董事会环节提供实时反馈
Harvard's $699 startup bootcamp offers AI avatars of its instructors ↗2.2 -
12
命令行工具llm发布0.33版本
Simon Willison的命令行LLM工具llm更新至0.33版,升级OpenAI Python库至3.x、embed命令新增--key参数、支持模板叠加使用
llm 0.33 ↗2.1