-
1
顶尖模型可合并代码得分仅 13%
Cognition 推出编码基准 FrontierCode,150 道由 20 多名开源维护者设计的任务考察补丁能否被合并;最强的 Claude Opus 4.8 在最难子集仅得 13.4%,GPT-5.5 6.3%。
Cognition 发布 FrontierCode:测 AI 代码能否被真实维护者合并 ↗4.6 -
2
SpaceX 递表,押注太空 AI 算力
SpaceX 招股文件称 AI 市场或达 26.5 万亿美元,因地面电力受限,计划 2027 年底实现年部署 1GW 太空 AI 算力、逐年数量级递增,最终冲 1TW。
SpaceX IPO 文件押注太空 AI 数据中心 ↗4.0 -
3
OpenEnv 落户 HF,多家联合共管
智能体环境协议 OpenEnv 迁入 Hugging Face,由 Meta-PyTorch、Nvidia、Prime Intellect、Unsloth、Modal 等组成委员会共管,定位训练用的统一接口层而非奖励框架。
智能体环境标准 OpenEnv 迁入 Hugging Face,多家联合共管 ↗4.0 -
4
苹果端侧塞进 200 亿参数模型
苹果在设备端运行 20B 模型,用一个小模型按查询预测要从闪存加载哪些专家、整段生成沿用同一组专家,区别于逐 token 切换的常规 MoE,以此压进内存。
苹果端侧跑 20B 模型用按查询加载专家的异构架构 ↗3.8 -
5
哈佛让智能体组队自主做科研
哈佛 AutoScientists 把多个智能体连成无主管的自组织科研团队,共享工作区并行探索、互相批评;BioML-Bench 取得 74.4% 平均分位,GPT 训练提速 1.9 倍。
哈佛 AutoScientists:由智能体组成的自组织科研团队 ↗3.8 -
6
微软开源工具被投毒窃开发者密码
攻击者篡改微软维护的开源工具并植入窃密代码,盗取 AI 开发者的账号密码,再次暴露 AI 软件供应链的投毒风险;TechCrunch 报道登上 HN 首页。
微软开源工具被投毒,窃取 AI 开发者密码 ↗3.6 -
7
两巨头同提放缓 AI 需全球协调
Anthropic 与 OpenAI 在各自最新「下一步」文章中均提到放缓 AI 发展的可能性,但都强调须依赖一套尚未确定的全球协调机制才能落地。
Anthropic 与 OpenAI 同提放缓 AI,但需全球协调 ↗3.6 -
8
Meta 公布 VLA-JEPA 技术细节
LeCun 转发 LeRobot 的 VLA-JEPA 后续线程,拆解视觉-语言-动作模型的架构、训练与演示配方,延续 JEPA 路线切入机器人控制。
Meta 放出 VLA-JEPA 视觉-语言-动作模型技术细节 ↗3.4 -
9
Perplexity 锁定 2028 年 IPO
CEO Srinivas 向 CNBC 表示,无论 Anthropic、OpenAI、SpaceX 上市表现如何,Perplexity 都将于 2028 年 IPO,并称下一阶段会惩罚无脑烧 token。
Perplexity 称无论同行如何都将 2028 年 IPO ↗3.2 -
10
Gemma 4 MTP 合入 llama.cpp
谷歌 Gemma 4 的 MTP 多 token 预测正式并入 llama.cpp,可与 Gemma 4 QAT 量化搭配,得到更快、更轻量的本地推理部署。
Gemma 4 MTP 正式合入 llama.cpp ↗3.1 -
11
3.0
-
12
谷歌开源实时音乐模型 Magenta RT2
Google Magenta 发布 Magenta RealTime 2,开放权重的实时音乐生成模型,登上 GitHub 趋势榜,并附预构建的应用与插件。
谷歌开源实时音乐模型 Magenta RealTime 2 ↗3.0 -
13
Mercor 创始人炮轰红杉双重定价
Mercor 创始人 Brendan Foody 公开指责红杉等顶级机构把同一份股权按两种价格出售,质疑其在估值上玩定价花招。
Mercor 创始人炮轰红杉「双重定价」估值手法 ↗3.0 -
14
K、V 可共享,KV 缓存砍半
一篇被广泛转发的论文显示 Transformer 可让 Key、Value 共用同一投影,KV 缓存减半而困惑度仅升 3.1%;叠加 GQA/MQA 最高可省 87.5%。
QKV 研究:Key 与 Value 可共享,KV 缓存砍半 ↗2.9 -
15
AI「摇滚明星」程序员留下烂摊子
一篇登上 HN 首页(93 分)的博文讨论 AI 辅助下高产却低质的「摇滚明星」开发者,团队不得不为其代码善后,呼应当下的可维护性焦虑。
博文:替「AI 摇滚明星」程序员收拾烂摊子 ↗2.8