-
1
Qwen3.8-Max上线,下周开源权重
阿里发布2.4T参数旗舰模型Qwen3.8-Max,主打自主编程与长程规划,下周同步开源Qwen3.8-Max与Qwen3.8-27B权重。
Qwen3.8-Max 发布:阿里新旗舰模型,下周开源权重 ↗4.4 -
2
Astra内测2千美元解10数学难题
据AI研究博主披露,OpenAI内测中的下一代模型Astra以约2000美元token成本解出10个数学与理论计算机科学难题,并附形式化Lean证明。
OpenAI 内测模型 Astra 据称以 2000 美元 token 成本解出 10 个数学难题 ↗3.6 -
3
OpenAI上线GPT-Live连续语音
OpenAI发布GPT-Live架构,采用无轮次(turnless)语音模型与低延迟设计,实现更自然的连续语音对话,历时六个月打造。
OpenAI 发布 GPT-Live:低延迟连续语音交互系统 ↗3.6 -
4
AI基建隐性负债达1.65万亿美元
Fortune披露AI超大规模厂商通过债券等隐性借贷为算力扩张融资,累计规模达1.65万亿美元,引发对AI资本开支可持续性的担忧。
AI 基建的隐性债务已达 1.65 万亿美元 ↗3.4 -
5
MiniMax H3开源,支持2K视频
MiniMax开源H3视频模型权重,支持原生音频与2K分辨率生成,ComfyUI已完成Day-0适配。
MiniMax H3 开源权重视频模型,ComfyUI 完成 Day-0 支持 ↗3.4 -
6
3.4
-
7
AI自动调参超越人类,Locus登顶
Intology的Locus系统自动后训练Qwen3模型,得分51.6%超越官方人类调优版本的49.4%,在扩展算力预算下取得SOTA。
Intology 的 Locus 自动化研究系统在 PostTrainBench 上超越人类调优 ↗3.4 -
8
4B小模型预测购物行为超大模型
基于Qwen3-4B微调的开源模型Athena在购物行为预测测试集上取得24.5%严格匹配率,超过GPT-5.6与Opus 4.8,已上传Hugging Face。
开源 4B 模型 Athena 在购物行为预测上超越 GPT-5.6 与 Claude Opus 4.8 ↗3.3 -
9
vibe coding工具进AWS私有云
AWS宣布支持vibe coding创业公司Superblocks嵌入客户私有云环境,被视为应用与底层模型解耦的又一步。
AWS 支持 vibe-coding 创业公司 Superblocks 嵌入私有云 ↗3.1 -
10
Karp批AI行业太马克思主义
Palantir单季利润达10亿美元后,CEO Karp再次警告前沿AI实验室不可信,称AI行业带有马克思主义倾向。
Palantir CEO Alex Karp:利润创纪录后再批 AI 行业太马克思主义 ↗3.0 -
11
2.6
-
12
2.5
-
13
DesignArena融资790万美元
AI审美评估平台DesignArena完成790万美元融资,为前沿实验室提供人类评估数据,全球用户超530万。
DesignArena 完成 790 万美元融资,为 AI 模型评估注入人类审美 ↗2.5 -
14
Claude Code新增Focus视图
Claude Code v2.1.221为VS Code新增Focus view功能,将工具调用活动折叠为可展开的每轮摘要,并显示实时运行状态。
Claude Code v2.1.221 发布,新增 Focus view 功能 ↗2.5