实时信息流
OpenAI 完成超 10T 参数"Bel"预训练
OpenAI 据报已完成代号“Bel”的下一代预训练模型,总参数超 10T,规模接近 GPT-4.5,预计成为 Astra 与 GPT-6 的基础。Anthropic 因算力受限,被认为今年内难以应对 Astra 的公开推出,但预计明年初可重回领先。
阿里即将开源 Qwen3.8-Flash-Next
阿里即将开源 Qwen3.8-Flash-Next,这是一款基于下一代架构的开放权重多模态 MoE 模型,该架构将支撑即将推出的 Qwen4 系列。开发者可提前体验 Qwen4 的架构改进。有评论称 Qwen-3.8 27B 表现出色,并对 Qwen-4 27B 充满期待。
汤森路透推出首个大语言模型 Thomson,基于阿里 Qwen3.5-397B 构建
汤森路透推出其首个大语言模型 Thomson,基于阿里 Qwen3.5-397B 构建,总研发投入约 4000 万美元。该模型与帝国理工学院联合重训以保障安全与政治中立,并用自有内容进一步训练。Thomson 在斯坦福 LegalBench 得分 0.823,在 Harvey 法律智能体基准上接近 Opus 4.8。
阿里云通义万相 Wan 3.0 已上线 AI 创作平台 Pixmax
阿里云通义万相 Wan 3.0 已上线 AI 创作平台 Pixmax,主打电影级画质输出。新版本支持任意艺术风格下的视觉一致性、物理真实的流畅运动,以及多模态与混合现实编辑能力。即日起至 8 月 24 日,Pixmax 用户可享 30% 折扣;开发者还可通过 Model Studio 与 Qwen Cloud 获取 API 接入。
Apodex 1.1 发布:Agent Team 拆解复杂研究
Apodex 1.1 模型家族发布,主打异步 Agent Team 功能,可并行协调多智能体拆解复杂任务并持续整合结果。同步开源 FrontierAgent 本地研究工具台及 Apodex 1.1 mini 开放权重模型,后者支持本地运行复杂工作。
Fastino 发布 GLiNER2.5:以边界预测取代跨度枚举的信息抽取架构
Fastino 发布 GLiNER2.5,以边界预测取代跨度枚举,移除最大实体宽度限制,支持 4096 词上下文,计算量随序列长度线性增长。多语言检查点在 16 个零样本基准上整体 macro F1 达 56.17(GLiNER2 为 56.09),XNLI 提升 24.75 分。
Grok Voice Think Fast 2.0 现已在 Artificial Analysis 语音到语音指数中排名第一
Grok Voice Think Fast 2.0 现已在 Artificial Analysis 语音到语音指数中排名第一。 该指数衡量语音智能体能否对所听到的语音进行推理、解决真实客户问题,并使用智能体工具正确完成任务。

GPT-5.6 登陆 Kiro,为开发者提升性价比
GPT-5.6 模型家族现已登陆软件开发智能体 Kiro,包含 Sol、Terra 和 Luna 三款模型。在 Terminal-Bench 2.1 测试中,GPT-5.6 Terra 在 Kiro 内完成任务成本降低约 82%。该更新由 OpenAI 与 AWS 合作优化,旨在以更少迭代和更高 token 价值帮助开发者产出更高质量的代码。
阿里巴巴达摩院推出肝癌 AI 模型 DAMO LiON,可精准识别 1 厘米微小肿瘤
阿里巴巴达摩院联合中国医科大学附属盛京医院等机构研发出肝癌诊断 AI 模型 DAMO LiON,可通过 CT 影像识别微小肝脏癌变病灶。两个月真实世界前瞻临床试验中,该模型发现 15 例原本被遗漏的恶性肿瘤,绝大部分为 1 厘米左右病灶;AI 协助阅片用时减少 27%,对恶性肿瘤敏感性提高 11.5%,相关论文登上《自然·医学》。

新Claude模型在中等推理任务上表现优异,或为Opus 5.1更新
此前Thariq和Boris已回应批评,暗示将改进Opus 5并可能推出新Haiku。泄露的"claude-melon-eap"和"claude-marshmallow-eap"输出显示3D强化学习能力突出,但两者均消耗大量思考token,多次触及max-tokens上限。