实时信息流
曝谷歌内部开始测试 Gemini 3.8 Flash 模型,Pro 和 Flash 系列"冰火两重天"
谷歌部分员工已开始试用 Gemini 3.8 Flash 预览版,该模型已登陆内部编程平台 Jetski。一名参与测试的员工称,其体验已明显好于 3.7 Flash,但现阶段还不适合下完整结论。谷歌正以数周为间隔快速更新模型,CEO 皮查伊希望将发布节奏提高到接近每月一次。
腾讯混元发布 Hy4 preview:770B 总参数、1M 上下文,开源上线
腾讯混元发布新一代旗舰模型 Hy4 preview,总参数 770B、激活参数 49B、上下文长度 1M,现已开源并在腾讯云 TokenHub 和 OpenRouter 上线。
蚂蚁百灵发布金融增强模型 Ling-3.0-flash-Fin,面向真实金融工作流
蚂蚁集团联合中金等机构发布金融增强模型 Ling-3.0-flash-Fin,延续 Ling-3.0-flash 架构,保持 124B 总参数、5.1B 激活参数,通过金融语料持续预训练强化年报、财务工作簿等复杂内容处理。
谷歌推出 Gemini Omni 1.1 Flash 视频生成 AI 模型,最高 4K 分辨率
谷歌推出 Gemini Omni 1.1 Flash 视频生成 AI 模型,最高可生成 4K 视频。新模型支持场景扩展(每次 10 秒步长,单条最长 40 秒)、指定首尾帧及最长 3 秒视频参考。360p 预览生成速度较标准 720p 最高提升 60%,成本仅为三分之一;价格从 360p 每秒 0.03 美元到 4K 每秒 0.3 美元不等。
Midjourney 开放 V8.2 图像编辑模型测试
Midjourney 开始向所有用户开放其首个 V8.2 图像编辑模型的测试。该模型支持指令编辑、以图生图(最多同时引用 4 张参考图)、局部重绘与扩画,并兼容个性化、moodboards 和 srefs 功能。用户可通过网页端或 Discord 的 --edit 命令使用,官方同步更新了 midjourney.com 与 alpha.midjourney.com 的界面。
Microduck 发布:不到 400 美元的开源强化学习机器人
Hugging Face 联创 Thomas Wolf 宣布推出 Microduck,一款 25 厘米、15 个执行器、配备摄像头、LiDAR 等传感器的开源双足机器人,支持用户通过强化学习自行训练。它开箱即用,内置行走、坐下、轮滑、拾取物体等多项预训练策略,售价低于 400 美元。

阿里云Qwen大会香港站:Agentic AI进入生产阶段
阿里云Qwen Conference Hong Kong 2026落幕,吸引600+行业领袖、16个解决方案展台。会上展示Qwen3.8-Max、QwenWork、Wan3.0、Qwen-Image-3.0等模型,释放明确信号:Agentic AI已从可能性走向生产落地。活动获AMD、Cyberport等合作伙伴支持。
英国实施全球首例 AI 实时辅助脑外科手术,成功切除脑部肿瘤
英国贝德福德郡48岁的里斯·希伯特成为全球首位在AI实时辅助下接受脑部手术的患者,伦敦大学学院医院医生成功切除其11mm垂体良性肿瘤。手术中AI实时分析内镜画面并追踪器械位置,标出血管和神经分布及相对安全的切除位置,帮助医生避开关键结构。该AI由伦敦大学学院研究人员开发,获英国国家卫生与护理研究院和谷歌资助,目前团队正筹备更大规模临床试验。
NVIDIA Vera CPU 正式出货:首款为 AI 智能体打造的处理器
NVIDIA 超大规模与高性能计算副总裁 Ian Buck 亲自向 AI 生态交付 Vera CPU 系统,标志着这款专为 AI 智能体设计的首款处理器开始大规模出货。Vera 是 NVIDIA 首款面向智能体场景打造的 CPU,现已进入规模化交付阶段。
谷歌推出全球首个双盲 AI 评估技术,基于加密环境保障基准测试公正性
8 月 27 日消息,谷歌宣布推出全球首个针对前沿专有 AI 模型的双盲评估,将外部评估限制在加密“黑箱”环境中,避免模型提前获取测试信息来优化性能。
就像学生考前不能提前看到试题才能真实反映水平一样,当前 AI 模型评估也面临同样问题:如果模型提前接触测试题目(也就是所谓的“基准污染”),评估结果的可信度就会大打折扣。
