ITIMO创新库

实时信息流

仅保留近一个月的消息
  • 3 天实测 GPT Images 2.5:730 张生成数据统计与 5 大问题总结

    3 天高强度 GPT Images 2.5 ➡️ 数据统计 + 5 大问题总结:

    【总体感分】82/100 【核心问题总结】单次生成很强,多轮/复杂创作无法稳定地保持设计状态,成本不再是生成而是对齐

    【生成成功率】96.6% 【一次到位体感】75–80% 【专业连续编辑能力】74/100

    【时间】9.9-9.11 【生成总数】730张 【日均】243张 【用途】前2天测试(重广度,不重深度),第3天创作(重深度,不重广度)

    【返工】 25次 【返工密度】1次/29.2张,3.56/100张 【连续返工最长】6轮

    【创作返工】13次,占比52%(总返工 【返工密度】1次/26.8张,3.72/100张 【创作生成量】349张,占比48%(总量

    【核心问题】 【1】Identity Drift|主体身份漂移: 多轮/复杂组合任务中特征丢失、主体信息衰减

    【2】Style Drift|风格一致性不稳定: 连续 5 轮之后明显衰减/丢失

    【3】Structural Failure|结构错误: 手部、姿势、接触关系、机械结构设计等是最大结构短板 硬伤,暂无法很好解决,还停留在仅仅看个样子阶段

    【4】Design Failure|设计能力较差: 设计能力依旧是严重的语言式思维,并且在将语言式落实为视觉式表达能力很弱(常说的概念强手不行 经常把“重新设计”理解成“轻微修改”

    【5】Local Fix Cascade|局部修正容易引发新的漂移,也就是“修 A 坏 B”

    image.png
  • Google Research 发布 TimesFM-3 时序预测模型,首次支持多变量与已知未来事件

    Google Research 发布 TimesFM-3 时序预测模型,可同时处理多个相关变量,并利用折扣计划、天气预报等已知未来事件改进预测,每步输出九个值以刻画不确定性。

    image.png
  • 阿里 Qoder CLI 个人版 v1.1.50 开放自定义模型接入

    9 月 12 日消息,阿里 Qoder 今日宣布,从 v1.1.50 开始,Qoder CLI 正式向个人版用户开放自定义模型接入

    Qoder CLI 是阿里巴巴于 2025 年 10 月发布的 AI 编程命令行工具,属于 Qoder 智能体编程平台的产品形态之一。

    image.png
  • 生数科技发布 Motus2:面向灵巧操作的自进化通用世界模型

    生数科技发布面向机器人灵巧操作的世界模型 Motus2,将行动、预测、评估三种能力统一进同一个共享参数模型,形成生成动作、预测未来、评估结果、更新策略的闭环,并加入轻量触觉专家模块。

  • 从 Prompt 到 Graph:AI 工程成熟度梯子

    为什么你用同样的模型做 Agent,跑三步就陷入上下文腐烂? 因为你把说明书当成了架构。 把 Karpathy 在斯坦福讲的图上消息传递投射到今天的软件工程里,你会看清一条极度冷血的准则,

    这套被后人借势提纯出来的「AI 工程成熟度梯子」,结结实实戳中了全行业最痛的死穴:

    • 10% LLM:选一台运行时可重编程的计算机; • 30% Prompt:用自然语言写程序(只管这一拍说什么); • 50% Agent:给预测接上工具与记忆(只管这一拍调什么); • 70% Loop:把“做完”从“生成”里彻底拆出来(只管这一拍怎样算做对); • 100% Graph:决定哪些任务存在、谁并行、结果回流给谁(管这一拍该不该存在)。

    全网 90% 的团队至今卡在 30%–50% 的泥潭里打转: 一次生成漂移了就拼命改提示词,一出环境幻觉了就怪模型不够聪明; 然而真正的工业级生产力,全被后两层统治

  • Minitap 指控 Google Artemis 未署名使用其开源项目 mobile-use 代码

    Minitap 团队发文指认 Google 的移动设备自动化项目 Artemis 大量复用了其开源项目 mobile-use 的代码,包括完全一致的 Hopper agent 提示词和示例,却未在 README 中署名;更早的包文件曾列出三位作者,8 月一次 force push 将其替换为另一作者。

  • 苹果公布 SimpleDesign 蛋白质设计模型,可联合生成序列与三维结构

    苹果研究人员公布蛋白质设计模型 SimpleDesign,可联合生成氨基酸序列与三维结构,并直接在氨基酸序列和连续三维坐标上端到端训练,省去自编码器等中间表示环节。该模型使用超过 200 万组蛋白质序列与结构配对数据,在联合设计、结构生成和序列生成基准测试中表现具有竞争力。论文目前仅报告计算机评估结果,尚未经实验验证生成蛋白质能否实际折叠或发挥功能。

  • 月之暗面 Kimi K2.8 Preview 全量上线 Kimi Code,综合性能接近 K3

    9 月 11 日消息,月之暗面 Kimi K2.8 Preview 模型今日全量上线 Kimi Code,Model ID 不变,仍为 kimi-for-coding,客户端与第三方工具无需修改配置即可使用。

    官方表示,K2.8 Preview 综合性能接近 K3,思考效率更高。编码与智能体能力全面提升,思考(thinking)效率较 K2.7 Code 显著改善,全部会员档位均开放最高 1M 上下文窗口

    Kimi K2.8 Preview 支持 thinking effort 档位调节,与 K3 的思考等级一致,支持 low / high / max 三档(默认 max)。关闭 thinking 后,K3 系列与 K2.8 Preview 的请求均路由到 K2.8 Preview(无思考)。

    image.png
  • Cohere 发布 North Small Translate:218B MoE 翻译模型,WMT26 全语言均分 83.6

    Cohere 与 Cohere Labs 发布开源权重翻译模型 North Small Translate,采用稀疏 MoE 架构,总参数 218B、每 token 激活 25B,覆盖 50 种语言。

    image.png
  • 台积电 1.4nm 工厂最快 2027 年 4 月试产,较原计划提前约 1 年

    台积电位于台中的 1.4nm 半导体工厂计划 2027 年 4 月启动试产、2027 年下半年转入量产,较原定 2028 年量产提前约 1 年。该厂 2025 年 10 月动工,规划 4 座厂房,首座钢结构已完成,第二座 P2 预计明年 10 月完工,两座厂房可能在 2027 年 10 月启动量产。