当前位置:首页 » AI资讯 » AI日报

AI日报 · 2026-09-22

2026-09-22 1

模型发布/更新

小米发布并开源 MiMo-V2.6 系列,扩展强化学习规模迈向自我提升

Xiaomi MiMo 于今日正式发布并开源 MiMo-V2.6 系列模型,包含 Pro 与 Flash 两个原生全模态模型,称这是探索 RSI(递归自我改进)路径的关键一步。

来源:公众号:小米 MiMo

xAI 发布 Grok 4.7,主打编码与知识工作

xAI 发布 Grok 4.7,定位为其最强编码与知识工作模型,定价 $2/百万输入 token、$6/百万输出 token,与 Grok 4.6 同价同速,另有速度和价格加倍的快速变体。

来源:xAI:News(网页)

小米发布 MiMo-V2.6 Pro 与 Flash 全模态开源模型

小米 MiMo 发布 MiMo-V2.6 Pro 与 Flash 两个全模态模型,通过规模化强化学习训练。Pro 在多数 Agent 基准上与 Claude Opus 5 和 GPT-5.6 Sol 表现相当,在 Artificial Analysis Intelligence Index 得分 46,为开源模型中最高;能力覆盖编码、computer use、3D 推理和创作。

来源:X:小米 MiMo (@XiaomiMiMo)

小米发布开放权重模型 MiMo-V2.6-Pro,登顶 Artificial Analysis 开放权重模型智能指数

小米(Xiaomi)发布开放权重模型 MiMo-V2.6-Pro,在 Artificial Analysis Intelligence Index 得分 46,超越前代 MiMo-V2.5-Pro 的 26,为开放权重模型中最高。

来源:X:Clément Delangue(Hugging Face CEO) (@ClementDelangue)

通义千问发布 Qwen-Image-2.1:7B 单检查点同时支持图像生成与编辑

通义千问发布 Qwen-Image-2.1,一个 7B 参数的原生图像生成与编辑模型,生成和编辑共用单一检查点,最多支持 10 张参考图。模型自带提示词增强 LLM,已集成 diffusers 和 ComfyUI,并在 Hugging Face Spaces 提供免安装的浏览器在线 demo:https://huggingface.co/spaces/hugging-apps/qwen-image-2-1

来源:X:通义千问 / Qwen (@Alibaba_Qwen)

小米 MiMo-V2.6-Pro 登上 Code Arena: WebDev 榜约第10名,开源权重中约第3

小米发布 MiMo-V2.6-Pro 与 Flash 两款全模态模型,MiMo-V2.6-Pro 在 Code Arena: WebDev 榜以 1628 分(AutoEval)位列约第10名,开源权重(MIT 许可)中约第3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。

来源:X:Arena (@arena)

产品发布/更新

Kimi 发布 Kimi Code Desktop 1.0,macOS 与 Windows 版同步上线

Kimi(月之暗面)发布 Kimi Code Desktop 1.0,作为 Kimi Code 官方桌面客户端,macOS(Apple 与 Intel 芯片)和 Windows 版同步上线,下载地址为 kimi.com/code。

来源:公众号:月之暗面(Kimi)

行业动态

不列颠哥伦比亚省起诉 OpenAI,指其未在枪击案前将 flagged ChatGPT 活动转介警方

不列颠哥伦比亚省在加州起诉 OpenAI,指 flagged 的 ChatGPT 活动本应在 2026 年 2 月 10 日 Tumbler Ridge 枪击案前通报警方,该案致 8 人死亡(含 5 名儿童和一名教育工作者)、27 人受伤。

来源:X:Rohan Paul (@rohanpaul_ai)

亚马逊封禁 Meta Muse 智能体代用户购物,双方争端升级

亚马逊阻断了 Meta 个人 AI 智能体 Muse 代用户在其网站购物的访问权限,称从未许可该访问,并指 Muse 不表明身份、会采集保存用户账号凭证,带来隐私和安全隐患。

来源:IT之家(RSS)

技巧与观点

马斯克称 Grok 4.7 使 xAI 在智能体编码领域位列第三

Elon Musk 引用 Artificial Analysis 评测称,Grok 4.7 使 xAI 在智能体编码上排名第三,仅次于 Anthropic 和 OpenAI。

来源:X:Elon Musk (@elonmusk, xAI)

Nathan Lambert 撰文分析开源模型的中美实力格局

Nathan Lambert 发布其向美国国会汇报的开源模型现状综述,指出中国开源权重模型已在下载量、基准成绩和学术采用上领先,自 2025 年 7 月起在 Hugging Face 下载量上领先约 1.6B(总 3.2B,为美国两倍)。

来源:Nathan Lambert:Interconnects(RSS)

Artificial Analysis 评测 Grok 4.7:智能体知识工作跻身前沿,编码代理得分升至 56

Artificial Analysis 发布 Grok 4.7 评测,该模型在 Intelligence Index 得 46 分,较 Grok 4.6 高 2 分,AA-Briefcase 得 1657 Elo(+111),仅次于 Claude Opus 5 和 Claude Fable 5.1。

来源:Artificial Analysis 完整文章(网页)

数字生命卡兹克访谈汉化组:AI 时代字幕组与漫画组的真实处境

作者访谈多位字幕组与漫画汉化组成员,发现他们并不抵触AI。Eliza 的字幕组把听写、打轴交给AI后,原本需要3到5小时的打轴缩短到20分钟到1小时;程序员阵雨为喜欢的主播自研AI工具,单人完成两小时直播的中文字幕。漫画汉化组则因嵌字质量等原因仍坚持人工制作,成员看重的是同好社群与爱好本身。

来源:公众号:数字生命卡兹克

Tomer Tunguz 谈 AI 优化 if-then 判断:专用决策器把分类成本降近百倍

Tomer Tunguz 撰文提出最新一波 AI 正在接管软件中的 if-then 判断原语,Jev 与 SemIf 这类专用决策器以数百毫秒返回结果,成本比传统生成式调用低约 76x 到 209x。作者在自己的 Agent 中替换了约四分之一的调用,在 98 条人工核验的生产邮件线程上,Jev 达到 80%、本地 SemIf 达到 82% 的分类准确率,高于生产模型的 47%。

来源:Tomer Tunguz 博客(VC 分析)

Linear 重构 CI 流程应对 AI 编码带来的验证瓶颈,PR 等待时间从 6 分钟降至 5 分钟

Linear 工程师分享如何解决 AI Agent 加速写代码后 CI 成为瓶颈的问题,PR 等待时间从 6 分钟以上降至 5 分钟出头,单测 runner 时间约减半。

来源:Linear:Now(RSS)

扫码关注

qrcode

联系我们

回顶部