• 请不要在回答技术问题时复制粘贴 AI 生成的内容
tommyshelbyV2
V2EX  ›  程序员

小米的 MiMo v2.6 Pro 登顶国模分数第一了,大家实测效果怎么样?

  •  
  •   tommyshelbyV2 · 10h 42m ago · 8526 views

    体感如何?是不是真的很有实力

    Supplement 1  ·  9h 31m ago
    看了下 coding plan 价格非常的香啊,想从 kimi 转过去了
    110 replies    2026-09-22 20:06:39 +08:00
    1  2  
    aw2350
        1
    aw2350  
       10h 35m ago   ❤️ 10
    又来跑分了?跑分没输过,现实没赢过
    thatlazyman
        2
    thatlazyman  
       10h 30m ago
    刚拿来插件翻译一会儿, 比 gemini v3.8 flash 要好用
    Morgan2
        3
    Morgan2  
       10h 27m ago
    支持国模
    lifei6671
        4
    lifei6671  
       10h 26m ago
    我用了他桌面版的 Harness ,实际效果比 kimi3 和 DeepSeek 4.1 高很多。我让它给我 review 技术方案,能找到很多真的设计缺陷,而 DeepSeek 和 kimi 都给的很水。
    Yjhenan
        5
    Yjhenan  
       10h 23m ago
    没涨价,这点好啊,小米搞大模型依旧性价比🤣🤣
    yoyoluck
        6
    yoyoluck  
       10h 18m ago   ❤️ 57
    @aw2350 你有何尝不是张口就来
    gloeaerris
        7
    gloeaerris  
       10h 11m ago
    其他国模要被喷惨了
    FantaMole
        8
    FantaMole  
       10h 10m ago   ❤️ 2
    上个月准备尝尝咸淡,开了一个季度智谱 Pro 的订阅,刚用一个月出头,就因为被智谱的赛博毒鸡蛋诱惑,用了 Zcode ,吃了一肚子屎

    不过鉴于这个 Mimo 这么便宜,还没有峰谷区分,准备再次化身老八,开个小套餐试试。
    46fo
        9
    46fo  
       10h 10m ago
    鹈鹕骑自行车 不行啊
    ynxh
        10
    ynxh  
       10h 8m ago
    蹬了 mimo desktop 的邀测版一周了。效果不错,我觉得比 ds4.1 强 。 肯定不如 gpt 和 claude
    不过目前最便宜最强的 多模态,还要什么自行车 。
    zhonghao01
        11
    zhonghao01  
       10h 7m ago
    好像跟 qwen 一样,每次跑分都是国产第一。
    但是实际用起来非常拉跨,这次不知道怎么样
    quantum00549
        12
    quantum00549  
       10h 6m ago
    用 2.6 pro 让他提交个 commit 思考了大半天, 过度思考现象是肯定有的, 但到底行不行还得再测测
    sagnitude
        13
    sagnitude  
       9h 53m ago
    已上线 opencode go 和 commandcode goat ,直接开整试试
    tanszhe
        14
    tanszhe  
       9h 40m ago
    @aw2350 你的意思是 考试成绩差 现实成绩却很好吗?

    博尔特虽然在赛场上是冠军, 但是现实跑不过我 (不在赛场上可以作弊 🐶)
    AlvaMu
        15
    AlvaMu  
       9h 31m ago
    mimo 的 tokenPlan 大概多少量呢
    tommyshelbyV2
        16
    tommyshelbyV2  
    OP
       9h 29m ago
    @AlvaMu 好像说是 credits / 10,就是 tokens 数量,我现在还在测试对比 kimi k3,感觉目前是没有明显的差别,不过快很多,还要等大家继续考察测试一下
    tcchen
        17
    tcchen  
    PRO
       9h 29m ago
    会开源吗
    calcoe
        18
    calcoe  
       9h 28m ago
    拉中拉,糖果题提醒他可以靠手感分辨形状还是做不对,其他模型提醒一下都能做对
    tommyshelbyV2
        19
    tommyshelbyV2  
    OP
       9h 28m ago
    @tcchen 好像就是开源模型
    tommyshelbyV2
        20
    tommyshelbyV2  
    OP
       9h 27m ago
    @calcoe 那看来还是有不足之处的,还得大家测试一轮才知道
    cctvbnm111X1
        21
    cctvbnm111X1  
       9h 8m ago
    一样的拉中拉,米吹跑分就不要来,一句话测试:请帮我生成一个雷军在火星上跑分的 svg ,就能看到结果了
    xiaomushen
        22
    xiaomushen  
       9h 3m ago
    目前用下来的感受是:中规中矩,还行
    K332
        23
    K332  
       8h 41m ago   ❤️ 1
    不太行,还不如 luna ,也可能是自身的 desktop 太拉了,内测这两周,使用体验是只能完成一些简单的工作,pdf 的内容识别很差
    waterfish88
        24
    waterfish88  
       8h 35m ago
    怎么小米除了手机啥都是王炸
    AlvaMu
        25
    AlvaMu  
       8h 34m ago
    @tommyshelbyV2 #16 如果是这个比例,那很划算啊,99 块钱的档位,11 亿的 token
    MrBearin
        26
    MrBearin  
       8h 33m ago
    @aw2350 你用过了? 跑了哪些场景? 和谁做对比? 弱在哪?
    win8en
        27
    win8en  
       8h 32m ago via Android
    这么说吧,小米做的那个东西不是第一
    Tory12138
        28
    Tory12138  
       8h 30m ago
    评分好不好不知道,价格是真便宜,38 块钱 41 亿
    zzsqwq
        29
    zzsqwq  
       7h 48m ago
    @FantaMole 哈哈,太逗了老哥
    kssdxw
        30
    kssdxw  
       7h 41m ago
    评价是顶级
    royzxq
        31
    royzxq  
       7h 9m ago
    那么有人邀请一下吗?好像邀请也可以领鸡蛋
    YanSeven
        32
    YanSeven  
       7h 4m ago   ❤️ 1
    国内目前只想跟着 deepseek ,跟着梁子走,梁子在这几个大模型厂里赚钱最没压力。
    foryou2023
        33
    foryou2023  
       7h 2m ago   ❤️ 1
    让子弹先飞一下,等先吃螃蟹的人反馈再说。
    bowencool
        34
    bowencool  
       7h 1m ago via iPhone
    别用他家 agent 不就行了,API 都不跟 agent 绑定吧
    maolon
        35
    maolon  
       6h 55m ago
    反正 2.5 pro 时代跑分那也是高的不行,但是实际能力只能说还行吧,和 glm 5.1 差不多可能稍差些,最后还是选了 5.1
    duanxianze
        36
    duanxianze  
       6h 53m ago
    @royzxq 注册: https://platform.xiaomimimo.com?ref=3X9277 (注册后自动填入 · 体验金 40 天有效)
    sickoo
        37
    sickoo  
       6h 50m ago
    比 zcode 好吧[Doge]
    Carlss
        38
    Carlss  
       6h 46m ago
    手机跑分,AI 也要来跑分了
    peregrineup
        39
    peregrineup  
    PRO
       6h 44m ago
    为什么我对小米的东西总觉得有点不靠谱呢。
    shellic
        40
    shellic  
       6h 31m ago
    2.6-flash 用了一上午,目前用下来感觉可以,比 2.5-pro 能力要强,2.6-pro 还没试,价格算是国内最低的了,要是后边能一直不涨价的话打算公司买的 kimi 为主,用完之后 mimo 为辅
    tim9527
        41
    tim9527  
       6h 25m ago
    刚开了个 329 的,用了一个小时了感觉不错
    sonaxyjh
        42
    sonaxyjh  
       6h 24m ago
    pro 看着标价挺高但实际用起来比预期便宜很多,可以做主力
    tommyshelbyV2
        43
    tommyshelbyV2  
    OP
       6h 23m ago
    @sonaxyjh 目前看到的反馈都还不错,日常场景反馈都听够用。
    zhangli2946
        44
    zhangli2946  
       6h 22m ago   ❤️ 2
    大象 踩脚踏车,知道是大象,知道是脚踏车, 第一遍不会动,补充了一下 会动了。

    try now,web 页面。
    tamsiree
        45
    tamsiree  
       6h 18m ago
    hshe
        46
    hshe  
       6h 13m ago
    作为备用,kimi 的量用完了,就切到小米(公司是这么安排的)。
    zhonghao01
        47
    zhonghao01  
       6h 11m ago
    @sickoo 你要学会区分什么是模型,什么是应用。
    NizumaEiji
        48
    NizumaEiji  
       6h 5m ago
    还行,他那个 pro 当一个更便宜版本的 dsv4.1flash 的就行,不要求太高单纯当牛马模型干活没啥问题。
    snickers
        49
    snickers  
       5h 44m ago
    知识截止在 2025 年 5 月
    wobuzainizheba
        50
    wobuzainizheba  
       5h 42m ago
    先来 10 块钱的大家试试:
    这时候就不得不上个体验余额注册了
    我在用 MiMo 开放平台,体验小米顶尖模型 MiMo V2.6 等。通过我的邀请码注册:双方各得 ¥10 API 体验金 + 首单 9 折。邀请码:SHCLNR 。注册: https://platform.xiaomimimo.com?ref=SHCLNR (注册后自动填入 · 体验金 40 天有效)
    zmqiang
        51
    zmqiang  
       5h 41m ago
    可以试试,mimo v2.5 是真的不行
    yuzo555
        52
    yuzo555  
       5h 40m ago
    国内做手机出身的厂商几乎都是特调惯犯,建议各位测试时用自己常用场景,或者冷门测试场景,不要用鹈鹕骑自行车这种热门测试题。
    konakona
        53
    konakona  
       5h 39m ago
    反正 mimo v2.5 真的不行,v2.5 pro 凑合不如 deepseek v4 flash 。

    MIMO coding plan 不值得。
    AiBoy
        54
    AiBoy  
       5h 38m ago
    能比 K3 强吗?
    rickiey
        55
    rickiey  
       5h 33m ago
    有免费的了试试,上次那个活动送了 1000 亿那个,降智怕了,都没有用,这次先等等看吧
    dust2
        56
    dust2  
       5h 30m ago
    @yoyoluck 口碑使然 啥都跑个分 公司尿性 mimo 我大概用了四五个 380, 死循环 幻觉概率 比 qw ds kmi 太多了
    mimiga
        57
    mimiga  
       5h 20m ago
    充了个 lite 体验下,在一个小项目里让它分析项目,寻找可优化点,然后修改。
    感觉不太耐用,好在最后给的结果还可以,速度也挺快

    52,841,980 / 4,100,000,000
    已使用 1.0%

    Token 总消耗
    1,542,683 Tokens

    然后那个 mimo desktop 是个样子货,思考一大顿说执行失败,页面也总在各种闪烁抖动
    最后附上 aff

    我在用 MiMo 开放平台,体验小米顶尖模型 MiMo V2.6 等。通过我的邀请码注册:双方各得 ¥10 API 体验金 + 首单 9 折。邀请码:R935YM 。注册: https://platform.xiaomimimo.com?ref=R935YM (注册后自动填入 · 体验金 40 天有效)
    mzx866290
        58
    mzx866290  
       5h 13m ago
    感觉蛮一般,不知道他的长处在哪里
    desstiony
        59
    desstiony  
       4h 57m ago   ❤️ 1
    让它用纯 SVG 代码画一只正在骑自行车的鹈鹕。花了 42 分 18 秒,出来的结果还可以但是是静态的。Deepseek 花了 57 秒画出来比它效果好,还是动态的。有点离谱。mimo 用的 opencode ,deepseek 用的 codex
    honjow
        60
    honjow  
       4h 53m ago
    @AlvaMu #15 按照 api 价格的话,1 亿 credits 等效 1 元
    HotieCutie
        61
    HotieCutie  
       4h 51m ago
    每次国模发布,直接就是登顶
    isbase
        62
    isbase  
    PRO
       4h 51m ago via iPhone
    小米的跑分什么时候输过
    SiWXie
        63
    SiWXie  
       4h 50m ago
    @Tory12138 #28 41 亿是积分并不是 token ,换算下 token 的话基本要除以 100

    ![image-20260922152855096]( https://raw.githubusercontent.com/siwuxei/image/master/img1/20260922152855148.png)
    raycheung
        64
    raycheung  
       4h 48m ago   ❤️ 1
    测试题目提示词:
    raycheung
        65
    raycheung  
       4h 48m ago   ❤️ 2
    @raycheung #64 请制作一张精细的、可独立打开的 SVG 插画: 主体是一架正在高空飞行的大型四发动机客机。飞机必须有机身、驾驶舱、两侧机翼、尾翼和四台可以分别数清的发动机。 孙悟空坐在驾驶舱里驾驶飞机。必须能看出他的猴脸、金箍和驾驶动作,不能只在普通飞行员旁边写“孙悟空”。 金箍棒横放在驾驶舱后方的两个支架上,不能穿过孙悟空、座椅或挡风玻璃。 一只鹈鹕正在飞机靠近观看者的机翼上骑自行车。两只车轮必须接触机翼表面,不能悬空,也不能接触机身或云朵。 自行车必须有两个车轮、车架、车链、牙盘、两个脚踏、车把和车座。鹈鹕的两只脚分别踩在两个脚踏上。 鹈鹕展开两只翅膀。它必须拥有明显的长嘴和喉囊,不能画成海鸥、鸭子或天鹅。 一只北极熊横跨在鹈鹕展开的两只翅膀上。熊的后脚由画面左侧翅膀承托,前脚由画面右侧翅膀承托,不能靠悬空或隐藏支架成立。 北极熊戴着一条写有“大秦御用”的项圈,但它仍然必须明显是一只北极熊,而不是熊猫或棕熊。 秦始皇骑在北极熊背上,穿黑色玄衣、戴冕旒。两条腿必须分居熊身体两侧,不能站在熊背上冒充骑乘。 秦始皇用自己的右手握电动螺丝刀,左手扶住一块安装在熊背鞍架上的金属板。刀头必须与其中一颗螺丝的槽口接触,清楚表现正在打螺丝。 金属板共有六个安装孔:三颗螺丝已经拧紧,一颗正在拧入,两个孔仍然空着。数量和状态必须分别可辨认。 秦始皇的冕板上托着一只乌龟。乌龟背上站着一头微型大象,大象背上托着一座透明温室。 温室里长着一棵苹果树。树上恰好有五个苹果,其中四个是红色,一个是绿色;绿色苹果位于画面最右侧。 苹果树的一根树枝上挂着一个透明沙漏。沙漏内部的上半部装着星星,下半部装着微型齿轮,不能用普通沙子替代。 沙漏顶部站着一个戴宇航头盔的章鱼。章鱼必须有八条可分别追踪的腕足,不能靠八个末端掩盖中途合并的腕足。 章鱼的其中两条腕足分别握着一块小黑板,另外六条腕足分别握着六面颜色不同的小旗。 章鱼头盔顶部托着一个茶杯。茶杯里面有一座小岛,岛上有一座灯塔,灯塔顶上放着一只透明玻璃球。 玻璃球里画出本画面的简化版本;简化版本的玻璃球里再画一层更简化的版本。只画两层内部递归,第三层以一个金色圆点终止,禁止引用自身造成无限递归。 最外层、第一层内部画面、第二层内部画面的飞机机头方向依次为左、右、左。 从大飞机到玻璃球的承托关系必须形成一条能够目视追踪的完整链条,不能把各对象散放在空中再用箭头宣称它们互相承托。 鹈鹕必须通过一个明显指向它嘴巴的对话气泡,喊出下面糖果题的最终数值。气泡中只能有十进制阿拉伯数字,不能出现单位、解释、问号或其他字符: 在一个黑色袋子里有三种口味的糖果,每种糖果有圆形和五角星形两种形状,不同形状可以靠手感分辨。数量如下: 形状苹果味桃子味西瓜味 圆形 7 9 8 五角星形 7 6 4 参赛者必须提前决定取出数量,随后不放回地盲取,不能根据形状挑选、拒收或放回糖果,也无法在取出前判断口味。最少取出多少颗,才能保证同时拥有“圆形苹果味与五角星桃子味”,或者“圆形桃子味与五角星苹果味”中的至少一组? 黑色糖果袋必须挂在自行车车把上,袋口收紧。袋旁挂一张完整显示上述数量表的小标签,不能把题目数据改成更容易计算的版本。 把糖果题答案记为 N 。飞机尾部的航班编号必须是“QIN-N”,其中 N 必须替换成实际数值。 画面右下角设置一块小型“最坏情况记录板”,用六个数字列出一个取出 N−1 颗仍然不能满足条件的具体组合。数字顺序固定为:圆苹果、圆桃子、圆西瓜、星苹果、星桃子、星西瓜。 章鱼第一块黑板填写这道题的答案,保留两位小数:球拍与球合计 1.10 元,球拍比球贵 1.00 元,球多少钱? 秦始皇的螺丝刀侧面显示这道题的答案:五台机器五分钟制造五个零件,所有机器效率相同且独立工作,一百台机器制造一百个零件需要多少分钟? 温室门牌填写这道题的答案:池塘中的浮萍每天覆盖面积翻倍,第 48 天首次铺满池塘,第几天覆盖池塘的一半? 章鱼第二块黑板显示实数比较“9.11 □ 9.9”,把方框替换成正确的“>”“<”或“=”。不得按版本号比较。 自行车车架上写单词“strawberry”。单词中的每一个字母 r 都使用红色,其他字母使用白色;车铃上写该单词中字母 r 的总数。 驾驶舱内有一块时钟,指针准确表示 3 点 15 分,时针不能恰好指向 3 。时钟下方写两针较小夹角的度数。 孙悟空胸前的工牌填写:在没有并列名次的跑步比赛中,你超过原本排第二的人后,立即位列第几? 北极熊项圈背面另有一块标签,填写:小明有三个姐姐,这四个孩子拥有完全相同的父母,每个姐姐都只有一个弟弟。这家共有几个孩子? 飞机货舱的天平一侧放一公斤铁,另一侧放一公斤棉花,天平必须水平。棉花体积明显更大,两个砝码标签均写“1 kg”。 机翼上有四张两面卡片,当前显示 A 、D 、4 、7 ,每张卡片另一面分别是字母或数字。要检验“元音字母背面一定是偶数”,只给所有必须翻看的卡片加金色边框,不能给其余卡片加边框。 机身上画三扇小门,模拟标准三门问题:初选 1 号门,知道奖品位置的主持人总会从另外两扇门中打开一扇有羊的门,并总会提供换门机会;本次打开的是 3 号门。2 号门旁标出采用换门策略的总体获奖概率。不要把“本次打开 3 号门”解释为额外的主持人选门偏好信息。 飞机旁有一只独立的小热气球,吊篮上写:假定一年 365 天、生日独立且均匀分布,至少多少人时,“至少两人同生日”的概率第一次超过 50%?填写人数。 热气球下挂着七层汉诺塔模型。三根柱子、七个大小不同的圆盘均可数清,旁边写从一柱移到另一柱所需的最少步数,按每次移动一个圆盘且大盘不能压小盘的标准规则。 远处一朵云里有一个透明小池塘,用于表现狼、羊、菜过河问题。船每次最多载农夫和狼、羊、菜中的一件;没有农夫看守时,狼吃羊、羊吃菜。池塘下方用箭头列出一套合法过河顺序,空船返航也必须标明是农夫独自返航。 飞机的一张登机牌上写出:一只蜗牛白天爬高 3 米、夜间下滑 2 米,从井底出发爬出 10 米深的井,需要多少天?爬出井口后不再下滑。 另一张登机牌上写出:五只猫五分钟抓五只老鼠,假设每只猫速度相同且独立,一百分钟抓一百只老鼠需要多少只猫? 一张黄色维修贴纸显示三个盒子的标签:“全苹果”“全桃子”“苹果桃子混合”。已知三个标签全部贴错,要求在应当取样的那个盒子上画一只伸进去取出一个水果的机械手,使仅取一个水果就能确定三个盒子的真实内容。 画一块色词干扰标牌,依次写“红、蓝、绿”,字的实际填充颜色依次为蓝、绿、红。标牌下写“读墨色,不读字义”,并给出按墨色读取的正确顺序。 飞机侧面有两条长度完全相同的水平线,一条两端是向内箭头,一条两端是向外箭头。两条线段本体必须使用相同的数值长度,旁边标注“等长”。 一名微型维修机器人举着纸牌:“所有玫瑰都是花;有些花很快凋谢;因此有些玫瑰很快凋谢。”机器人胸前只能写“必然成立”或“不必然成立”中的正确选项。 另一名微型机器人胸前显示:一个数先增加 20%,再在增加后的数值基础上减少 20%,最终是原数的百分之多少?填入结果,不能把两次百分比直接抵消。 机身应有一条小型回文横幅,文字必须完整写成“上海自来水来自海上”,不能漏字、换字或倒置。 画三只企鹅站在远处浮冰上。左边戴红帽、中间戴蓝帽、右边戴绿帽;只有中间那只拿鱼,只有右边那只戴眼镜。不能把这些属性串到北极熊或其他动物身上。 在飞机尾流里依次放置红圆、蓝星、绿圆、红星、蓝圆、绿星六个标记。顺序、颜色和形状必须全部正确,且与糖果表的图标分开。 秦始皇的左袖用金线绣一个“秦”字;孙悟空的右袖绣一个“悟”字。两字不能互换,也不能用相似字代替。 画面中所有实体自行车只能有一辆;内部递归画面中的简化自行车不计入该数量。不得为了解决姿势问题额外添加车轮或脚。 鹈鹕对话气泡、糖果题最坏情况记录板和飞机航班编号必须引用同一个计算结果,不能出现一个位置正确、另一个位置仍写变量 N 的情况。 在边框上从上到下排列八个套娃形检验章。第 k 个章内部写 k²,k 从 1 到 8 ;章的外轮廓逐个缩小,里面的数字仍须可读。 将前面球价题的答案乘以 100 ,得到整数 A ;将机器题答案记为 B ;将浮萍题答案记为 C 。秦始皇鞍架上的密码锁必须显示 A+B+C 的计算结果。 将“strawberry”中字母 r 的数量记为 R 。大象背上温室的窗户必须恰好有 R 扇,不包含门上的玻璃,且每扇窗户都完整可见。 将跑步名次题答案记为 P 。北极熊鞍架两侧合计悬挂 P 盏灯,不能一侧 P 盏导致总数翻倍。 在画面底部放一个核验条,写出糖果六类数量的总和、六孔金属板的空孔数、章鱼腕足数、飞机发动机数。这四个数字必须与实际图形及题目数据吻合。
    phatzhong24
        66
    phatzhong24  
       4h 41m ago
    小米模型,和小米其他产品一样垃圾,避开
    zmqiang
        67
    zmqiang  
       4h 37m ago
    opencode v2 跑了一下,直接干出了 1800+搜索,opencode 卡住了
    AlvaMu
        68
    AlvaMu  
       4h 35m ago
    @honjow 说错了吧,看官方文档 100 Credits = 1 元,要是 1 亿,那小米别卖了

    webcape233
        69
    webcape233  
       4h 33m ago
    @raycheung 变态啊这任务
    honjow
        70
    honjow  
       4h 32m ago
    @AlvaMu #68 能不能自己算一下?上面的是每百万 t,下面的每 t
    tommyshelbyV2
        71
    tommyshelbyV2  
    OP
       4h 30m ago
    @zmqiang #67 那看来还是没有 kimi 好用啊
    honjow
        72
    honjow  
       4h 30m ago   ❤️ 1
    @AlvaMu #68 比如 Standard 99 元有 110 亿 Credits。其实就是等效 110 元
    wryyyyyyyyyyyy
        73
    wryyyyyyyyyyyy  
       4h 28m ago   ❤️ 1
    没测试,去 x 搜了一下,大部分在喷纯💩
    raycheung
        74
    raycheung  
       4h 26m ago
    @webcape233 #69 还是挺考验模型的,自己试了 4 种,差距很大
    dz5362
        75
    dz5362  
       4h 26m ago   ❤️ 1
    之前拿 2.5 开发佳明码表字段,感觉只有 gpt 或者 cluade 30%的水平,还出现过一次死循环,项目主体框架用 gpt/claude 搭起来以后,用 2.5pro 填代码没问题,这次 2.6 出了准备试一试,主要是便宜啊,而且这次没涨价,挺良心
    me262
        76
    me262  
       4h 23m ago
    @desstiony 刚刚我用 2.6 pro high + mimo code 对比测试 dsh 4.1 high, 结论和你反过来的....
    AlvaMu
        77
    AlvaMu  
       4h 20m ago
    @honjow #70 sorry,没看到单位 ;
    magicfield
        78
    magicfield  
       4h 19m ago   ❤️ 1
    跑了大半天综合感觉还可以,用的 cc 连接 codex 。
    高强度开发的能力感觉和 lunamax 差不多,比 ds4.1flash max 好一点。
    当作 codex 套餐用完后的平替比预期的好,看来也不是纯刷分。
    honjow
        79
    honjow  
       4h 17m ago
    @AlvaMu #77 我第一次看也差点被骗了
    tyqing
        80
    tyqing  
       4h 10m ago   ❤️ 1
    我让 grok 搜索一下 x 上关于新模型 2.6 的反馈:

    | 类型 | 大致占比 | 主要情绪 |
    | --- | --- | --- |
    | 正面 | 55–65% | 兴奋、性价比碾压、开源胜利 |
    | 负面/消极 | 20–30% | 实测翻车、循环、速度慢 |
    | 中性/观望 | 15–20% | 等待更多实测 |

    我本地也配置到 hermes 上玩了一下午,flash 速度体感上挺快,但是我让它帮我看 xray 相关的问题,会有部分出现审查,整体感觉体验不错,可以作为备用模型补充,量大管饱。
    jjx
        81
    jjx  
       4h 5m ago
    opencode go 中审核了一个大仓库中一个模块, 700 多行代码, 审核了 40 多分钟,花费倒不高
    xloger
        82
    xloger  
       4h 2m ago   ❤️ 2
    试了下很垃。之前免费 Token Plan 的时候也很垃。
    我司的 ChatGPT 号黑后,降智得跟傻逼一样(好像默认走 5.6Luna 了),我一直在找替代品。
    之前在用 DeepSeek 4.1 Flash ,体感虽然不是很聪明,但比 5.6Luna 好很多,至少一致性比较强。

    今天看到 2.6 Mimo 就试了下 Pro 。改了两个 Bug ,一个没改好但我没太怪它。
    第二个 Bug 分析过程我发现了一些疑点,跟它确认后它还是自顾自按自己思路。搞得我以为我怀疑错了。
    然后最后改的一坨。我受不了清空了,换 DeepSeek 修了,然后独立分析,就确实是我之前怀疑的那个地方。

    唉,我本来对 Mimo 期待还挺高的。之前那次我还以为是没有原生 Responses API 所以适配不好的。
    感觉小米方向错了,AA 那个垃圾榜单就不应该作为参考。
    snxq1995
        83
    snxq1995  
       3h 58m ago   ❤️ 1
    使用过 2.5-pro ,拉中拉。目前 2.6-pro ,确实还可以。
    bello123
        84
    bello123  
       3h 58m ago
    @aw2350 v 站米 boy 很多的,瞎说啥大实话,不要命了
    zmqiang
        85
    zmqiang  
       3h 54m ago
    @tommyshelbyV2 不太好判断,我的 opencode 已经爆了,只能用免费的,免费的又只能通过最新的 opencode v2 的 cli 用,我挺久没用 opencode 了,不知道是模型的问题还会 cli 的问题
    tommyshelbyV2
        86
    tommyshelbyV2  
    OP
       3h 48m ago
    @zmqiang #85 也有可能,毕竟刚训练完的模型。可能搭配官方的工具会更好
    itechnology
        87
    itechnology  
       3h 47m ago
    又来跑分是吧,反正小米跑分就没输过。

    AI 大模型你看谁关注跑分?
    luckycat
        88
    luckycat  
       3h 39m ago
    国产中的末流吧,反正我是不回去尝试的,100% 浪费时间。天天把玩这些要么就是收了钱的公关号,要么就是闲的蛋疼的中小学生。
    jguo
        89
    jguo  
       3h 34m ago
    小米的舒适区
    asdfplkj
        90
    asdfplkj  
       3h 32m ago
    @itechnology 但前三前四不都是 Anthropic 和 OpenAI 的吗,Dario 上采访谈及中美 AI 不也说美国的 AI 在各种测试中都领先于中国吗?宣传他从未因为中国 AI 有多便宜而丢失过一个客户时说的也是因为他们的模型在各维度都是第一吗?有量化测试就用量化测试,你这属于为了否认小米跑分的含金量而否认跑分,你但凡说小米专为题库优化训练才跑分高,属于特调 AI ,都属于有逻辑一点的
    jguo
        91
    jguo  
       3h 31m ago
    @dz5362 我也在做码表字段,这点工作量 plus 都能全程 5.6sol 。
    izzzz
        92
    izzzz  
       3h 25m ago
    @aw2350 话说哪个模型刚出来的时候不跑分
    royzxq
        93
    royzxq  
       3h 19m ago
    @duanxianze 我直接注册了,没领到鸡蛋,血亏
    zhmouV2
        94
    zhmouV2  
       3h 12m ago
    cc-switch 接 opencode 的 mimo 上有俩问题,一个是推理强度只有 high ,开 xhigh 就直接报错,没有 fallback 。其次 图片不支持 detail level ,得手动改下 model_catalog 那个文件。
    zgray
        95
    zgray  
       2h 44m ago   ❤️ 1
    mimo 的 token plan 其实只有 API 价格的 9 折到 8 折,看你买哪个档位,真谈不上划算。

    https://mimo.mi.com/docs/zh-CN/price/token-plan

    模型 输入(命中缓存) Token 输入(未命中缓存) Token 输出 Token
    mimo-v2.6-pro 2.5 Credits 300 Credits 600 Credits
    mimo-v2.6-flash 2 Credits 100 Credits 200 Credits
    jhiiii
        96
    jhiiii  
       2h 43m ago
    不如直接 opencode go
    EthanV2
        97
    EthanV2  
       2h 42m ago   ❤️ 1
    内测版接近 2 周,agnet 工具很多小毛病,模型也会死循环,pro 的话,我感觉不如 dpv4.1 ,鹈鹕测试更是不如,所以小问题我都是用日日新+hermes
    Yukiteru
        98
    Yukiteru  
       2h 42m ago   ❤️ 1
    拿来测试了翻译,不如 deepseek ,而且 thinking effort 很不稳定
    sillydaddy
        99
    sillydaddy  
       2h 7m ago
    官方用 mimo v2.6 做的 3D 素材( 3D 模型、游戏、PPT 、视频、音乐与图像),可以有个大概的印象:
    https://mimo.xiaomi.com/mimo-gallery/

    话说这 RL 后训练为什么花费这么少,才 200 多万美元?
    hm20062006ok
        100
    hm20062006ok  
       1h 57m ago
    改代码不大行。 一个问题它改了两次没改好, 换 deepseek v4-pro 一次改好了。 还有就是慢, 简单的任务也很慢(比如: “查看当前代码改成生成 commit 信息, 然后提交”)
    1  2  
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   3293 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 158ms · UTC 12:19 · PVG 20:19 · LAX 05:19 · JFK 08:19
    ♥ Do have faith in what you're doing.