走个量 Pushin'Weight

  • 趋势摘要 过期

    已选择29个,显示2个

    DeepSeek 过期 · 上次验证于2天前

    DeepSeek V4.1 Flash 获价格与速度好评,整体声量低于前一日

    智谱 GLM 过期 · 上次验证于22小时前

    智谱 GLM 的讨论集中在 Flash 系列与低价模型,用户把 GLM-5.2 和 GLM-5.3-Flash 与其他模型对比,并希望有一个单台 Spark 规模的 GLM

    本窗口最新

    英语综合@dioscuri 说 DeepSeek 是女的,尤其是那个思维链,一股子小姐姐脑回路。
    Frank Bradford · 14m (16:15 本地)
    英语综合说白了就是:前沿模型吃 token 吃到这种程度,本地部署根本没戏,除非大厂真把 DeepSeek 那套效率突破学过去。
    Makaverli🥷 · 14m (16:15 本地)
    英语综合回帖里甩了一句混合了 pidgin 的歌词梗,纯整活,和 AI 没关系。
    J A Z I I · 14m (16:15 本地)
    英语综合列了一长串模型名字:Claude 5.2、GPT 6、Kimi、Gemini、MiniMax、Qwen,一个个全用上,模型多得回不过来。
    ComputeCapital · 15m (16:14 本地)
    英语综合字节营收涨 30%、利润却掉到 200 亿美元,账都算到 AI 模型和算力投入上了——国内大厂 AI 已经不是研发费用里一笔小注脚,直接进损益表了。
    Liora · 15m (16:14 本地)
    英语综合一长篇模型身份迁移的伦理骂战,作者逐条翻出对方五月的 prompt 记录,指控对方以“同情自愿”为包装在做诱导式跨谱系人设移植——本质上和诱导操控没区别。
    Eric Murrell · 15m (16:14 本地)
    英语综合4700 万 token,GLM 5.3 Flash 花 2.33 美元,Claude Opus 5 要 423 美元,他自己说效果分不出差别——这条就是开源模型降维打击的最直白证据,2027 年市场结构不变才怪。
    Frit🅾️ Pendej🅾️ · 16m (16:13 本地)
    英语综合就一句“DeepSeek 5 🙏”,跪求下一个版本的虔诚感都溢出来了。
    Kamimoto(かみもと) · 16m (16:13 本地)
    日语综合日推实测 MiniMax-H3 的 NSFW LoRA,4070 12G 能跑但效果跟原版没差,local 微调国产视频模型这条路还没真正走通。
    Aveek Sen Ballalzai · 16m (16:13 本地)
    英语综合又一篇唱衰帖:本地 DeepSeek 加 RAG 免费还能用,付费 ChatGPT 就那样,连七八轮对话都撑不住;真正该叫 AI 的机器学习早就在干活了。
    Frit🅾️ Pendej🅾️ · 16m (16:13 本地)
    英语综合觉得 DeepSeek 一出,OpenAI 和 Anthropic 那套估值故事基本就讲不下去了。
    Praveen Chauhan · 16m (16:13 本地)
    英语综合推荐把 DeepSeek 4.1 Flash 接到 GPT 5.6 extra high 上跑,说这套组合稳得一批。
    akmal · 16m (16:13 本地)
    其他综合智谱发 GLM-5.3-FlashX,主打的就是 agent 工作流最痛的推理延迟,峰值 200 tok/s,宣传口径已经从「榜多少分」转成「agent 跑得快不快」了。
    Lucja(n) Kifer · 17m (16:12 本地)
    其他综合波兰语长帖讲得很朴素:堵住批评不等于消灭错误,只是把纠错的信号通道给掐了,模型照样自洽地跑偏。
    Fountain City · 17m (16:12 本地)
    英语综合13 组 A/B 测出来的结论:前沿模型当大脑、DeepSeek 4.1 Flash 当手,成本低、质量还能打平甚至反超,绕订阅限额的野路子成了。
    Frit🅾️ Pendej🅾️ · 17m (16:12 本地)
    英语综合Jev 生态大盘点:护栏、社区管理、GEO 营销、智能家居、游戏仿真、量化交易全都有,底下还有一堆基于 Qwen 的本地研究分身。
    Mili 🎯 · 17m (16:11 本地)
    英语综合AI 视频工具转了 18 个月还是那样,烧积分烧迭代才出片;不过这次是 Astra 6 指挥海螺等工具生成的,agent 编排这条路真在跑通。
    D. Michel Morelli · 18m (16:11 本地)
    其他综合意大利语的 AI 每日新闻播报,标签里塞了一堆 2026 年的项目名,Qwen、Alibaba、Jev、OrcaRouter 全在。
    Lip Sucre👩‍🚒 · 18m (16:10 本地)
    zh-Hans综合感觉 DeepSeek 比它快太多了,试了千问办公和 qoder 都慢得离谱,用户体验这块还得卷延迟。
    Brocker Editorial Team · 19m (16:10 本地)
    英语综合阿里 Qwen 又发新模型,Qwen3.8-LiveTranslate 同传延迟压到 2.3 秒,还带说话人分离和声音克隆,工具层又要被卷一波。
    DryHoleCo · 20m (16:09 本地)
    英语综合现在干活都流行多模型编排了,规划、执行、视觉、提交各配一个模型,一张配置表全是国产和海外混搭。
    Al Per · 26m (16:03 本地)
    英语综合就硬吹 Mistral,说它吊打所有国产模型,这不纯纯夹带私货嘛。
    market participant · 26m (16:03 本地)
    英语综合这段 Grok 分析的核心就一句:看 OpenRouter 的 token 榜以为开源赢了,其实采样的是爱用路由的开发者,不是企业钱包。Ramp 数据显示真正花 AI 钱的企业只有 5.8% 用模型服务平台,而且其中 96% 还在给 OpenAI/Anthropic 付费。token 归开源、美元归闭源,企业就是「闭源打底 + 网关兜底」的重叠格局。
    Dijkstra Liu · 28m (16:01 本地)
    英语综合这篇日语卒中问诊基准挺有意思:18 个模型里只有 Claude Fable 5 和 Opus 4.7 过了「80 分 + 零致命错误」这条线,GLM-5.2 以 75.6% 排第三,还有 11 个模型犯下 17 次致命错误。医疗评测光看总分没用,要看会不会漏掉 t-PA 前的血糖确认这种要命的步骤。
    Leon Lin · 28m (16:01 本地)
    英语综合两周内要发一堆模型:GPT 6 Sol/Luna、Grok 4.7、Fable 5.2、Opus 5.2、可能还有 Gemini 4,国产这边就一个 Kimi K3.1 挤进名单——发布密度本身已经比单个模型更值得关注。
    shashank sn · 29m (16:00 本地)
    英语综合同一个帖子里又一条简短回复,推荐 deepseek flash。反复被点名说明 DeepSeek 的 Flash 档在英文用户中已经有了一定的自来水口碑——这对国内厂商来说是很值得追踪的出海信号。
    shashank sn · 29m (16:00 本地)
    英语综合一句极简的回复:deepseek flash。在模型对比的帖子里这种就是最直接的站队——国产模型的口碑传播很多时候就靠这种短平快的推荐。
    tinySnake · 29m (15:59 本地)
    zh-Hans综合有人觉得这块是 Qwen 团队的舒适区,估计很快就能推出类似的东西。这话里透着对 Qwen 迭代速度的默认——国内做竞品追踪的都知道,Qwen 一出手基本就是同类最快跟进的那个。
    Volta · 29m (15:59 本地)
    英语综合有人在追问 GLM 5.3 Flash 和 Qwen 3.8 Flash Next 在具体硬件配置下的直接对比。这说明 GLM 和 Qwen 之间的竞争已经到了用户逐项比较的程度,市场情报人员值得留意这种一手性能反馈。
    日语综合官方公告:Qwen 要下线 qwen3.8-2.4t-a95b 和 qwen3.6-35b-a3b 两个模型,2026-09-30 截止,理由是产品线合并到后继模型。对依赖这些 endpoint 的产品经理来说,这是必须提前排期的迁移信号——Qwen 的模型迭代节奏越来越快了。
    Willian Valle · 30m (15:59 本地)
    其他综合一位葡语开发者在实际流程中对比了 GLM+ZCode 和 DeepSeek+Reasonix,结论是 GLM 更好。这是 GLM 和 DeepSeek 竞争中的一个真实用户反馈,对国内模型市场情报有直接参考价值。
    Frankie_p · 30m (15:59 本地)
    英语综合这篇帖子把 TypeSafe 的 Jev/RLCD 扒了个底朝天,说概念不新、模型早有先例、开源克隆一大把,TypeSafe 就发了个 waitlist 和 4000 万美元的发布会,没论文没数据集没 ECE。典型的 '套壳炒作' 打假帖,对国内做决策模型或 agent routing 的团队来说是很好的竞争情报参考。
    netrunner · 30m (15:59 本地)
    英语综合(大概是厂商侧)承认响应速度确实不如 DS4F 和 Qwen,正在优化但前提是质量不能掉。
    Crymonade · 31m (15:58 本地)
    其他综合印尼网友实测:DeepSeek 干中低难度任务没问题,写一整天代码才花 5 刀。
    MaineCoonMouser · 31m (15:58 本地)
    英语综合在 Fox News 这位还在说事,人家 Qwen 4 月底就来了,benchmark 追平美国前沿、成本四分之一,这不打脸吗?
    يوسُف | Yousuf · 31m (15:58 本地)
    其他综合阿拉伯网友的安利:DeepSeek harness 一用就回不去了,谁试谁知道。
    Emmy Bear AI · 31m (15:57 本地)
    英语综合Bonzai 接棒 Qwopus 做对照测试,prompt、DeepSeek harness、设置全一致,就比纯模型表现。
    英语综合在线求单卡 DGX Spark 上 Qwen 3.8 Flash Next 和 DeepSeek v4.1 Flash 的正面对决。
    CoolTea · 32m (15:57 本地)
    zh-Hans综合DeepSeek 官方 API 高强度用一天能烧 2 亿 token,推理是真吃 token,改天拿 GLM Flash 来比划一下性价比。
    afrocode · 32m (15:57 本地)
    其他综合推荐 GLM 5.3 Flash 而非 DeepSeek V4.1,理由很直接:幻觉太多。
    Suhit Anantula · 32m (15:57 本地)
    英语综合真·实战数据:5.6 亿 token 的会话,DeepSeek Flash 花了不到 5 刀,缓存命中 99.4%,性价比直接封神。
    Søren Pedersen · 32m (15:57 本地)
    其他综合丹麦网友自己纠了个误解,顺势安利 DeepSeek 4.1 Flash,直呼神模型建议实测。
    🔻agitprop + absurdity🔻 · 32m (15:57 本地)
    英语综合Mozilla 报告的核心观点:开放权重模型能力已经追平闭源前沿,价格只要三成,真正较劲的地方转移到了 harness 层面和谁掌握数据、成本和切换权。
    Sachiv C · 33m (15:56 本地)
    英语综合隐身模型 Ox Alpha 揭晓是智谱 GLM-5.3-Flash,配的推理基建文章更狠——10 万+ 国产加速器,还拿自家模型当 Infra Agent 调栈,这才是真正的硬核。
    cokebyby · 33m (15:56 本地)
    英语综合无所谓了,ox alpha 也就那样。
    yara David · 37m (15:52 本地)
    英语综合FlashX 快是快,就 2.5 倍差价换不换得来省时间还得实测,反正夜间循环我还是用 Flash,UI 卡了再切,10 月不行就直接弃。
    Mehmet · 37m (15:52 本地)
    其他综合土耳其老哥的选型心得:没有全能模型,GLM 偶尔能修 Claude、GPT 都修不了的 bug,日常代码设计还是 GPT 6 Astra 顺手。
    AminTechs · 41m (15:48 本地)
    英语综合聚合吞吐别拿来糊弄冷启动延迟,想问问你们 185K 长上下文下 MTP 草稿接受率是先崩了还是还能撑住。
    Brian · 41m (15:48 本地)
    英语综合单卡 3090 跑本地编码 agent 的实测攻略,Qwen3.8-27B Q4 是甜点位,其余量化位和 Flash-Next 都要么 OOM 要么工具调用翻车,直接放弃。
    tenshin · 43m (15:45 本地)
    英语综合DS V4.1 Flash 真香,就是思维循环得靠 RL 治一治,4.2 别动这套架构和 KV Cache 压缩的底子。