原帖内容GLM 5.1 vs GLM 5.2 6 advanced HTML canvas challenges: 💧 Ink diffusing in water ⚔️ Energy-blade duel 📱 Slide to unlock 🅿️ 360° parking assist 🔥 Burning letter to ash 🏠 Build-a-house sequence Pure canvas, zero libraries.
视频GLM-5.2查看原帖 ↗收藏一句话落地页对决与 Opus 4.8 并排各做落地页,左 GLM、右 Opus;作者称几乎难辨;花费 0.06 美元对 0.49 美元,便宜逾六倍,且更快、更省 token。@nutlope· 2026-06-17编程/生成应用8.2k6461.6M
视频GLM-5.2查看原帖 ↗收藏无视觉建站再走质检账号称网站设计超过 Fable 5;模型纯文本、无法自检页面;用 Browser Use v2 多模态 QA 子代理查 bug、评美观并回传修改;构建加全程质检低于 0.75 美元。@browser_use· 2026-06-20Agent/工具调用2.2k195274k
视频GLM-5.2查看原帖 ↗收藏自主跑通 RL 对照实验团队称这是其 autoresearch 流水线上首个能做真实研究任务的开源权重模型;视频在两台 8xH100 的 SkyRL 上跑 Harbor 竞赛的异步与同机同步 RL,并处理环境、跑完实验、对比吞吐与奖励稳定性。@askalphaxiv· 2026-06-22Agent/工具调用2.1k274272k
截图GLM-5.2查看原帖 ↗收藏一次复现 SDPO 论文与 Opus 4.8 对照一次性复现该论文;须先解决凌乱 verl 问题,再跑完消融并核对结论;花费 6.21 美元对 46.35 美元;排除重读后 2.65M 对 4.53M token;首次成功前失败 14 次对 9 次。@askalphaxiv· 2026-06-25Agent/工具调用1.5k243242k
视频GLM-5.2查看原帖 ↗收藏多轮生成个人站点作者称要推着它才出活,但很有创意;只要求一个漂亮个人站,展示内容均为模型多轮自行构思;认为开源模型在 UI/UX 上已补上差距。@anshuc· 2026-06-17编程/生成应用1.5k66182k
视频GLM-5.2查看原帖 ↗收藏本地医疗专家智能体群在 Mac Studio 上经 llama.cpp 运行,作为医疗智能体工作流的推理核心;调度本机小型 OpenMed 专家覆盖肿瘤、用药与化验;强调无云端、无限流、不能被收回。@MaziyarPanahi· 2026-06-26Agent/工具调用7767588k
视频GLM-5.2查看原帖 ↗收藏一次生成三维手表附演示视频;作者称这是首个无明显大错做出 3D 手表的中国模型,并认为该前端题极难一次做对。@chetaslua· 2026-06-18编程/生成应用67750294k
视频GLM-5.2查看原帖 ↗收藏类瘟疫公司反 AI 游戏本想用 Claude 做幽默游戏 Luddite,玩法类似瘟疫公司,任务是摧毁 AI、阻止扩散;Claude 以可接受使用条款拒绝并威胁限制账号,于是改用它做成。@atmoio· 2026-06-23编程/生成应用5333468k