SHELL PULSE

8月28日 · 星期五4 条

  1. 向阳乔木by 向阳乔木 · 长文AI评分:70/100

    混元 Hy4 preview 8个项目实测,我想买腾讯股票了!

    腾讯发布混元 Hy4 preview 模型,总参数770B,激活49B,上下文1M,强化了多步骤Agent、代码开发和生产力任务能力。实测显示前端审美大幅提升,长程任务稳定,能生成动效画布、在线鼓机、游戏等,并主动询问和遵守版权。模型已内置到Workbuddy,免费试用两周。

    X @vista8模型产品原文
  2. 歸藏by 歸藏 · 推文AI评分:70/100

    混元4Preview发布,Arena WebDEV评分第五

    腾讯混元4Preview模型发布,在Arena的WebDEV评分中排名第五,与刚发布的GLM-5.3Flash相近。该模型总参数770B,激活参数49B。

    X @op7418模型评测原文
  3. Gorden Sunby Gorden Sun · 推文AI评分:70/100

    Cohere 发布文档解析模型 Parse 5,主打高准确率与低成本

    Cohere 发布文档解析模型 Parse 5,支持文本、表格、表单和图像识别,并提供边界框定位,便于 RAG 和自动化处理。定价每 1000 页 1.50 美元,比前沿模型和主流云服务便宜 95%,比 Mistral 便宜 63%。模型未开源,可通过 API 或 HuggingFace 体验。

    X @Gorden_Sun模型产品原文
  4. MiniMaxby MiniMax · 推文AI评分:50/100

    祝贺 fal 团队推出 MiniMax-H3 Max

    fal 团队优化了 MiniMax-H3 Max 模型,提升了实际性能,并协同设计推理系统以实现超实时速度。这结合了前沿模型研究与深度推理优化能力,展示了第三方后训练模型的潜力。

    X @MiniMax_AI模型行业原文

8月27日 · 星期四5 条

  1. Gorden Sunby Gorden Sun · 推文AI评分:70/100

    谷歌发布Gemini 3.5 Transcribe语音转文本模型

    谷歌发布Gemini 3.5 Transcribe,提供实时和非实时两个版本,支持通过语音调用工具、识别说话人、时间戳及去除语气词。已在AI Studio中可用,API Key可免费调用。

    X @Gorden_Sun模型产品原文
  2. 向阳乔木by 向阳乔木 · 推文AI评分:50/100

    GLM-5.3-Flash 就是 Ox-Alpha,实测剪辑电影并采用国产卡部署

    作者揭秘 GLM-5.3-Flash 即 X 上热门的“Ox-Alpha”,实测 6-7 个场景,包括将整部电影剪辑成 3 分钟解说版,并分享提示词、制作思路和工具。最令人震惊的是,该模型使用国产卡部署,推测需数十万张。

    X @vista8模型教程原文
  3. 向阳乔木by 向阳乔木 · 长文AI评分:90/100

    智谱发布GLM-5.3-Flash:性能对标Opus 4.8,价格仅为其1/40

    智谱发布GLM-5.3-Flash,320B总参数,激活18B,为GLM-5系列首个原生多模态模型。在AA综合智能指数上得分57,与Opus 4.8持平,但价格仅为后者的1/40。该模型采用稀疏注意力与线性注意力混合架构,上线后调用量激增,成为OpenRouter周榜第一。

    X @vista8模型行业原文

8月25日 · 星期二2 条

  1. Gorden Sunby Gorden Sun · 推文AI评分:70/100

    Fastino发布信息抽取模型GLiNER2.5

    Fastino发布了仅0.3B参数的信息抽取模型GLiNER2.5,相比2.0版本,支持长文本自动分段处理、无长度限制的长句子抽取、避免自相矛盾的判断,并能在抽取实体的同时进行情感标签分类。模型已开源。

    X @Gorden_Sun模型开源原文

8月24日 · 星期一2 条

  1. Orange AIby Orange AI · 推文AI评分:30/100

    全新模型 August 发布:小型、快速、高性能

    最近 Flash 级别的模型能力都上来了,又一个全新模型 August 来了,小型、快速、高性能。Ox 牛来在海外已经火到暴量,现在全网的资源紧张,在官方公布谜底之前,应该都是这样的状态了。Cola 首发,限时免费 2 天,欢迎来玩~

    X @oran_ge模型原文

8月23日 · 星期日2 条

8月22日 · 星期六2 条

  1. Gorden Sunby Gorden Sun · 推文AI评分:70/100

    VA-Judger:首个音视频一体的裁判模型

    研究团队发布VA-Judger,首个能同时评估视频画面和声音的裁判模型。它从文字匹配度、声画同步率、画面质量、声音质量和内容完整性五个维度打分,以更符合人类感知的方式指导生成模型改进。团队收集了上万组人类对比数据,并公开测试集,代码和模型完全开源。

    X @Gorden_Sun模型开源原文

8月21日 · 星期五4 条

  1. 向阳乔木by 向阳乔木 · 推文AI评分:30/100

    全网竞猜 OX Alpha是哪家的模型啊

    全网竞猜 OX Alpha是哪家的模型啊。 有不少人做了分析,智谱概率更大。 但叫这个名字,大家又会自然想到雷总的小米 MiMo,哈哈哈。 猜对猜错都行,反正都是国模。 据不少朋友的私人评测集显示,很接近一流前沿模型,牛逼啊!

    X @vista8模型原文
  2. DeepSeekby DeepSeek · 推文AI评分:70/100

    DeepSeek-V4-Flash-Vision-Exp 已在 DeepSeek API 平台上线

    DeepSeek 发布实验性多模态模型 V4-Flash-Vision-Exp,文本能力与 V4-Flash 相当,多模态智能体基准大幅提升,接近 Opus-4.8。同时发布 DeepSeek Harness 0.1.1 以支持新模型。

    X @deepseek_ai模型产品原文
  3. Orange AIby Orange AI · 推文AI评分:30/100

    Ox 可能是整个 8 月最惊喜的大模型了

    Ox 可能是整个 8 月最惊喜的大模型了,强烈推荐试用,免费 7 天。目前已在 Cola、Openrouter、Hermes、Opencode 等平台上线。

    X @oran_ge模型原文

8月20日 · 星期四3 条

  1. Gorden Sunby Gorden Sun · 推文AI评分:70/100

    Generalist 发布机器人模型 GEN-1.5,看一眼演示即可学会新动作

    Generalist 发布机器人模型 GEN-1.5,通过观看 3-12 秒的动作演示即可学会新任务,平均成功率约 59%,经 5 分钟快速适应后可达 83%。该模型支持动作串联、从人手或电脑动画学习,并能灵活使用替代工具,有望大幅降低机器人编程门槛。

    X @Gorden_Sun模型产品原文
  2. 宝玉by 宝玉 · 推文AI评分:70/100

    智谱联合创始人唐杰分享:GLM-5.3 纯靠后训练让编码能力提升 50%

    智谱联合创始人唐杰透露,GLM-5.3 未更换基座,基于 GLM-5.2(743B MoE,激活 40B)通过一个月长周期强化学习,编码能力提升 50%。他强调总参数量决定知识量,激活参数与有效深度决定推理深度,并指出后训练仍有巨大潜力,模型扩展不止堆参数一条路。

    X @dotey模型行业原文