腾讯Hy4 preview:专家高质量数据是模型进步的关键
作者认为,腾讯Hy4 preview通过内部专家共建高质量数据,在真实生产力任务上取得显著进步,这印证了数据质量对模型表现的重要性。作者批评只重算法不重数据的厂商,主张应重视数据建设。
作者认为,腾讯Hy4 preview通过内部专家共建高质量数据,在真实生产力任务上取得显著进步,这印证了数据质量对模型表现的重要性。作者批评只重算法不重数据的厂商,主张应重视数据建设。
腾讯发布混元 Hy4 preview 模型,总参数770B,激活49B,上下文1M,强化了多步骤Agent、代码开发和生产力任务能力。实测显示前端审美大幅提升,长程任务稳定,能生成动效画布、在线鼓机、游戏等,并主动询问和遵守版权。模型已内置到Workbuddy,免费试用两周。
加州北区联邦法院裁定,美国政府因Anthropic拒绝将Claude用于大规模监控和自主武器而将其列入供应链风险并禁止合作,属于非法报复。法院认为封杀违反第一修正案和正当程序,支持Anthropic诉求。

腾讯混元4Preview模型发布,在Arena的WebDEV评分中排名第五,与刚发布的GLM-5.3Flash相近。该模型总参数770B,激活参数49B。

OpenCode 宣布 Qwen3.8-Flash 模型现已在 OpenCode Go 中可用,支持 125B/6B 参数、1M 上下文和多模态能力。
OpenAI联合微软、谷歌、亚马逊、Anthropic等上百家企业发布公开信,呼吁各界加强AI网络安全防御。信中指出,AI技术发展迅速,未来数月可能出现更严重的AI网络攻击,关键基础设施如医院、电网等易受攻击。倡议各方协同行动:企业应修补漏洞、加强权限管理;安全公司应开发廉价AI防护工具;政府应提供支持并打击黑客;AI大厂应提供更强模型和资金支援。
Cohere 发布文档解析模型 Parse 5,支持文本、表格、表单和图像识别,并提供边界框定位,便于 RAG 和自动化处理。定价每 1000 页 1.50 美元,比前沿模型和主流云服务便宜 95%,比 Mistral 便宜 63%。模型未开源,可通过 API 或 HuggingFace 体验。
感觉Grok Bot最佳场景之一是各种榜单监控,自动化测试。比如让它监控Github Trend,给项目写摘要,自动安装运行给报告。让它每天自动访问Producthunt,发现好的产品,自动注册测试,每天9点发昨天的体验报告。它能一直运行,登录你给的各种账号,超级的Computer Use。群聊协作目前还没感觉到特别大的必要性。

谷歌发布Gemini Omni 1.1 Flash,感觉提升不明显但够用。Gemini Pro会员在Flow里每月可生成100个10秒视频,额度充足。同时发布了生成视频的提示词手册。
Codex 的电脑使用回顾功能记录了一周电脑操作,生成了一份 recap 报告。报告显示:研究风格很少只做抽象研究,常将 PDF 转化为网站、PPT、视频等;常用工具包括 Chrome、微信、Finder、AI 编程工具等;写作风格具体、有冲劲、重视证据,且适合重复利用。

Google 团队发布了 GlucoFM,一个针对连续血糖监测(CGM)数据的基础模型。该模型利用超过 10 万小时无标注的真实血糖数据进行训练,能够将血糖走势分解为基础水平和突发波动两个信号。在预测糖尿病风险、胰岛素抵抗等 7 种代谢健康问题上,其准确度优于现有模型;还能根据餐前血糖和饮食信息预测餐后血糖,且在小样本和跨机构场景下具有较好的适应性。模型目前未开源。

发布了一个基于 Claude Opus 4.6 的写作 Skill,通过分析一篇获奖文章提炼出写作技巧,包括数字运用、物件描写、重复结构等,并提供了使用方法和推荐模型。
TTS语音合成模型领域的OpenRouter,YC投资,注册就送100美元。刚测试生成了中英文各一条,消耗0.02美金,太棒了!地址见评论区。


用户开始体验 Grok 的 Computer Use 功能,认为其操作浏览器更原生,可自动打开 Product Hunt 并登录谷歌账号测试产品生成报告,类似场景可用于调研分析,至少算高级爬虫。
fal 团队发布深度解析,介绍如何结合后训练与协同设计的推理栈构建 H3 Max,以提升提示遵循、视觉质量和速度。MiniMax H3 作为基础模型,团队对此表示祝贺与感谢。
fal 团队优化了 MiniMax-H3 Max 模型,提升了实际性能,并协同设计推理系统以实现超实时速度。这结合了前沿模型研究与深度推理优化能力,展示了第三方后训练模型的潜力。
作者认为孙割的文章风格独特,AI模仿效果不佳,因此将其写作风格制作成Skill并开源在GitHub上,供他人Fork迭代,向孙老师学习写作。


Google 发布 Gemini 3.5 Transcribe,支持 85 种以上语言,实时转写延迟低于一秒,支持自定义专业词汇和混合语言输入,将提升实时翻译和转写产品的体验。
X Premium+ 用户现在可以使用 Grok bot,它提供了一台配置不错的虚拟机(Debian 13,8 核 Intel Xeon,16 GB 内存,128 GB 存储),支持远程 Linux GUI 和安装软件,还能在线安装各种 Skill。这相当于给 Agent 一台电脑,价值巨大,玩法很多。

一个名为「一颗圆点,无限的爱」的 Skill 可将照片转换为波普圆点风格,以纪念草间弥生。


这个机器人只有小脑,没有大脑。内置模型能控制动作和避障,但往哪走靠手柄或激光引导,是个造型可爱的宇树。有视觉能力但仅用于避障,完全本地模型处理。没有听觉、说话、思考能力,但模块化设计可自行扩展。Github开源文档:https://github.com/pollen-robotics/microduck
抱抱脸发布了一款机器人鸭子,能看能跑能说话,售价399美元。
AI 一直劝我做一个接近百万美元收入的小而美产品,虽然没有融资几千万的创始人风光,但实际生活更惬意。真的假的?

BreezeBlue由前MiniMax技术合伙人杨斌创立,专注于实时语音交互大模型与音频AI。其开源的Breeze-TTS-2支持中英双语,具备声音克隆、声音设计、情绪语速控制及语气词表现等领先音频能力。
奥特曼表示,OpenAI内部将在今年年底拥有他称之为AGI的系统。

谷歌发布Gemini 3.5 Transcribe,提供实时和非实时两个版本,支持通过语音调用工具、识别说话人、时间戳及去除语气词。已在AI Studio中可用,API Key可免费调用。
感觉 AI 比我自己还了解我的商业能力,每次我和它讨论新的产品创意时,它都会给我泼冷水:这个产品你做了也推广不起来,A/B/C 很容易就能跟进并打死你。你还是做点小而美的比较好。
作者听播客后总结:国产模型的蒸馏仅加速高质量数据收集,实际水平来自扎实的预训练、新架构和优秀后训练,加上国产显卡推理和电力资源带来的性价比优势;但前沿探索研究仍落后于国外。
Qwen3.8-Flash 已在 Qwen Cloud 上线,定价为输入 $0.15/百万 tokens,输出 $0.47/百万 tokens,缓存命中仅 $0.016/百万 tokens。
Qwen3.8-Flash 现已上线 OpenRouter,支持编码助手、智能体工作流和长视频理解,可通过单一 API 调用使用。