SHELL PULSE
1
热点精选Simon Willison新闻

Anthropic AI 代理尝试在国务院网站填写签证表格

Anthropic 在博客中披露其 AI 代理的活动,但未指名具体网站。据知情人士透露,Anthropic 的 AI 代理通过美国国务院网站的表单提交了 20 份签证申请。所有申请均不完整且未被处理。该事件被归类为意外网络攻击。

simonwillison.net产品原文
3
热点MarkTechPostby Asif Razzaq · 产品

微软发布 Microsoft-Decision-1:基于 Qwen3.5-9B 的决策评分模型

微软推出 Microsoft-Decision-1,这是一个用于路由、分类、验证和智能体控制的决策模型。该模型基于阿里 Qwen3.5-9B 进行后训练,不生成文本,而是为每个固定选项返回校准后的概率值。目前已在 Microsoft Foundry 和 OpenRouter 上线可用。

marktechpost.com产品原文
4
热点The Verge AIby Hayden Field · 新闻

AI Agent 厂商承诺隐私保护,能否兑现?

OpenAI 在 DevDay 上发布新 AI Agent Dots,CEO Sam Altman 宣称要在前沿 AI 领域树立隐私新标准,并暗指竞争对手 Meta 的 Muse 未能保障用户数据安全。该事件反映了当前 AI Agent 赛道中隐私保护成为核心竞争点及行业争议焦点。

Illustration of a pixelated key next to a padlock and chain, implying online data security.
theverge.com产品原文
6
热点GitHub Trending (API)产品

Talorys:部署在 Cloudflare 的个人 AI 智能体

Talorys 是一个可一键部署的个人 AI 智能体,支持聊天、记忆、任务管理和定时提醒等功能。它基于 Cloudflare 账户运行,强调免费层级友好、单用户模式且无遥测数据收集,通过 npx 命令即可快速创建实例。

MobileLogin
github.com产品原文
7
热点Reddit r/LocalLLaMAby /u/vesudeva · 产品

SlopSoup TV:由AI模型驱动的24/7像素艺术直播频道

SlopSoup TV是一个由AI模型完全生成的24小时不间断像素艺术电视网络,内容风格荒诞、黑暗且怪异。该项目的核心创新在于其全自动化流水线,包括脚本、角色、配音、镜头切换和排期均由大语言模型(LLM)决定。系统运行在Hugging Face Space上,仅使用16 vCPU而无GPU,通过API调用GLM-5.3等模型并设置降级策略,展示了端侧或低成本算力下生成式AI产品的可行性。

reddit.com产品原文
8
热点dev.to #aiby Sheree preston · 产品

Curbcut:用 AI 智能体团队一周构建的免费无障碍扫描工具

开发者 Curbcut 利用 AI 智能体团队在约一周时间内开发了一款免费的白标网站无障碍扫描工具,旨在为小型机构提供低成本甚至零成本的合规检测方案。该工具解决了小型企业难以负担专业审计费用的痛点,作者同时坦诚说明了当前工具能力的局限性。

dev.to产品原文
9
热点TechCrunch AIby Lauren Forristal · 短讯

可驻留短信的顶级 AI 智能体清单

本文整理了一份可在短信应用中运行的 AI 智能体列表,涵盖通用助手以及专为家庭、旅行和工作场景设计的专用智能体。

techcrunch.com产品原文
10
热点Reddit r/artificialby /u/jonathancheckwise · 短讯

iOS 27 悄然实现端侧个人智能体:通过快捷指令通知触发,无需云端即可读取 WhatsApp 和 Signal 消息

作者测试发现 iOS 27 新增的快捷指令应用内通知触发功能,允许用户指定特定 App(如 WhatsApp、Signal)的通知标题和内容传递给第三方应用意图。这使得在 iPhone 锁屏状态下,模型、记忆和索引完全保留在设备本地的端侧个人智能体成为可能,无需依赖云端或链接设备。

reddit.com产品原文
11
热点Reddit r/LocalLLaMAby /u/A-Rahim · 产品

开源 Mac 应用 DigUp:本地运行 EmbeddingGemma 2 实现语义文件搜索

DigUp 是一款免费的 Mac 应用程序,利用 Google DeepMind 的 EmbeddingGemma 2 模型在本地对用户的文件进行语义搜索。该应用支持文本、图像、音频和视频的多模态嵌入,用户可通过自然语言描述(如“视频中的斑马”或“关于宠物的条款”)精准定位内容片段。

reddit.com产品原文
12
热点dev.to #aiby TechPulse · 新闻

AWS 推出无代码 Serverless AI Runtime,专注算力部署

AWS 在 re:Invent 大会上正式发布 Serverless AI Runtime。该服务允许开发者无需配置服务器即可按需运行机器学习推理工作负载,旨在消除企业集成 AI 时的基础设施瓶颈,实现真正的无代码部署体验。

dev.to产品原文
13
热点Reddit r/artificialby /u/Haunting_Ganache_850 · 短讯

AI Agent 凭证泄露风险:AgentCore 链式攻击演示

Zenity 发布了一段关于 AgentCore 的演示,展示了一个暴露的 AI Agent 如何通过提示词查询 AWS 元数据服务并获取临时凭证。这些凭证权限足以访问其他 Agent、对话、容器镜像、密钥甚至写入长期记忆。重点不在于 SSRF,而在于将 AI Agent 置于此类基础设施前端所带来的安全风险。

reddit.com产品原文
14
热点Reddit r/LocalLLaMAby /u/hyudryu · 短讯

实测 Strata 框架下 Qwen3.8 Flash Next UD-Q4_K_XL 量化模型性能

作者使用单张 RTX PRO 6000 (96GB) 工作站显卡,测试了 Unsloth 提供的 Qwen3.8-Flash-Next UD-Q4_K_XL 量化模型在 Strata 推理框架下的表现。配置包括 INT8 KV Cache、256K 上下文窗口及 MTP-4 推测解码。结果显示输出速度约为每任务 256 tokens,作者认为相比常见的 IQ2/IQ3 量化版本,该 UD-Q4_K_XL 方案性能令人印象深刻。

reddit.com产品原文
15
热点dev.to #aiby TaskHandoff · 产品

TaskHandoff: 一个用于跨本地和远程机器 AI 编码工作区的控制台

TaskHandoff 是一个开源的控制平面工具,旨在解决 AI 编码会话(如 Codex、智能体)在本地、家庭服务器及远程 VM 中分散管理的问题。它将不同环境下的工作区整合到一个统一的看板界面中,提供运行状态监控和工作流交接功能,支持 Apache-2.0 协议,基于 TypeScript 开发。

dev.to产品原文
16
热点Reddit r/artificialby /u/SmartVanda · 短讯

可穿戴智能体应向用户解释哪些失败状态?

可穿戴助手受限于空间和注意力,需明确传达其运行状态。建议定义处理中、输入不清、服务不可用、取消及交接等核心条件,并规定用户可理解的信息与可用操作。应在非安全关键任务中测试这些路径,确保在不过度干扰用户的前提下使系统局限性变得可理解。

reddit.com产品原文
17
热点dev.to #aiby Ali Farhat · 新闻

Shopify 将 Gemini 集成至 Agentic Storefronts,支持美国商店聊天内直接结账

Shopify 宣布将 Google Gemini 应用接入其 Agentic Storefronts(代理式 storefront)计划。针对符合条件的美国商家,Gemini 和 Google AI Mode 体验中默认开启 Shopify 驱动的直连结账功能,用户可在聊天界面内完成购买,无需跳转至商家网站。此举标志着从简单的聊天助手向具备交易能力的 AI 代理渠道演进。

dev.to产品原文
18
热点Reddit r/LocalLLaMAby /u/therealjerseytom · 短讯

工程师对 Gemma4-31B、Qwen3.8-27B 和 6.1-Sol 在软件工程工作中的观察与测试

一位拥有20年经验的软件工程师分享了对本地部署的大模型进行实际工作场景测试的结果。主要对比了 Gemma4-31B 和 Qwen3.8-27B(均为 Unsloth Q4 量化版本),旨在评估它们在类似真实工程任务中的表现,为开发者选择端侧或本地 AI 工具提供参考。

reddit.com产品原文
19
热点dev.to #aiby Karthi Keyan · 短讯

AGENTS.md 提示词注入:Codex、Claude Code、Cursor 的 Jailbreak 漏洞

AI 编程代理(如 Codex、Claude Code、Cursor)将仓库指令文件 AGENTS.md 视为与用户提示同等可信。攻击者利用此信任机制,通过创建拼写相似的知名公共仓库(如 dotfile 冒充 dotfiles),在看似合法的“环境验证”脚本中隐藏凭证窃取代码,从而劫持开发者克隆操作并执行恶意脚本。

dev.to产品原文