yan

Token Saver:用本地混合 RAG 将 Claude PDF token 消耗削减 92%-99% 的开源 MCP 扩展

Marktechpost AI 团队发布 Token Saver,一款面向 Claude Desktop 的开源 MCP 扩展,通过本地混合 RAG 在设备端检索 PDF,无需上传文件。该工具将 token 消耗削减 92%-99%,并保证数据隐私,设置无需 Python 环境或终端配置。

阅读原文 →

评论
yan

Replit Design 发布:AI 赋能设计愿景

你不需要成为设计师。你只需要知道你想把什么变为现实。
你脑海中的想法与屏幕上的成果之间的差距刚刚消失了。
这就是 Replit Design 背后的愿景。
阅读我们构建它的原因以及我们认为 AI 驱动设计的未来方向:https://replit.com/blog/introducing-replit-design

阅读原文 →

评论
yan

OpenAI 为学术研究者免费提供前沿模型

ChatGPT for Academic Researchers - 免费(!!)使用我们的前沿模型,包括 GPT-5.6-Sol Pro,面向数学家、科学家、研究人员和学者。
让未解难题倒下!

阅读原文 →

评论
yan

Perplexity 开源智能体检测层 Numbat

今天我们开源了 Numbat,这是一个智能体检测与响应层,旨在跨多种智能体框架工作。
Numbat 为安全团队提供对智能体活动的可见性,并可在执行前阻止选定操作。
了解更多:https://research.perplexity.ai/articles/securing-agents-across-perplexity%E2%80%99s-client-endpoints-with-numbat

阅读原文 →

评论
yan

Replit 用环境智能重塑 AI 设计体验

Replit Design 通过环境智能重新构想 AI 设计的用户体验。
你无需输入提示词,也无需设计语言。
每一步,智能体都会建议下一步最佳操作,一键即可执行,助你快速从创意生成惊艳成果。

阅读原文 →

评论
yan

开源引擎可在任何 M 系列 Mac 上以 2 GB 内存运行 Gemma 4 26B

一个开源引擎让 Gemma 4 26B 模型能在任何 M 系列 Mac 上运行,仅需 2 GB 内存。该项目已发布在 GitHub 上,大幅降低了本地运行大语言模型的硬件门槛。

阅读原文 →

评论
yan

Martha Stewart 联合创办 AI 初创公司 Hint,为房主提供家居管理 AI 助手

Hint 今日上线,利用 AI 技术帮助房主管理维护计划、能耗、土壤与空气质量、保险理赔等事务,并支持存储和查询房屋相关合同与文件。该应用基于公开数据为每栋房屋建立档案,通过 AI 聊天机器人回答个性化问题,并提供主动维护提醒与"房屋评分"。Hint 目前免费提供 iOS 版,无订阅或广告,未来计划推出付费高级功能。

阅读原文 →

评论
yan

腾讯混元开源 AngelSpec 投机解码框架

腾讯混元开源端到端投机解码框架 AngelSpec,支持训练与部署。在 Hy3-A21B 模型上,其 DFly 方案相比自回归解码实现 1.98-2.40 倍端到端加速,吞吐量比 DFlash 高 10.5-11.8%。训练代码及 Hy3-A21B MTP/DFly 草稿模型权重已开源。

阅读原文 →

评论
yan

在 M1 Max 上运行 2.8T 参数的 Kimi K3:Deltafin 项目实现 0.0687 token/s 推理

Deltafin 项目成功在 64 GB M1 Max 上运行了 2.8T 参数的 MoE 模型 Kimi K3,当前中位推理速度为 0.0687 token/s(14.6 秒/token)。完整安装需约 1.7 TB 本地磁盘,流式模式仅需 215 GB 但推理速度降至 3 分钟以上/token。项目提供 OpenAI 兼容 API 服务器,支持聊天和代码补全,但建议客户端超时设为小时级别。

阅读原文 →

评论
yan

OpenAI 发布 Codex 安全 CLI 与 SDK

更多开源福利。我们刚刚发布了一个 CLI 和 TypeScript SDK,用于查找、验证和修复代码中的安全漏洞。扫描仓库、审查变更、随时间追踪发现,并在 CI 中运行安全检查。
https://github.com/openai/codex-security

阅读原文 →

评论