2作者: ardatasci大约 1 个月前原帖
嗨,HN!<p>过去一个月我一直在开发PAI,这是一个类似Linux的个人助手AI框架,专为你的Mac设计。与其给聊天机器人提供一堆工具,我更想把大型语言模型(LLM)直接放入终端,看看它能表现得如何。<p>我一直在用它管理我的日历、五个以上的电子邮件账户,并及时与人互动和回复(这是整个项目的起因)。<p>在观察其他始终在线助手的设计后,我认为Unix/Linux的系统设计哲学可以应用于AI框架,因此我想实验一下它与这些助手的对比效果。因此,我在构建PAI时考虑了以下几点:<p>1. 在LLM中启用“代码模式”(LLM是自然的软件开发工程师/SysAdmin) - 如果你还记得之前的[代码模式](<a href="https://blog.cloudflare.com/code-mode/" rel="nofollow">https://blog.cloudflare.com/code-mode/</a>)文章,我想尝试在模型中利用这些能力,使其能够自然地与框架接口,而不是试图用大量的解释来加载它。LLM自然知道与配置相关的内容应该放在/etc/中,如何使用`cd`、`cat`、`tail`等命令。<p>2. 避免使用LLM轮询。 - 我想看看能否避免轮询,因为这浪费了令牌,而任意的时间间隔显得不够优雅。 - 相反,我创建了一个事件总线,可以唤醒LLM,并接受PAI可能自己连接的任意来源。 - 使用脚本进行轮询有时是不可避免的,没关系。<p>3. PAI有自己的FHS(类似)目录 - 该目录托管多个不同的用户(代理),位于~/.pai/home/;默认配置包括一个根代理、一个用户界面代理和一个负责内存整合和学习等的“图书管理员”。 - 每个代理可以订阅来自源的不同事件,并拥有不同的权限来访问/运行内容。<p>4. 工具是二进制文件,API/连接器是驱动程序(所有内容都是文件) - 这更像是一个建议,而不是我严格遵循的规则,但基本上每个工具都是可执行文件,每个事件生产者都遵循Linux中驱动程序的结构。一切都是一个进程,落在/proc/中,事件是文件,等等。<p>5. PAI有自己的包管理器 - 这个包管理器被称为`paiman`,它只是PAI共享他们编写的新内容的一种方式。我意识到这非常不安全(说实话,我不知道如何让它安全),所以我实际上还没有实现上游提交的功能。<p>6. grep是否等同于向量搜索? - 我想看看单纯使用grep(rg)是否足够,因为实际上延迟在这里并不是问题。我可能会在之后尝试向量搜索。<p>7. 我讨厌登录所有账户 - 我使用存储在Mac上的本地SQLite数据库与iMessage和邮件集成。它开箱即用(前提是你的Mac上已设置好这些应用)。<p>*在尝试之前你应该知道的事情* PAI没有沙箱。PAI需要完全的磁盘访问权限。 PAI会将你的Chrome cookies复制到一个单独的Chrome实例中用于Playwright。不过你可以看到它所做的一切。 开源软件和自带密钥。我一直在使用5美元的Deepseek信用额度,至今还没有用完。如果有兴趣,我可能会将其转变为云服务,但我对此不太确定 :D<p>请按照<a href="https://whitematterlabs.ai" rel="nofollow">https://whitematterlabs.ai</a>上的说明尝试一下 | GitHub: <a href="https://github.com/whitematterlabs/pai" rel="nofollow">https://github.com/whitematterlabs/pai</a>。另外,请原谅这个毫不掩饰的LLM生成的网站 :-)<p>任何评论、想法或建议都将不胜感激。你也可以直接告诉PAI更改你可能不喜欢的任何内容。
1作者: throwaw12大约 1 个月前原帖
在80%的bash调用中,我不断看到这个消息。<p>这是Claude模型的新常态吗?如果工具调用失败,Fable又尝试用另一个工具调用,但又一次失败,我们能否对此循环失败获得退款?我不断看到这个错误,感到非常沮丧:<p><pre><code> 错误:claude-fable-5暂时不可用,因此自动模式无法判断当前Bash的安全性。请稍等片刻,然后再尝试此操作。如果仍然失败,请继续进行其他不需要此操作的任务,稍后再回来处理。注意:读取文件、搜索代码和其他只读操作不需要分类器,仍然可以使用。</code></pre>
1作者: alsterg大约 1 个月前原帖
嗨,HN。Live-Memory 是一个开源的 Claude Code 插件 / MCP 服务器,旨在为您的代码库提供一个始终最新的记忆。它使用一个独立的、低成本的大上下文窗口模型,提炼您代码库的组织结构、约定和一般架构。它会观察主要代理的活动,并随着时间的推移被动地建立对您代码库的理解。这样,当您开始一个新的 Claude Code 会话时,您的主要代理可以通过一个只读的 ask_live_memory 工具查询 Live-Memory,并为当前任务启动对代码库的理解,而无需重新阅读文件。Live-Memory 在所有 Claude Code 会话中共享(单例模式)。该记忆模型是可插拔的,并且在 Claude 订阅(Haiku)上零配置,或者可以指向 DeepSeek / 任何兼容 OpenAI 的本地模型。请注意,它是一个长期运行的本地 HTTP 服务器,您只需启动一次(不是标准输入输出)。 <p>基准测试结果:在一个复杂代码库的 A/B 测试中,在理解密集型工作中,它卸载了约 93% 的构建(高级)模型的代码库读取令牌,使该模型每个任务的成本降低了约 61%,并且运行速度提高了约 22%(编辑密集型工作持平)。考虑到记忆模型自身的成本,在 Haiku 上总成本约便宜 25%——或者在像 DeepSeek-v4-flash 这样的便宜模型上便宜约 57%(其准确性与 Haiku 相当,但价格低了约 8 倍),在本地模型上接近全额的 61%。 <p>代码库:<a href="https://github.com/shofer-dev/claude-code-live-memory" rel="nofollow">https://github.com/shofer-dev/claude-code-live-memory</a>——乐意深入探讨每个工作区的记忆窗口和被动摄取。
1作者: BorisRadonic大约 1 个月前原帖
2作者: akashtndn大约 1 个月前原帖
在过去几个月里,我经常使用编码工具创建HTML解释文档,以帮助理解新主题或探索代码库。这并不复杂,但这种方法确实很有帮助。这里有一些示例:<a href="https:&#x2F;&#x2F;www.akashtandon.in&#x2F;interactive-explainers" rel="nofollow">https:&#x2F;&#x2F;www.akashtandon.in&#x2F;interactive-explainers</a>。 在几位朋友要求我分享这个工作流程后,我决定为此创建一个技能插件。希望这对大家有所帮助。欢迎在此基础上进行扩展或提供反馈!