1作者: StanleySathler2 天前原帖
大家好!<p>我每天在几个Facebook页面上发布内容。<p>它们都有相同的格式:一种推特风格的帖子——一张图片,包含名字、照片和正文。<p>这是我第一次寻找这个模板,但没有找到。尝试了Canva,搜索模板,也没有找到。<p>于是我在Canva上从零开始设计了一个。<p>现在,我希望其他人不再需要自己设计这个模板。<p>这是一个简单的应用程序。一个推特风格的模板。你只需更换照片、名字,添加你的内容,然后将图片下载为JPG格式,便于在社交媒体上发布。<p>非常简单。无需登录。没有后台。没有AI功能。100%免费。<p>这是为我自己制作的——但可能对其他人也有用。希望你们喜欢!
5作者: mstaoru2 天前原帖
我正在开发一个复杂的多部件3D打印产品,需要一些来自大型语言模型(LLMs)的工程输入。我使用的是最高级别的Gemini Pro推理、Fable和K3 Max,并将所有设置调至最高。 我面临的问题是如何在杠铃套筒上安装传感器。这个传感器是一个半空心的100mm圆柱体,直径为60mm,套筒部分有一个50mm直径、50mm深的管状切口。(其实比这要复杂一些。) 我正在尝试头脑风暴不同的夹紧机制,并评估几种设计的耐用性和可制造性。 无论我尝试什么,所有LLMs的输出都非常离谱,尤其是当你要求制作技术图纸时。Anthropic的表现一直是最糟糕的,而Gemini,令人惊讶的是,表现最好。 但没有一个模型能够详细理解各个部件的具体位置,除了不断输出一段段奇怪的想法,包括在凹槽环TPU夹头上使用旋转凸轮夹具(显然,这是一个“绝妙的枢轴”)之类的东西。 这是“未征服的边界”吗?我需要重新启用我的AutoCAD吗? :)
1作者: GodelNumbering2 天前原帖
目前有很多大型语言模型(LLM)的基准测试,但很少有,甚至没有,专门针对“工具使用”的基准测试。我认为这将是一个非常好的社区项目,可以建立这样一个基准测试。 最终目标:建立一个关于“工具使用”性能的排行榜(多维度),涵盖一系列多样化的现实世界任务[1],并按基础模型和推理努力进行分组。任何人都可以贡献结果。 任务标准、测量方法、基础框架等可以由一个团队而不是单个人决定。 如果有足够的兴趣,我将创建一个Discord频道。 披露:我是一款名为Dirac的编码代理的维护者(https://github.com/dirac-run/dirac),因此我不会影响最终基准测试的样子,以避免任何利益冲突。我只是想让这个项目实现。 [1] 多样化的现实世界任务是指那些复杂程度足够高、贡献者曾经遇到过的任务,最好来自开源代码库。
2作者: alias_122 天前原帖
这是一个旨在被公众破解的实验,因此,请随意利用。这个实验基本上是一个有限的免费供应,由公众进行挖掘,总量在100到10000之间,因此比比特币的2100万有更严格的上限。一旦免费供应耗尽,交易就会开始,而我的理论并没有深入到这一点,因此经济要么会蓬勃发展,要么会严重崩溃。祝你实验愉快!