全部 AI技术 安全技术 IT技术
AI技术

事后剖析:使用Ollama和ChromaDB构建代码库记忆的本地MCP服务器

事后剖析:使用Ollama和ChromaDB构建代码库记忆的本地MCP服务器 开发者们正在抵制云API计费以及将专有代码库发送至第三方端点所带来的隐私风险。今年Hacker News上的一条讨论帖直言不讳:问题不在于每token的价格,而在于当AI代理持续轮询API时,基于使用量的计费方式具有不可预

2026/7/18 182
AI技术

你的评估通过率是98%,但置信区间可能算错了

你的评估通过率是98%?你的置信区间大概率是错的 摘要: 几乎每一个 eval 工具在报告通过率时都会附带误差条(error bar),而这些误差条几乎全都来自正态近似法:p̂ ± 1.96 × √(p̂(1−p̂)/n)。这个近似法往往是错的。

2026/7/17 238
AI技术

用经典机器学习检测LLM生成的文本(AIGC文本检测)

用"古典"机器学习检测 LLM 生成的网络小说(AIGC 文本检测) 截至 2026 年初,主流 LLM 生成的文本表现出强烈的统计模式,使用传统机器学习模型可以有效地将其与人类撰写的内容区分开来。我怀疑这就是许多所谓的"AI 查重工具"背后的实际工作原理。

2026/7/17 270
AI技术

Kimi K3:开放前沿智能

Kimi K3:开放前沿智能 Kimi K3 是首个达到 2.8 万亿参数的开源模型,标志着 Kimi 在扩展前沿的持续推进——今年连续第三次推出前沿级开源模型。

2026/7/17 209
AI技术

如何阻止Claude说“承重”之类的话

如何阻止Claude说“承重”之类的话 2026年7月14日 2分钟阅读 claude llm parody 看到Claude把所有东西都称为“诚实看法”和“承重接缝”,你是不是气得抓狂?你不是一个人。但如果我告诉你,有一种方法可以把这种巨大的挫败感变得如此荒谬,让你忍不住笑出来呢?或者干脆直...

2026/7/15 258
AI技术

LogiChat:从问答对到文档RAG的架构重构

LogiChat 是一个聊天机器人(chatbot)平台。客户上传文档,获取聊天组件(chat widget),无需接触模型。过去两年里,“训练机器人”意味着在仪表盘表单中手动整理问答列表——question 和 answer 对,一次一行,作为少样本(few-shot)对注入提示词(prom...

2026/7/15 188
AI技术

AI时代的可观测性设计(第二部分):PII防护与自愈

_AI辅助声明:本文在Claude的协助下起草。所有技术内容、设计决策、代码引用和截图均反映我在airCloset设计并运行的生产系统;正文在发布前由我本人修订。_ 大家好,我是Ryan,airCloset的CTO。 在第一部分中,我介绍了四个监控轴(应用 / 基础设施 / CI / LLM)...

2026/7/15 207
AI技术

如何在不烧钱的情况下测试AI产品

如何在不烧钱的情况下测试AI产品 原文:https://dev.to/debs_obrien/how-we-test-an-ai-product-without-burning-credit-4c5p 大多数测试都很廉价。点击按钮,断言某些变化,运行一千次也无人察觉。但测试AI产品则不同,因为有趣

2026/7/14 210
AI技术

提示词为何失败(以及如何修正)

提示词为何失败(以及如何修正) 原文:https://dev.to/blobxiaoyao/why-your-prompts-fail-and-how-to-fix-them-1fb6 这里有一个可靠的测试方法:找一个效果不佳的提示词,仔细阅读。然后问自己——模型是在哪个具体句子获得了许可,从而做

2026/7/14 207
AI技术

你可能不需要向量数据库来做RAG

你可能不需要向量数据库来做RAG 来源:dev.to/arthurpro 提到“RAG”,脑海中会浮现一幅特定画面:一个嵌入模型、一个像Pinecone或pgvector这样的向量数据库,以及每次查询都要调用的嵌入API。这感觉就像入场券——真正的基础设施、真实的账单、实际的运维面——仅仅为了让

2026/7/14 208