Skip to content

tools

10 articles tagged “tools”.

Abstract illustration of a narrow beam passing through a stack of data columns beside the same stack fully lit
engineeringtoolsobservabilityunder-the-hood

ClickHouse Text Indexes, Direct Read, and the Compatibility Trap

We shipped a text index that did byte-for-byte nothing while every diagnostic said it was working. The culprit: one compatibility setting silently pinning a prerequisite off.

Daniel Brodsky8 min read
Mastering Parallel Claude Code Sessions: A Guide to Multi-Agent Workflows
claudemcpagent-reliabilitytoolsopen-source

Mastering Parallel Claude Code Sessions: A Guide to Multi-Agent Workflows

Six terminals open and no idea which agent is waiting on you. How to run parallel Claude Code sessions with fleet.

Yuval Hayke14 min read
Agent Evaluations: Why Output-Only Checks Fail
engineeringproducttools

Agent Evaluations: Why Output-Only Checks Fail

Evaluating AI agents on final output hides silent failures and loops. Learn why trajectory evaluation and observability are essential for reliable agentic workflows.

Dennis Zagiansky9 min read
AI Agent Error Handling: Why Strict Tool Standards Matter
engineeringproducttoolsagent-reliability

AI Agent Error Handling: Why Strict Tool Standards Matter

Fix silent failures with a strict AI agent error handling contract. Learn how structured tool errors improve debugging and observability for LLM agents.

Dennis Zagiansky9 min read
RAG Retrieval Optimization: The #1 Mistake AI Builders Make
productengineeringtoolsragagent-reliabilityllm-cost

RAG Retrieval Optimization: The #1 Mistake AI Builders Make

Upgrading your LLM to fix hallucinations is a costly trap. Learn how RAG retrieval optimization and key evaluation metrics solve the real bottleneck.

Itamar Kramer8 min read
AI Product Management: Fixing Silent Model Degradation
productengineeringtoolsobservabilityagent-reliabilityai-product-management

AI Product Management: Fixing Silent Model Degradation

Stop AI model drift. Learn why AI product management requires continuous evaluation of probabilistic systems to prevent silent failure and user churn.

Daniel Shapira8 min read
AI Agent Analytics: Why Traditional SaaS Metrics Fail
productengineeringtoolsagent-analyticsai-product-management

AI Agent Analytics: Why Traditional SaaS Metrics Fail

Stop slicing AI agent data by industry or ARR. Learn how intent-based AI agent analytics surface real product gaps and improve agentic workflow performance.

Daniel Shapira8 min read
Continuous Evaluation for AI: Why Traditional QA Fails
productengineeringtoolsevalsobservability

Continuous Evaluation for AI: Why Traditional QA Fails

Stop silent AI degradation. Learn why continuous evaluation for AI is replacing traditional QA to monitor semantic drift and maintain LLM product quality.

Daniel Shapira7 min read