AI Observability & Evaluation

agents ai-monitoring ai-observability aiengineering anthropic datasets evals langchain llamaindex llm-eval llm-evaluation llmops llms openai prompt-engineering smolagents
20 Open Issues Need Help Last updated: Jul 10, 2026

Open Issues Need Help

View All on GitHub
enhancement good first issue c/dx good-agent-issue c/cli

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
enhancement help wanted backlog c/experiments c/usability

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
good first issue backlog javascript

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
enhancement help wanted backlog c/infra

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
enhancement good first issue stale c/experiments

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
enhancement good first issue c/ui

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
enhancement help wanted backlog c/traces stale

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
enhancement help wanted stale c/prompts

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
bug help wanted stale priority: medium c/filters

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
bug help wanted c/ui stale

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
enhancement good first issue needs information c/experiments

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents
enhancement good first issue help wanted

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents

AI Summary: Enhance the Arize Phoenix platform's TypeScript client to allow running experiments using in-memory datasets provided as parameters to the `runExperiment` function, eliminating the need for persistent dataset storage. This involves modifying the function to accept a dataset object containing examples directly, rather than a dataset ID.

Complexity: 3/5
enhancement good first issue triage

AI Observability & Evaluation

Python
#agents#ai-monitoring#ai-observability#aiengineering#anthropic#datasets#evals#langchain#llamaindex#llm-eval#llm-evaluation#llmops#llms#openai#prompt-engineering#smolagents