/content-analysis
Analyze text content using both traditional NLP and LLM-enhanced methods. Extract sentiment, topics, keywords, and insights from various content types including social media posts, articles, reviews, and video content. Use when working with text analysis, sentiment detection,
$ npx -y skills add liangdabiao/claude-data-analysis-ultra-main --skill content-analysis --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
- Fires itselfAuto-invocation. Claude auto-loads it when your prompt matches the work.Auto-invocation is when the right skill fires by itself at the right moment, driven by a FLOW.md router and a hook, instead of you invoking it by name. It is the difference between a skill being installed and a skill actually getting used.Read the full definition →
- You can call itInvoke it directly when you want it.
- Slash command
/content-analysis
Context preview
The summary Claude sees to decide when to auto-load this skill.
Analyze text content using both traditional NLP and LLM-enhanced methods. Extract sentiment, topics, keywords, and insights from various content types including social media posts, articles, reviews, and video content. Use when working with text analysis, sentiment detection,
SKILL.md
content-analysis.SKILL.mdname: content-analysis
description: Analyze text content using both traditional NLP and LLM-enhanced methods. Extract sentiment, topics, keywords, and insights from various content types including social media posts, articles, reviews, and video content. Use when working with text analysis, sentiment detection, topic modeling, or content optimization.
allowed-tools: Read, Write, Edit, Bash, Grep, Glob
Content Analysis Skill
Analyze text content using advanced NLP techniques and LLM-powered insights to extract sentiment, topics, and actionable intelligence from various content sources.
Quick Start
This skill helps you: 1. **Analyze sentiment** using both traditional NLP and LLM methods 2. **Extract topics and keywords** from large text datasets 3. **Classify and cluster content** automatically 4. **Identify viral content** patterns and characteristics 5. **Generate content insights** and recommendations 6. **Support multiple languages** and content formats
When to Use
- **Social Media Analysis**: Facebook, Twitter, Instagram, Weibo posts
- **Content Marketing**: Blog posts, articles, marketing copy analysis
- **Video Content**: YouTube titles, descriptions, comments analysis
- **Product Reviews**: Amazon, e-commerce customer feedback
- **News Analysis**: Article categorization, sentiment tracking
- **Customer Feedback**: Support tickets, surveys, reviews analysis
Key Requirements
Traditional NLP Analysis
pip install pandas numpy matplotlib seaborn nltk scikit-learn wordcloud
LLM-Enhanced Analysis (Optional)
pip install openai dashscope # For OpenAI and Qwen API access
Setup NLTK Data
import nltk
nltk.download('vader_lexicon')
nltk.download('punkt')
nltk.download('stopwords')Core Workflow
1. Data Preparation
Your data should include:
- **Text Content**: Main text to analyze (titles, descriptions, comments, etc.)
- **Metadata**: Optional (author, date, category, engagement metrics)
- **Multiple Languages**: Support for English, Chinese, and other languages
2. Analysis Process
1. **Text Preprocessing**: Clean, tokenize, and normalize text 2. **Sentiment Analysis**: Traditional VADER + LLM-enhanced analysis 3. **Topic Extraction**: TF-IDF keywords + LLM semantic topics 4. **Content Classification**: Automated categorization and clustering 5. **Pattern Recognition**: Identify viral content characteristics 6. **Insight Generation**: Actionable recommendations
3. Output Deliverables
- Sentiment analysis reports with confidence scores
- Topic models and keyword extractions
- Content classification results
- Viral content pattern analysis
- Optimization recommendations
Example Usage Scenarios
Social Media Content Analysis
# Analyze Twitter posts for brand sentiment
# Identify trending topics and hashtags
# Measure engagement patterns
YouTube Video Analysis
# Analyze video titles and descriptions
# Extract topics from comments
# Identify viral content patterns
Product Review Analysis
# Analyze customer feedback sentiment
# Extract product feature mentions
# Identify improvement opportunities
Key Analysis Methods
Traditional NLP Techniques
- **VADER Sentiment Analysis**: Rule-based sentiment scoring
- **TF-IDF Keyword Extraction**: Statistical term importance
- **Text Clustering**: K-means and hierarchical clustering
- **Word Frequency Analysis**: Term frequency and co-occurrence
- **Language Detection**: Automatic language identification
LLM-Enhanced Analysis
- **Context-Aware Sentiment**: Nuanced emotion understanding
- **Semantic Topic Extraction**: Meaning-based topic identification
- **Content Summarization**: Automatic text summarization
- **Multi-Language Support**: Cross-lingual analysis
- **Zero-Shot Classification**: Categorization without training data
Advanced Analytics
- **Time Series Analysis**: Content trends over time
- **Engagement Prediction**: Predict viral potential
- **Competitive Analysis**: Compare content performance
- **Audience Insights**: Demographic and preference analysis
Common Business Questions Answered
1. **What is the overall sentiment toward our brand?** 2. **Which topics are trending in our industry?** 3. **What makes content go viral?** 4. **How does sentiment vary by demographic or region?** 5. **What are customers saying about our products?** 6. **Which content formats perform best?**
Integration Examples
See [examples/](examples/) directory for:
- `basic_content_analysis.py` - Traditional NLP analysis
- `llm_enhanced_analysis.py` - LLM-powered analysis
- `social_media_analysis.py` - Social media specific analysis
- Sample datasets for testing
LLM Configuration
Supported LLM Providers
- **OpenAI**: GPT-3.5, GPT-4 models
- **Qwen (通义千问)**: Chinese-optimized models
- **Open Source**: Local models via HuggingFace
API Setup Examples
# OpenAI Configuration
import openai
openai.api_key = 'your-api-key'
# Qwen Configuration
import dashscope
dashscope.api_key = 'your-api-key'
Best Practices
1. **Data Quality**: Ensure clean, consistent text data 2. **Sampling Strategy**: Use representative samples for LLM analysis 3. **Cost Management**: Balance traditional NLP with LLM calls 4. **Language Handling**: Configure appropriate language models 5. **Validation**: Cross-validate sentiment analysis results 6. **Privacy**: Ensure compliance with data protection regulations
Performance Optimization
For Large Datasets
- Use data sampling for LLM analysis
- Implement batch processing
- Cache LLM responses when possible
- Use traditional NLP for initial filtering
Cost Management
- Prioritize important content for LLM analysis
- Use traditional NLP for bulk processing
- Implement smart sampling strategies
- Monitor API usage and costs
Advanced Features
- **Real-time Analysis**: Stream processing for live content
- **Multi-modal Analysis**: Text
Read more
name: content-analysis description: Analyze text content using both traditional NLP and LLM-enhanced methods. Extract sentiment, topics, keywords, and insights from various content types including social media posts, articles, reviews, and video content. Use when working with text analysis, sentiment detection, topic modeling, or content optimization. allowed-tools: Read, Write, Edit, Bash, Grep, Glob
Content Analysis Skill
Analyze text content using advanced NLP techniques and LLM-powered insights to extract sentiment, topics, and actionable intelligence from various content sources.
Quick Start
This skill helps you: 1. **Analyze sentiment** using both traditional NLP and LLM methods 2. **Extract topics and keywords** from large text datasets 3. **Classify and cluster content** automatically 4. **Identify viral content** patterns and characteristics 5. **Generate content insights** and recommendations 6. **Support multiple languages** and content formats
When to Use
- **Social Media Analysis**: Facebook, Twitter, Instagram, Weibo posts
- **Content Marketing**: Blog posts, articles, marketing copy analysis
- **Video Content**: YouTube titles, descriptions, comments analysis
- **Product Reviews**: Amazon, e-commerce customer feedback
- **News Analysis**: Article categorization, sentiment tracking
- **Customer Feedback**: Support tickets, surveys, reviews analysis
Key Requirements
Traditional NLP Analysis
pip install pandas numpy matplotlib seaborn nltk scikit-learn wordcloud
LLM-Enhanced Analysis (Optional)
pip install openai dashscope # For OpenAI and Qwen API access
Setup NLTK Data
import nltk
nltk.download('vader_lexicon')
nltk.download('punkt')
nltk.download('stopwords')Core Workflow
1. Data Preparation
Your data should include:
- **Text Content**: Main text to analyze (titles, descriptions, comments, etc.)
- **Metadata**: Optional (author, date, category, engagement metrics)
- **Multiple Languages**: Support for English, Chinese, and other languages
2. Analysis Process
1. **Text Preprocessing**: Clean, tokenize, and normalize text 2. **Sentiment Analysis**: Traditional VADER + LLM-enhanced analysis 3. **Topic Extraction**: TF-IDF keywords + LLM semantic topics 4. **Content Classification**: Automated categorization and clustering 5. **Pattern Recognition**: Identify viral content characteristics 6. **Insight Generation**: Actionable recommendations
3. Output Deliverables
- Sentiment analysis reports with confidence scores
- Topic models and keyword extractions
- Content classification results
- Viral content pattern analysis
- Optimization recommendations
Example Usage Scenarios
Social Media Content Analysis
# Analyze Twitter posts for brand sentiment # Identify trending topics and hashtags # Measure engagement patterns
YouTube Video Analysis
# Analyze video titles and descriptions # Extract topics from comments # Identify viral content patterns
Product Review Analysis
# Analyze customer feedback sentiment # Extract product feature mentions # Identify improvement opportunities
Key Analysis Methods
Traditional NLP Techniques
- **VADER Sentiment Analysis**: Rule-based sentiment scoring
- **TF-IDF Keyword Extraction**: Statistical term importance
- **Text Clustering**: K-means and hierarchical clustering
- **Word Frequency Analysis**: Term frequency and co-occurrence
- **Language Detection**: Automatic language identification
LLM-Enhanced Analysis
- **Context-Aware Sentiment**: Nuanced emotion understanding
- **Semantic Topic Extraction**: Meaning-based topic identification
- **Content Summarization**: Automatic text summarization
- **Multi-Language Support**: Cross-lingual analysis
- **Zero-Shot Classification**: Categorization without training data
Advanced Analytics
- **Time Series Analysis**: Content trends over time
- **Engagement Prediction**: Predict viral potential
- **Competitive Analysis**: Compare content performance
- **Audience Insights**: Demographic and preference analysis
Common Business Questions Answered
1. **What is the overall sentiment toward our brand?** 2. **Which topics are trending in our industry?** 3. **What makes content go viral?** 4. **How does sentiment vary by demographic or region?** 5. **What are customers saying about our products?** 6. **Which content formats perform best?**
Integration Examples
See [examples/](examples/) directory for:
- `basic_content_analysis.py` - Traditional NLP analysis
- `llm_enhanced_analysis.py` - LLM-powered analysis
- `social_media_analysis.py` - Social media specific analysis
- Sample datasets for testing
LLM Configuration
Supported LLM Providers
- **OpenAI**: GPT-3.5, GPT-4 models
- **Qwen (通义千问)**: Chinese-optimized models
- **Open Source**: Local models via HuggingFace
API Setup Examples
# OpenAI Configuration import openai openai.api_key = 'your-api-key' # Qwen Configuration import dashscope dashscope.api_key = 'your-api-key'
Best Practices
1. **Data Quality**: Ensure clean, consistent text data 2. **Sampling Strategy**: Use representative samples for LLM analysis 3. **Cost Management**: Balance traditional NLP with LLM calls 4. **Language Handling**: Configure appropriate language models 5. **Validation**: Cross-validate sentiment analysis results 6. **Privacy**: Ensure compliance with data protection regulations
Performance Optimization
For Large Datasets
- Use data sampling for LLM analysis
- Implement batch processing
- Cache LLM responses when possible
- Use traditional NLP for initial filtering
Cost Management
- Prioritize important content for LLM analysis
- Use traditional NLP for bulk processing
- Implement smart sampling strategies
- Monitor API usage and costs
Advanced Features
- **Real-time Analysis**: Stream processing for live content
- **Multi-modal Analysis**: Text
基于 Claude Skill 架构的智能数据分析平台。提供两套完整的技能体系: 通用数据分析技能 - 6阶段完整分析流程 互联网数据分析技能 - 7个专业分析模块 + 1个入口技能
Other skills on claude-data-analysis-ultra-main.
- /ab-testing-analyzer
全面的AB测试分析工具,支持实验设计、统计检验、用户分群分析和可视化报告生成。用于分析产品改版、营销活动、功能优化等AB测试结果,提供统计显著性检验和深度洞察。
Open skill - /attribution-analysis-modeling
Perform multi-touch attribution analysis using Markov chains, Shapley values, and custom attribution models. Use when you need to analyze marketing channel effectiveness, calculate conversion attribution, optimize marketing budgets, or understand customer journey paths. Supports
Open skill - /code-generator
Generates production-ready analysis code in Python, R, SQL. Invoke when user wants reusable code for data analysis, ML, or visualization.
Open skill - /data-analysis
通用的 6 阶段数据分析助手:数据质量→探索性分析→假设生成→可视化→代码生成→综合报告。提供完整的方法论和模板!
Open skill - /data-exploration-visualization
自动化数据探索和可视化工具,提供从数据加载到专业报告生成的完整EDA解决方案。支持多种图表类型、智能数据诊断、建模评估和HTML报告生成。适用于医疗、金融、电商等领域的数据分析项目。
Open skill - /data-explorer
Performs exploratory data analysis, statistical analysis, and pattern discovery. Invoke when user wants to analyze data, find patterns, statistical testing, or get deep insights.
Open skill

