| 1 |
|
| 2 |
|
| 3 |
|
| 4 |
|
| 5 |
|
| 6 |
|
| 7 |
|
| 8 |
|
| 9 |
|
| 10 |
use std::sync::Arc; |
| 11 |
use std::time::Duration; |
| 12 |
|
| 13 |
use sqlx::PgPool; |
| 14 |
use tokio::sync::Semaphore; |
| 15 |
use uuid::Uuid; |
| 16 |
|
| 17 |
use crate::constants; |
| 18 |
use crate::db::{ |
| 19 |
self, FileScanStatus, ItemId, VersionId, |
| 20 |
scan_jobs::{ScanJob, ScanTargetKind}, |
| 21 |
}; |
| 22 |
use crate::storage::{FileType, StorageBackend}; |
| 23 |
use crate::wam_client::WamClient; |
| 24 |
|
| 25 |
use super::{LayerResult, LayerVerdict, ScanPipeline, ScanResult}; |
| 26 |
|
| 27 |
|
| 28 |
const IDLE_POLL_INTERVAL: Duration = Duration::from_millis(500); |
| 29 |
|
| 30 |
|
| 31 |
|
| 32 |
|
| 33 |
|
| 34 |
const STUCK_JOB_SECS: i64 = 300; |
| 35 |
|
| 36 |
|
| 37 |
|
| 38 |
|
| 39 |
const HEARTBEAT_INTERVAL: Duration = Duration::from_secs(30); |
| 40 |
|
| 41 |
|
| 42 |
const REAPER_INTERVAL: Duration = Duration::from_mins(1); |
| 43 |
|
| 44 |
|
| 45 |
|
| 46 |
struct AbortOnDrop(tokio::task::JoinHandle<()>); |
| 47 |
|
| 48 |
impl Drop for AbortOnDrop { |
| 49 |
fn drop(&mut self) { |
| 50 |
self.0.abort(); |
| 51 |
} |
| 52 |
} |
| 53 |
|
| 54 |
|
| 55 |
|
| 56 |
|
| 57 |
|
| 58 |
|
| 59 |
|
| 60 |
async fn process_job_with_heartbeat( |
| 61 |
ctx: &WorkerContext, |
| 62 |
job: ScanJob, |
| 63 |
) -> Result<(), Box<dyn std::error::Error + Send + Sync>> { |
| 64 |
let job_id = job.id; |
| 65 |
let hb_db = ctx.db.clone(); |
| 66 |
let heartbeat = tokio::spawn(async move { |
| 67 |
let mut ticker = tokio::time::interval(HEARTBEAT_INTERVAL); |
| 68 |
|
| 69 |
|
| 70 |
ticker.tick().await; |
| 71 |
loop { |
| 72 |
ticker.tick().await; |
| 73 |
if let Err(e) = db::scan_jobs::bump_heartbeat(&hb_db, job_id).await { |
| 74 |
tracing::warn!(%job_id, error = %e, "scan heartbeat bump failed"); |
| 75 |
} |
| 76 |
} |
| 77 |
}); |
| 78 |
let _guard = AbortOnDrop(heartbeat); |
| 79 |
process_job(ctx, job).await |
| 80 |
} |
| 81 |
|
| 82 |
|
| 83 |
pub struct WorkerContext { |
| 84 |
pub db: PgPool, |
| 85 |
pub s3: Arc<dyn StorageBackend>, |
| 86 |
pub pipeline: Arc<ScanPipeline>, |
| 87 |
pub scan_semaphore: Arc<Semaphore>, |
| 88 |
pub wam: Option<WamClient>, |
| 89 |
|
| 90 |
|
| 91 |
|
| 92 |
pub bg: crate::background::BackgroundTx, |
| 93 |
|
| 94 |
|
| 95 |
|
| 96 |
|
| 97 |
pub cloudflare: Option<crate::cloudflare::CloudflarePurger>, |
| 98 |
|
| 99 |
|
| 100 |
pub cdn_base_url: Arc<str>, |
| 101 |
|
| 102 |
|
| 103 |
|
| 104 |
pub synckit_s3: Option<Arc<dyn StorageBackend>>, |
| 105 |
|
| 106 |
|
| 107 |
|
| 108 |
|
| 109 |
|
| 110 |
pub public_s3: Option<Arc<dyn StorageBackend>>, |
| 111 |
|
| 112 |
|
| 113 |
|
| 114 |
pub config: crate::config::Config, |
| 115 |
} |
| 116 |
|
| 117 |
|
| 118 |
|
| 119 |
|
| 120 |
|
| 121 |
|
| 122 |
|
| 123 |
|
| 124 |
|
| 125 |
|
| 126 |
|
| 127 |
|
| 128 |
|
| 129 |
|
| 130 |
|
| 131 |
|
| 132 |
|
| 133 |
|
| 134 |
|
| 135 |
|
| 136 |
fn resolve_pass_status( |
| 137 |
pipeline_status: FileScanStatus, |
| 138 |
is_trusted: bool, |
| 139 |
layers: &[LayerResult], |
| 140 |
) -> FileScanStatus { |
| 141 |
if pipeline_status == FileScanStatus::HeldForReview { |
| 142 |
return FileScanStatus::HeldForReview; |
| 143 |
} |
| 144 |
if is_trusted && !clamav_layer_errored(layers) { |
| 145 |
FileScanStatus::Clean |
| 146 |
} else { |
| 147 |
FileScanStatus::HeldForReview |
| 148 |
} |
| 149 |
} |
| 150 |
|
| 151 |
|
| 152 |
|
| 153 |
|
| 154 |
fn clamav_layer_errored(layers: &[LayerResult]) -> bool { |
| 155 |
layers |
| 156 |
.iter() |
| 157 |
.any(|l| l.layer == "clamav" && l.verdict == LayerVerdict::Error) |
| 158 |
} |
| 159 |
|
| 160 |
|
| 161 |
|
| 162 |
|
| 163 |
|
| 164 |
|
| 165 |
|
| 166 |
pub fn spawn_pool( |
| 167 |
n: usize, |
| 168 |
ctx: &Arc<WorkerContext>, |
| 169 |
shutdown_rx: tokio::sync::watch::Receiver<()>, |
| 170 |
) { |
| 171 |
for worker_id in 0..n { |
| 172 |
let ctx = Arc::clone(ctx); |
| 173 |
let mut shutdown_rx = shutdown_rx.clone(); |
| 174 |
tokio::spawn(async move { |
| 175 |
tracing::info!(worker_id, "scan worker started"); |
| 176 |
loop { |
| 177 |
match db::scan_jobs::claim_next(&ctx.db).await { |
| 178 |
Ok(Some(job)) => { |
| 179 |
let job_id = job.id; |
| 180 |
if let Err(e) = process_job_with_heartbeat(&ctx, job).await { |
| 181 |
tracing::error!(worker_id, %job_id, error = %e, "scan job failed"); |
| 182 |
if let Err(e2) = |
| 183 |
db::scan_jobs::mark_failed(&ctx.db, job_id, &e.to_string()).await |
| 184 |
{ |
| 185 |
tracing::error!(worker_id, %job_id, error = %e2, "failed to mark job failed"); |
| 186 |
} |
| 187 |
} |
| 188 |
} |
| 189 |
Ok(None) => { |
| 190 |
tokio::select! { |
| 191 |
() = tokio::time::sleep(IDLE_POLL_INTERVAL) => {} |
| 192 |
res = shutdown_rx.changed() => { |
| 193 |
if res.is_err() { |
| 194 |
tracing::info!(worker_id, "scan worker shutting down"); |
| 195 |
break; |
| 196 |
} |
| 197 |
} |
| 198 |
} |
| 199 |
} |
| 200 |
Err(e) => { |
| 201 |
tracing::error!(worker_id, error = %e, "claim_next failed; backing off"); |
| 202 |
tokio::select! { |
| 203 |
() = tokio::time::sleep(Duration::from_secs(5)) => {} |
| 204 |
res = shutdown_rx.changed() => { |
| 205 |
if res.is_err() { |
| 206 |
break; |
| 207 |
} |
| 208 |
} |
| 209 |
} |
| 210 |
} |
| 211 |
} |
| 212 |
} |
| 213 |
}); |
| 214 |
} |
| 215 |
|
| 216 |
let ctx_reaper = Arc::clone(ctx); |
| 217 |
let mut shutdown_rx = shutdown_rx; |
| 218 |
tokio::spawn(async move { |
| 219 |
loop { |
| 220 |
match db::scan_jobs::reap_stuck(&ctx_reaper.db, STUCK_JOB_SECS).await { |
| 221 |
Ok(n) if n > 0 => { |
| 222 |
tracing::warn!( |
| 223 |
reset = n, |
| 224 |
max_age_secs = STUCK_JOB_SECS, |
| 225 |
"reset stuck scan jobs" |
| 226 |
); |
| 227 |
} |
| 228 |
Ok(_) => {} |
| 229 |
Err(e) => tracing::error!(error = %e, "scan job reaper failed"), |
| 230 |
} |
| 231 |
tokio::select! { |
| 232 |
() = tokio::time::sleep(REAPER_INTERVAL) => {} |
| 233 |
res = shutdown_rx.changed() => { |
| 234 |
if res.is_err() { |
| 235 |
break; |
| 236 |
} |
| 237 |
} |
| 238 |
} |
| 239 |
} |
| 240 |
}); |
| 241 |
} |
| 242 |
|
| 243 |
|
| 244 |
|
| 245 |
|
| 246 |
|
| 247 |
|
| 248 |
pub async fn process_next_for_test( |
| 249 |
ctx: &WorkerContext, |
| 250 |
) -> Result<bool, Box<dyn std::error::Error + Send + Sync>> { |
| 251 |
match db::scan_jobs::claim_next(&ctx.db).await? { |
| 252 |
Some(job) => { |
| 253 |
let job_id = job.id; |
| 254 |
if let Err(e) = process_job(ctx, job).await { |
| 255 |
db::scan_jobs::mark_failed(&ctx.db, job_id, &e.to_string()).await?; |
| 256 |
return Err(e); |
| 257 |
} |
| 258 |
Ok(true) |
| 259 |
} |
| 260 |
None => Ok(false), |
| 261 |
} |
| 262 |
} |
| 263 |
|
| 264 |
|
| 265 |
|
| 266 |
|
| 267 |
|
| 268 |
|
| 269 |
|
| 270 |
|
| 271 |
#[tracing::instrument(skip_all, fields(%job_id = job.id, target_kind = %job.target_kind, %target_id = job.target_id, attempts = job.attempts))] |
| 272 |
async fn process_job( |
| 273 |
ctx: &WorkerContext, |
| 274 |
job: ScanJob, |
| 275 |
) -> Result<(), Box<dyn std::error::Error + Send + Sync>> { |
| 276 |
let job_id = job.id; |
| 277 |
let kind = job |
| 278 |
.typed_kind() |
| 279 |
.ok_or_else(|| format!("unknown target_kind: {}", job.target_kind))?; |
| 280 |
let file_type = job |
| 281 |
.typed_file_type() |
| 282 |
.ok_or_else(|| format!("unknown file_type: {}", job.file_type))?; |
| 283 |
let target_id = job.target_id; |
| 284 |
let started = std::time::Instant::now(); |
| 285 |
|
| 286 |
|
| 287 |
|
| 288 |
|
| 289 |
update_entity_status(&ctx.db, kind, target_id, FileScanStatus::Scanning) |
| 290 |
.await |
| 291 |
.ok(); |
| 292 |
|
| 293 |
let entity_status = match run_pipeline_and_decide(ctx, &job, kind, file_type).await { |
| 294 |
Ok(s) => s, |
| 295 |
Err(e) => { |
| 296 |
|
| 297 |
|
| 298 |
|
| 299 |
update_entity_status(&ctx.db, kind, target_id, FileScanStatus::HeldForReview) |
| 300 |
.await |
| 301 |
.ok(); |
| 302 |
crate::metrics::record_scan_verdict("error"); |
| 303 |
crate::metrics::record_scan_duration(started.elapsed().as_secs_f64()); |
| 304 |
return Err(e); |
| 305 |
} |
| 306 |
}; |
| 307 |
|
| 308 |
|
| 309 |
|
| 310 |
|
| 311 |
|
| 312 |
|
| 313 |
|
| 314 |
|
| 315 |
update_entity_status(&ctx.db, kind, target_id, entity_status).await?; |
| 316 |
|
| 317 |
|
| 318 |
|
| 319 |
|
| 320 |
if kind == ScanTargetKind::OtaArtifact { |
| 321 |
annotate_release_scan(ctx, db::OtaArtifactId::from(target_id)).await; |
| 322 |
} |
| 323 |
|
| 324 |
|
| 325 |
|
| 326 |
let verdict_label = match entity_status { |
| 327 |
FileScanStatus::Clean => "clean", |
| 328 |
FileScanStatus::Quarantined => "quarantined", |
| 329 |
FileScanStatus::HeldForReview => "held_for_review", |
| 330 |
FileScanStatus::Pending => "pending", |
| 331 |
FileScanStatus::Scanning => "scanning", |
| 332 |
FileScanStatus::Error => "error", |
| 333 |
}; |
| 334 |
crate::metrics::record_scan_verdict(verdict_label); |
| 335 |
crate::metrics::record_scan_duration(started.elapsed().as_secs_f64()); |
| 336 |
|
| 337 |
db::scan_jobs::mark_done(&ctx.db, job_id).await?; |
| 338 |
Ok(()) |
| 339 |
} |
| 340 |
|
| 341 |
|
| 342 |
|
| 343 |
async fn run_pipeline_and_decide( |
| 344 |
ctx: &WorkerContext, |
| 345 |
job: &ScanJob, |
| 346 |
kind: ScanTargetKind, |
| 347 |
file_type: FileType, |
| 348 |
) -> Result<FileScanStatus, Box<dyn std::error::Error + Send + Sync>> { |
| 349 |
|
| 350 |
|
| 351 |
|
| 352 |
|
| 353 |
|
| 354 |
|
| 355 |
|
| 356 |
|
| 357 |
|
| 358 |
|
| 359 |
|
| 360 |
|
| 361 |
|
| 362 |
|
| 363 |
|
| 364 |
|
| 365 |
|
| 366 |
let bucket = kind.storage_bucket(); |
| 367 |
let backend: &Arc<dyn StorageBackend> = match bucket { |
| 368 |
crate::storage::S3Bucket::Synckit => ctx.synckit_s3.as_ref().ok_or_else(|| { |
| 369 |
Box::<dyn std::error::Error + Send + Sync>::from( |
| 370 |
"SyncKit storage not configured; cannot scan OTA artifact", |
| 371 |
) |
| 372 |
})?, |
| 373 |
|
| 374 |
|
| 375 |
|
| 376 |
|
| 377 |
|
| 378 |
crate::storage::S3Bucket::Public => { |
| 379 |
return Err(Box::<dyn std::error::Error + Send + Sync>::from( |
| 380 |
"invariant: a staging/scan object must never live in the public bucket", |
| 381 |
)); |
| 382 |
} |
| 383 |
crate::storage::S3Bucket::Main => &ctx.s3, |
| 384 |
}; |
| 385 |
|
| 386 |
let result: ScanResult = if job.file_size_bytes as u64 > constants::SCAN_SPOOL_MAX_BYTES { |
| 387 |
|
| 388 |
|
| 389 |
|
| 390 |
|
| 391 |
|
| 392 |
tracing::warn!( |
| 393 |
job_id = %job.id, size = job.file_size_bytes, |
| 394 |
cap = constants::SCAN_SPOOL_MAX_BYTES, |
| 395 |
"upload exceeds scan spool ceiling; holding for review (not auto-scanned)" |
| 396 |
); |
| 397 |
super::too_large_to_scan(job.file_size_bytes as u64) |
| 398 |
} else if (job.file_size_bytes as usize) < constants::SCAN_MAX_MEMORY_BYTES { |
| 399 |
|
| 400 |
|
| 401 |
|
| 402 |
|
| 403 |
|
| 404 |
|
| 405 |
let cap = (job.file_size_bytes as u64) |
| 406 |
.saturating_add(constants::SCAN_SPOOL_SLACK_BYTES) |
| 407 |
.min(constants::SCAN_MAX_MEMORY_BYTES as u64); |
| 408 |
let data = backend.download_object_buf_capped(&job.s3_key, cap).await?; |
| 409 |
let _permit = ctx.scan_semaphore.acquire().await?; |
| 410 |
Arc::clone(&ctx.pipeline).scan(data, file_type).await |
| 411 |
} else { |
| 412 |
let stream = backend.download_stream(&job.s3_key).await?; |
| 413 |
let spool = super::spool::download_into_tempfile( |
| 414 |
std::path::Path::new(constants::SCAN_SPOOL_DIR), |
| 415 |
&job.id.to_string(), |
| 416 |
&job.s3_key, |
| 417 |
job.file_size_bytes as u64, |
| 418 |
stream, |
| 419 |
) |
| 420 |
.await?; |
| 421 |
let _permit = ctx.scan_semaphore.acquire().await?; |
| 422 |
Arc::clone(&ctx.pipeline) |
| 423 |
.scan_stream(spool, file_type) |
| 424 |
.await |
| 425 |
}; |
| 426 |
|
| 427 |
db::scanning::insert_scan_result(&ctx.db, &job.s3_key, &result).await?; |
| 428 |
|
| 429 |
if result.status == FileScanStatus::Quarantined { |
| 430 |
let failed_layers: Vec<&str> = result |
| 431 |
.layers |
| 432 |
.iter() |
| 433 |
.filter(|l| l.verdict == LayerVerdict::Fail) |
| 434 |
.map(|l| l.layer) |
| 435 |
.collect(); |
| 436 |
if let Some(wam) = ctx.wam.clone() { |
| 437 |
|
| 438 |
|
| 439 |
|
| 440 |
|
| 441 |
|
| 442 |
let title = format!("File quarantined: {}", job.s3_key); |
| 443 |
let body = format!( |
| 444 |
"Upload by user {} flagged as malicious.\n\ |
| 445 |
Failed layers: {}\nFile type: {file_type:?}\nSize: {}", |
| 446 |
job.user_id, |
| 447 |
failed_layers.join(", "), |
| 448 |
job.file_size_bytes, |
| 449 |
); |
| 450 |
let s3_key = job.s3_key.clone(); |
| 451 |
ctx.bg.spawn("malware quarantine ticket", async move { |
| 452 |
wam.create_ticket( |
| 453 |
&title, |
| 454 |
Some(&body), |
| 455 |
"high", |
| 456 |
"malware-quarantine", |
| 457 |
Some(&s3_key), |
| 458 |
) |
| 459 |
.await; |
| 460 |
}); |
| 461 |
} |
| 462 |
|
| 463 |
|
| 464 |
|
| 465 |
|
| 466 |
|
| 467 |
|
| 468 |
|
| 469 |
|
| 470 |
|
| 471 |
|
| 472 |
|
| 473 |
|
| 474 |
|
| 475 |
|
| 476 |
|
| 477 |
|
| 478 |
|
| 479 |
|
| 480 |
|
| 481 |
|
| 482 |
|
| 483 |
|
| 484 |
|
| 485 |
|
| 486 |
let row_deleted = kind.is_cdn_served_without_gate(); |
| 487 |
if row_deleted { |
| 488 |
match db::scanning::purge_cdn_image_rows_by_key(&ctx.db, &job.s3_key).await { |
| 489 |
Ok(n) => tracing::warn!( |
| 490 |
s3_key = %job.s3_key, target_kind = %kind.as_str(), rows_removed = n, |
| 491 |
"removed quarantined CDN-served image row(s); URL is no longer rendered" |
| 492 |
), |
| 493 |
Err(e) => tracing::error!( |
| 494 |
s3_key = %job.s3_key, target_kind = %kind.as_str(), error = %e, |
| 495 |
"FAILED to remove quarantined image row(s); the URL may still render until manual removal" |
| 496 |
), |
| 497 |
} |
| 498 |
} |
| 499 |
|
| 500 |
|
| 501 |
|
| 502 |
|
| 503 |
|
| 504 |
let mut object_removed = !kind.quarantine_purges_object(); |
| 505 |
if kind.quarantine_purges_object() { |
| 506 |
|
| 507 |
|
| 508 |
|
| 509 |
|
| 510 |
let auth = crate::storage::S3DeleteAuthority::new(); |
| 511 |
match backend |
| 512 |
.delete_object(&auth, &crate::storage::S3Key::from_stored(&job.s3_key)) |
| 513 |
.await |
| 514 |
{ |
| 515 |
Ok(()) => { |
| 516 |
tracing::warn!( |
| 517 |
s3_key = %job.s3_key, target_kind = %kind.as_str(), |
| 518 |
"purged quarantined object from storage" |
| 519 |
); |
| 520 |
object_removed = true; |
| 521 |
} |
| 522 |
Err(e) => { |
| 523 |
tracing::error!( |
| 524 |
s3_key = %job.s3_key, target_kind = %kind.as_str(), error = %e, |
| 525 |
"immediate purge of quarantined object failed" |
| 526 |
); |
| 527 |
|
| 528 |
|
| 529 |
|
| 530 |
|
| 531 |
|
| 532 |
|
| 533 |
|
| 534 |
if row_deleted { |
| 535 |
match db::pending_s3_deletions::enqueue_deletions( |
| 536 |
&ctx.db, |
| 537 |
&[(job.s3_key.clone(), bucket.as_str().to_string())], |
| 538 |
"malware_quarantine", |
| 539 |
) |
| 540 |
.await |
| 541 |
{ |
| 542 |
Ok(()) => { |
| 543 |
tracing::warn!( |
| 544 |
s3_key = %job.s3_key, |
| 545 |
"quarantined object enqueued for durable deletion after direct purge failed" |
| 546 |
); |
| 547 |
object_removed = true; |
| 548 |
} |
| 549 |
Err(enqueue_err) => tracing::error!( |
| 550 |
s3_key = %job.s3_key, error = %enqueue_err, |
| 551 |
"FAILED to enqueue quarantined object for durable deletion; will retry the scan job" |
| 552 |
), |
| 553 |
} |
| 554 |
} else { |
| 555 |
tracing::error!( |
| 556 |
s3_key = %job.s3_key, target_kind = %kind.as_str(), |
| 557 |
"quarantined object still referenced by its entity row; durable queue cannot delete it, will retry the scan job" |
| 558 |
); |
| 559 |
} |
| 560 |
} |
| 561 |
} |
| 562 |
} |
| 563 |
|
| 564 |
|
| 565 |
|
| 566 |
|
| 567 |
|
| 568 |
|
| 569 |
|
| 570 |
|
| 571 |
if !object_removed { |
| 572 |
return Err(format!( |
| 573 |
"quarantine incomplete: malicious object {} could neither be purged nor enqueued for deletion", |
| 574 |
job.s3_key |
| 575 |
) |
| 576 |
.into()); |
| 577 |
} |
| 578 |
|
| 579 |
|
| 580 |
|
| 581 |
|
| 582 |
|
| 583 |
|
| 584 |
|
| 585 |
|
| 586 |
if let Some(cf) = ctx.cloudflare.clone() { |
| 587 |
let url = format!("{}/{}", ctx.cdn_base_url.trim_end_matches('/'), job.s3_key); |
| 588 |
ctx.bg.spawn("malware quarantine cdn purge", async move { |
| 589 |
cf.purge_urls(vec![url]).await; |
| 590 |
}); |
| 591 |
} |
| 592 |
|
| 593 |
return Ok(FileScanStatus::Quarantined); |
| 594 |
} |
| 595 |
|
| 596 |
|
| 597 |
|
| 598 |
|
| 599 |
|
| 600 |
let is_trusted = db::users::is_upload_trusted(&ctx.db, job.user_id).await?; |
| 601 |
let status = resolve_pass_status(result.status, is_trusted, &result.layers); |
| 602 |
|
| 603 |
|
| 604 |
|
| 605 |
|
| 606 |
|
| 607 |
|
| 608 |
if clamav_degraded_hold_occurred(result.status, is_trusted, &result.layers) { |
| 609 |
tracing::warn!( |
| 610 |
s3_key = %job.s3_key, |
| 611 |
user_id = %job.user_id, |
| 612 |
"clamav layer errored on a trusted upload; held for review on reduced AV coverage" |
| 613 |
); |
| 614 |
crate::metrics::record_clamav_degraded_hold(); |
| 615 |
if let Some(wam) = ctx.wam.clone() { |
| 616 |
let body = format!( |
| 617 |
"A trusted upload was held for review because its clamav layer errored \ |
| 618 |
(reduced AV coverage, clamd may be unreachable).\n\n\ |
| 619 |
s3_key: {}\nuser_id: {}", |
| 620 |
job.s3_key, job.user_id |
| 621 |
); |
| 622 |
wam.create_ticket( |
| 623 |
"ClamAV degraded: trusted upload held on reduced AV coverage", |
| 624 |
Some(&body), |
| 625 |
"medium", |
| 626 |
"clamav-degraded-hold", |
| 627 |
Some(&job.s3_key), |
| 628 |
) |
| 629 |
.await; |
| 630 |
} |
| 631 |
} |
| 632 |
|
| 633 |
|
| 634 |
|
| 635 |
|
| 636 |
|
| 637 |
|
| 638 |
|
| 639 |
|
| 640 |
|
| 641 |
|
| 642 |
|
| 643 |
|
| 644 |
|
| 645 |
|
| 646 |
|
| 647 |
|
| 648 |
|
| 649 |
|
| 650 |
|
| 651 |
|
| 652 |
|
| 653 |
if status == FileScanStatus::Clean && job.s3_key.starts_with("staging/") { |
| 654 |
|
| 655 |
|
| 656 |
|
| 657 |
|
| 658 |
super::promote_staging_to_content( |
| 659 |
&ctx.db, |
| 660 |
backend.as_ref(), |
| 661 |
ctx.public_s3.as_deref(), |
| 662 |
&ctx.cdn_base_url, |
| 663 |
kind, |
| 664 |
file_type, |
| 665 |
job.target_id, |
| 666 |
job.user_id, |
| 667 |
&job.s3_key, |
| 668 |
&result.sha256, |
| 669 |
bucket, |
| 670 |
) |
| 671 |
.await?; |
| 672 |
} else if status != FileScanStatus::Clean && kind.is_cdn_served_without_gate() { |
| 673 |
|
| 674 |
|
| 675 |
match db::scanning::set_cdn_image_scan_status_by_key(&ctx.db, &job.s3_key, status).await { |
| 676 |
Ok(n) => tracing::info!( |
| 677 |
s3_key = %job.s3_key, target_kind = %kind.as_str(), scan_status = %status, rows = n, |
| 678 |
"stamped CDN-served image scan_status (renders only when clean)" |
| 679 |
), |
| 680 |
Err(e) => tracing::warn!( |
| 681 |
s3_key = %job.s3_key, target_kind = %kind.as_str(), error = %e, |
| 682 |
"failed to stamp CDN-served image scan_status; image stays hidden until re-scan" |
| 683 |
), |
| 684 |
} |
| 685 |
} |
| 686 |
|
| 687 |
Ok(status) |
| 688 |
} |
| 689 |
|
| 690 |
|
| 691 |
|
| 692 |
|
| 693 |
fn clamav_degraded_hold_occurred( |
| 694 |
pipeline_status: FileScanStatus, |
| 695 |
is_trusted: bool, |
| 696 |
layers: &[crate::scanning::LayerResult], |
| 697 |
) -> bool { |
| 698 |
pipeline_status == FileScanStatus::Clean && is_trusted && clamav_layer_errored(layers) |
| 699 |
} |
| 700 |
|
| 701 |
|
| 702 |
|
| 703 |
|
| 704 |
|
| 705 |
|
| 706 |
|
| 707 |
|
| 708 |
|
| 709 |
|
| 710 |
|
| 711 |
|
| 712 |
|
| 713 |
|
| 714 |
|
| 715 |
async fn annotate_release_scan(ctx: &WorkerContext, artifact_id: db::OtaArtifactId) { |
| 716 |
let Ok(Some(artifact)) = db::ota::get_artifact_by_id(&ctx.db, artifact_id).await else { |
| 717 |
return; |
| 718 |
}; |
| 719 |
let Ok(artifacts) = db::ota::list_artifacts(&ctx.db, artifact.release_id).await else { |
| 720 |
return; |
| 721 |
}; |
| 722 |
if artifacts.is_empty() |
| 723 |
|| artifacts.iter().any(|a| { |
| 724 |
matches!( |
| 725 |
a.scan_status, |
| 726 |
FileScanStatus::Pending | FileScanStatus::Scanning |
| 727 |
) |
| 728 |
}) |
| 729 |
{ |
| 730 |
return; |
| 731 |
} |
| 732 |
|
| 733 |
|
| 734 |
|
| 735 |
let Ok(Some(build)) = db::builds::get_build_by_release(&ctx.db, artifact.release_id).await |
| 736 |
else { |
| 737 |
return; |
| 738 |
}; |
| 739 |
let Ok(Some(config)) = db::builds::get_build_config_by_app(&ctx.db, build.app_id).await else { |
| 740 |
return; |
| 741 |
}; |
| 742 |
let Ok(Some(repo)) = db::git_repos::get_repo_by_id(&ctx.db, config.repo_id).await else { |
| 743 |
return; |
| 744 |
}; |
| 745 |
let Ok(Some(owner)) = db::users::get_user_by_id(&ctx.db, repo.user_id).await else { |
| 746 |
return; |
| 747 |
}; |
| 748 |
let owner = owner.username.to_string(); |
| 749 |
|
| 750 |
let Some(target) = crate::routes::git::notes_server::resolve_tag_commit( |
| 751 |
&ctx.config, |
| 752 |
&owner, |
| 753 |
&repo.name, |
| 754 |
&build.tag, |
| 755 |
) |
| 756 |
.await |
| 757 |
else { |
| 758 |
return; |
| 759 |
}; |
| 760 |
|
| 761 |
let verdicts: Vec<(String, FileScanStatus)> = artifacts |
| 762 |
.iter() |
| 763 |
.map(|a| (format!("{}/{}", a.target, a.arch), a.scan_status)) |
| 764 |
.collect(); |
| 765 |
|
| 766 |
crate::routes::git::notes_server::note_scan( |
| 767 |
&crate::routes::git::notes_server::OwnedRepo { |
| 768 |
db: &ctx.db, |
| 769 |
config: &ctx.config, |
| 770 |
id: repo.id, |
| 771 |
owner: &owner, |
| 772 |
name: &repo.name, |
| 773 |
}, |
| 774 |
target, |
| 775 |
&build.version, |
| 776 |
&verdicts, |
| 777 |
) |
| 778 |
.await; |
| 779 |
} |
| 780 |
|
| 781 |
async fn update_entity_status( |
| 782 |
db: &PgPool, |
| 783 |
kind: ScanTargetKind, |
| 784 |
target_id: Uuid, |
| 785 |
status: FileScanStatus, |
| 786 |
) -> Result<(), sqlx::Error> { |
| 787 |
match kind { |
| 788 |
ScanTargetKind::Version => { |
| 789 |
db::scanning::update_version_scan_status(db, VersionId::from(target_id), status).await |
| 790 |
} |
| 791 |
ScanTargetKind::Item => { |
| 792 |
db::scanning::update_item_scan_status(db, ItemId::from(target_id), status).await |
| 793 |
} |
| 794 |
ScanTargetKind::Media => { |
| 795 |
db::scanning::update_media_file_scan_status( |
| 796 |
db, |
| 797 |
db::MediaFileId::from(target_id), |
| 798 |
status, |
| 799 |
) |
| 800 |
.await |
| 801 |
} |
| 802 |
ScanTargetKind::OtaArtifact => { |
| 803 |
db::ota::update_artifact_scan_status(db, db::OtaArtifactId::from(target_id), status) |
| 804 |
.await |
| 805 |
} |
| 806 |
ScanTargetKind::ItemImage |
| 807 |
| ScanTargetKind::ProjectImage |
| 808 |
| ScanTargetKind::GalleryImage |
| 809 |
| ScanTargetKind::ContentInsertion => Ok(()), |
| 810 |
} |
| 811 |
} |
| 812 |
|
| 813 |
#[cfg(test)] |
| 814 |
mod tests { |
| 815 |
use super::*; |
| 816 |
|
| 817 |
fn layer(name: &'static str, verdict: LayerVerdict) -> LayerResult { |
| 818 |
LayerResult { |
| 819 |
layer: name, |
| 820 |
verdict, |
| 821 |
detail: None, |
| 822 |
} |
| 823 |
} |
| 824 |
|
| 825 |
|
| 826 |
|
| 827 |
|
| 828 |
const CLEAN: FileScanStatus = FileScanStatus::Clean; |
| 829 |
|
| 830 |
#[test] |
| 831 |
fn trusted_passes_when_clamav_clean() { |
| 832 |
let layers = [layer("clamav", LayerVerdict::Pass)]; |
| 833 |
assert_eq!( |
| 834 |
resolve_pass_status(CLEAN, true, &layers), |
| 835 |
FileScanStatus::Clean |
| 836 |
); |
| 837 |
} |
| 838 |
|
| 839 |
#[test] |
| 840 |
fn trusted_held_on_first_clamav_error() { |
| 841 |
|
| 842 |
|
| 843 |
|
| 844 |
|
| 845 |
let layers = [layer("clamav", LayerVerdict::Error)]; |
| 846 |
assert_eq!( |
| 847 |
resolve_pass_status(CLEAN, true, &layers), |
| 848 |
FileScanStatus::HeldForReview |
| 849 |
); |
| 850 |
} |
| 851 |
|
| 852 |
#[test] |
| 853 |
fn untrusted_always_held() { |
| 854 |
let layers = [layer("clamav", LayerVerdict::Pass)]; |
| 855 |
assert_eq!( |
| 856 |
resolve_pass_status(CLEAN, false, &layers), |
| 857 |
FileScanStatus::HeldForReview |
| 858 |
); |
| 859 |
} |
| 860 |
|
| 861 |
#[test] |
| 862 |
fn trusted_held_when_pipeline_already_held_not_downgraded() { |
| 863 |
|
| 864 |
|
| 865 |
|
| 866 |
let layers = [layer("clamav_incomplete", LayerVerdict::Error)]; |
| 867 |
assert_eq!( |
| 868 |
resolve_pass_status(FileScanStatus::HeldForReview, true, &layers), |
| 869 |
FileScanStatus::HeldForReview |
| 870 |
); |
| 871 |
} |
| 872 |
|
| 873 |
#[test] |
| 874 |
fn pipeline_hold_survives_even_with_no_clamav_layer() { |
| 875 |
|
| 876 |
|
| 877 |
|
| 878 |
let layers = [layer("scan_size_limit", LayerVerdict::Error)]; |
| 879 |
assert_eq!( |
| 880 |
resolve_pass_status(FileScanStatus::HeldForReview, true, &layers), |
| 881 |
FileScanStatus::HeldForReview |
| 882 |
); |
| 883 |
} |
| 884 |
|
| 885 |
|
| 886 |
|
| 887 |
#[test] |
| 888 |
fn degraded_hold_detected_for_trusted_clamav_error() { |
| 889 |
let layers = [layer("clamav", LayerVerdict::Error)]; |
| 890 |
assert!(clamav_degraded_hold_occurred(CLEAN, true, &layers)); |
| 891 |
} |
| 892 |
|
| 893 |
#[test] |
| 894 |
fn degraded_hold_not_for_untrusted_upload() { |
| 895 |
|
| 896 |
|
| 897 |
let layers = [layer("clamav", LayerVerdict::Error)]; |
| 898 |
assert!(!clamav_degraded_hold_occurred(CLEAN, false, &layers)); |
| 899 |
} |
| 900 |
|
| 901 |
#[test] |
| 902 |
fn degraded_hold_not_when_clamav_passed() { |
| 903 |
let layers = [layer("clamav", LayerVerdict::Pass)]; |
| 904 |
assert!(!clamav_degraded_hold_occurred(CLEAN, true, &layers)); |
| 905 |
} |
| 906 |
|
| 907 |
#[test] |
| 908 |
fn degraded_hold_not_when_pipeline_not_clean() { |
| 909 |
|
| 910 |
|
| 911 |
let layers = [layer("clamav", LayerVerdict::Error)]; |
| 912 |
assert!(!clamav_degraded_hold_occurred( |
| 913 |
FileScanStatus::HeldForReview, |
| 914 |
true, |
| 915 |
&layers |
| 916 |
)); |
| 917 |
} |
| 918 |
} |
| 919 |
|