ฉันจะบอกได้อย่างไรว่าบัฟเฟอร์ของท่อเต็ม?


11

ฉันกำลังส่งออกท่อจากโปรแกรมหนึ่งไปยัง Perl บางอันที่ฉันเขียน นี่เป็นกระบวนการที่ใช้เวลานานบางครั้งหลายวันดังนั้นฉันต้องการค้นหาว่าคอขวดของฉันอยู่ที่ใดและพยายามเปิดมันขึ้นมา ฉันต้องการทราบว่าข้อมูลถูกส่งเข้าสู่สคริปต์ของฉันเร็วกว่าสคริปต์ของฉันหรือไม่ หากเป็นกรณีนี้ฉันจะพยายามปรับแต่งสคริปต์ของฉัน แต่ไม่ใช่ถ้าไม่ต้องการ ฉันเห็นการพูดคุยเกี่ยวกับการตั้งค่าสถานะเมื่อบัฟเฟอร์เต็มซึ่งป้องกันการเขียนอีกต่อไป แต่ฉันจะตรวจสอบเพื่อดูว่ามีการตั้งค่าสถานะหรือความถี่ได้อย่างไร? ความคิดใด ๆ


3
ฉันคิดว่ากระบวนการเขียนเท่านั้นที่จะรู้
enzotib

5
คุณสามารถดูการใช้ที่pvใดก็ได้ตามแนวโซ่ท่อ
แอมเฟตามาจิน

คำตอบ:


9

ฉันจะติดตามสคริปต์ Perl ของคุณด้วยเครื่องมือการติดตามการโทรของระบบ: strace(Linux), dtruss(OS X), ktrace(FreeBSD), truss(Solaris) ฯลฯ เป้าหมายจะเห็นว่าเวลาที่สคริปต์ Perl ของคุณใช้เวลารออ่านจากมันนานเท่าใด stdin และเวลาที่โปรแกรมอื่นใช้เวลาในการรอการเขียนไปยัง stdout

ที่นี่ฉันกำลังทดสอบสิ่งนี้กับผู้เขียนในฐานะคอขวด:

terminal 1$ gzip -c < /dev/urandom | cat > /dev/null

terminal 2$ ps auxw | egrep 'gzip|cat'
slamb    25311 96.0  0.0  2852  516 pts/0    R+   23:35   3:40 gzip -c
slamb    25312  0.8  0.0  2624  336 pts/0    S+   23:35   0:01 cat

terminal 2$ strace -p 25312 -s 0 -rT -e trace=read
Process 25312 attached - interrupt to quit
     0.000000 read(0, ""..., 4096) = 4096 <0.005207>
     0.005531 read(0, ""..., 4096) = 4096 <0.000051>

หมายเลขแรกที่นี่คือเวลาตั้งแต่เริ่มต้น syscall ก่อนหน้าและหมายเลขสุดท้ายคือเวลาที่ใช้ใน syscall ดังนั้นเราสามารถโพสต์โปรเซสด้วย Perl สักนิดเพื่อรวม ... [*]

terminal 2$ strace -p 25312 -s 0 -rT -e trace=read 2>&1 | perl -nle 'm{^\s*([\d.]+) read\(0, .*<([\d.]+)>} or next; $total_work += $1 - $last_wait; $total_wait += $2; $last_wait = $2; print "working for $total_work sec, waiting for $total_wait sec"; $last_wait = $2;'
working for 0 sec, waiting for 0.005592 sec
...
working for 0.305356 sec, waiting for 2.28624900000002 sec
...

terminal 2$ strace -p 25311 -s 0 -rT -e trace=write 2>&1 | perl -nle 'm{^\s*([\d.]+) write\(1, .*<([\d.]+)>} or next; $total_work += $1 - $last_wait; $total_wait += $2; $last_wait = $2; print "working for $total_work sec, waiting for $total_wait sec"; $last_wait = $2;'
...
working for 5.15862000000001 sec, waiting for 0.0555740000000007 sec
...

คุณสามารถเล่นได้ดีขึ้นและสร้างสคริปต์ SystemTap หรือ DTrace ที่ติดตามทั้งสองด้านในครั้งเดียวติดตามเฉพาะไฟล์ descriptor ที่ถูกต้องและพิมพ์สถานะการอัพเดตที่ดีทุกวินาทีหรือมากกว่านั้นด้วยเปอร์เซ็นต์ที่เวลาแต่ละอันรออยู่

[*] - คำเตือน: การรวมอย่างหยาบของฉันไม่ถูกต้องหากกำลังเรียกอ่าน / เขียนบนตัวอธิบายไฟล์อื่น มันจะประมาทเวลาทำงานในกรณีนั้น


รุ่น dtrace ค่อนข้างเรียบร้อยจริงๆ

terminal 1$ gzip -c < /dev/urandom | cat > /dev/null

terminal 2$ ps aux | egrep 'gzip| cat'
slamb    54189  95.8  0.0   591796    584 s006  R+   12:49AM  22:49.55 gzip -c
slamb    54190   0.4  0.0   599828    392 s006  S+   12:49AM   0:06.08 cat

terminal 2$ cat > pipe.d <<'EOF'
#!/usr/sbin/dtrace -qs

BEGIN
{
  start = timestamp;
  writer_blocked = 0;
  reader_blocked = 0;
}

tick-1s, END
{
  this->elapsed = timestamp - start;
  printf("since startup, writer blocked %3d%% of time, reader %3d%% of time\n",
         100 * writer_blocked / this->elapsed,
         100 * reader_blocked / this->elapsed);
}

syscall::write:entry
/pid == $1 && arg0 == 1/
{
  self->entry = timestamp;
}

syscall::write:return
/pid == $1 && self->entry != 0/
{
  writer_blocked += timestamp - self->entry;
  self->entry = 0;
}

syscall::read:entry
/pid == $2 && arg0 == 0/
{
  self->entry = timestamp;
}

syscall::read:return
/pid == $2 && self->entry != 0/
{
  reader_blocked += timestamp - self->entry;
  self->entry = 0;
}
EOF

terminal 2$ chmod u+x pipe.d
terminal 2$ sudo ./pipe.d 54189 54190
since startup, writer blocked   0% of time, reader  98% of time
since startup, writer blocked   0% of time, reader  99% of time
since startup, writer blocked   0% of time, reader  99% of time
since startup, writer blocked   0% of time, reader  99% of time
since startup, writer blocked   0% of time, reader  99% of time
^C
since startup, writer blocked   0% of time, reader  99% of time

และรุ่น SystemTap:

terminal 1$ gzip -c /dev/urandom | cat > /dev/null

terminal 2$ ps auxw | egrep 'gzip| cat'
slamb     3405  109  0.0   4356   584 pts/1    R+   02:57   0:04 gzip -c /dev/urandom
slamb     3406  0.2  0.0  10848   588 pts/1    S+   02:57   0:00 cat

terminal 2$ cat > probes.stp <<'EOF'
#!/usr/bin/env stap

global start
global writer_pid
global writes
global reader_pid
global reads

probe begin {
  start = gettimeofday_us()
  writer_pid = strtol(argv[1], 10)
  reader_pid = strtol(argv[2], 10)
}

probe timer.s(1), end {
  elapsed = gettimeofday_us() - start
  printf("since startup, writer blocked %3d%% of time, reader %3d%% of time\n",
         100 * @sum(writes) / elapsed,
         100 * @sum(reads) / elapsed)
}

probe syscall.write.return {
  if (pid() == writer_pid && $fd == 1)
    writes <<< gettimeofday_us() - @entry(gettimeofday_us())
}

probe syscall.read.return {
  if (pid() == reader_pid && $fd == 0)
    reads <<< gettimeofday_us() - @entry(gettimeofday_us())
}
EOF

terminal 2$ chmod a+x probes.stp
terminal 2$ sudo ./pipe.stp 3405 3406
since startup, writer blocked   0% of time, reader  99% of time
...

6

คุณสามารถแทรกpv -TCคำสั่งในไพพ์ไลน์ของคุณ:

cmd1 | pv -TC | cmd2

pvใช้บัฟเฟอร์ของตัวเองและ-Tทำให้มันรายงานว่ามันเต็มโดยเฉลี่ยในช่วงเวลา 1 วินาที (โดยค่าเริ่มต้น)

หากเป็น 100% เสมอแสดงว่าcmd1ผลิตได้เร็วกว่าcmd2บริโภค ถ้าไม่เช่นนั้นก็เป็นอีกทางหนึ่ง ระวังว่าตัวท่อสามารถเก็บ 64kB ได้

ดูเพิ่มเติม-Bเพื่อระบุpvขนาดบัฟเฟอร์ของ คุณสามารถใช้หลาย ๆpvอย่างใน:

$ cmd1 | pv -cCTrbN 'cmd1 -> cmd2' | cmd2 | pv -cCTrbN 'cmd2 -> cmd3' | cmd3
cmd1 -> cmd2: 1.92GiB { 53%} [ 387MiB/s]
cmd2 -> cmd3: 1.92GiB {  0%} [ 387MiB/s]
โดยการใช้ไซต์ของเรา หมายความว่าคุณได้อ่านและทำความเข้าใจนโยบายคุกกี้และนโยบายความเป็นส่วนตัวของเราแล้ว
Licensed under cc by-sa 3.0 with attribution required.